Gemini 2.5 Flash-Lite ist unser ausgewogenstes Gemini-Modell und für latenzarme Anwendungsfälle optimiert. Es bietet dieselben Funktionen wie andere Gemini 2.5-Modelle, z. B. die Möglichkeit, die Antwortgenerierung bei unterschiedlichen Budgets zu aktivieren, eine Verbindung zu Tools wie der Fundierung mit der Google Suche und der Codeausführung herzustellen, multimodale Eingaben zu verwenden und eine Kontextlänge von 1 Million Tokens zu nutzen.
In Agent Studio testen Beispiel-App bereitstellen Preise ansehen
| Modell-ID | gemini-2.5-flash-lite |
|
|---|---|---|
| Betriebsarten |
|
|
| Token limits | Kontextfenster | 1.048.576 |
| Maximale Ausgabetokens | 65.536 | |
| Leistungsspektrum |
|
|
| Tools |
|
|
| Nutzungsoptionen |
|
|
| Maximale Eingabegröße | 500 MB | |
| Technische Spezifikationen | Bild |
|
| Text |
|
|
| Video |
|
|
| Audio |
|
|
| Standardparameter |
|
|
| Unterstützte Regionen |
|
|
| Versionen |
|
|
| Sicherheitskontrollen | Onlinevorhersage |
|
| Batch-Inferenz |
|
|
| Abstimmung |
|
|
| Kontext-Caching |
|
|
| RAG Engine |
|
|
| Fundierung mit der Google Suche und Fundierung mit Google Maps |
|
|
| Weitere Informationen finden Sie unter Sicherheitskontrollen. | ||