Gemini 2.5 Flash-Lite è il nostro modello Gemini più equilibrato, ottimizzato per i casi d'uso a bassa latenza. Offre le stesse funzionalità che rendono utili gli altri modelli Gemini 2.5, come la possibilità di attivare la funzionalità di ragionamento con budget diversi, la connessione a strumenti come grounding con la Ricerca Google e l'esecuzione di codice, l'input multimodale e una finestra contestuale di 1 milione di token.
Prova in Agent Studio Esegui il deployment dell'app di esempio Visualizza i prezzi
| ID modello | gemini-2.5-flash-lite |
|
|---|---|---|
| Modalità |
|
|
| Limiti di token | Finestra contestuale | 1.048.576 |
| Numero massimo di token di output | 65.536 | |
| Funzionalità |
|
|
| Strumenti |
|
|
| Opzioni di consumo |
|
|
| Limite delle dimensioni dell'input | 500 MB | |
| Specifiche tecniche | Immagine |
|
| Testo |
|
|
| Video |
|
|
| Audio |
|
|
| Valori predefiniti dei parametri |
|
|
| Aree geografiche supportate |
|
|
| Versioni |
|
|
| Controlli di sicurezza | Previsione online |
|
| Inferenza batch |
|
|
| Ottimizzazione |
|
|
| Memorizzazione nella cache del contesto |
|
|
| RAG Engine |
|
|
| Grounding con la Ricerca Google e Grounding con Google Maps |
|
|
| Per ulteriori informazioni, consulta Controlli di sicurezza. | ||