O Gemini 2.5 Flash-Lite é nosso modelo mais equilibrado do Gemini, otimizado para casos de uso de baixa latência. Ele vem com os mesmos recursos que tornam outros modelos do Gemini 2.5 úteis, como a capacidade de ativar o raciocínio em diferentes orçamentos, conectar-se a ferramentas como o embasamento com a Pesquisa Google e a execução de código, entrada multimodal e um tamanho do contexto de 1 milhão de tokens.
Testar no Agent Studio Implantar app de exemplo Ver preços
| ID do modelo | gemini-2.5-flash-lite |
|
|---|---|---|
| Modalidades |
|
|
| Limites de tokens | Janela de contexto | 1.048.576 |
| Máximo de tokens de saída | 65.536 | |
| Recursos |
|
|
| Ferramentas |
|
|
| Opções de consumo |
|
|
| Limite de tamanho da entrada | 500 MB | |
| Especificações técnicas | Imagem |
|
| Texto |
|
|
| Vídeo |
|
|
| Áudio |
|
|
| Padrões de parâmetros |
|
|
| Regiões compatíveis |
|
|
| Versões |
|
|
| Controles de segurança | Previsão on-line |
|
| Inferência em lote |
|
|
| Ajuste |
|
|
| Armazenamento em cache de contexto |
|
|
| Mecanismo RAG |
|
|
| Embasamento com a Pesquisa Google e embasamento com o Google Maps |
|
|
| Consulte Controles de segurança para mais informações. | ||