Gemini 2.5 Flash-Lite es nuestro modelo de Gemini más equilibrado, optimizado para casos de uso de latencia baja. Incluye las mismas capacidades que hacen que otros modelos de Gemini 2.5 sean útiles, como la capacidad de activar el razonamiento con diferentes presupuestos, conectarse a herramientas como Fundamentación con la Búsqueda de Google y la ejecución de código, la entrada multimodal y una longitud de contexto de 1 millón de tokens.
Probar en Agent Studio Implementar una app de ejemplo Ver precios
| ID de modelo | gemini-2.5-flash-lite |
|
|---|---|---|
| Modalidades |
|
|
| Límites de tokens | Ventana de contexto | 1,048,576 |
| Cantidad máxima de tokens de salida | 65,536 | |
| Funciones |
|
|
| Herramientas |
|
|
| Opciones de consumo |
|
|
| Límite de tamaño de entrada | 500 MB | |
| Especificaciones técnicas | Imagen |
|
| Texto |
|
|
| Video |
|
|
| Audio |
|
|
| Valores predeterminados de los parámetros |
|
|
| Regiones admitidas |
|
|
| Versiones |
|
|
| Controles de seguridad | Predicción en línea |
|
| Inferencia por lotes |
|
|
| Ajuste |
|
|
| Almacenamiento de contexto en caché |
|
|
| RAG Engine |
|
|
| Fundamentación con la Búsqueda de Google y Fundamentación con Google Maps |
|
|
| Consulta Controles de seguridad para obtener más información. | ||