Gemini 2.5 Flash-Lite 是我们最均衡的一款 Gemini 模型,经过优化,适合要求延迟时间较短的应用场景。它具备其他 Gemini 2.5 模型所具有的实用功能,例如能够根据不同预算开启思考功能、连接到“使用 Google 搜索和代码执行进行接地”等工具、支持多模态输入,以及支持 100 万词元的上下文长度。
在 Agent Studio 中试用 部署示例应用 查看价格
| 模型 ID | gemini-2.5-flash-lite |
|
|---|---|---|
| 模态 |
|
|
| token 数量上限 | 上下文窗口 | 1,048,576 |
| 输出词元数上限 | 65536 | |
| 功能 |
|
|
| 工具 | ||
| 使用选项 |
|
|
| 输入大小限制 | 500 MB | |
| 技术规范 | 图片 |
|
| 文本 |
|
|
| 视频 |
|
|
| 音频 |
|
|
| 参数默认值 |
|
|
| 支持的区域 |
|
|
| 版本 |
|
|
| 安全控制 | 在线预测 |
|
| 批量推理 |
|
|
| 调优 |
|
|
| 上下文缓存 |
|
|
| RAG Engine |
|
|
| 依托 Google 搜索进行接地和 Grounding with Google Maps |
|
|
| 如需了解详情,请参阅安全控制。 | ||