Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite 是我们最经济高效的 Gemini 模型,专为大体量、成本敏感型大语言模型 (LLM) 流量而设计,并针对低延迟应用场景进行了优化。 与 Gemini 2.5 Flash-Lite 相比,它在质量方面有了显著提升,在关键功能领域与 Gemini 2.5 Flash 的性能相当:

  • 回答质量有所提升: 旨在与 2.5 Flash 的性能相当。
  • 指令遵循能力有所提升: 针对性改进,可作为复杂聊天机器人和指令繁重型工作流的可靠迁移路径。
  • 音频输入能力有所提升: 提升了自动语音识别 (ASR) 等任务的音频输入质量。
  • 扩展了思考支持: 您可以选择最低、低、中或高思考级别,以控制模型执行的推理量 。借助此功能,您可以针对特定应用场景平衡回答质量和速度。

在 Agent Studio 中试用 部署示例应用 查看价格

注意:“部署示例应用”需要启用结算功能和 Agent Platform API 的 Google Cloud 项目。
模型 ID gemini-3.1-flash-lite
模态
Text Input and output
Image Input only
Audio Input only
Video Input only
token 数量上限 上下文窗口 1,048,576
输出词元数上限 65536
功能
工具
使用选项
技术规范 图片
  • 每个提示的图片数量上限: 3,000
  • 内嵌数据或通过控制台直接上传的每个文件的文件大小上限: 7 MB
  • Google Cloud Storage 中每个文件的文件大小上限: 30 MB
  • 支持的 MIME 类型:
    image/pngimage/jpegimage/webpimage/heicimage/heif
文本
  • 每个提示的文件数量上限: 3,000
  • 每个文件的页数上限: 3,000
  • 通过 API 或 Cloud Storage 导入时,每个文件的文件大小上限: 50 MB(application/pdf) 或 7 MB(text/plain)
  • 通过控制台直接上传的每个文件的文件大小上限: 7 MB
  • 支持的 MIME 类型:
    application/pdftext/plain
视频
  • 视频时长上限(包含音频): 约 45 分钟
  • 视频时长上限(不含音频): 约 1 小时
  • 每个提示的视频数量上限: 10
  • 支持的 MIME 类型:
    video/x-flvvideo/quicktimevideo/mpegvideo/mpegsvideo/mpgvideo/mp4video/webmvideo/wmvvideo/3gpp
音频
  • 每个提示的音频长度上限: 约 8.4 小时或最多 100 万个 token
  • 每个提示的音频文件数量上限: 1
  • 支持的 MIME 类型:
    audio/x-aacaudio/flacaudio/mp3audio/m4aaudio/mpegaudio/mpgaaudio/mp4audio/oggaudio/pcmaudio/wavaudio/webm
参数默认值
  • 温度:0.0-2.0(默认值为 1.0)
  • topP:0.0-1.0(默认值为 0.95)
  • topK:64(固定值)
  • candidateCount:1-8(默认值为 1)
支持的区域

模型可用性

  • 全球: global
  • 多区域:useu

机器学习处理

  • 美国: Multi-region
  • 欧洲: Multi-region
版本
  • gemini-3.1-flash-lite
    • 发布阶段:正式版
    • 发布日期:2026 年 5 月 7 日
    • 停用日期:2027 年 5 月 7 日或之后
安全控制 在线预测
  • 数据驻留
  • CMEK
  • VPC-SC
  • AXT
批量推理
  • 数据驻留
  • CMEK
  • VPC-SC
  • AXT
上下文缓存
  • 数据驻留
  • CMEK
  • VPC-SC
  • AXT
如需了解详情,请参阅安全控制