思考模型会在返回回答之前生成内部“思考”过程。此功能可帮助模型执行复杂的多步规划、解决数学问题并生成准确的代码。
本页面介绍了如何:
支持的模型
以下模型支持思考功能:
点击即可展开支持的型号
- Gemini Omni Flash
- Gemini Omni 1.1 Flash
- Gemini 3.8 Flash Cyber
- Gemini 3.8 Flash
- Gemini 3.7 Flash
- Gemini 3.6 Flash
- Gemini 3.5 Flash-Lite
- Gemini 3.5 Flash
- Gemini 3.1 Pro
- Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite)
- Gemini 3.1 Flash-Lite
- Gemini 3.1 Flash Image
- Gemini 3 Pro Image
- Gemini 3 Flash
- Gemini 2.5 Pro
- Gemini 2.5 Flash-Lite
- Gemini 2.5 Flash
控制模型思考
在受支持的 Gemini 模型中,系统默认启用思考功能。在 Agent Studio 中,您可以查看完整的思考过程以及生成的回答。
思考的配置方式取决于模型版本:
Gemini 3 及更高版本的模型
Gemini 3 模型使用 thinking_level 参数。此参数用于设置离散推理层级,以便您在延迟时间和推理深度之间进行优化。
控制台
-
前往 Agent Studio,然后依次选择新建 > 对话,并展开模型面板。
- 在模型设置面板中,从模型菜单中选择一个受支持的模型。
- 从思考水平下拉菜单中选择一个值。
Python
from google import genai
from google.genai import types
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.5-flash",
contents="How does AI work?",
config=types.GenerateContentConfig(
thinking_config=types.ThinkingConfig(
# Options: MINIMAL, LOW, MEDIUM, HIGH
thinking_level=types.ThinkingLevel.THINKING_LEVEL_VALUE
)
),
)
print(response.text)思考等级值
您可以将 thinking_level 设为以下某个值:
MINIMAL:使用尽可能少的 token 进行思考。最适合不需要扩展推理的简单任务。MINIMAL在多轮对话中需要思考签名;如果省略,模型会返回400: INVALID_ARGUMENT错误。LOW:使用较少的思考 token,以更快地生成回答。最适合吞吐量高、任务复杂度低的应用。MEDIUM:在推理质量和延迟时间之间取得平衡。适合中等复杂度的任务,这些任务可受益于中间推理步骤。HIGH:使用最大思考能力。最适合需要深度推理、多步问题解决、正式代码验证或多轮工具执行的复杂提示。
各模型支持的思考等级
下表列出了支持的 thinking_level 值和默认配置(按模型):
| 模型 | 支持的 thinking_level 值 |
默认 |
|---|---|---|
| Gemini 3.8 Flash Cyber | LOW、MEDIUM、HIGH |
MEDIUM |
| Gemini 3.8 Flash | LOW、MEDIUM、HIGH |
MEDIUM |
| Gemini 3.7 Flash | LOW、MEDIUM、HIGH |
MEDIUM |
| Gemini 3.6 Flash | MINIMAL、LOW、MEDIUM、HIGH |
MEDIUM |
| Gemini 3.5 Flash-Lite | MINIMAL、LOW、MEDIUM、HIGH |
MINIMAL |
| Gemini 3.5 Flash | MINIMAL、LOW、MEDIUM、HIGH |
MEDIUM |
| Gemini 3.1 Pro | LOW、MEDIUM、HIGH |
HIGH |
| Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite) | MINIMAL,HIGH |
MINIMAL |
| Gemini 3.1 Flash-Lite | MINIMAL、LOW、MEDIUM、HIGH |
MINIMAL |
| Gemini 3.1 Flash Image | MINIMAL,HIGH |
MINIMAL |
| Gemini 3 Pro Image | HIGH |
HIGH |
| Gemini 3 Flash | MINIMAL、LOW、MEDIUM、HIGH |
HIGH |
Gemini 2.5 及更早版本的模型
对于 Gemini 2.5 及更早版本的模型,请使用 thinking_budget 参数配置思考。此形参用于为模型在内部推理期间可使用的 token 数量设置一个软限制。
控制台
-
前往 Agent Studio,然后依次选择新建 > 对话。
- 在模型设置面板中,从模型菜单中选择一个受支持的模型。
- 在思考预算选择器中,选择手动,然后使用滑块调整令牌限额。
Python
安装
pip install --upgrade google-genai
如需了解详情,请参阅 SDK 参考文档。
设置环境变量以将 Google Gen AI SDK 与 Vertex AI 搭配使用:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
安装
npm install @google/genai
如需了解详情,请参阅 SDK 参考文档。
设置环境变量以将 Google Gen AI SDK 与 Vertex AI 搭配使用:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
了解如何安装或更新 Go。
如需了解详情,请参阅 SDK 参考文档。
设置环境变量以将 Google Gen AI SDK 与 Vertex AI 搭配使用:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
了解如何安装或更新 Java。
如需了解详情,请参阅 SDK 参考文档。
设置环境变量以将 Google Gen AI SDK 与 Vertex AI 搭配使用:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
如果您未指定预算,模型会将 token 预算动态设置为最多 8,192 个 token。如需在 API 中显式启用动态预算,请将 thinking_budget 设置为 -1。
各模型支持的思考预算
下表列出了每种模型的最小、最大和默认 token 限制:
| 模型 | 最少 token 数 | token 数上限 | 默认 |
|---|---|---|---|
| Gemini 2.5 Flash | 1 | 24,576 | 自动(最多 8,192 个 token) |
| Gemini 2.5 Pro | 128 | 32,768 | 自动(最多 8,192 个 token) |
| Gemini 2.5 Flash-Lite | 512 | 24,576 | 自动(最多 8,192 个 token) |
关闭思考
您可以将 thinking_budget 设置为 0,以关闭 Gemini 2.5 Flash 和 Gemini 2.5 Flash-Lite 的思考功能。虽然思考内容不会在回答中返回,但生成的文本可能仍会显示推理风格的输出。
对于 Gemini 2.5 Pro,您无法关闭思考功能。
查看思考总结
思考摘要会显示中间推理步骤以及模型的最终回答。Gemini 2.5 及更高版本的模型支持思考总结。
控制台
Agent Studio 中默认启用思考总结。如需查看总结的推理步骤,请展开思考面板。
Python
安装
pip install --upgrade google-genai
如需了解详情,请参阅 SDK 参考文档。
设置环境变量以将 Google Gen AI SDK 与 Vertex AI 搭配使用:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
安装
npm install @google/genai
如需了解详情,请参阅 SDK 参考文档。
设置环境变量以将 Google Gen AI SDK 与 Vertex AI 搭配使用:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
了解如何安装或更新 Go。
如需了解详情,请参阅 SDK 参考文档。
设置环境变量以将 Google Gen AI SDK 与 Vertex AI 搭配使用:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
了解如何安装或更新 Java。
如需了解详情,请参阅 SDK 参考文档。
设置环境变量以将 Google Gen AI SDK 与 Vertex AI 搭配使用:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
在以下情况下,响应可能会返回思考签名,但没有思考总结文本:
- 低复杂度的请求:请求所需的推理步骤最少。
- 已停用摘要:未请求或已关闭思考摘要。
- 非文本模态:对某些模态(例如图片分析)进行推理可能不会生成文本摘要。
您的应用必须妥善处理空白或缺失的想法总结字段,同时保留任何随附的想法签名。
思维签名
思考签名是模型内部推理状态的加密表示形式。它们可在多轮对话中保持上下文,尤其是在使用函数调用时。
为了在多轮互动中保留推理上下文,请将之前回答中返回的思考签名传递回后续请求,无论配置的思考级别如何。
如果您使用的是官方 Google Gen AI SDK(Python、Node.js、Go 或 Java),则在使用标准聊天会话或将全卷答完的回答对象附加到消息记录中时,系统会自动管理思考签名。
如需了解实现模式、要求和示例,请参阅思想签名。
价格
您需要为模型在思考过程中生成的 token 付费。对于默认启用思考功能的模型(例如 Gemini 3 Pro 和 Gemini 2.5 Pro),这些思考 token 会计入您的应付费用。
如需了解完整的费率详情,请参阅价格。