打开 Gemini Thinking 观察模型推理预算
按 Gemini Thinking 文档配置 thinking 预算,并读取思考与最终回答。
基于 Gemini API 整理 · Thinking · 官方资料
部分 Gemini 模型支持 thinking:在最终回答前使用额外推理 token。
这篇配置 thinking_config,跑一个需要分步推理的问题,并确认返回里能区分思考与答案(以当前 SDK 字段为准)。
配置 thinkingBudget
GenerateContentConfig + ThinkingConfig
python
from google import genai
from google.genai import types
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.1-pro-preview",
contents="一个农场有鸡和兔子共 36 个头、100 只脚,各有多少只?写出计算过程。",
config=types.GenerateContentConfig(
thinking_config=types.ThinkingConfig(thinking_budget=1024)
),
)
print(response.text)什么时候开 Thinking
- 数学、规划、多步工具调用
- 需要更高正确率、可接受更高延迟与成本
- 日常短问答可关掉或降低预算
最容易踩的坑
模型不支持 thinking
换官方列出的 thinking 模型;不要假设所有 Gemini 规格都支持。
官方资料
Gemini APIThinking相关 AI 工具
相关 AI 模型
相关 TodayAI 指南
- 用 Structured Outputs 拿到可解析的模型结果用 json_schema + strict 约束 Chat Completions 输出,让结果可以直接解析进入应用逻辑。
- 用 Gemini Embeddings 做文本向量化按 Gemini API Embeddings 文档:用 embedContent 生成向量,配置 task 前缀或 task_type,并用 output_dimensionality 控制维度。
- 用 Gemini Structured Outputs 约束 JSON 结果按官方 Structured outputs:用 JSON Schema / Pydantic 约束 Gemini 的最终回答格式,提取菜谱等结构化数据并可直接校验。