AI 推理模型
推理模型适合需要分步求解的任务:证明、排错、长链路工具调用。复杂推理任务通常需要在能力、响应延迟和使用成本之间做权衡。
同一家里也会拆成旗舰推理规格和更快的通用规格。先看任务是否真的需要显式思考,再看托管 API 还是开放权重。
适合解决什么
- 多步数学、逻辑和规划问题
- 复杂代码修改与排错
- 需要工具调用的代理式工作流
- 对照开放权重推理模型做自托管评测
精选模型
相关指南
- 用 Structured Outputs 拿到可解析的模型结果用 json_schema + strict 约束 Chat Completions 输出,让结果可以直接解析进入应用逻辑。
- 用 Claude API Tool Use 调用外部工具在 Messages API 里声明客户工具,处理 tool_use,再回传 tool_result,跑通 Claude 的外部工具闭环。
- 打开 Gemini Thinking 观察模型推理预算按 Gemini Thinking 文档配置 thinking 预算,并读取思考与最终回答。
- 用 Transformers 跑通第一次模型推理按 Transformers Quickstart:用 pipeline 做 text-generation,再用 AutoModel / AutoTokenizer 走一遍手动推理路径。
相关工具
相关 Agent 资源
全部模型
Claude Fable 5
Anthropic
Anthropic 广泛发布的最高能力 Claude 模型,面向长程代理任务。
reasoningcodingmultimodaltool-use
推理专有1M
Claude Opus 4.8
Anthropic
仍在提供的 Claude Opus 4.8,面向深度研究与长程代理任务。
reasoningcodingtool-uselong-context
推理专有1M
DeepSeek-R1
DeepSeek
侧重复杂推理与数学、代码任务的开放权重推理模型。
reasoningcodingopen-weight
推理开放权重
Gemini 2.5 Pro
具备自适应思考能力的多模态推理模型,支持百万级上下文。
reasoningmultimodalcodinglong-context
推理专有1M
Gemini 3.1 Pro
面向复杂推理与长上下文任务的 Gemini 3.1 Pro 模型。
reasoningmultimodallong-contextcoding
推理专有
GPT-5.5 Pro
OpenAI
GPT-5.5 的更高算力版本,侧重更精确的专业任务响应。
reasoningcoding
推理专有
GPT-5.6 Sol
OpenAI
面向复杂专业工作与高难度推理、编程任务的 GPT-5.6 旗舰模型。
reasoningcodingmultimodaltool-use
推理专有
Llama 3.1 405B Instruct
Meta
Llama 3.1 超大规模指令模型,面向复杂通用与推理任务。
open-weightreasoninglong-context
推理开放权重128K
Magistral
Mistral AI
Mistral Magistral 推理模型,面向复杂推理任务。
reasoning
推理专有
o3
OpenAI
面向复杂任务的推理模型,仍在 API 中作为正式型号提供。
reasoningcodingvision
推理专有200K
Phi-4
Microsoft
微软 Phi-4 小参数高效率模型,面向推理与通用任务。
open-weightreasoning
推理开放权重
Qwen3-Thinking-2507
Alibaba
Qwen3 思考版本,侧重多步推理与复杂问题求解。
reasoningopen-weight
推理开放权重