推理模型
推理模型
推理(思考)模型会在给出答案之前先进行一段内部推理,适合数学、编程、复杂分析等任务。推理产生的 token 通常按输出价格计费。
OpenAI 系列
使用 reasoning_effort 控制推理强度(low、medium、high,部分模型支持更多档位):
Responses 接口中对应字段是 reasoning.effort。
Claude 系列
在 /v1/messages 中开启扩展思考:
国产模型
deepseek-reasoner 等专用推理模型直接调用即可,推理过程在 reasoning_content 字段返回。 Kimi、智谱 GLM、MiniMax、通义千问等模型的思考开关使用各自的参数,网关会原样转发给上游。
推理 token 会计入用量。可以在控制台的用量记录中查看每次请求的推理强度和 token 数。