推理模型
推理模型
推理(思考)模型會在給出答案之前先進行一段內部推理,適合數學、程式設計、複雜分析等任務。推理產生的 token 通常按輸出價格計費。
OpenAI 系列
使用 reasoning_effort 控制推理強度(low、medium、high,部分模型支援更多檔位):
Responses 介面中對應欄位是 reasoning.effort。
Claude 系列
在 /v1/messages 中開啟擴充套件思考:
國產模型
deepseek-reasoner 等專用推理模型直接呼叫即可,推理過程在 reasoning_content 欄位返回。 Kimi、智譜 GLM、MiniMax、通義千問等模型的思考開關使用各自的引數,閘道器會原樣轉發給上游。
推理 token 會計入用量。可以在控制台的用量記錄中檢視每次請求的推理強度和 token 數。