Reasoning models
GPT-5・Claude・HCX-007・Kimi のモデル別推論リクエスト形式と opaque continuation 契約です。
推論(reasoning)モデルは、難しい数学・コーディング・論理タスクに答える前に内部作業を行います。 PleumRouter は OpenAI、Anthropic、Naver、GMI のモデル別 wire 形式を合わせつつ、署名・暗号化 data などの continuation 値を opaque データとして扱います。
動作の仕組み#
OpenAI o シリーズに加え、gpt-5、gpt-5-mini、 gpt-5-nano、gpt-5.1、 gpt-5.2 は temperature を外し、 max_tokens を max_completion_tokens に変換して 送信します。この変換はこれらの reasoning payload モデルだけに適用されます。
gpt-5・gpt-5-mini・ gpt-5-nano は forced reasoning です。none は外されますが、low/medium/high は転送されます。gpt-5.1・gpt-5.2・GPT-5.6(sol/terra/luna)は optional で、minimal…max に加え reasoning_mode と service_tier を受け取ります。 既存の o シリーズの動作は変わりません。
Claude のポリシーは実際の upstream モデル ID で選ばれます。claude-fable-5 は常に adaptive thinking を使い、none でオフにはできません。Opus 4.8/4.7/4.6 と Sonnet 5/4.6 は optional adaptive で、 low/medium/high は adaptive effort、none は disabled になります。Opus 4.5・Sonnet 4.5・Haiku 4.5・ Claude 3.7 は 20%/50%/80% の manual budget(最小 1,024、最大 32,000、常に max_tokens 未満)を使い、 max_tokens が 1,024 以下なら 400 を返します。 Claude 3.5 系には native thinking フィールドを送りません。
{
"model": "gpt-5.6-sol",
"messages": [
{"role": "user", "content": "Prove that there are infinitely many primes."}
],
"max_completion_tokens": 4096,
"reasoning_effort": "xhigh",
"reasoning_mode": "pro",
"service_tier": "priority"
}リクエスト#
HCX-007 は Naver の OpenAI-compatible complete-only 経路で optional reasoning_effort を受け、temperature は最大 1.0 に制限されます。 moonshotai/Kimi-K2-Thinking は forced-thinking GMI モデルですが GPT-5 payload モデルではありません。通常の OpenAI-compatible max_tokens と temperature を維持し、max_completion_tokens には変換されません。
curl https://apirouter.pleum.ai/v1/chat/completions \
-H "Authorization: Bearer plm_..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-sol",
"messages": [
{"role": "user", "content": "Prove that there are infinitely many primes."}
],
"max_tokens": 4096,
"reasoning_effort": "xhigh",
"reasoning_mode": "pro",
"service_tier": "priority"
}'reasoning_details の signature/data を調べたりマスク・再生成したりせず、同じ tool continuation でのみ原文のまま返してください。Anthropic の平文の思考は返されません。reasoning token breakdown は観測用で、completion/total token や課金に再加算されません。