Skip to content

Reasoning models

GPT-5・Claude・HCX-007・Kimi のモデル別推論リクエスト形式と opaque continuation 契約です。

POST/v1/chat/completions

推論(reasoning)モデルは、難しい数学・コーディング・論理タスクに答える前に内部作業を行います。 PleumRouter は OpenAI、Anthropic、Naver、GMI のモデル別 wire 形式を合わせつつ、署名・暗号化 data などの continuation 値を opaque データとして扱います。

動作の仕組み#

OpenAI o シリーズに加え、gpt-5gpt-5-mini gpt-5-nanogpt-5.1 gpt-5.2temperature を外し、 max_tokensmax_completion_tokens に変換して 送信します。この変換はこれらの reasoning payload モデルだけに適用されます。

gpt-5gpt-5-mini gpt-5-nano は forced reasoning です。none は外されますが、low/medium/high は転送されます。gpt-5.1gpt-5.2・GPT-5.6(sol/terra/luna)は optional で、minimalmax に加え reasoning_modeservice_tier を受け取ります。 既存の o シリーズの動作は変わりません。

Claude のポリシーは実際の upstream モデル ID で選ばれます。claude-fable-5 は常に adaptive thinking を使い、none でオフにはできません。Opus 4.8/4.7/4.6 と Sonnet 5/4.6 は optional adaptive で、 low/medium/high は adaptive effort、none は disabled になります。Opus 4.5・Sonnet 4.5・Haiku 4.5・ Claude 3.7 は 20%/50%/80% の manual budget(最小 1,024、最大 32,000、常に max_tokens 未満)を使い、 max_tokens が 1,024 以下なら 400 を返します。 Claude 3.5 系には native thinking フィールドを送りません。

forwarded payload
{
  "model": "gpt-5.6-sol",
  "messages": [
    {"role": "user", "content": "Prove that there are infinitely many primes."}
  ],
  "max_completion_tokens": 4096,
  "reasoning_effort": "xhigh",
  "reasoning_mode": "pro",
  "service_tier": "priority"
}

リクエスト#

HCX-007 は Naver の OpenAI-compatible complete-only 経路で optional reasoning_effort を受け、temperature は最大 1.0 に制限されます。 moonshotai/Kimi-K2-Thinking は forced-thinking GMI モデルですが GPT-5 payload モデルではありません。通常の OpenAI-compatible max_tokens temperature を維持し、max_completion_tokens には変換されません。

request
curl https://apirouter.pleum.ai/v1/chat/completions \
  -H "Authorization: Bearer plm_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "messages": [
      {"role": "user", "content": "Prove that there are infinitely many primes."}
    ],
    "max_tokens": 4096,
    "reasoning_effort": "xhigh",
    "reasoning_mode": "pro",
    "service_tier": "priority"
  }'
reasoning_details の signature/data を調べたりマスク・再生成したりせず、同じ tool continuation でのみ原文のまま返してください。Anthropic の平文の思考は返されません。reasoning token breakdown は観測用で、completion/total token や課金に再加算されません。