Skip to content

Perfect

分野別の最強 AI を並列実行して合成 — 価格不問、精度最優先。

"model": "perfect" は分野別の最強 AIを複数並列で 実行し、1 モデルが結果を批判的に検証・合成します。“最も高価で強いモデル同士を競わせて 答えを出す”モードです — 精度がコストより優先される作業向け。

perfect — parallel + synthesis
curl https://apirouter.pleum.ai/v1/chat/completions \
  -H "Authorization: Bearer plm_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "perfect",
    "messages": [
      {"role": "user", "content": "Refactor this function for thread safety and explain the trade-offs."}
    ],
    "stream": false
  }'

動作の仕組み#

意図を判定し、そのカテゴリーのベンチマーク上位 N モデル(デフォルト 2、価格不問) をワーカーとして並列呼び出しします。2 件以上成功すれば合成モデルが結果を統合・検証して最終答を 出し、1 件のみなら合成なしでその結果を返し、全失敗なら拒否します。

ワーカープールは Benchmark Smart と同じスコア表の 上位 N から選びます。コード要求なら最強コードモデル同士、推論要求なら最強推論モデル同士が競います。

簡単な要求(日常会話など)は深いオーケストレーションではなく 1 モデル 1 呼び出し(ファストパス) で処理し、平均客単価を通常ルーティング並みに保ちます。code reasoning カテゴリーのみ並列+合成対象です(運用設定で調整可)。

コスト構造#

コストは N ワーカー呼び出し + 合成 1 呼び出しの合計です(デフォルト 3 件)。各子 呼び出しは独立セッションで正常課金され、親は結果を集計して返すだけです。一部ワーカーが失敗した 場合は合成をスキップして生存ワーカーの結果へフォールバックし、コストを節約します。

ストリーミング非対応 — 合成後に最終テキストが確定します。必ず "stream": false で呼び出してください。

Benchmark Smart は最良モデル 1 呼び出しで終わります (高速・低コスト)。自動合成ではなく固定の複数モデルを並列呼び出ししたい場合は Fusion エンドポイントを使ってください。