Perfect
分野別の最強 AI を並列実行して合成 — 価格不問、精度最優先。
"model": "perfect" は分野別の最強 AIを複数並列で 実行し、1 モデルが結果を批判的に検証・合成します。“最も高価で強いモデル同士を競わせて 答えを出す”モードです — 精度がコストより優先される作業向け。
perfect — parallel + synthesis
curl https://apirouter.pleum.ai/v1/chat/completions \
-H "Authorization: Bearer plm_..." \
-H "Content-Type: application/json" \
-d '{
"model": "perfect",
"messages": [
{"role": "user", "content": "Refactor this function for thread safety and explain the trade-offs."}
],
"stream": false
}'動作の仕組み#
意図を判定し、そのカテゴリーのベンチマーク上位 N モデル(デフォルト 2、価格不問) をワーカーとして並列呼び出しします。2 件以上成功すれば合成モデルが結果を統合・検証して最終答を 出し、1 件のみなら合成なしでその結果を返し、全失敗なら拒否します。
ワーカープールは Benchmark Smart と同じスコア表の 上位 N から選びます。コード要求なら最強コードモデル同士、推論要求なら最強推論モデル同士が競います。
簡単な要求(日常会話など)は深いオーケストレーションではなく 1 モデル 1 呼び出し(ファストパス) で処理し、平均客単価を通常ルーティング並みに保ちます。code と reasoning カテゴリーのみ並列+合成対象です(運用設定で調整可)。
コスト構造#
コストは N ワーカー呼び出し + 合成 1 呼び出しの合計です(デフォルト 3 件)。各子 呼び出しは独立セッションで正常課金され、親は結果を集計して返すだけです。一部ワーカーが失敗した 場合は合成をスキップして生存ワーカーの結果へフォールバックし、コストを節約します。
ストリーミング非対応 — 合成後に最終テキストが確定します。必ず
"stream": false で呼び出してください。関連モード#
Benchmark Smart は最良モデル 1 呼び出しで終わります (高速・低コスト)。自動合成ではなく固定の複数モデルを並列呼び出ししたい場合は Fusion エンドポイントを使ってください。