본문으로 건너뛰기

Perfect

가격을 생각하지 않고 분야별 최고 AI로 멀티모델 합성해 정답률을 끌어올립니다.

"model": "perfect"는 분야별 최고 AI를 여러 개 병렬로 돌리고, 그 결과를 한 모델이 비판적 검증·합성합니다. "가장 비싸고 강한 모델끼리 경쟁시켜 답을 뽑는" 모드입니다 — 비용보다 정확도가 최우선인 작업에 씁니다.

perfect — parallel + synthesis
curl https://apirouter.pleum.ai/v1/chat/completions \
  -H "Authorization: Bearer plm_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "perfect",
    "messages": [
      {"role": "user", "content": "Refactor this function for thread safety and explain the trade-offs."}
    ],
    "stream": false
  }'

동작 방식#

요청 의도를 판정해 분야별 벤치마크 상위 N개 모델(기본 2개, 가격 무관)을 워커로 병렬 호출합니다. 2개 이상 성공하면 합성 모델이 결과를 종합·검증해 최종 답을 내고, 1개만 성공하면 합성 없이 그 결과를, 전부 실패하면 거절합니다.

워커풀은 Benchmark Smart와 같은 점수표의 상위 N개에서 뽑습니다. 코드 요청이면 코드 분야 최고 모델들끼리, 추론 요청이면 추론 분야 최고 모델들끼리 경쟁합니다.

쉬운 요청(일반 대화 등)은 deep 오케스트레이션 대신 단일 모델 1콜(fast-path)로 처리합니다 — 평균 객단가를 일반 라우팅 수준으로 유지합니다. code, reasoning 카테고리만 병렬+합성 대상입니다(운영 config로 조절).

비용 구조#

비용은 워커 N콜 + 합성 1콜의 합입니다(기본 3콜분). 각 자식 콜이 독립 세션에서 정상 과금됩니다 — 부모는 결과만 합산해 반환합니다. 워커 일부가 실패하면 합성 없이 생존 워커 결과로 폴백해 비용을 아낍니다.

스트리밍을 지원하지 않습니다 — 합성 단계 이후에야 최종 텍스트가 확정됩니다. 반드시 "stream": false로 호출하세요.

Benchmark Smart는 단일 최고 모델 1콜로 끝냅니다(빠르고 저렴). 병렬 합성 대신 직접 여러 모델을 고정 호출하려면 Fusion 엔드포인트를 쓰세요.