OpenRouter, Fusion API 출시: 절반의 비용으로 Fable 레벨 5 인텔리전스를 달성하기 위한 "좋은 금형 제작"
OpenRouter는 Fusion API 다중 모델 협업 시스템을 출시합니다. Gemini 3 Flash+Kimi K2.6+DeepSeek V4 Pro 조합은 Claude Fable 5 비용의 약 절반으로 가까운 성능을 달성합니다. OpenRouter 액세스 모델 수는 400개를 초과합니다.
OpenRouter, Fusion API 출시: 다중 모델 "좋은 모델을 조합"하여 절반의 비용으로 Fable 5에 도전
세계 최대 AI 대형 모델 API 집계 플랫폼인 오픈라우터(OpenRouter)가 사용자 입력을 여러 모델에 동시에 보내고, 검토 모델이 집계 및 분석을 거쳐 통일된 답변을 생성하는 다중 모델 협업 시스템인 퓨전(Fusion) API를 6월 14일 출시했다. 벤치마크 점수로 판단하면 일부 다중 모델 조합은 Anthropic의 주력 제품인 Claude Fable 5를 능가했습니다.
Fusion의 작업 링크는 세 단계로 나뉩니다. 첫 번째 단계는 요청을 병렬로 보내고 여러 모델이 자체 응답에 응답하도록 하는 것입니다. 두 번째 단계는 검토 모델이 답변을 읽고 구조화된 분석을 출력하는 것입니다. 세 번째 단계는 모델을 호출하여 분석 내용을 기반으로 최종 답변을 생성하는 것입니다.
SWE-Bench의 전체 순위:
| 유형 | 모델 조합 | 점수 |
|---|---|---|
| 퓨전 | 우화 5 + GPT-5.5 | 69.0% |
| 퓨전 | Opus 4.8 + GPT-5.5 + Gemini 3.1 Pro | 68.3% |
| 퓨전 | Opus 4.8 + GPT-5.5 | 67.6% |
| 퓨전 | 듀얼 오푸스 4.8 | 65.5% |
| 솔로 | 클로드 우화 5 | 65.3% |
| 퓨전 | Gemini 3 플래시 + Kimi K2.6 + DeepSeek V4 Pro | 64.7% |
| 솔로 | DeepSeek V4 프로 | 60.3% |
| 솔로 | GPT-5.5 | 60.0% |
| 솔로 | 클로드 오푸스 4.8 | 58.8% |
| 솔로 | 키미 K2.6 | 53.7% |
| 솔로 | 제미니 3.1 프로 | 45.4% |
| 솔로 | 제미니 3 플래시 | 43.1% |
가장 주목할만한 것은 "저렴한 콤보" - Gemini 3 Flash + Kimi K2.6 + DeepSeek V4 Pro입니다. 이는 Claude Fable 5의 약 절반 가격으로 단 1%(64.7% 대 65.3%)의 벤치마크 점수 차이를 관리합니다. 더 주목할만한 점은 이 조합의 세 모델은 개별 실행 점수가 높지 않다는 것입니다(43.1%, 53.7%, 60.3%), 그러나 Fusion의 검토-합성 메커니즘을 통해 시너지 효과는 각각의 상한선을 크게 초과합니다.
또한 두 가지 반직관적인 결과도 있습니다. 첫째, Fable 5 + GPT-5.5 조합(69.0%)은 Fable 5 단일 실행 점수(65.3%)를 능가할 뿐만 아니라 GPT-5.5 단일 실행 점수 약 60.0%를 능가합니다. 이는 가장 강력한 모델이라도 다중 모델 협업을 통해 추가 이득을 얻을 수 있음을 나타냅니다. 둘째, 듀얼 Opus 4.8 조합(65.5%)은 실제로 Fable 5를 약간 능가합니다. 별도의 실행 점수(65.3%)는 두 개의 하위 강력한 모델의 협력이 특정 시나리오에서 가장 강력한 단일 모델을 능가할 수 있음을 의미합니다.
OpenRouter는 또한 액세스 모델 수가 400을 초과했다고 발표했습니다. Fusion API의 본질은 "저렴한 컴퓨팅 성능을 인텔리전스로 교환"하는 것입니다. 여러 저가 모델을 병렬로 호출하고 검토 모델을 사용하여 결정을 내리면 단일 공급업체 종속을 우회하고 더 저렴한 비용으로 주력 AI 기능을 얻을 수 있는 새로운 경로가 열립니다.
후기