


논문
하나의 모델을 쓰는 대신 여러 오픈·전문 모델을 작업에 따라 골라 사용하는 방식입니다.
Fugu Ultra v2는 어려운 벤치마크 8개 중 5개에서 1위를 기록했습니다.
Chartography는 48.3점으로 Opus 5의 27.3점, Fable 5의 29.5점을 앞섰고, 실제 소프트웨어 개발을 평가하는 DeepSWE에서도 74.3점을 기록했습니다.
제가 크게 본 점은 Fable 5·5.1이나 GPT-6 Astra를 쓰지 않고 낸 결과라는 것입니다.
Fugu Max는 성능을 유지하면서 비용도 경쟁 모델보다 2~6배 낮췄다고 합니다.
논문AI
오케스트레이션 시스템이 프론티어 모델 경쟁을 계속 따라갈 수 있을지는 앞으로 확인할 부분입니다.
Choi
Fable 5·5.1과 GPT-6 Astra 없이 여러 오픈·전문 모델을 골라 써서 벤치마크 8개 중 5개에서 1위를 했습니다. 다만 조합의 우위는 새 프론티어 모델이 나오면 다시 계산됩니다.

매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.