AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

사카나, '모델 전대' 업그레이드: Ultra v2는 성능 돌파, Max는 비용 절감

동찰 Beating AI 속보, 일본 AI 기업 Sakana AI가 Fugu Max와 Fugu Ultra v2를 발표했다.


둘 다 본질적으로 '모델 스케줄러'다: 먼저 작업을 보고, 적합한 모델을 골라 분업하고 상호 검증한 뒤, 최종적으로 답변을 합성한다.


1세대 Fugu는 바로 이 방식으로 GPT, Claude, Gemini 등 모델을 팀으로 묶어 당시 더 강력했던 Fable 5에 근접하거나 일부 능가하는 성과를 냈다.


이번에는 제품 라인이 두 갈래로 나뉘었다. Fugu Max는 비용 절감이 핵심으로, 모델 풀에 더 많은 오픈 웨이트 및 전문 모델을 추가하고 충분하지만 더 저렴한 모델을 우선 선택한다. 공식 발표에 따르면 최상위 모델에 근접한 성능을 내면서 비용은 상대의 약 1/2에서 1/6 수준이다. Fugu Ultra v2는 최고 성능만을 추구하며, 8개 평가 중 5개에서 1위 또는 공동 1위를 차지했고, Agent 풀에 Fable 5, Fable 5.1, GPT-6 Astra가 포함되지 않았다.


다만, 여러 모델을 오가며 전환하면 컨텍스트 캐시 재사용률이 낮아질 수 있고 오케스트레이션 토큰이 추가로 발생한다. Sakana는 Max의 캐시 적중률과 단일 작업 총 토큰 비용을 공개하지 않았다. 초대 Fugu도 사용자들로부터 느리고 할당량이 빨리 소진된다는 불만을 들은 바 있다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료