AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

샤오미 MiMo-V3-Pro 벤치마크 점수 유출 추정, SWE-Bench Pro 72.8로 해외 최고 수준의 폐쇄형 모델에 근접

BlockBeats 뉴스, 8월 21일, Max For AI가 글을 통해 샤오미의 차세대 대형 언어 모델로 추정되는 MiMo-V3-Pro의 Benchmark 스크린샷이 커뮤니티에서 유포되고 있다고 공개했다. 스크린샷에 따르면 해당 모델은 Coding Agent 및 범용 Agent 시나리오에 중점을 두고 있으며, 일부 테스트 성적은 이미 Claude Opus, GPT 등 해외 최고 수준의 모델에 근접한 것으로 나타났다.


해당 스크린샷에 따르면, MiMo-V3-Pro는 SWE-Bench Pro에서 72.8점을 기록하여 GLM 5.3의 67.9점과 Kimi K3의 65.8점보다 높았으며, Claude Opus 5의 74.6점, GPT-5.6 Sol Max의 75.4점과의 차이는 3점 미만이었다. Terminal-Bench 2.0에서는 70.6점을 기록하여 역시 Claude Opus 5의 72.0점과 GPT-5.6 Sol Max의 73.5점에 근접했다. 또한 τ3-bench에서는 76.4점을 기록했으며, GPT-5.6 Sol Max는 78.8점이었다.


만약 위 성적이 최종적으로 공식 확인되고 정식 버전에서 재현될 수 있다면, MiMo-V3-Pro는 글로벌 최고 수준 모델의 1군에 진입할 가능성이 있다. 다만 현재 해당 Benchmark 스크린샷의 진위 여부와 테스트 조건은 아직 샤오미 공식의 확인을 받지 못했으며, 관련 데이터는 여전히 검증되지 않은 폭로로 간주해야 한다. 주목할 점은 샤오미가 현재 공식적으로 공개한 최신 MiMo 플래그십 모델이 MiMo-V2-Pro 및 MiMo-V2.5-Pro라는 점이며, 따라서 V3-Pro의 존재 여부와 구체적인 출시 시기는 여전히 공식의 추가 발표를 기다려야 한다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료