AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

엔비디아의 해자에 또 한 칼이 들어왔다: '황소 온다' 모델 GLM-5.3 Flash가 23조 토큰을 폭발적으로 처리하며, 전량 국산 칩에서 실행된다.

동차 Beating AI 속보, GLM-5.3 Flash 출시 후, 지푸(Zhipu)는 이전에 공개되지 않았던 세부 사항을 확인했습니다: Ox Alpha 익명 테스트 기간 동안의 트래픽은 전적으로 중국산 AI 칩이 추론 연산력을 제공했습니다.


Ox Alpha는 OpenRouter에서 6일간의 완전한 자연일 동안 23.2조 개의 토큰을 처리했으며, 이는 같은 기간 DeepSeek-V4-Flash의 2배 이상입니다. OpenCode는 이전에 백엔드가 하루 100조 개의 토큰 무료 할당량을 제공할 수 있다고 밝히기도 했습니다.


지푸는 동일한 중국산 하드웨어에서 엔드투엔드 추론 성능을 초기 대비 3배로 최적화했으며, 현재 하드웨어 효율성과 단일 토큰 비용이 주류 엔비디아 GPU에 근접할 수 있다고 밝혔습니다.


SemiAnalysis는 특히 이 점을 지적했습니다. 이전에 외부에서는 하루 100조 개의 토큰 공급 능력을 보고, 이러한 규모가 최상위 연구소와 엔비디아 GPU만이 감당할 수 있는지 추측했습니다. 그러나 이번에는 처음부터 끝까지 중국산 칩이 사용되었습니다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료