AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

지푸 GLM-5.3-FlashX 출시, 최대 200tokens/s

동찰 Beating AI 속보, 즈푸가 GLM-5.3-FlashX를 출시했다. GLM-5.3-Flash의 고속 버전으로 이해할 수 있으며, 최대 출력 속도가 200 tokens/s에 달한다. 공식적으로 이번에는 새로운 성능 벤치마크나 아키텍처 변화를 공개하지 않았고, 업데이트의 핵심은 추론 속도를 계속 높이는 것이다.


이번 발표는 어제의 추론 시스템 최적화 직후에 이루어졌다. 즈푸는 방금 GLM-5.3 기반의 Infra Agent가 Flash의 추론 인프라 최적화에 참여했다고 밝혔다. 2주도 안 되어 엔드투엔드 처리량이 최초의 약 3배로 향상되었으며, 전체 서비스가 10만 장 이상의 중국산 AI 칩에서 운영되고 있다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료