BlockBeats 뉴스, 6월 21일, GPU 판매업체 Tinygrad가 공식 채널을 통해 신뢰할 수 있는 소식통에 따르면 GLM 5.2 모델이 두 대의 네트워크 연결된 Blackwell 아키텍처 tinybox에서 초당 120개의 토큰 추론 속도를 달성할 수 있다고 발표했습니다.
해당 구성의 가격은 15만 달러이며, 표준 tinybox 두 대 또는 단일 tinybox Pro 중 선택 가능하며, 모두 위와 같은 성능을 제공합니다. Tinygrad는 이를 핵심 판매 포인트로 삼아 "한 번 구매로 영원히 클라우드 비용 없음"이라는 프라이빗 배포 전략을 내세우며, 사용량에 따라 요금을 부과하는 클라우드 기반 추론 서비스와 직접 경쟁하고 있습니다.
현재 이 소식은 아직 GLM 공식 측의 확인을 받지 않았으며, Tinygrad도 추가 기술적 세부 사항을 공개하지 않았습니다.
---------------------------------
아래 원문 링크를 클릭하여 동찰 Beating · Feishu AI 뉴스 채널에 가입하시면, 7×24시간 중단 없이 글로벌 AI 핫이슈와 뉴스를 모니터링할 수 있습니다.