동차 Beating AI 속보, 엔비디아 CEO 젠슨 황이 오늘 아침 공개한 바에 따르면, GPT-6 Astra 훈련에는 약 10만 장 이상의 Grace Blackwell GPU가 사용되었으며, NVLink72를 통해 고속 상호 연결 클러스터를 구성했습니다. 그는 또한 다음 배치로 40만 장의 GPU가 온라인에 투입될 예정이지만, 구체적인 모델과 소속은 밝히지 않았습니다.
Astra를 기준으로 삼을 때, 중국 주요 모델 기업들의 공개된 컴퓨팅 파워는 여전히 뚜렷한 격차를 보입니다. 바이트댄스가 현재 가장 근접하며, 올해 말레이시아를 통해 약 3.6만 장의 B200을 도입했습니다. 이 칩들은 Astra가 사용하는 GB200과 동일한 Blackwell 세대에 속하지만, 컴퓨팅 파워는 해외에 배치되어 있습니다. 바이트댄스가 올해 중국 내 클러스터를 공개적으로 소개할 때는 주로 Hopper 아키텍처의 중국 특별판 H20과 H800을 사용하고 있습니다.
Kimi는 최근 알리바바를 통해 약 2만 장의 Hopper GPU를 확보한 것으로 알려졌습니다. Bloomberg 소식통에 따르면 구체적으로 H200 모델이지만, 알리바바는 H200 모델이라는 주장을 부인했습니다. H200은 이전 세대 Hopper에 속하며, B200은 이미 Blackwell로 업그레이드되었습니다. GB200은 Grace CPU와 Blackwell GPU를 결합한 것으로, NVL72는 72장의 GPU를 동일한 고속 상호 연결 도메인에 배치할 수 있습니다.
DeepSeek는 V4의 전체 훈련 하드웨어를 공개하지 않았습니다. 유출된 량원펑 투자자 간담회 녹취록에 따르면, 회사는 5월 기준 약 2만 장의 H 등급 컴퓨팅 파워를 보유하고 있으며, 대부분이 막 도착했고, 향후 구매는 "기본적으로 엔비디아"라고 밝혔습니다. 화웨이가 DeepSeek에 공급하는 950 생산량은 약 1.6만 장입니다. 량원펑은 이 중국산 카드들이 약 4000장의 Nvidia B 시리즈에 해당하며, 현재 세대 모델 훈련에만 충분하다고 말했습니다.
Astra가 사용하는 Blackwell도 더 이상 엔비디아의 최신 세대가 아닙니다. Vera Rubin은 이미 본격적인 양산 단계에 진입했습니다. NVIDIA는 Rubin이 대규모 MoE 모델 훈련에 필요한 GPU 수를 Blackwell의 4분의 1로 줄일 수 있다고 추산합니다.
공개 자료에서 아직 중국 기업이 10만 장의 동일 세대 첨단 GPU를 단일 모델 훈련에 사용한 사례를 공개한 적은 없습니다. 따라서 현재 중미 AI 기업 간 공개적으로 드러난 격차는 단순히 카드 수량의 문제가 아니라, 어느 세대의 카드를 확보할 수 있는지, 그리고 한 번에 하나의 모델에 얼마나 많은 카드를 집중할 수 있는지의 문제입니다.
