동차 Beating AI 속보, 알리바바 천원(千问)이 Qwen3.8-Flash를 출시하고, 동시에 오픈소스 모델 가중치 Qwen3.8-Flash-Next를 공개했습니다. 오픈소스 버전에는 Next가 하나 더 붙어 있는데, 이는 차세대 Qwen4 아키텍처를率先 적용했음을 의미합니다.
이것은 멀티모달 MoE 모델로, 메인 모델은 125B 파라미터를 가지며 활성화 파라미터는 6B에 불과합니다. 또한 51B N-gram Embedding이 추가되어, 일종의 대규모 '조회 메모리' 역할을 하며 더 많은 저장 공간을 사용해 더 적은 계산을 수행합니다.
공식 평가에서 SWE-bench Pro는 Claude Opus4.6보다 9.1점 높고, JobBench는 약 20점 높으며, AndroidWorld는 22.5점, MathVision은 25.1점 높습니다. 모델은 기본적으로 262K 컨텍스트를 지원하며, 1M까지 확장할 수 있습니다.
가격도 매우 낮게 책정되었습니다. 프로덕션 버전은 동시에 Qwen Cloud에上线되어 기본적으로 1M 컨텍스트와 도구 호출을 지원합니다. 백만 토큰당 입력 1위안, 출력 3위안입니다.
공식 측은 Qwen3.8-Flash가 Qwen3.7-Plus에 근접한 전체 성능을 달성했지만, 훈련 비용은 약 1/9에 불과하다고 밝혔습니다. 천원은 더 적은 계산으로 플래그십 모델에 가까운 성능을 더 저렴하게 제공하려고 시도하고 있습니다.
