동차 Beating 모니터링에 따르면, Artificial Analysis가 마침내 Qwen3.8-27B의 독립 벤치마크를 공개했습니다: Intelligence Index 52점.
이 27B 파라미터의 Dense 모델은 DeepSeek V4 Flash 0731 및 GPT-5.6 Luna Max와 직접 동률을 이루며, DeepSeek V4 Pro 0813 및 GLM-5.2의 53점과는 단 1점 차이입니다. 이전 세대 Qwen3.6-27B는 38점에 불과했습니다.
더 놀라운 것은 Agent 능력입니다. Qwen3.8-27B의 Agentic Index는 51점으로, DeepSeek V4 Pro의 50점, DeepSeek V4 Flash의 48점, GPT-5.6 Luna의 47점을 모두 초과합니다. 이 지표는 모델의 도구 호출, 계획 수립, 연속적인 복잡한 작업 완료 능력을 전문적으로 테스트합니다.
하지만 52점에도 대가가 따릅니다. Artificial Analysis가 전체 Intelligence Index를 실행하는 동안 Qwen3.8-27B는 총 약 1.6억 개의 출력 토큰을 생성했으며, 명백히 '토큰으로 지능을 쌓는' 유형에 속합니다.
Qwen 공식 기본 추론 단계는 바로 xhigh이며, 동시에 medium, low 및 사고 비활성화를 지원합니다. 현재 Artificial Analysis는 구체적으로 어떤 추론 단계를 사용했는지 명시하지 않았으므로, 이것이 기본 xhigh의 성적인지 아직 확인할 수 없습니다.
