동찰 Beating AI 속보, Artificial Analysis가 DeepSeek V4.1 Flash의 독립 테스트를 완료했으며 종합 지능 지수 40점을 받았다. 이는 자사 V4 Pro 0813의 36점을 넘어선 것이지만, 여전히 Kimi K3의 44점과 GLM-5.3의 45점에는 미치지 못한다. 이 제3자 순위표에 따르면 DeepSeek는 아직 중국산 모델 1위를 되찾지 못했다.
하지만 가격 차이는 매우 극적이다. V4.1 Flash가 Intelligence Index 작업 하나를 완료하는 데 평균 0.27달러밖에 들지 않는 반면, Kimi K3와 GLM-5.3는 모두 약 2달러로 약 7배 차이다. 출력 속도는 197 Token/s에 달해 Kimi K3의 약 36 Token/s와 GLM-5.3의 약 58 Token/s보다 훨씬 높다.
Agent는 여전히 가장 강력한 부분이다. AutomationBench-AA에서 V4.1 Flash는 69%를 기록해 GPT-6 Astra와 동률을 이루었고 GLM-5.3의 62%를 넘어섰다. 장문맥 테스트 AA-LCR에서도 84%를 기록했다. 단점은 말이 특히 많다는 것으로, AA 테스트에서 단일 작업 평균 출력이 약 8.9만 Token으로 V4 Pro보다 62% 많아 가격 우위의 일부를 잠식했다.