동찰 Beating AI 속보, DeepSeek가 V4.1 Flash를 공식 발표했습니다. 새 모델의 총 파라미터는 552B(5,520억)이며, 완전히 새로운 Causal-Encoder-Decoder 아키텍처를 채택하고 이미지 이해를 네이티브로 지원합니다. 또한 DeepSeek의 이 새로운 아키텍처 시리즈 중 현재 가장 작은 모델입니다.
이 아키텍처는 입력과 출력을 분리하여 처리합니다. 입력을 읽을 때는 8B(80억) 파라미터만 활성화하고, 답변을 생성할 때는 16B(160억)를 활성화합니다. DeepSeek는 이를 통해 552B 대형 모델도 추론 비용을 낮출 수 있다고 밝혔습니다. 새로운 사전 학습과 더 대규모의 강화 학습을 거친 후, V4.1 Flash는 공식 벤치마크에서 이미 V4 Pro를 초과했습니다.
캐시도 대폭 압축되었습니다. 이전 세대와 비교해 V4.1 Flash는 HBM 메모리 수요가 1/4로, SSD 저장 수요가 1/8로 줄었으며, 주로 긴 컨텍스트와 Agent 반복 호출 시의 비용을 낮추기 위한 것입니다.
V4.1 Flash는 이미 API에 동시 출시되었으며, 모델명을 deepseek-flash로 변경하면 호출할 수 있습니다.