AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

딥시크 V4.1 플래시 정식 출시: 552B 신규 아키텍처, 입력 시 8B만 활성화

동찰 Beating AI 속보, DeepSeek가 V4.1 Flash를 공식 발표했습니다. 새 모델의 총 파라미터는 552B(5,520억)이며, 완전히 새로운 Causal-Encoder-Decoder 아키텍처를 채택하고 이미지 이해를 네이티브로 지원합니다. 또한 DeepSeek의 이 새로운 아키텍처 시리즈 중 현재 가장 작은 모델입니다.


이 아키텍처는 입력과 출력을 분리하여 처리합니다. 입력을 읽을 때는 8B(80억) 파라미터만 활성화하고, 답변을 생성할 때는 16B(160억)를 활성화합니다. DeepSeek는 이를 통해 552B 대형 모델도 추론 비용을 낮출 수 있다고 밝혔습니다. 새로운 사전 학습과 더 대규모의 강화 학습을 거친 후, V4.1 Flash는 공식 벤치마크에서 이미 V4 Pro를 초과했습니다.


캐시도 대폭 압축되었습니다. 이전 세대와 비교해 V4.1 Flash는 HBM 메모리 수요가 1/4로, SSD 저장 수요가 1/8로 줄었으며, 주로 긴 컨텍스트와 Agent 반복 호출 시의 비용을 낮추기 위한 것입니다.


V4.1 Flash는 이미 API에 동시 출시되었으며, 모델명을 deepseek-flash로 변경하면 호출할 수 있습니다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료