원문 제목: 《DeepSeek V4 Pro 정식 버전 출시》
원문 저자: 동차Beating
DeepSeek V4 Pro 정식 버전이 출시되었습니다.
8월 12일 저녁, DeepSeek 공식 API 문서에서 deepseek-v4-pro에 해당하는 모델 버전을 DeepSeek-V4-Pro-0813으로 업데이트했습니다. 현재 개발자는 API를 통해 새 버전을 직접 호출할 수 있으며, 가격은 입력 100만 토큰당 3위안, 출력 100만 토큰당 6위안, 캐시 적중 입력은 100만 토큰당 0.025위안입니다.
V4 Pro-0813은 계속해서 100만 토큰 컨텍스트 창을 지원하며, 최대 출력은 38.4만 토큰에 달합니다. 동시에 사고(Thinking) 및 비사고(Non-Thinking) 두 가지 모드를 지원합니다. JSON Output, Tool Calls 등의 기능도 이미 개방되었습니다.
8월 12일 저녁 기준, DeepSeek 공식 업데이트 로그에는 아직 V4 Pro 정식 버전 공지가 별도로 게시되지 않았습니다. 그러나 이전 V4 Flash 정식 버전 업데이트 시, DeepSeek은 V4 Pro 정식 버전이 곧 출시될 것이라고 명확히 밝혔습니다. 현재 API 백엔드 모델 노드는 이전 버전에서 DeepSeek-V4-Pro-0813으로 전환되었습니다.
V4가 처음 등장한 지 약 4개월이 지났습니다.
올해 4월 24일, DeepSeek은 V4 Preview를 출시하면서 동시에 V4 Pro와 V4 Flash를 공개했습니다. 그중 V4 Pro는 시리즈의 플래그십 버전으로, 총 파라미터 수가 1.6T에 달하며, 각 토큰당 약 49B 파라미터가 활성화되고 100만 토큰 컨텍스트를 지원합니다. V4 세대는 처음부터 코딩, 도구 호출 및 장기 Agent 작업을 크게 강화했습니다.
7월 31일, DeepSeek은 V4-Flash-0731을 출시했습니다. 공식 발표에 따르면, 이 버전은 기존 모델 아키텍처와 크기를 유지하면서 주로 후훈련(Post-training)을 다시 진행했으며, Agent 능력이 크게 강화되고 Responses API가 기본적으로 추가되었으며, Codex에 대한 적응도 이루어졌습니다. 당시 DeepSeek은 이번 업데이트가 Flash에만 해당되며 Pro와 웹端 모델에는 변화가 없다고 특별히 강조했고, V4 Pro 정식 버전은 이후에 출시될 것이라고 밝혔습니다.
이제 Pro의 마지막 퍼즐 조각이终于 맞춰졌습니다.

DeepSeek 이번 세대 모델은 점점 더 Agent 중심으로 진화하고 있습니다
V4 Pro 정식 버전 출시 시점은 마침 대형 모델 업계의 새로운 제품 중심축 이동과 맞물렸습니다.
올해 모델 제조사들이 신제품을 발표할 때, 단순히 지식问答, 수학, 기존 Benchmark를 비교하는 비중은 점점 줄어들고 있습니다. Coding, Computer Use, Tool Use, 장시간 작업 완료율, 그리고 한 번의 작업을 완료하는 데 드는 비용이 새로운 핵심 지표가 되고 있습니다.
7월 GPT-5.6 출시 당시 OpenAI는 Agent와 Coding 능력에 많은 지면을 할애했습니다. GPT-5.6 Sol은 새로운 max reasoning effort를 지원하며, ultra 모드를 추가로 선보여 여러 Agent가 병렬로 복잡한 작업을 수행합니다. Responses API도 이제 모델이 직접 프로그램을 작성해 도구를 조율하고 중간 결과를 처리한 뒤 다음 행동을 결정할 수 있게 허용합니다. OpenAI는 심지어 "1달러로 얼마나 많은 작업을 완료할 수 있는가"를 이번 세대 제품의 주요 판매 포인트 중 하나로 내세웠습니다.
Anthropic의 방향도 매우 유사합니다.
6월 말 출시된 Claude Sonnet 5의 주요 개선점 역시 Coding, Agent, Computer Use, 장시간 작업에 집중되어 있습니다. Anthropic은 다양한 effort level을 제공해 개발자가 작업에 따라 추론 강도를 선택할 수 있게 했으며, 8월 10일에는 Sonnet 5의 기존 프로모션 가격인 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러를 영구적으로 유지한다고 발표했습니다.
모델 기업들이 이제 직면한 것은 단순히 "누가 더 똑똑한가"가 아닙니다.
하나의 Agent는 수십 분에서 수시간 동안 연속 실행되며 코드를 반복적으로 읽고 쓰고, 자료를 검색하고, 브라우저와 외부 도구를 호출할 수 있습니다. 실제 프로덕션 환경에 들어가면 모델 호출 횟수는 급격히 증가합니다. 능력, 속도, 토큰 소비, 호출 가격이 함께 Agent 제품이 실제로 돌아갈 수 있는지를 결정하기 시작했습니다.
DeepSeek V4의 설계도 기본적으로 이 방향을 따라 전개되고 있습니다.
100만 토큰 컨텍스트는 모델이 한 번에 더 큰 코드 저장소, 기업 지식 베이스, 작업 이력을 읽을 수 있게 해줍니다. Tool Calls는 외부 환경과의 상호작용을 담당하며, Anthropic API 및 Flash가 이미 선도적으로 지원하는 Responses API와의 호환성은 모델이 기존 Agent 도구 체인에 진입하는 장벽을 낮춥니다. DeepSeek은 4월 V4 출시 당시 이미 OpenAI ChatCompletions와 Anthropic 형식 인터페이스를 동시에 개방했습니다.
이것이 V4 Pro 정식 버전이 단순히 또 하나의 더 큰 DeepSeek 모델보다 더 주목할 만한 이유입니다. DeepSeek는 모델을 Agent가 직접 호출할 수 있는 인프라로 더욱 발전시키고 있습니다.
V4 Pro 정식 버전 출시 후, DeepSeek의 이번 세대 제품 계층 구조도 더욱 명확해졌습니다.
현재 V4 Flash 입력 가격은 1위안/백만 토큰, Pro는 3위안이며, Flash 출력은 2위안, Pro는 6위안입니다. 두 가격은 정확히 3배 차이가 납니다. V4 Pro와 Flash 모두 100만 컨텍스트를 지원하지만, Pro는 더 큰 활성화 파라미터 규모를 사용하여 복잡한 추론, 코딩 및 더 어려운 Agent 작업에 더 적합합니다.
Flash는 대량, 고빈도, 비용 민감한 작업을 담당하고, Pro는 더 무거운 작업을 처리합니다.
2025년의 대형 모델 경쟁은 여전히 '플래그십 모델 중 누가 벤치마크 1위인가'를 중심으로 전개되었습니다. 2026년에 이르러 모델은 점점 진정한 소프트웨어 인프라에 가까워지고 있으며, 똑똑해야 할 뿐만 아니라 안정적인 API, 긴 컨텍스트, 도구 호출, 충분히 높은 동시성, 그리고 개발자가 계산할 수 있는 가격도 갖춰야 합니다.
V4 Pro 정식 버전 출시 이후, DeepSeek V4 세대의 제품 윤곽이 드디어 완성되었습니다.
원문 링크
BlockBeats 공식 커뮤니티에 참여하세요:
Telegram 구독 그룹:https://t.me/theblockbeats
Telegram 토론 그룹:https://t.me/BlockBeats_App
Twitter 공식 계정:https://twitter.com/BlockBeatsAsia