AI 모델 및 플랫폼
DeepSeek, V4 Pro 출시… 프리뷰 종료

DeepSeek는旗艦 모델인 DeepSeek V4 Pro의 생산 버전을 출시했으며, 이는 4개월 동안 진행된 프리뷰 기간을 마감한다. 2026년 8월 12일에 출시된 V4 Pro 0813 빌드는 OpenRouter의 모델 페이지와 DeepSeek의 API 문서에서 일반적으로 사용 가능한 릴리즈로 나타난다. API 문서는 현재 deepseek-v4-pro 엔드포인트에서 사용되는 모델 버전으로 DeepSeek-V4-Pro-0813을 나열한다.
API 경제는 프리뷰에서継承된다: 캐시 미스의 경우 1백만 토큰당 $0.435, 캐시 히ット의 경우 1백만 토큰당 $0.003625, 출력 토큰당 $0.87, 1백만 토큰의 컨텍스트 창과 384,000 토큰의 최대 출력을 갖는다. DeepSeek의 가격 페이지는 0813 버전 문자열, 가격, 및 Pro 엔드포인트에 대한 동시성 제한(Flash에 대한 2,500 대 500)을 확인한다.
이 GA는 봄부터 공개적으로 진행된 단계적인 론칭을 마무리한다. DeepSeek는 2026년 4월 24일에 V4 시리즈를 프리뷰로 출시했으며, MIT 라이선스下的 오픈 소스와 함께 API 액세스를 제공했다. 2026년 7월 31일에 Flash 모델을 공식적으로 출시했으며, 변경 로그에서 Pro의 공식 출시가 ” 곧 따라올 것”이라고 말했다. 0813 빌드는 이러한 약속을 실현한다.
0813 빌드의 기반
V4 Pro는 1.6조 개의 총 파라미터와 토큰당 49억 개의 활성 파라미터를 갖는 전문가 시스템의 혼합으로, Hugging Face의 모델 카드에 따르면, Compressed Sparse Attention과 Heavily Compressed Attention이라는 두 가지 주의 변형을 결합한다. 이 아키텍처는 단일 토큰 추론 컴퓨팅을 27%로, KV 캐시를 10%로 줄인다. 두 V4 모델은 모두 32조 개 이상의 토큰으로 사전 훈련되었으며, 도메인별 전문가들을 별도로 성장시키고 정책 증류를 통해 한 모델로 통합한다.
프리뷰 빌드의 오픈 소스는 4월以来 다운로드할 수 있으며, Hugging Face의 Pro 저장소는 지난 달에 140만 회 이상 다운로드되었다. 모델 카드는 로컬에서 모델의 최대 추론 모드를 실행할 때 최소 384,000 토큰의 컨텍스트 창을 권장한다.
DeepSeek가 제시하는 숫자
헤드라인 평가 주장은 벤더 보고서이며, 모델 카드와 회사의 하네스 실행에서 가져온다. 최대 추론 노력을 가진 V4-Pro-Max의 경우, 모델 카드는 다음을 보고한다:
- SWE-bench Verified: 80.6% 해결
- Terminal Bench 2.0: 67.9% 정확도
- GPQA Diamond: 90.1% 패스@1
- Humanity’s Last Exam: 37.7% 패스@1
- MMLU-Pro: 87.5%
- LiveCodeBench: 93.5% 패스@1
- Codeforces 등급: 3,206
- MRCR 1백만 토큰: 83.5 MMR
모델 카드의 비교 표는 이러한 점수를 명명된 프론티어 시스템과 비교한다: V4-Pro-Max는 Terminal Bench 2.0에서 GPT-5.4(xHigh 노력)에 뒤처리고(67.9 대 75.1), Humanity’s Last Exam에서 Gemini-3.1-Pro에 뒤처린다(37.7 대 44.4). 그러나 LiveCodeBench와 Apex Shortlist 점수는 최고이다. SWE-bench Verified에서 80.6을 기록하며, Gemini-3.1-Pro와 동등하고 Claude Opus 4.6(80.8)에 약간 뒤처진다. 이러한 열은 아직 0813 빌드에 대해 독립적인 평가자가 복제하지 않았다.
API는 세 가지 운영 모드를 노출하며(사고 없음, 높은 추론 노력, 최대 노력), OpenAI ChatCompletions 형식, Anthropic Messages 형식, 및 DeepSeek의 Responses API를 지원한다. 또한 Pro와 Flash에서 툴 호출 및 JSON 출력을 지원한다.
DeepSeek가 여기까지 온 길
Pro GA는 더 저렴한 모델을 먼저 출시하는 전략의 두 번째 절을 완성한다. V4-Flash가 2026년 7월 31일에 공식적으로 출시되었을 때, DeepSeek는 에이전트 벤치마크 결과를 게시했으며, 재훈련된 Flash 빌드가 V4-Pro-Preview를 초과하는 것을 보여주었다. 0813 빌드는旗艦 모델의 답이다. 프로 엔드포인트의 컨텍스트 창, 출력 상한, 및 기능 세트는 이름으로는 변경되지 않는다. 변경된 것은 프리뷰 레이블이 제거된 것이다.
가격 태세는 주목할 만하다. DeepSeek의 가격 페이지에는 전체 API 가격이 곧 상당히 증가할 것이라고 공지되어 있다. 아직은 V4 Pro의 가격이 프리뷰 수준으로 유지되며, OpenRouter를 통해 실제로 지불되는 평균 가격은 $0.435의 목록 가격보다 낮다. 이는 캐싱과 할인으로 인한 것이다.
DeepSeek는 지난 1년 동안 모델 자체에서 외부로 확장해 왔다. V4 시리즈는 2026년 4월의 프리뷰 발표에서 이미 회사의 내부 개발을 주도하는 에이전트 워크로드(코딩 어시스턴트, 멀티스텝 자동화, 긴 문서 합성)를 중심으로 훈련되었다. 중국 오픈 웨이트 연구소는 거의 매월旗艦 모델을 출시했으며, V4 Pro의 GA는 이러한 패키지의 선두를 유지하기 위한 DeepSeek의 시도이다.
다음에 무엇이 출시될까
새로운 가중치가 열린 문제이다. Hugging Face 저장소는 아직 4월의 프리뷰 빌드를 호스팅하며, 모델 카드의 다운로드 표는 이러한 아티팩트를 가리킨다. DeepSeek는 0813 가중치를 게시할 타임라인이나 GA 빌드가 프리뷰와 다른 점이 있는지 발표하지 않았다. 회사의 V4 라인에 대한 변경 로그에 따르면, API를 통해 먼저 진행된다.
상업적인 측면에서, 가격 페이지의 공지사항은 DeepSeek가 수정된 가격 계획을 공식적으로 발표할 것을 약속하며, 이는 API 서비스 전반에 적용된다. 이 공지가 나올 때까지, deepseek-v4-pro는 2026년 8월 12일에 발표된 가격으로 0813 빌드를 제공한다. 1백만 토큰당 $0.435, 출력 토큰당 $0.87, 1백만 토큰의 컨텍스트 창을 갖는다.












