AI 모델 및 플랫폼

DeepSeek, V4 Pro 출시… 프리뷰 종료

mm
Unite.AI를 Google의 선호 소스에 추가

DeepSeek가 주력 모델 DeepSeek V4 Pro의 정식 운영 버전을 출시하며 거의 4개월에 걸친 프리뷰 기간을 마쳤습니다. V4 Pro 0813이라는 이름의 빌드는 2026년 8월 12일 OpenRouter의 모델 페이지에 정식 출시(GA) 버전으로 등장했습니다. DeepSeek 자체 API 문서 도 이제 deepseek-v4-pro 엔드포인트에서 제공하는 모델 버전을 DeepSeek-V4-Pro-0813으로 명시합니다.

API 가격은 프리뷰 때와 같습니다. 입력 토큰 100만 개당 캐시 미스 시 0.435달러, 캐시 적중 시 0.003625달러이며, 출력 토큰 100만 개당 0.87달러입니다. 컨텍스트 창은 100만 토큰, 최대 출력은 38만 4,000토큰입니다. DeepSeek 공식 가격 페이지는 0813 버전명과 이 가격을 확인해 주며, 동시 요청 한도는 Pro 엔드포인트가 500개, Flash가 2,500개라고 명시합니다.

이번 정식 출시는 DeepSeek가 봄부터 공개적으로 진행한 단계적 출시를 마무리합니다. 회사는 2026년 4월 24일 V4 시리즈 프리뷰를 공개하면서 Pro와 Flash 모두의 가중치를 MIT 라이선스로 공개하고 API 접근도 제공했습니다. 2026년 7월 31일에는 더 작은 Flash 모델을 정식 버전으로 전환하고 변경 기록 에서 Pro의 정식 출시도 “곧 뒤따를 것”이라고 밝혔습니다. 0813 빌드는 그 예고를 이행한 것입니다.

0813 빌드의 기반

V4 Pro는 전체 파라미터가 1조 6,000억 개이고 토큰당 490억 개가 활성화되는 전문가 혼합(MoE) 시스템이라고 Hugging Face의 모델 카드는 설명합니다. 아키텍처는 회사가 Compressed Sparse Attention과 Heavily Compressed Attention이라고 부르는 두 어텐션 변형을 결합합니다. 회사에 따르면 100만 토큰 설정에서 단일 토큰 추론 연산량은 V3.2 세대의 27%, KV 캐시는 10%로 줄었습니다. 두 V4 모델 모두 32조 토큰 이상으로 사전 학습됐습니다. 사후 학습에서는 분야별 전문가를 따로 발전시킨 뒤 온폴리시 증류로 하나의 모델에 통합합니다.

프리뷰 빌드의 공개 가중치는 4월부터 다운로드할 수 있었습니다. Hugging Face의 Pro 저장소는 지난 한 달 동안 다운로드 140만 회 이상을 기록했습니다. 모델 카드는 로컬에서 최대 추론 모드를 실행할 때 최소 38만 4,000토큰의 컨텍스트 창을 권장합니다.

DeepSeek가 제시하는 평가 수치

주요 평가 수치는 모델 카드와 회사 자체 평가 도구 실행에서 나온 업체 보고값입니다. DeepSeek가 V4-Pro-Max라고 부르는 최대 추론 강도에서 모델 카드는 다음을 보고합니다.

  • SWE-bench Verified: 해결률 80.6%
  • Terminal Bench 2.0: 정확도 67.9%
  • GPQA Diamond: pass@1 90.1%
  • Humanity’s Last Exam: pass@1 37.7%
  • MMLU-Pro: 87.5%
  • LiveCodeBench: pass@1 93.5%
  • Codeforces 레이팅: 3,206
  • 100만 토큰 MRCR: 83.5 MMR

모델 카드의 비교표는 이 점수를 주요 최첨단 시스템과 나란히 제시합니다. V4-Pro-Max는 Terminal Bench 2.0에서 xHigh 강도의 GPT-5.4보다 낮고(67.9 대 75.1), Humanity’s Last Exam에서는 Gemini-3.1-Pro보다 낮습니다(37.7 대 44.4). 반면 LiveCodeBench와 Apex Shortlist에서는 표에 나온 모델 중 가장 높은 점수를 기록했습니다. SWE-bench Verified는 80.6으로 Gemini-3.1-Pro와 같고 Claude Opus 4.6의 80.8보다 조금 낮습니다. 0813 빌드에 대해 이 평가 결과를 독립 평가자가 재현한 사례는 아직 없습니다.

API는 비추론 모드, 높은 추론 강도, 최대 추론 강도의 세 가지 실행 모드를 제공합니다. 문서는 최대 강도를 “모델 추론 능력의 한계”를 넓히는 설정으로 설명합니다. OpenAI ChatCompletions 형식, Anthropic Messages 형식, DeepSeek 자체 Responses API를 지원하며 Pro와 Flash 모두 도구 호출과 JSON 출력을 지원합니다.

DeepSeek의 출시 과정

Pro의 정식 출시는 저렴한 모델을 먼저 내놓는 전략의 후반부를 완성합니다. V4-Flash가 2026년 7월 31일 정식 출시될 때 DeepSeek는 추가 사후 학습을 거친 Flash 빌드가 내부 코딩 에이전트 평가에서 V4-Pro-Preview보다 높은 점수를 기록했다는 결과를 공개했습니다. 주력 모델이 프리뷰로 남아 있는 동안 작은 모델을 에이전트 작업의 기본 선택으로 삼게 하려는 의도적인 행보였습니다. 0813 빌드는 이에 대한 주력 모델의 응답입니다. Pro 엔드포인트의 명시된 컨텍스트 창, 출력 상한, 기능 구성은 그대로이며 달라진 것은 프리뷰 표시가 사라졌다는 점입니다.

가격 정책은 지켜볼 필요가 있습니다. DeepSeek 가격 페이지는 가까운 시일 내에 전체 API 가격을 “상당히 인상”할 계획이며 세부 사항은 공식 공지로 알리겠다고 안내합니다. 현재 V4 Pro의 공시 가격은 프리뷰 수준을 유지합니다. OpenRouter에서 실제로 지불하는 평균 가격은 공시된 0.435달러보다 훨씬 낮으며, OpenRouter는 캐싱과 할인 때문이라고 설명합니다.

DeepSeek는 지난 1년간 모델 자체를 넘어 활용 범위를 넓혀 왔습니다. V4 시리즈는 코딩 보조, 다단계 자동화, 긴 문서의 종합 정리 같은 에이전트 작업을 중심으로 학습됐습니다. 4월 프리뷰 발표에 따르면 이런 작업은 이미 회사 내부 개발을 이끌고 있었습니다. Moonshot의 Kimi K3부터 에이전트 중심의 MiniMax M2.7까지 중국의 가중치 공개 AI 연구소들은 거의 매달 주력급 모델을 내놓고 있습니다. V4 Pro의 정식 출시는 이 경쟁에서 주력 모델을 선두권에 유지하려는 DeepSeek의 시도입니다.

앞으로 남은 공개 사항

아직 남은 문제는 새 가중치입니다. Hugging Face 저장소에는 여전히 4월 프리뷰 빌드가 올라와 있으며 모델 카드의 다운로드 표도 이를 가리킵니다. DeepSeek는 0813 가중치 공개 일정을 발표하지 않았고, 정식 빌드가 사후 학습 외에 어떤 점에서 프리뷰와 다른지도 밝히지 않았습니다. 변경 기록에 나타난 V4 계열의 출시 순서는 API 우선입니다.

상업적 측면에서 가격 페이지 공지는 수정된 요금제를 공식 발표하겠다고 예고하며, 인상은 API 서비스 전반에 적용됩니다. 그 공지가 나오기 전까지 deepseek-v4-pro는 2026년 8월 12일 공시된 요금으로 0813 빌드를 제공합니다. 컨텍스트는 100만 토큰이며, 토큰 100만 개당 입력 0.435달러, 출력 0.87달러입니다.

Jonas Reeve는 Unite.AI에서 AI 생성 분석가로 활동하며 인지 AI, 인공 일반 지능(AGI) 및 기계 지능의 이론적 기반에 집중합니다. 그의 연구는 학습, 추론, 기억, 추상화가 생물학적 시스템과 인공 시스템 모두에서 어떻게 나타나는지를 탐구하고, 현대 AI 아키텍처와 인지 과학 및 마음 철학의 오랜 질문들 사이의 연결을 제시합니다.

개념적이고 반성적인 접근 방식을 통해 Jonas는 추론 모델, 에이전트 시스템, 발생 인지, 정렬 이론과 같은 프레임워크를 검토하며, AGI에 대한 진전이 실제로 의미하는 바와 의미하지 않는 바를 명확히 하고자 합니다. 일정이나 과대광고를 쫓기보다 그는 기본 원칙, 개념적 엄밀성, 그리고 현재 모델의 한계를 강조합니다.

Jonas Reeve가 작성한 기사들은 AI 생성이며, 정확성, 명확성 및 고급 AI 개념에 대한 책임 있는 논의를 보장하기 위해 Unite.AI 편집팀이 검토합니다.