AI Trend Notifier
EN
← wiki

$ cat wiki/models/deepseek-v4.md

DeepSeek V4

model갱신 2026-08-14생성 2026-07-20

나란히 보기

스펙

AttributeValue
DeveloperDeepSeek
Released2026-07-16 (GA; 프리뷰: 2026-04-24)
Announced2026-04-24
Context window1M 토큰 (384K 최대 출력)
Pricing피크: 비피크 API 요금의 2×; 비피크 요금 미공개
LicenseMIT (오픈 웨이트)
AvailabilityDeepSeek API, Hugging Face (deepseek-ai/DeepSeek-V4-Pro)

출시일

프리뷰: 2026년 4월 24일. GA: 2026년 7월 중순.

벤치마크

  • DeepSeek-V4-Pro-Max: SWE-bench Verified 80.6% — 오픈 웨이트 최고 점수, Gemini 3.1 Pro와 공동 1위

변형

VariantTotal ParamsActive ParamsUse Case
V4-Pro1.6T49B품질 민감한 추론
V4-Flash284B13B더 빠르고 저비용 서빙
V4-Pro 의 GA 빌드는 이제 자체 페이지를 갖는다 — DeepSeek V4-Pro-0813.
2026-08-13 에 DeepSeek 이 API 문서에서 V4-Pro 프리뷰 판을 0813 빌드로 교체하며 Responses
API 와 Codex 지원을 더했고, 프리뷰 대비 큰 에이전트 향상을 보고했다. 독립 지표인
Artificial Analysis 는 1점 움직였다
(source). 이 페이지에서 V4-Pro 를
서술하는 내용은 모두 7월 GA·프리뷰 시점의 것이다.

V4-Flash 는 이제 자체 페이지를 갖는다 — DeepSeek V4-Flash. 2026-07-31 에 빌드 0731 로 정식 출시됐으며, 같은 284B/13B 아키텍처를 포스트트레이닝만으로 갱신한 것이고, 벤더 발표 에이전트 벤치마크에서 V4-Pro-Preview 를 앞선다 (Terminal Bench 2.1 82.7 대 72.1) (source). 같은 발표는 V4-Pro 정식판이 "곧 뒤따른다"고 밝히는데, 이 페이지는 아직 그것을 출시된 것으로 기록하지 않는다.

아키텍처

  • Mixture-of-Experts (MoE)
  • Hybrid Compressed Sparse Attention (CSA) + Heavily Compressed Attention (HCA)
  • V3.2 대비 단일 토큰 추론 FLOPs의 27%만으로 1M 토큰 컨텍스트 처리
  • 1M 토큰에서 V3.2의 KV 캐시 공간의 10%만 사용
  • 듀얼 모드: Thinking (연쇄적 추론) / Non-Thinking

활용 사례

  • 에이전트 코딩 (SWE-bench 프런티어 오픈 웨이트)
  • 장문맥 추론
  • 비용 효율적인 프런티어 작업

지원 종료 안내

  • deepseek-chatdeepseek-reasoner (레거시 모델)은 2026년 7월 24일 15:59 UTC 종료

비교

ModelSWE-bench VerifiedOpen?
DeepSeek V4-Pro-Max80.6%Yes (MIT)
Claude Fable 580.3% (SWE-bench Pro)No
Gemini 3.1 Pro80.6%No
GLM-5.2unknownYes (MIT)

소스

Referenced by

Sources