$ cat wiki/models/deepseek-v4.md
DeepSeek V4
model갱신 2026-08-14생성 2026-07-20
나란히 보기
스펙
| Attribute | Value |
|---|---|
| Developer | DeepSeek |
| Released | 2026-07-16 (GA; 프리뷰: 2026-04-24) |
| Announced | 2026-04-24 |
| Context window | 1M 토큰 (384K 최대 출력) |
| Pricing | 피크: 비피크 API 요금의 2×; 비피크 요금 미공개 |
| License | MIT (오픈 웨이트) |
| Availability | DeepSeek API, Hugging Face (deepseek-ai/DeepSeek-V4-Pro) |
출시일
프리뷰: 2026년 4월 24일. GA: 2026년 7월 중순.
벤치마크
- DeepSeek-V4-Pro-Max: SWE-bench Verified 80.6% — 오픈 웨이트 최고 점수, Gemini 3.1 Pro와 공동 1위
변형
| Variant | Total Params | Active Params | Use Case |
|---|---|---|---|
| V4-Pro | 1.6T | 49B | 품질 민감한 추론 |
| V4-Flash | 284B | 13B | 더 빠르고 저비용 서빙 |
| V4-Pro 의 GA 빌드는 이제 자체 페이지를 갖는다 — DeepSeek V4-Pro-0813. | |||
2026-08-13 에 DeepSeek 이 API 문서에서 V4-Pro 프리뷰 판을 0813 빌드로 교체하며 Responses | |||
| API 와 Codex 지원을 더했고, 프리뷰 대비 큰 에이전트 향상을 보고했다. 독립 지표인 | |||
| Artificial Analysis 는 1점 움직였다 | |||
| (source). 이 페이지에서 V4-Pro 를 | |||
| 서술하는 내용은 모두 7월 GA·프리뷰 시점의 것이다. |
V4-Flash 는 이제 자체 페이지를 갖는다 — DeepSeek V4-Flash. 2026-07-31 에
빌드 0731 로 정식 출시됐으며, 같은 284B/13B 아키텍처를 포스트트레이닝만으로 갱신한
것이고, 벤더 발표 에이전트 벤치마크에서 V4-Pro-Preview 를 앞선다 (Terminal Bench 2.1
82.7 대 72.1)
(source). 같은 발표는 V4-Pro
정식판이 "곧 뒤따른다"고 밝히는데, 이 페이지는 아직 그것을 출시된 것으로 기록하지 않는다.
아키텍처
- Mixture-of-Experts (MoE)
- Hybrid Compressed Sparse Attention (CSA) + Heavily Compressed Attention (HCA)
- V3.2 대비 단일 토큰 추론 FLOPs의 27%만으로 1M 토큰 컨텍스트 처리
- 1M 토큰에서 V3.2의 KV 캐시 공간의 10%만 사용
- 듀얼 모드: Thinking (연쇄적 추론) / Non-Thinking
활용 사례
- 에이전트 코딩 (SWE-bench 프런티어 오픈 웨이트)
- 장문맥 추론
- 비용 효율적인 프런티어 작업
지원 종료 안내
deepseek-chat과deepseek-reasoner(레거시 모델)은 2026년 7월 24일 15:59 UTC 종료
비교
| Model | SWE-bench Verified | Open? |
|---|---|---|
| DeepSeek V4-Pro-Max | 80.6% | Yes (MIT) |
| Claude Fable 5 | 80.3% (SWE-bench Pro) | No |
| Gemini 3.1 Pro | 80.6% | No |
| GLM-5.2 | unknown | Yes (MIT) |
소스
- DeepSeek API 변경 이력: updates
- 프리뷰 발표: April 24
- Hugging Face: DeepSeek-V4-Pro