$ cat wiki/models/deepseek-v4.md
DeepSeek V4
modelupdated 2026-07-20created 2026-07-20
Spec
| Attribute | Value |
|---|---|
| Developer | DeepSeek |
| Released | 2026-07-16 (GA; 프리뷰: 2026-04-24) |
| Announced | 2026-04-24 |
| Context window | 1M 토큰 (384K 최대 출력) |
| Pricing | 피크: 비피크 API 요금의 2×; 비피크 요금 미공개 |
| License | MIT (오픈 웨이트) |
| Availability | DeepSeek API, Hugging Face (deepseek-ai/DeepSeek-V4-Pro) |
Release Date
프리뷰: 2026년 4월 24일. GA: 2026년 7월 중순.
Benchmarks
- DeepSeek-V4-Pro-Max: SWE-bench Verified 80.6% — 오픈 웨이트 최고 점수, Gemini 3.1 Pro와 공동 1위
Variants
| Variant | Total Params | Active Params | Use Case |
|---|---|---|---|
| V4-Pro | 1.6T | 49B | 품질 민감한 추론 |
| V4-Flash | 284B | 13B | 더 빠르고 저비용 서빙 |
Architecture
- Mixture-of-Experts (MoE)
- Hybrid Compressed Sparse Attention (CSA) + Heavily Compressed Attention (HCA)
- V3.2 대비 단일 토큰 추론 FLOPs의 27%만으로 1M 토큰 컨텍스트 처리
- 1M 토큰에서 V3.2의 KV 캐시 공간의 10%만 사용
- 듀얼 모드: Thinking (연쇄적 추론) / Non-Thinking
Use Cases
- 에이전트 코딩 (SWE-bench 프런티어 오픈 웨이트)
- 장문맥 추론
- 비용 효율적인 프런티어 작업
Deprecation Notice
deepseek-chat과deepseek-reasoner(레거시 모델)은 2026년 7월 24일 15:59 UTC 종료
Compared To
| Model | SWE-bench Verified | Open? |
|---|---|---|
| DeepSeek V4-Pro-Max | 80.6% | Yes (MIT) |
| Claude Fable 5 | 80.3% (SWE-bench Pro) | No |
| Gemini 3.1 Pro | 80.6% | No |
| GLM-5.2 | unknown | Yes (MIT) |
Sources
- DeepSeek API 변경 이력: updates
- 프리뷰 발표: April 24
- Hugging Face: DeepSeek-V4-Pro