ai-trend-notifierEN
← wiki

$ cat wiki/entities/deepseek.md

DeepSeek

Latest

  • 2026-07-24

    유출된 투자자 회의록 — Liang Wenfeng의 중국 컴퓨트 병목에 대한 발언

  • 2026-07-16 (7월 중순 GA): DeepSeek V4가 공식적으로 프리뷰 (4월 24일 출시)에서 GA로 전환; 피크/오프피크 가격 체계 도입; 기존 deepseek-chat + deepseek-reasoner는 7월 24일 종료

Overview

중국 AI 연구 랩 (항저우 High-Flyer Capital Management 산하). 비용 경쟁력 있는 오픈 가중치 모델 공개로 알려짐. V2와 V3 시리즈로 2026년 중반 이전 지배적 오픈 가중치 랩으로 자리잡음. DeepSeek V4 GA (2026년 7월)는 SWE-bench Verified 80.6%로 오픈 가중치 SOTA 타이틀을 유지하며 Gemini 3.1 Pro와 공동.

Key People

  • Liang Wenfeng (창업자/CEO)

Models & Products

  • DeepSeek V4 — 2026년 7월 GA; V4-Pro 1.6T MoE, V4-Flash 284B MoE; MIT 라이선스; 1M 컨텍스트; SWE-bench Verified 80.6% (오픈 가중치 SOTA)

Recent Activity

  • 2026-07-24: 유출된 투자자 회의록 — Liang Wenfeng의 중국 컴퓨트 병목에 대한 발언 — 2026년 5월 20일 DeepSeek 비공개 투자자 회의의 3시간 44분 녹음이 7월 하순 Tencent Tech를 통해 유출됨. DeepSeek이 공식 진위를 확인하지 않았지만, 내부 수치는 DeepSeek 자체의 공개 발표와 일치. 핵심 주장: (1) DeepSeek은 프런티어 모델 훈련을 위해 Huawei Ascend 950 칩 20만 개가 필요; Huawei가 실제 제공한 것은 1만 6천 개 (필요량의 8%); (2) Huawei의 총 Ascend 950 생산량은 모든 중국 AI 기업을 합산해 연간 ~75만 개 — 제약이 최소 3년은 지속; (3) NVIDIA GB300 1개 ≈ Huawei Ascend 950 4개 원시 훈련 성능; (4) DeepSeek의 유명한 효율 혁신은 철학적 선택이 아닌 칩 부족에 대한 적응으로 명시적으로 프레이밍됨; (5) CUDA 해자가 무너지고 있음 — AI 기반 코드 생성이 1년 안에 장벽을 낮출 것이며, Ascend 950 SuperNode가 GB200/GB300 워크로드를 대체할 것으로 예상; (6) 2026년 5월 첫 외부 라운드: RMB 500억 전량 구독 (Liang이 40% 기여). 수출 통제 시사점: 이 수치들은 계속된 미국 수출 통제의 사례를 검증함 — NVIDIA 칩의 거부가 중국의 프런티어 AI 개발을 실제로 제약하고 있음. 직접적인 모순: Liang은 또한 NVIDIA가 통제하기 어려운 CUDA 생태계를 구축함으로써 "자기 무덤을 파고 있다"고 말함. → AI Governance (source) (Hello China Tech) (Transformer News) (Geopolitechs — 64개 인용구)

  • 2026-07-16 (7월 중순 GA): DeepSeek V4가 공식적으로 프리뷰 (4월 24일 출시)에서 GA로 전환; 피크/오프피크 가격 체계 도입; 기존 deepseek-chat + deepseek-reasoner는 7월 24일 종료 (source)

Strategic Position

DeepSeek은 글로벌 AI 지도에서 "비용 효율적 오픈 가중치" 포지션을 점유. 중국 오픈 가중치 티어에서 Alibaba / Qwen AI Lab (Qwen 3.8, 2.4T), Moonshot AI (Kimi K3, 2.8T), Z.ai (GLM-5.2, 744B)와 경쟁하지만, 프런티어 수준 SWE-bench 점수 (80.6%, Gemini 3.1 Pro와 동점)를 발표한 유일한 랩.

Referenced by

Sources