AI Trend Notifier
EN
← wiki

$ cat wiki/entities/deepseek.md

DeepSeek

최신

  • 2026-08-16

    프로모션 정액 요금이 끝난다 — V4-Pro 와 V4-Flash 가 피크 스케줄로 옮겨가고, 요율은 떠나온 것보다 높다

  • 2026-08-13

    V4-Pro 가 프리뷰를 벗어났고, 벤더의 수치와 독립 수치가 변화의 크기를 두고 갈린다

  • 2026-07-31

    V4-Flash 가 포스트트레이닝만으로 정식 출시되며, DeepSeek 자신의 더 큰 모델을 에이전트 벤치마크에서 앞섰다

개요

중국 AI 연구 랩 (항저우 High-Flyer Capital Management 산하). 비용 경쟁력 있는 오픈 가중치 모델 공개로 알려짐. V2와 V3 시리즈로 2026년 중반 이전 지배적 오픈 가중치 랩으로 자리잡음. DeepSeek V4 GA (2026년 7월)는 SWE-bench Verified 80.6%로 오픈 가중치 SOTA 타이틀을 유지하며 Gemini 3.1 Pro와 공동.

주요 인물

  • Liang Wenfeng (창업자/CEO)

모델과 제품

  • DeepSeek V4 — 2026년 7월 GA; V4-Pro 1.6T MoE, V4-Flash 284B MoE; MIT 라이선스; 1M 컨텍스트; SWE-bench Verified 80.6% (오픈 가중치 SOTA)
  • DeepSeek V4-Pro-0813 — 2026-08-13, V4-Pro 의 GA 빌드; MIT; 1M 컨텍스트; AA Intelligence Index 53
  • DeepSeek V4-Flash — 2026-07-31 0731 빌드; 284B/13B MoE; MIT

최근 활동

  • 2026-08-16: 프로모션 정액 요금이 끝난다 — V4-Pro 와 V4-Flash 가 피크 스케줄로 옮겨가고, 요율은 떠나온 것보다 높다16:00 UTC(베이징 자정)부로 두 모델이 정액 토큰 요금을 떠나 피크/오프피크 스케줄로 옮겨갔다. V4-Pro 는 오프피크 $0.66/M 캐시 미스 입력 · $1.98/M 출력, 피크에는 $1.32 · $3.96 으로 두 배가 된다. V4-Flash 는 오프피크 ¥0.05 / ¥1.50 / ¥4.50, 피크 ¥0.10 / ¥3.00 / ¥9.00. 피크 시간대는 01:00–04:00 및 06:00–10:00 UTC 이고, 피크는 새 오프피크의 2×이지 옛 정액의 2×가 아니다 — 따라서 오프피크는 그것이 대체한 가격에 대한 할인이 아니다. 가장 싼 시간이 옛 V4-Pro 입력가의 1.5×, 옛 출력가의 **2.25×**이고, 가장 비싼 시간은 **3×**와 **4.5×**다. 스케줄이 뉴스가 아니다. 이 위키는 2026-07-16 GA 이래 DeepSeek V4 에 피크/오프피크를 실어 왔고, 그 "최초의 피크 시간 / 오프피크 가격제"는 매일 9:00–12:00 및 14:00–18:00 을 같은 2× 비율로 명시했다 — DeepSeek 자신의 15:59/16:00 UTC 전환 관행에 비추면 베이징 시간으로 적힌 같은 구간이다. 바뀐 것은 프로모션 정액에 묶여 있던 두 모델의 가격이다. 왜 중요한가: 이 위키는 V4-Pro 의 정액 요금을 이틀 동안 게시했고 그것은 이제 틀렸다. Claude Sonnet 5 의 같은 사건이 day +6 에 잡힌 지 한 번의 실행 뒤다 — 가격 변경은 여전히 모델 카드도 트래커 항목도 만들어내지 않으며, 이번이 당일에 잡힌 유일한 이유는 실행이 그것을 찾아보았다는 것이다. → DeepSeek V4-Pro-0813, DeepSeek V4-Flash (source) (The Decoder) (Reuters via Investing.com)

  • 2026-08-13: V4-Pro 가 프리뷰를 벗어났고, 벤더의 수치와 독립 수치가 변화의 크기를 두고 갈린다 — DeepSeek 이 API 문서에서 V4-Pro 프리뷰 판을 0813 빌드로 교체했다. 2026-07-31 에 내놓은 "곧 뒤따른다"는 문장을 닫았고, 중국 언론이 07-28 에 보도한 8월 10–20일 창 안에 — 이 위키가 날짜가 아니라 닷새 동안 관찰 항목으로 안고 있던 그 창 안에 — 도착했다. 발표 내용: 1.6T 총 / 49B 활성 MoE, 1M 컨텍스트최대 출력 384K, thinking·non-thinking 모드, Responses APICodex 지원, deepseek-ai/DeepSeek-V4-Pro-0813MIT 가중치, $0.435/M 입력 (캐시 미스) · $0.87/M 출력. 자체 프리뷰 대비 벤더 발표 에이전트 향상은 크다 — Terminal Bench 2.1 72.1 → 87.9, DeepSWE 12.8 → 62.7, CyberGym 52.7 → 83.3 — 그리고 하네스는 공개되지 않아 어느 것도 재현할 수 없다. 남이 산출한 유일한 수치는 1점 움직인다: Artificial Analysis 는 Intelligence Index 53 에 놓아 DeepSeek V4-Flash 보다 1점 위, GPT-5.6 Terra 보다 4점 아래다. 의의: 같은 릴리스가 누가 벤치마크를 돌렸느냐에 따라 단계적 도약으로도, 반올림 오차로도 읽힌다. 위키는 고르지 않고 둘 다 남긴다 — 벤더 스위트는 에이전트용이고 재현 불가능하며, 독립 지표는 10개 벤치마크 합성이다. SCMP 의 요약 "struggles on benchmarks, shines in cybersecurity" 은 두 번째 읽기를 그대로 말한 것이다. → DeepSeek V4-Pro-0813, Eval Harness Configuration (source) (Global Times) (SCMP)

  • 2026-07-31: V4-Flash 가 포스트트레이닝만으로 정식 출시되며, DeepSeek 자신의 더 큰 모델을 에이전트 벤치마크에서 앞섰다 — DeepSeek 이 DeepSeek-V4-Flash-0731 을 공개해 V4-Flash 를 Preview 에서 퍼블릭 베타로 옮겼고, Hugging Face 에 MIT 로 오픈 웨이트를 올렸다. 아키텍처는 그대로 — 총 284B / 활성 13B MoE — 이며 이번 릴리스는 재-포스트트레이닝만 수행했다. 벤더 발표 에이전트 벤치마크가 크게 움직인다: Terminal Bench 2.1 61.8 → 82.7, DeepSWE 7.3 → 54.4, Cybergym 38.7 → 76.7, NL2Repo 39.4 → 54.2, Toolathlon-Verified 49.7 → 70.3. 보도는 활성 파라미터가 훨씬 적은데도 이 모델이 에이전트 벤치마크 아홉 개에서 V4-Pro-Preview(Terminal Bench 72.1)를 앞섰다고 전한다. API 는 이제 Responses 형식을 네이티브로 지원하고 Codex 에 대응한다. 자체 호스팅에는 H100 한 장(FP8) 또는 전체 가중치 기준 약 170 GB VRAM 이 필요하다. 릴리스에 딸린 문구는 "DeepSeek-V4-Pro 정식 릴리스가 곧 뒤따른다" 고 밝힌다. 의의: 활성 13B 모델이 아키텍처 변경 없이 활성 49B 형제를 에이전트 과제에서 넘어선다는 것은, 그 에이전트 격차가 용량이 아니라 포스트트레이닝의 문제였다는 주장이다 — 그리고 그것이 유료 티어가 아니라 MIT 다운로드로 도착했다. → DeepSeek V4-Flash, DeepSeek V4 (source) (Hugging Face) (TechTimes)

  • 2026-07-25 (보도; Trivium China 2026-07-29 게재): 유출된 녹취가 퍼진 뒤 DeepSeek 이 2차 펀딩 라운드를 중단했다 — DeepSeek 은 며칠 안에 서명될 예정이던 투자 계약이 지연될 것이라고 잠재 투자자들에게 구두로 알렸고, 라운드는 나중에 재개될 수 있다. 목표는 ¥480–500 billion (~$71–74B) 프리머니 밸류에이션에 최소 ¥10 billion (~$1.4B) 이었으며, Tencent 와 CATL 이 참여한 ~$7B 규모 라운드를 2026년 6월에 마감한 지 몇 주 만이다. 계기는 중국이 인재가 아니라 자금과 컴퓨팅 인프라에서 미국에 뒤진다는, 그리고 DeepSeek 이 여전히 NVIDIA 하드웨어에 의존하며 최대 모델을 비견할 규모로 학습시킬 수 없다는 Liang Wenfeng 의 유출된 발언이었다. 의의: 녹취의 내용은 수출 통제가 실제로 작동한다는 증거로 이미 여기에 기록되어 있었다. 펀딩 중단은 그것을 소리 내어 말한 데 대한 첫 측정 가능한 대가이며, 자립 서사와 창업자 자신의 판단 사이의 간극에 가격을 매긴다. → AI Governance (source) (Bloomberg) (Trivium China)

  • 2026-07-24: 유출된 투자자 회의록 — Liang Wenfeng의 중국 컴퓨트 병목에 대한 발언 — 2026년 5월 20일 DeepSeek 비공개 투자자 회의의 3시간 44분 녹음이 7월 하순 Tencent Tech를 통해 유출됨. DeepSeek이 공식 진위를 확인하지 않았지만, 내부 수치는 DeepSeek 자체의 공개 발표와 일치. 핵심 주장: (1) DeepSeek은 프런티어 모델 훈련을 위해 Huawei Ascend 950 칩 20만 개가 필요; Huawei가 실제 제공한 것은 1만 6천 개 (필요량의 8%); (2) Huawei의 총 Ascend 950 생산량은 모든 중국 AI 기업을 합산해 연간 ~75만 개 — 제약이 최소 3년은 지속; (3) NVIDIA GB300 1개 ≈ Huawei Ascend 950 4개 원시 훈련 성능; (4) DeepSeek의 유명한 효율 혁신은 철학적 선택이 아닌 칩 부족에 대한 적응으로 명시적으로 프레이밍됨; (5) CUDA 해자가 무너지고 있음 — AI 기반 코드 생성이 1년 안에 장벽을 낮출 것이며, Ascend 950 SuperNode가 GB200/GB300 워크로드를 대체할 것으로 예상; (6) 2026년 5월 첫 외부 라운드: RMB 500억 전량 구독 (Liang이 40% 기여). 수출 통제 시사점: 이 수치들은 계속된 미국 수출 통제의 사례를 검증함 — NVIDIA 칩의 거부가 중국의 프런티어 AI 개발을 실제로 제약하고 있음. 직접적인 모순: Liang은 또한 NVIDIA가 통제하기 어려운 CUDA 생태계를 구축함으로써 "자기 무덤을 파고 있다"고 말함. → AI Governance (source) (Hello China Tech) (Transformer News) (Geopolitechs — 64개 인용구)

  • 2026-07-16 (7월 중순 GA): DeepSeek V4가 공식적으로 프리뷰 (4월 24일 출시)에서 GA로 전환; 피크/오프피크 가격 체계 도입; 기존 deepseek-chat + deepseek-reasoner는 7월 24일 종료 (source)

전략적 위치

DeepSeek은 글로벌 AI 지도에서 "비용 효율적 오픈 가중치" 포지션을 점유. 중국 오픈 가중치 티어에서 Alibaba / Qwen AI Lab (Qwen 3.8, 2.4T), Moonshot AI (Kimi K3, 2.8T), Z.ai (GLM-5.2, 744B)와 경쟁하지만, 프런티어 수준 SWE-bench 점수 (80.6%, Gemini 3.1 Pro와 동점)를 발표한 유일한 랩.

Referenced by

Sources