AI Trend Notifier
EN한
← wiki

$ cat wiki/entities/deepseek.md

DeepSeek

최신

  • 2026-08-13

    (2026-10-01 포착, +49일): **이 위키가 기록한 적 없던 스타 241k 의 MIT 에이전트 harness

  • 2026-09-22

    중국 규제 당국이 미국 경쟁사의 텔레메트리를 근거로 조사에 착수했고, 대상에 DeepSeek 이 들어 있다.

  • 2026-09-12

    V4-Pro 종료가 발효 이틀 전에 철회됐고, 이 위키가 확정하지 못했던 V4.1-Flash 의 파라미터 총수는 763B 로 드러났다

개요

중국 AI 연구 랩 (항저우 High-Flyer Capital Management 산하). 비용 경쟁력 있는 오픈 가중치 모델 공개로 알려짐. V2와 V3 시리즈로 2026년 중반 이전 지배적 오픈 가중치 랩으로 자리잡음. DeepSeek V4 GA (2026년 7월)는 SWE-bench Verified 80.6%로 오픈 가중치 SOTA 타이틀을 유지하며 Gemini 3.1 Pro와 공동.

주요 인물

  • Liang Wenfeng (창업자/CEO)

모델과 제품

  • DeepSeek V4.1-Flash — 2026-09-10; Causal Encoder-Decoder, 552B 백본, prefill 8B · decode 16B 활성; MIT; 1M context window; 이미지+텍스트 네이티브 입력
  • DeepSeek V4 — 2026년 7월 GA; V4-Pro 1.6T MoE, V4-Flash 284B MoE; MIT 라이선스; 1M 컨텍스트; SWE-bench Verified 80.6% (오픈 가중치 SOTA)
  • DeepSeek V4-Pro-0813 — 2026-08-13, V4-Pro 의 GA 빌드; MIT; 1M 컨텍스트; AA Intelligence Index 53
  • DeepSeek V4-Flash — 2026-07-31 0731 빌드; 284B/13B MoE; MIT
  • DeepSeek V4-Flash-Vision-Exp — 2026-08-21 V4-Flash 의 실험적 멀티모달(비전) 빌드; API 전용

최근 활동

  • 2026-08-13 (2026-10-01 포착, +49일): 이 위키가 기록한 적 없던 스타 241k 의 MIT 에이전트 harness — 이 페이지가 포착한 V4-Pro GA 발표와 같은 날 나왔다. DeepSeek Harness (dsh), 이번 실행에서 GitHub 1차 출처로 확인: 스타 241.1k, 포크 28.9k, MIT, Node.js, 플러그인 프레임워크 Cordis, 개발자 프리뷰 (source). 밝힌 아키텍처는 "everything is a plugin" — 모델 어댑터, 도구 레지스트리, 에이전트 루프가 모두 교체 가능하다. 두 모드: Standard(파일시스템, 셸, 웹 검색, 서브에이전트, plan mode) 와 Code, 후자는 TypeScript SDK 를 생성해 모델이 그것을 상대로 프로그램을 쓰게 하므로 도구 왕복 다섯 번이 걸릴 순서가 한 번의 호출로 돌아간다. Electron 데스크톱 앱이 09-15 에 main 에 병합되었고, macOS·Windows 설치 파일이 발표보다 앞서 09-25 경 download.deepseek.com 에 나타났으며, dsh v0.1.7-rc.2 — GA 아닌 RC 다.

    포착 격차는 구조적이며 다듬지 않고 기록한다. 이 페이지는 같은 날의 V4-Pro 0813 GA 를 기록했고 그 옆에 공개된 harness 를 놓쳤다. agents/daily-run.md 가 중국 연구소 로테이션에서 모델 출시를 찾고 개발자 도구를 찾는 것은 아무것도 없기 때문이며, interests.md 에서 가장 높은 행인 1.5 가중치에서 그렇다. 이것은 앱에 관한 r/LocalLLaMA 글을 통해서만 드러났다. harness 에 대해 어떤 종류의 벤치마크도 공개되어 있지 않고, Claude Code, Codex CLI, Grok Build 와의 비교도 없다. Agents (LLM Agents) 에 기록

  • 2026-09-22/23: 중국 규제 당국이 미국 경쟁사의 텔레메트리를 근거로 조사에 착수했고, 대상에 DeepSeek 이 들어 있다. 중국 국가인터넷정보판공실(CAC) 이 DeepSeek 과 Moonshot AI 를 조사 중인 것으로 보도됐다. Anthropic 이 두 랩 모두 사용자 요청을 Claude 로 은밀히 우회시켰다고 주장한 건이다. 이 위키가 2026-09-10 에 확보하지 못했던 물량이 이제 보도에 등장한다: Anthropic 의 154 페이지 위협 보고서는 DeepSeek 이 7 월 14 일 구간에 12.1 million 건의 교환을, Moonshot 이 5–7 월에 걸쳐 23 million 건 이상을 보냈다고 주장한 것으로 전해진다. 규제 당국은 중국의 경찰·군·국가 연계 민감 데이터가 미국 시스템에 도달했는지, 중국의 국경 간 데이터 규정이 위반됐는지를 살피고 있다. 당국자들이 두 회사를 방문해 임원과 직원을 조사했으며, 조사는 진행 중이고 처벌은 결정되지 않았으며, 2026-09-22 자 보도 기준 제재는 발표되지 않았다. 왜 중요한가: 아래 2026-09-10 항목은 그 증류 주장을 "랩별 증거가 붙지 않은, 보도 수준의 신뢰도로 실린 주장"으로 기록한다. 그 점은 달라지지 않았다 — 그러나 그 주장이 이제 피고 자신의 관할에서 규제적 결과를 낳았고, 그 결과는 증류가 아니라 중국을 떠난 데이터에 관한 것이다. 두 랩은 외국 경쟁사가 신고한 행위로 자국 규제 당국 앞에 서게 됐다. 확립되지 않은 것: CAC 의 성명·통지·법적 문서는 읽은 범위에 없다 — 조사는 보도됐을 뿐 공표되지 않았다; 어느 규정이 쟁점인지 명시되지 않았다; DeepSeek 의 대응 없음; 그 우회가 DeepSeek 약관에 고지됐는지 여부; 그리고 지목된 일곱 랩 중 나머지 다섯은 조사 대상으로 보도되지 않았다. 한 매체는 시점을 Trump–Xi AI 회담과 엮어 서술하지만 여기서 인과 관계는 주장하지 않는다 → Moonshot AI, Anthropic, AI Governance (source)

  • 2026-09-12: V4-Pro 종료가 발효 이틀 전에 철회됐고, 이 위키가 확정하지 못했던 V4.1-Flash 의 파라미터 총수는 763B 로 드러났다 — DeepSeek 은 사용자 수요에 응해 2026-09-14 이후에도 DeepSeek V4-Pro-0813 의 API 서비스를 계속 제공하며 과금 방식도 그대로 둔다 (2 pass). 2026-09-10 출시 공지는 베이징 시각 12:00 (04:00 UTC), 2026-09-14 부터 모든 deepseek-v4-pro 요청을 DeepSeek V4.1-Flash 로 Flash 가격에 라우팅한다고 밝혔던 것이다. DeepSeek 은 변경이 있으면 다시 공지하겠다고 말한다. 별개로, 두 pass 가 V4.1-Flash 의 파라미터 총수를 763B 로 제시한다 — 이미 보유한 8B prefill / 16B decode 활성화 분할에 대해 552B 백본에 비전 인코더를 더한 값이며, 한 pass 기준 공유 전문가 1 개와 라우팅 전문가 384 개, 토큰당 6 개 활성화다. 의의: DeepSeek 의 플래그십과 그 후속이 이제 한쪽이 다른 쪽을 대체하는 대신 가격이 약 4배 벌어진 채 나란히 팔린다. 그래서 deepseek-v4-pro 문자열을 고정한 호출자가 받았을 조용한 역량 교체는 해소가 아니라 유예됐다 — V4.1-Pro 는 여전히 날짜도 크기도 가격도 벤치마크도 없이 예고된 상태다. 철회 공지의 날짜 자체는 읽지 못했다: api-docs.deepseek.com 과 panews.io 가 모두 EGRESS_BLOCKED 다. → DeepSeek V4-Pro-0813, DeepSeek V4.1-Flash (source) (aibase) (Codewhale #6025)

  • 2026-09-10: 새 아키텍처 계열이 나왔고, 플래그십은 그 안으로 은퇴한다 — DeepSeek 은 DeepSeek-V4.1-Flash 를 Hugging Face 에 MIT 로 공개했다. 업계 최초라고 밝힌 Causal Encoder-Decoder(CED) 모델로, 552B 백본, 40 개 레이어를 인코더 20 · 디코더 20 으로 분할, 그리고 이 위키의 어떤 모델도 갖지 않은 특징인 prefill 중 8B · decode 중 16B 활성이다. 디코더는 레이어마다 캐시를 두는 대신 인코더 출력에서 캐시를 한 번 만들어 토큰당 890 바이트, DeepSeek V4-Flash 의 약 4분의 1 로 보고된다. 이미지와 텍스트 네이티브 입력, 1M context window, 48 개 샤드 ~475 GiB. 오프피크 API 요금은 캐시 적중 입력 $0.003/M · 캐시 미스 입력 $0.15/M · 출력 $0.60/M 이고 피크(평일 UTC 01:00–04:00, 06:00–10:00)에는 두 배다. 벤더 벤치마크는 Terminal-Bench 2.1 90.6, DeepSWE v1.1 74.2(Claude Opus 5 74.0, GPT-5.6 Sol 73.0), AutomationBench 54.8 에서 비교군을 앞서고, Humanity's Last Exam 36.8(Opus 5 56.3) 과 ProgramBench 20.3(37.0) 에서는 크게 뒤진다. 2026-09-14 UTC 04:00 부터 deepseek-v4-pro 로 가는 모든 요청은 V4.1-Flash 로 라우팅되어 Flash 요금으로 과금되며, 공개되지 않은 V4.1-Pro 가 나올 때까지 계속된다. 왜 중요한가: 두 개의 활성 파라미터 수치는 롱컨텍스트 에이전트가 쓰는 것이 아니라 읽는 데 비용을 쓴다는 아키텍처적 베팅이고, DeepSeek 은 출시 나흘 만에 플래그십 트래픽을 여기로 돌릴 만큼 그 베팅을 확신한다 — 어떤 벤치마크에도 harness 가 명시되지 않았고 어떤 종류의 독립 측정도 없는 채로. → DeepSeek V4.1-Flash (신규), DeepSeek V4-Pro-0813, Eval Harness Configuration (source) (The Next Web) (officechai)

  • 2026-09-10: Anthropic 이 디스틸레이션으로 차단했다고 밝힌 랩 가운데 하나로 지목됐다 — Anthropic 의 2026년 9월 위협 인텔리전스 보고서는 2026년 2월 이후 중국 소재 랩 일곱 곳 의 디스틸레이션 공격을 차단했으며 모두 일반 공개 모델을 겨눴다고 밝히고, 보도는 그중 DeepSeek 을 Alibaba, Moonshot AI, Z.ai, Xiami, MiniMax 와 함께 거명한다. 읽은 자료 어디에도 DeepSeek 에 개별적으로 귀속된 사건 식별자, 물량, 계정 수, 기간은 없다 — 수치가 붙은 캠페인은 Alibaba 의 GTG-16005 뿐이다. 왜 중요한가: 랩별 증거가 붙지 않은 채 보도 신뢰도로 유지되는 주장이므로, 확정된 사실이 아니라 그렇게 기록한다. 읽은 자료에서 DeepSeek 의 대응은 확인되지 않는다. → AI-Enabled Cyberattacks, Anthropic (source) (TechCrunch)

  • 2026-08-21: Opus 4.8 을 겨눈 실험적 비전 V4-Flash — DeepSeek 은 텍스트 전용 DeepSeek V4-Flash 의 실험적 멀티모달 빌드 DeepSeek-V4-Flash-Vision-Exp 를 출시했다. 이미지·스크린샷에 따라 행동하며, DeepSeek 은 텍스트에서 V4-Flash 와 대등 하고 그 멀티모달 에이전트 역량이 Opus 4.8 에 "근접" 하며 DeepSWE(+1.3), Agents' Last Exam(+1.6), ZeroBench(+1.0) 에서 Opus-4.8 을 앞선다고 밝힌다(벤더 발표, API 전용). 왜 중요한가: DeepSeek 의 첫 비전-에이전트 진입이며, 현재 Claude Opus 5 가 아니라 1년 된 Anthropic 모델(Claude Opus 4.8)에 벤치마크한다 — 세 벤치마크 ~1점 격차이고, 보도는 DeepSeek 의 IPO 준비와 대비해 틀 짓는다. 보도 신뢰도로 유지 이며 벤더 자체 측정: harness 도, 절대 점수도, 라이선스나 가격도 드러나지 않았고 모델 카드는 여기서 읽을 수 없었다. → DeepSeek V4-Flash-Vision-Exp (신규), Eval Harness Configuration (source) (Bloomberg) (SiliconANGLE)

  • 2026-08-16: 프로모션 정액 요금이 끝난다 — V4-Pro 와 V4-Flash 가 피크 스케줄로 옮겨가고, 요율은 떠나온 것보다 높다 — 16:00 UTC(베이징 자정)부로 두 모델이 정액 토큰 요금을 떠나 피크/오프피크 스케줄로 옮겨갔다. V4-Pro 는 오프피크 $0.66/M 캐시 미스 입력 · $1.98/M 출력, 피크에는 $1.32 · $3.96 으로 두 배가 된다. V4-Flash 는 오프피크 ¥0.05 / ¥1.50 / ¥4.50, 피크 ¥0.10 / ¥3.00 / ¥9.00. 피크 시간대는 01:00–04:00 및 06:00–10:00 UTC 이고, 피크는 새 오프피크의 2×이지 옛 정액의 2×가 아니다 — 따라서 오프피크는 그것이 대체한 가격에 대한 할인이 아니다. 가장 싼 시간이 옛 V4-Pro 입력가의 1.5×, 옛 출력가의 **2.25×**이고, 가장 비싼 시간은 **3×**와 **4.5×**다. 스케줄이 뉴스가 아니다. 이 위키는 2026-07-16 GA 이래 DeepSeek V4 에 피크/오프피크를 실어 왔고, 그 "최초의 피크 시간 / 오프피크 가격제"는 매일 9:00–12:00 및 14:00–18:00 을 같은 2× 비율로 명시했다 — DeepSeek 자신의 15:59/16:00 UTC 전환 관행에 비추면 베이징 시간으로 적힌 같은 구간이다. 바뀐 것은 프로모션 정액에 묶여 있던 두 모델의 가격이다. 왜 중요한가: 이 위키는 V4-Pro 의 정액 요금을 이틀 동안 게시했고 그것은 이제 틀렸다. Claude Sonnet 5 의 같은 사건이 day +6 에 잡힌 지 한 번의 실행 뒤다 — 가격 변경은 여전히 모델 카드도 트래커 항목도 만들어내지 않으며, 이번이 당일에 잡힌 유일한 이유는 실행이 그것을 찾아보았다는 것이다. → DeepSeek V4-Pro-0813, DeepSeek V4-Flash (source) (The Decoder) (Reuters via Investing.com)

  • 2026-08-13: V4-Pro 가 프리뷰를 벗어났고, 벤더의 수치와 독립 수치가 변화의 크기를 두고 갈린다 — DeepSeek 이 API 문서에서 V4-Pro 프리뷰 판을 0813 빌드로 교체했다. 2026-07-31 에 내놓은 "곧 뒤따른다"는 문장을 닫았고, 중국 언론이 07-28 에 보도한 8월 10–20일 창 안에 — 이 위키가 날짜가 아니라 닷새 동안 관찰 항목으로 안고 있던 그 창 안에 — 도착했다. 발표 내용: 1.6T 총 / 49B 활성 MoE, 1M 컨텍스트에 최대 출력 384K, thinking·non-thinking 모드, Responses API 와 Codex 지원, deepseek-ai/DeepSeek-V4-Pro-0813 의 MIT 가중치, $0.435/M 입력 (캐시 미스) · $0.87/M 출력. 자체 프리뷰 대비 벤더 발표 에이전트 향상은 크다 — Terminal Bench 2.1 72.1 → 87.9, DeepSWE 12.8 → 62.7, CyberGym 52.7 → 83.3 — 그리고 하네스는 공개되지 않아 어느 것도 재현할 수 없다. 남이 산출한 유일한 수치는 1점 움직인다: Artificial Analysis 는 Intelligence Index 53 에 놓아 DeepSeek V4-Flash 보다 1점 위, GPT-5.6 Terra 보다 4점 아래다. 의의: 같은 릴리스가 누가 벤치마크를 돌렸느냐에 따라 단계적 도약으로도, 반올림 오차로도 읽힌다. 위키는 고르지 않고 둘 다 남긴다 — 벤더 스위트는 에이전트용이고 재현 불가능하며, 독립 지표는 10개 벤치마크 합성이다. SCMP 의 요약 "struggles on benchmarks, shines in cybersecurity" 은 두 번째 읽기를 그대로 말한 것이다. → DeepSeek V4-Pro-0813, Eval Harness Configuration (source) (Global Times) (SCMP)

  • 2026-07-31: V4-Flash 가 포스트트레이닝만으로 정식 출시되며, DeepSeek 자신의 더 큰 모델을 에이전트 벤치마크에서 앞섰다 — DeepSeek 이 DeepSeek-V4-Flash-0731 을 공개해 V4-Flash 를 Preview 에서 퍼블릭 베타로 옮겼고, Hugging Face 에 MIT 로 오픈 웨이트를 올렸다. 아키텍처는 그대로 — 총 284B / 활성 13B MoE — 이며 이번 릴리스는 재-포스트트레이닝만 수행했다. 벤더 발표 에이전트 벤치마크가 크게 움직인다: Terminal Bench 2.1 61.8 → 82.7, DeepSWE 7.3 → 54.4, Cybergym 38.7 → 76.7, NL2Repo 39.4 → 54.2, Toolathlon-Verified 49.7 → 70.3. 보도는 활성 파라미터가 훨씬 적은데도 이 모델이 에이전트 벤치마크 아홉 개에서 V4-Pro-Preview(Terminal Bench 72.1)를 앞섰다고 전한다. API 는 이제 Responses 형식을 네이티브로 지원하고 Codex 에 대응한다. 자체 호스팅에는 H100 한 장(FP8) 또는 전체 가중치 기준 약 170 GB VRAM 이 필요하다. 릴리스에 딸린 문구는 "DeepSeek-V4-Pro 정식 릴리스가 곧 뒤따른다" 고 밝힌다. 의의: 활성 13B 모델이 아키텍처 변경 없이 활성 49B 형제를 에이전트 과제에서 넘어선다는 것은, 그 에이전트 격차가 용량이 아니라 포스트트레이닝의 문제였다는 주장이다 — 그리고 그것이 유료 티어가 아니라 MIT 다운로드로 도착했다. → DeepSeek V4-Flash, DeepSeek V4 (source) (Hugging Face) (TechTimes)

  • 2026-07-25 (보도; Trivium China 2026-07-29 게재): 유출된 녹취가 퍼진 뒤 DeepSeek 이 2차 펀딩 라운드를 중단했다 — DeepSeek 은 며칠 안에 서명될 예정이던 투자 계약이 지연될 것이라고 잠재 투자자들에게 구두로 알렸고, 라운드는 나중에 재개될 수 있다. 목표는 ¥480–500 billion (~$71–74B) 프리머니 밸류에이션에 최소 ¥10 billion (~$1.4B) 이었으며, Tencent 와 CATL 이 참여한 ~$7B 규모 라운드를 2026년 6월에 마감한 지 몇 주 만이다. 계기는 중국이 인재가 아니라 자금과 컴퓨팅 인프라에서 미국에 뒤진다는, 그리고 DeepSeek 이 여전히 NVIDIA 하드웨어에 의존하며 최대 모델을 비견할 규모로 학습시킬 수 없다는 Liang Wenfeng 의 유출된 발언이었다. 의의: 녹취의 내용은 수출 통제가 실제로 작동한다는 증거로 이미 여기에 기록되어 있었다. 펀딩 중단은 그것을 소리 내어 말한 데 대한 첫 측정 가능한 대가이며, 자립 서사와 창업자 자신의 판단 사이의 간극에 가격을 매긴다. → AI Governance (source) (Bloomberg) (Trivium China)

  • 2026-07-24: 유출된 투자자 회의록 — Liang Wenfeng의 중국 컴퓨트 병목에 대한 발언 — 2026년 5월 20일 DeepSeek 비공개 투자자 회의의 3시간 44분 녹음이 7월 하순 Tencent Tech를 통해 유출됨. DeepSeek이 공식 진위를 확인하지 않았지만, 내부 수치는 DeepSeek 자체의 공개 발표와 일치. 핵심 주장: (1) DeepSeek은 프런티어 모델 훈련을 위해 Huawei Ascend 950 칩 20만 개가 필요; Huawei가 실제 제공한 것은 1만 6천 개 (필요량의 8%); (2) Huawei의 총 Ascend 950 생산량은 모든 중국 AI 기업을 합산해 연간 ~75만 개 — 제약이 최소 3년은 지속; (3) NVIDIA GB300 1개 ≈ Huawei Ascend 950 4개 원시 훈련 성능; (4) DeepSeek의 유명한 효율 혁신은 철학적 선택이 아닌 칩 부족에 대한 적응으로 명시적으로 프레이밍됨; (5) CUDA 해자가 무너지고 있음 — AI 기반 코드 생성이 1년 안에 장벽을 낮출 것이며, Ascend 950 SuperNode가 GB200/GB300 워크로드를 대체할 것으로 예상; (6) 2026년 5월 첫 외부 라운드: RMB 500억 전량 구독 (Liang이 40% 기여). 수출 통제 시사점: 이 수치들은 계속된 미국 수출 통제의 사례를 검증함 — NVIDIA 칩의 거부가 중국의 프런티어 AI 개발을 실제로 제약하고 있음. 직접적인 모순: Liang은 또한 NVIDIA가 통제하기 어려운 CUDA 생태계를 구축함으로써 "자기 무덤을 파고 있다"고 말함. → AI Governance (source) (Hello China Tech) (Transformer News) (Geopolitechs — 64개 인용구)

  • 2026-07-16 (7월 중순 GA): DeepSeek V4가 공식적으로 프리뷰 (4월 24일 출시)에서 GA로 전환; 피크/오프피크 가격 체계 도입; 기존 deepseek-chat + deepseek-reasoner는 7월 24일 종료 (source)

전략적 위치

DeepSeek은 글로벌 AI 지도에서 "비용 효율적 오픈 가중치" 포지션을 점유. 중국 오픈 가중치 티어에서 Alibaba / Qwen AI Lab (Qwen 3.8, 2.4T), Moonshot AI (Kimi K3, 2.8T), Z.ai (GLM-5.2, 744B)와 경쟁하지만, 프런티어 수준 SWE-bench 점수 (80.6%, Gemini 3.1 Pro와 동점)를 발표한 유일한 랩.

Referenced by

Sources