AI Trend Notifier
EN
← wiki

$ cat wiki/entities/zai.md

Z.ai

최신

  • 2026-08-20

    Jie Tang 이 사후 학습 스케일링 법칙을 명명하고 — "death of params" — GLM-5.3 을 실험으로 내놓는다

  • 2026-08-18

    Z.ai 에게도 자체 Project Glasswing 이 있고, 만듦새는 정반대다

  • 2026-08-14

    GLM-5.3 가 GLM Coding Plan 구독자에게 공개되고, 가중치는 보류됐다.

개요

Z.ai는 2019년 설립된 베이징 기반 AI 기업 Zhipu AI (智谱AI)의 국제 브랜드로, Tsinghua University에서 분사. Z.ai는 GLM (General Language Model) 시리즈를 운영하며, GLM-5.2 (2026년 6월)가 회사 최초의 프런티어급 오픈 가중치 모델. "중국의 오픈소스 프런티어 경쟁자"로 포지셔닝 — MIT 라이선스 하에 가중치를 공개 발행하면서 상업적 API도 운영.

모회사: Zhipu AI — 일부 국가 지원 (중국 국가 펀드 및 Alibaba 후원).

주요 인물

  • Zhipeng Jie — 최고경영자(CEO), Zhipu AI · Z.ai
  • 연구팀은 Tsinghua University의 KEG (Knowledge Engineering Group)에서 기원

모델과 제품

  • GLM-5.3 — 2026-08-14 GLM Coding Plan 구독자에게 공개. 같은 744B 베이스를 사후 학습만 더 한 모델이며, 가중치는 안전성 평가를 조건으로 약 2주간 보류
  • GLM-5.2 — 2026-06-16 공개, 744B MoE (40B 활성), MIT 라이선스, 1M 컨텍스트, Code Arena #2; ⚡ 늦은 수집 (+27일)
  • GLM Coding Plan — 최신 GLM 모델 접근 구독 상품
  • Z.ai API — GLM 모델용 독립형 API (중국 기반 인프라를 통해 라우팅)
  • NVIDIA NIM 호스팅 버전 — NVIDIA의 추론 마이크로서비스 플랫폼에서 GLM-5.2 이용 가능

최근 활동

  • 2026-08-20: Jie Tang 이 사후 학습 스케일링 법칙을 명명하고 — "death of params" — GLM-5.3 을 실험으로 내놓는다 — Z.ai 의 CEO 는 파라미터 수가 데이터, 컴퓨트를 어디에 쓸지, 누가 어떤 조건에서 모델을 돌릴지와 함께여야만 의미를 갖는다고 주장하며, MoE 희소성을 위한 새 "XA-YB" 표기 를 포함한 다섯 개의 스케일링 knob 을 든다고 보도된다. 무게를 지는 구분: 암기는 더 많은 파라미터를 선호하고, 추론은 더 많은 사후 학습 데이터와 유효 깊이를 선호하며, 고급 스킬 — 제시된 예는 소프트웨어 취약점 발견 — 은 지식 보유 임계를 넘고 나면 총 파라미터 수에 있지 않다. GLM-5.3 이 증거다: GLM-5.2 의 베이스는 손대지 않았고, 모든 이득이 장기 지평 환경에서의 RL 에서 나온다. 보도된 수치, GLM-5.2 → GLM-5.3: Terminal-Bench 3.0 4.6 → 28.3, DeepSWE 46.2 → 66.9, AutomationBench 26.2 → 48.2. 왜 중요한가: 이 위키의 Weekly Synthesis — W33 (2026-08-10 → 2026-08-16) 종합은 릴리스 노트 네 건에서 "역량이 가중치로 도착하기를 그만두었다" 를 읽어냈다. 모델을 출하하는 쪽이 이를 메커니즘을 갖춘 법칙 으로 단언한 것은 처음이고, Open-Weights Policy Fight 의 전제를 거스른다 — 베이스가 값싼 절반이라면 가중치 공개는 보이는 것보다 적게 전달한다. Terminal-Bench 와 DeepSWE 수치는 독립적인 2026-08-14 포착과 일치하며 이는 출처를 뒷받침한다. GLM-5.2 기준선은 새로운 것이다. 전부 하네스가 공개되지 않은 벤더 서술 이고, 논문이나 발표 전사가 아니라 뉴스레터 다이제스트를 통해 도착했다. → Post-Training Scaling, GLM-5.3 (source) (Latent Space)

  • 2026-08-18: Z.ai 에게도 자체 Project Glasswing 이 있고, 만듦새는 정반대다GLM-5.3 과 함께 Z.ai 가 "Shield of Open Source" 를 발표했다: 사용자가 취약점을 패치하도록 돕는 무료 보안 감사, ZCode 플랫폼을 통한 자동 코드 감사 도구, 오픈소스 커뮤니티를 위한 무료 모델 사용 쿼터, 그리고 모델의 가장 민감한 공격적 역량을 검증된 사용자에게만 남겨 두는 제한 계층 "Cybersecurity Trusted Access". SCMP 는 한 연구자를 인용해 이를 "중국식 Project Glasswing" 이라 부르며 개방성을 결점이 아니라 자산으로 다루는 접근으로 설명한다. 의의: Anthropic 의 Glasswing 은 비공개 모델을 약 100–150개 검증 조직에 게이팅한다. Z.ai 는 가중치를 공개하면서 공격적 역량을 게이팅하겠다고 제안하는데, 가중치가 풀린 뒤에는 둘이 양립한다고 보기 어렵다. 누구나 내려받을 수 있는 모델에 검증 접근 계층을 어떻게 강제하는지, GLM-5.3 의 보류 중인 가중치 — 안전성 평가를 거쳐 2026-08-28 무렵 단계적으로 공개 예정 — 가 이 프로그램 아래 나오는지 아니면 이 프로그램에 묶여 있는지, 읽은 자료 어디에도 설명이 없다. → AI-Enabled Cyberattacks, Open-Weights Policy Fight (source) (SCMP) (The Register)

  • 2026-08-14: GLM-5.3 가 GLM Coding Plan 구독자에게 공개되고, 가중치는 보류됐다. Z.ai 는 이 모델이 GLM-5.2 의 베이스를 그대로 재사용하며 모든 향상이 사후 학습만으로 나왔다고 밝혔다. 오픈 웨이트와 API 접근은 안전성 평가를 거친 뒤 단계적으로, 약 2주 뒤로 예고됐다. 벤더 발표: Terminal-Bench 3.0 4.6 → 28.3, DeepSWE v1.1 66.9, Agents' Last Exam CLI 28.5 (GPT-5.6 Sol 의 28.6 대비), CyberGym 84.5%, 그리고 내부 코딩 역량 약 50% 향상. 토큰 단가는 공개되지 않았다 — Z.ai 의 API 표에는 아직 GLM-5.3 항목이 없다 (source)

  • 2026-08-02 → 현재: GLM-5.5 는 확인되지 않은 소문으로 남아 있다 — JPMorgan 노트, 창업자의 "epic plus" 발언, 1T 이상 파라미터라는 소문뿐이고 모델 카드도 벤치마크도 엔드포인트도 없다. GLM-5.3 은 그 모델이 아니며 읽은 자료 어디에도 둘을 잇는 것이 없다 (source)

  • 2026-06-13 / 2026-06-16 (⚡ 늦은 수집 +27일): GLM-5.2 공개 — GLM Coding Plan 구독자 먼저 (6월 13일), 이후 오픈 가중치 + 독립형 API (6월 16일). 지역 제한 없는 MIT 라이선스 가중치. 전체 사양은 GLM-5.2 참조. (source) (VentureBeat)

전략적 위치

  • 틈새: 코딩 및 에이전트 작업을 위한 오픈 가중치 프런티어 모델 — 가격 대비 성능으로 명시적으로 Anthropic, OpenAI의 폐쇄 가중치 모델과 경쟁
  • 차별화: "지역 제한 없음" 조항의 MIT 라이선스로 GLM-5.2는 진정한 제한 없는 오픈소스 라이선스 하에서 가장 높은 성능의 모델 (2026년 6월 기준). 비교: Llama 4 (Meta 커스텀 라이선스, 7억 사용자 이상 제한), Mistral Large 3 (Apache 2.0, 675B vs GLM-5.2의 744B)
  • 데이터 위험: Z.ai API는 중국 인프라를 통해 라우팅 — 민감한 분야의 기업 및 정부 사용자는 관리형 API 대신 셀프 호스팅 오픈 가중치 사용 권장
  • 중미 역학: Z.ai는 중국산 AI 모델이 감시를 받는 지정학적 맥락에서 운영되는 중국 기업; GLM-5.2의 MIT 라이선스는 전 세계 채택 장벽을 낮추기 위한 의도적 포지셔닝 선택
  • 경쟁적 벤치마크: GLM-5.2는 Code Arena #2에 오른 첫 번째 오픈 가중치 모델 — Opus 4.8 바로 뒤, 다른 모든 오픈 가중치 모델 앞
  • 2026-08-14 에 출시 방식이 바뀌었다. GLM-5.2 는 구독자 접근과 오픈 웨이트 사이가 사흘이었다. GLM-5.3 은 그 둘을 예고된 2주 떼어 놓고 뒤쪽에 안전성 평가라는 조건을 붙였다 — 그러면서도 릴리스는 여전히 "가장 강력한 오픈 웨이트 코딩 모델"로 홍보된다 (source). 가중치가 그 일정대로 나오는지가 지켜볼 지점이다. 헤드라인의 주장은 현재 누구도 내려받을 수 있는 산출물로 뒷받침되지 않는다. Open-Weights Policy Fight 참조
  • 릴리스 둘, 베이스 하나. GLM-5.3 은 GLM-5.2 의 베이스를 사후 학습만 더 한 것이고, 이는 이 위키가 여드레 앞서 Gemini 3.7 Flash 에 대해 기록한 것과 같은 자리에 Z.ai 를 놓는다. 사후 학습을 번호가 붙은 모델로 출하하는 것이다. Frontier Pacing 참조

관련

  • GLM-5.3 — 현재 플래그십, 가중치 대기 중
  • GLM-5.2 — 두 릴리스가 공유하는 베이스
  • Alibaba / Qwen AI Lab — Qwen 시리즈 (별도 중국 오픈소스 경쟁자); Alibaba가 간접 후원
  • Mistral AI — 유럽 오픈 가중치 경쟁자; Mistral Large 3가 가장 근접한 직접 오픈 가중치 경쟁자

상충 보고

현재 기록된 내용 없음.

Referenced by

Sources