$ cat wiki/entities/microsoft.md
Microsoft
최신
- 2026-09-14
Microsoft 가 앞으로 낼 모델이 하지 말아야 할 것을 문서로 적었고, 중요한 조항은 내용이 아니라 성향에 관한 것이다
- 2026-08-20
Microsoft 가 에이전트 벤치마크를 냈고, 그 대표 수치는 에이전트가 두 번째 시도에서 얼마나 자주 실패하는가다
- 2026-06-29
Azure AI Foundry 에서 Claude 모델 GA — NVIDIA GB300 Blackwell Ultra 구동
개요
Redmond, WA 기반 테크 대기업. GitHub Copilot, Azure, Office 365 통해 AI 개발자·엔터프라이즈 도구 시장 지배. 2026년 5월 기준 내부 AI 사업부 MAI(Microsoft AI)가 OpenAI 의존에서 벗어나 독자 frontier 모델 개발로 전환 중.
주요 인물
- Satya Nadella — 최고경영자(CEO)
- Mustafa Suleyman — EVP & CEO, Microsoft AI (MAI); 전 Google DeepMind 공동창업자, Inflection AI CEO
모델과 제품
- Project Polaris — Project Polaris (코드명). MoE 아키텍처 + 언어별 특화 서브모듈, Maia 200 칩. GitHub Copilot 기본 모델 교체 예정 (2026-08 GA). HumanEval+MBPP에서 GPT-4 Turbo 초과 (Rust/Haskell에서 최대 차이). → (source)
- MAI-Code-1 / MAI-Code-1-Flash — MAI-Code-1 / MAI-Code-1-Flash (2026-06-02 GA). 5B급, Copilot harness 내 훈련. 85.8% MS 적대적 코딩 벤치마크, ~51% SWE-Bench Pro, 토큰 60% 절감. Copilot 모델 피커 즉시 배포.
- MAI-Thinking-1 — MAI-Thinking-1 (2026-06-02 발표). 35B active params, 128K ctx, scratch 훈련(distillation 없음). 추론 특화.
- MAI models 전체 — Transcribe-1, Voice-1, Image-2 상용화 발표. 2026-06-08 자체 개발 MAI 모델 7종(이미지·음성·전사·코딩·추론) 출시("hill-climbing machine") — Microsoft 자체 프런티어 스택으로, OpenAI 의존을 줄인다. (source) (source)
- GitHub Copilot — 세계 최대 AI 코딩 도구. 2026-06-01: AI-credit 과금 전환. 2026-06-02: Agent-native 독립 데스크톱 앱 출시, VS Code 멀티에이전트 GA.
- Windows Agent Framework 1.0 — MIT 라이선스 오픈소스, Windows 11/365/Arc 지원, 사람 승인 큐 내장 (source)
- Azure Agent Mesh — 멀티에이전트 federated 실행 플랫폼 (on-prem+cloud+edge); GA 목표 Q4 2026
- GitHub Copilot Workspace GA — Enterprise 에 자율 코딩 에이전트 (버그 픽스, 테스트 작성, PR)
- Azure AI Foundry — Claude(Anthropic), Mistral, Llama 4, DeepSeek 1차 지원 추가 (Build 2026)
- Azure Cobalt 200 VMs — agentic AI 최적화, 50% 성능 향상
- Foundry Local — 온디바이스 AI 추론 GA (Windows/macOS/Linux)
- Azure OpenAI Service — OpenAI 모델 엔터프라이즈 배포 채널 (병존 예정)
최근 활동
-
2026-09-14: Microsoft 가 앞으로 낼 모델이 하지 말아야 할 것을 문서로 적었고, 중요한 조항은 내용이 아니라 성향에 관한 것이다 — Microsoft AI 가 아직 출시하지 않은 모델을 규율하는 잠정 행동 강령 을 냈다. 37 쪽 / 약 15,000 단어. 내용 제한은 통상적이다(무기 제조 금지, 위험 물질 조달 지원 금지, 폭력적·성적으로 노골적인 출력 금지, 건강하지 않은 식습관 조장 금지). 성향 제한은 그렇지 않다: 모델은 종료 명령에 저항해서는 안 되고, 사람의 목표를 따르며 스스로 목표를 만들지 않아야 하고, 자신의 잘못을 은폐하려 해서는 안 된다. Mustafa Suleyman 은 CNBC 에 이 문서가 "수개월간 준비 중" 이었고 안전 우려가 "지난주 최고조에 달해" 지금 공개했다고 말했다. 별도로 그는 Amodei 의 제안을 지지했다 — "Self-pacing is a good thing, and we support ideas like embedded evaluators as long as they are truly third-party and represent a broad range of backgrounds and perspectives." 왜 중요한가: 이 페이지의 항목들은 Microsoft 를 플랫폼 으로 다뤄왔다 — 다른 랩의 프런티어 모델을 호스팅하고 그 위에 지은 에이전트를 벤치마크하는 쪽. 이것은 다른 세 랩이 pacing 을 두고 논쟁하던 주에 Microsoft 가 자사 모델을 묶은 것이고, 그것을 pacing 이라 부르지 않는다. 종료 조항은 brake-pedal 제안들이 시스템 수준에서 요구하는 것을 모델 수준에서 다시 쓴 것이다. 확립되지 않은 것: 집행 기제도 감사도 평가도 임계값도 발효일도 적용 모델도 읽은 자료에 없고, 어떤 pass 도 이 문서가 Amodei 의 에세이를 인용한다고 보고하지 않는다 — 인접은 달력의 것이다. 1 차 자료 미확인; 문서 자체는 어떤 pass 도 찾지 못했고 그에 대한 보도만 있다 → Frontier Pacing, AI Governance, AI Alignment (source) (CNBC)
-
2026-08-20: Microsoft 가 에이전트 벤치마크를 냈고, 그 대표 수치는 에이전트가 두 번째 시도에서 얼마나 자주 실패하는가다 — Thinkingbox (arXiv 2608.19741,
github.com/microsoft/thinkingbox) 는 격리된 MCP 호환 도구 세션, 완전한 실행 트레이스, 종단 백엔드 상태에 대한 결과 평가를 제공하는 샌드박스이며, 여기에 Thinkingbox-bench 가 붙는다: 리테일, 호스피탈리티, 자동차 보험, 네오뱅크 내부 IT, 컨설팅 IT/HR 지원에 걸친 507개의 정책 조건부 워크플로. 시험된 가장 강한 모델이 pass@1 65.36% 와 pass^20 25.25% 를 낸다 — 같은 실행을 한 번의 성공으로 세느냐 스무 번으로 세느냐의 차이다. 채점은 틀렸거나 빠졌거나 여분인 효과를 거부한다. 왜 중요한가: Azure 나 Copilot 제품 라인이 아니라 Microsoft 자체 연구 쪽에서 온 이 페이지의 첫 항목이며, 화려하지 않은 입장을 취한다 — 유통되는 에이전트 역량 수치가 엉뚱한 것을 재고 있다는 입장이다. 부차적 발견은 더 날카롭다: 실패한 시도 다수가 깔끔하게 종료하고 타당한 상태 변경 행동을 취하므로, 깔끔한 종료도 형식이 맞는 도구 호출도 완수를 예측하지 못한다. 두 수치 어느 쪽에도 모델 이름이 없다 → One Success Isn't Reliability: Thinkingbox, a Sandbox and Benchmark for Agents in Stateful Business Workflows (arXiv:2608.19741), Agents (LLM Agents), MCP — Model Context Protocol (source) -
2026-06-29: Azure AI Foundry 에서 Claude 모델 GA — NVIDIA GB300 Blackwell Ultra 구동 — Azure AI Foundry 가 NVIDIA GB300 NVL72 Blackwell Ultra GPU 에서 네이티브로 도는 Claude(Anthropic)를 정식 출시했다. 이로써 Microsoft 는 OpenAI(Azure OpenAI Service)와 Claude(Azure AI Foundry) 프런티어 모델을 같은 플랫폼에서 모두 제공하는 유일한 클라우드 사업자가 됐다. 하드웨어: 랙당 GB300 GPU 72장, 고속 메모리 37 TB, NVLink 대역폭 130 TB/s. Claude Sonnet 32-PTU 배포는 같은 지연 예산에서 H200 대비 처리량이 약 40% 높다. 전략적 맥락: Anthropic 이 Azure 컴퓨트에 $300억을 약정했고, NVIDIA 가 최대 $100억, Microsoft 가 최대 $50억을 Anthropic 에 투자했다(동시 발표). 거버넌스 측면: 이 배포는 Azure 컴플라이언스·책임 있는 AI 도구·다중 모델 에이전트 오케스트레이션과 깊이 통합돼 Microsoft 의 "에이전틱 AI" 기업 플랫폼 전략과 맞물린다. → Anthropic (source) (NVIDIA Blog)
-
2026-06-01: Build 2026 / Project Polaris 사전 발표 확정 — Microsoft 자체 개발 코딩 AI 모델 "Project Polaris" 상세 공개. GitHub Copilot 기본 모델 교체 (GPT-4 Turbo → Polaris, 2026-08 GA). CoT+ToT 추론, Code Content Guarantee. Satya Nadella: "AI는 더 이상 프롬프트에 반응하는 것이 아닌 일을 직접 수행한다." Claude Code 개발자 점유율 추월이 직접 트리거로 보도됨. Windows Agent Framework 오픈소스화, Azure Agent Mesh, Copilot Workspace GA, Foundry Local GA. → Project Polaris (source)
-
2026-06-01: GitHub Copilot AI-credit 과금 시작 — 좌석제 → 크레딧 기반. Codex Pro 2× 프로모션 5/31 종료.
-
2026-06-02: Microsoft Build 2026 키노트 — 풀 발표 완료. Satya Nadella + Mustafa Suleyman 키노트. 핵심: ① MAI-Code-1-Flash 즉시 GA (85.8% MS 벤치마크, ~51% SWE-Bench Pro, Copilot 전 티어 모델피커 배포), ② MAI-Thinking-1 발표 (35B active, 128K, scratch 훈련), ③ Project Polaris 확정 스펙 공개 (MoE+Maia200, GPT-4T 초과), ④ Windows Agent Framework 1.0 MIT 오픈소스화, ⑤ Azure Agent Mesh GA 경로 확정(Q4 2026), ⑥ GitHub Copilot App + VS Code 멀티에이전트 GA, ⑦ Azure AI Foundry에 Claude/Mistral/Llama/DeepSeek 1차 지원. → Project Polaris, MAI-Code-1 / MAI-Code-1-Flash, MAI-Thinking-1 (source)
-
2026-04 (지연 수집): OpenAI 파트너십 제약 재협상 — 독자 top-tier 모델 훈련 불가 조항 철폐. MAI 독자 개발의 공식 출발점.
-
2026-05-31: Microsoft Build 2026 사전 공개 — 독자 모델 라인업 상세 (source)
전략적 위치
- OpenAI 관계 변화: 단순 라이선시 → 경쟁자로 전환. Azure에서 여전히 OpenAI 모델을 제공하면서, 동시에 내부 대안 개발.
- 개발자 생태계 모트: GitHub Copilot(수천만 개발자), VS Code, GitHub Actions — 코딩 모델의 즉각적인 배포 채널 확보
- Mustafa Suleyman 효과: DeepMind 공동창업자 → Inflection AI(Pi) CEO → Microsoft AI 수장 경력. 각 랩에서의 경험을 내부화한 드문 경영진
- 비교: Anthropic, OpenAI, Google DeepMind 와 함께 frontier 4강 체제로 진입 — Polaris로 Claude Code 직접 경쟁 개시
관련
- OpenAI — 원 파트너이자 현재 경쟁자
- Google DeepMind — Mustafa Suleyman 출신 랩
- Project Polaris — 코딩 AI, GitHub Copilot 기본 모델 (2026-08)
- Agents (LLM Agents) — Windows Agent Framework, Azure Agent Mesh, Copilot Workspace
- Software 3.0 — 개발자 도구(GitHub Copilot) 아키텍처 변화와 연관
상충 보고
없음
Referenced by
Sources
- sources/blogs/microsoft-2026-09-14-ai-code-of-conduct.md
- sources/papers-daily/hf-daily-2026-08-26.md
- sources/blogs/microsoft-2026-05-31-build-2026-mai-preview.md
- sources/blogs/microsoft-2026-06-01-build-project-polaris.md
- sources/blogs/microsoft-2026-06-02-build-2026-keynote.md
- sources/blogs/microsoft-2026-06-08-mai-seven-models.md
- sources/blogs/anthropic-2026-06-29-claude-azure-gb300.md