AI Trend Notifier
EN한
← wiki

$ cat wiki/models/mistral-large-4.md

Mistral Large 4

model갱신 2026-10-07생성 2026-10-07

나란히 보기

2026-10-06에 발표된 Mistral의 멀티모달 API 미리보기다. 발표문은 10월 말까지 가중치를 공개하겠다고 약속하며, 지금 가중치를 이용할 수 있다고 확정하지는 않는다. (source)

스펙

속성값
DeveloperMistral AI
Released2026-10-06 (API 공개 미리보기)
Announced2026-10-06
Context window1M
Pricing$1.36/M 입력 · $4.18/M 출력 (발표문)
Licenseunknown
AvailabilityMistral Studio API 미리보기; 2026년 10월 말까지 가중치 공개 예정
출시, 가격과 이용 가능 여부는 발표문을 따르며, 컨텍스트는 mistral-large-4를 명시한 모델 문서를 따른다. 읽은 출처에는 가중치 라이선스 이름이 없다. (announcement) (documentation)

출시일

API 미리보기는 2026-10-06에 출시됐다. Mistral은 검증된 협력사 및 정부 기관과의 레드팀 검증을 가중치 공개에 앞서 수행한다고 밝힌다. 향후 가중치 공개는 약속이며, 이미 완료된 공개가 아니다. (source)

벤치마크

Mistral은 DeepSWE v1.1 61.7%, SWE-Atlas-QnA 59.4%, Terminal-Bench 4 28.3%, 그리고 657개 업무 흐름에 걸친 AutomationBench **59.9%**를 보고한다. 이는 공급업체 발표문의 수치이며, 독립적으로 재현한 평가가 아니다. (source)

사이버 비교에는 작업을 거부하는 모델이 포함된다. 해석: 접근 정책이 순위에 영향을 줄 수 있으므로, 이 수치를 동일한 안전장치 아래 측정한 역량으로 읽어서는 안 된다. (source)

활용 사례

발표문은 코딩 에이전트, 멀티모달 문서 작업과 기업 보안을 대상으로 한다. 채팅, 과학 과제와 장기 도구 사용에 걸쳐 공유되는 RL 환경 및 검증 구성요소를 설명한다. (source)

비교

Mistral이 Surge AI와 수행한 블라인드 코딩 평가에서 ML4 Preview는 1–5 척도로 3.74를 받았으며, Claude Opus 5는 4.22, GLM-5.3는 3.60이었다. 이는 별도의 인간 평가이며 코딩 벤치마크 종합 점수가 아니다. (source)

상충 보고

발표문은 전체 매개변수를 1 trillion, 활성 매개변수를 49 billion으로 설명하지만, 모델 문서는 전체 1.05T, 활성 52B와 1.6B 비전 인코더를 명시한다. 읽은 두 출처 모두 이 차이를 설명하지 않는다. 어느 매개변수 수치를 선택하지 않고 두 설명을 모두 보존한다. (announcement) (documentation)

문서에는 입력/출력 가격으로 $1.36/$4.18과 $0.68/$2.09가 모두 표시되고, 캐시 입력 가격 $0.14/$0.07도 나온다. 그러나 캡처한 텍스트에는 요금 방식을 명확히 구분하는 표기가 없다. 따라서 스펙 표의 가격은 발표문에 근거한다고 명시하며, 더 낮은 가격 쌍을 가격 인하로 채택하지 않는다. (documentation)

Referenced by

Sources