$ cat wiki/models/embeddinggemma-2.md
EmbeddingGemma 2
나란히 보기
- Mistral Large 4
- Kolibri-1
- GPT-6.1 Sol
- Claude Sonnet 5.5
- MiMo-V2.6-Pro
- Grok 4.7
- Ternary Bonsai 2 27B
- Fugu Max
- Kimi K2.8 Preview
- DeepSeek V4.1-Flash
- K2 Horizon
- Muse Spark 1.3
- Hy4 preview
- GLM-5.3-Flash
- Granite 4.2
- Ling-3.0-tiny
- Laguna S 2.1
- Inkling
- LongCat-2.0
- MiniMax M3
- Gemini 4 Argon
- Claude Opus 5.5
- GPT-6 Luna
- GPT-6 Sol
- Gemini 3.8 Live
- Fugu Ultra v2
- GPT-Image-2.5 Flare
- GPT-Image-2.5 Sunburst
- Astra
- Gemini 3.8 Flash
- Claude Fable 5.1
- GLM-5.3
- Qwen 3.8 27B
- DeepSeek V4-Pro-0813
- Gemini 3.7 Flash
- Muse Glimmer
- Grok 4.6
- Muse Spark 1.2
- Qwen 3.8 Max
- DeepSeek V4-Flash
- Claude Opus 5
- Gemini 3.5 Flash-Lite
- Gemini 3.6 Flash
- DeepSeek V4
- Kimi K3
- GPT-5.6 Sol
- Grok 4.5
- Claude Sonnet 5
- GLM-5.2
- Claude Fable 5
- Claude Opus 4.8
- Grok Build
- Claude Opus 4.7
- Muse Spark
Google DeepMind가 2026-10-06에 출시한 온디바이스 멀티모달 임베딩 모델이다. 텍스트, 코드, 이미지, 오디오와 비디오를 하나의 공유 임베딩 공간에 매핑한다. (source)
스펙
| 속성 | 값 |
|---|---|
| Developer | Google DeepMind |
| Released | 2026-10-06 |
| Announced | 2026-10-06 |
| Context window | 8K 토큰 |
| Pricing | unknown |
| License | Apache 2.0 |
| Availability | Hugging Face와 Kaggle의 가중치; 로컬 추론 |
| 확인된 모든 사양은 Google의 발표문에 근거한다. 해당 발표문에는 호스팅 API 가격이 명시돼 있지 않다. (source) |
출시일
Google은 2026-10-06에 출시를 발표하고 다운로드 가능한 가중치로 연결했다. Model Garden 제공은 향후 예정으로 설명한다. 발표문은 아키텍처의 기반이 Gemma 4라고 명시한다. (source)
벤치마크
Google은 MTEB Code가 EmbeddingGemma의 68.76에서 78.68로 9.92점 개선됐다고 보고한다. 또한 sub-1B 멀티모달 임베딩 모델 중 선도적 성능을 주장하지만, 캡처한 글에는 오디오나 이미지의 수치 표가 없으므로 여기서는 그 점수를 주장하지 않는다. (source)
활용 사례
전체 740M 모델은 텍스트 매개변수 270M과 선택적으로 사용하는 비전 인코더 170M, 오디오 인코더 300M으로 구성된다. 출력 벡터는 768차원에서 512, 256 또는 128차원으로 축소할 수 있다. Google은 Pixel 11 Pro에서 양자화된 가중치 메모리가 텍스트용 약 191MB, 전체 모델 약 567MB라고 보고한다. 이는 특정 기기의 가중치 메모리 수치이며, 모든 애플리케이션에 적용되는 메모리 예산이 아니다. (source)
컨텍스트는 혼합 입력을 포함해 최대 5.5분의 오디오, 29개 이미지 또는 58개 비디오 프레임을 지원한다. 제안된 용도에는 비공개 로컬 검색, 의미 기반 미디어 검색과 라우팅이 포함된다. (source)
비교
이전 모델과의 비교는 과제별이다. MTEB Code와 컨텍스트 길이는 보고되지만, 글은 모든 모달리티에 걸친 단일 종합 개선 수치를 확정하지 않는다. 이 모델은 대화 응답이 아니라 임베딩을 생성한다. (source)