$ cat wiki/models/gemini-3-5-flash.md
Gemini 3.5 Flash
나란히 보기
스펙
| Attribute | Value |
|---|---|
| Developer | Google DeepMind |
| Released | 2026-05-19 (Google I/O 2026 에서 GA) |
| Announced | 2026-05-19 (Google I/O 2026) |
| Context window | 입력 1,048,576 / 출력 65,536 토큰 |
| Pricing | 1M 토큰당 입력 $1.50 · 출력 $9.00 ($0.15 캐시) |
| License | proprietary (API 전용, 가중치 미공개) |
| Availability | Gemini API, Google AI Studio, Google Antigravity, Gemini 앱, Google 검색의 AI Mode |
| Family | Gemini 3.5 |
| Modalities | 텍스트 + 이미지 + 오디오 + 비디오 → 텍스트 |
| Thinking | 동적 사고 (기본 활성) |
| Knowledge cutoff | 2026년 1월 |
| Speed | 다른 프런티어 모델보다 4배 빠름 (초당 출력 토큰 기준) |
벤치마크
| Benchmark | Score | Context |
|---|---|---|
| Terminal-Bench 2.1 | 76.2% | 에이전틱 코딩 |
| MCP Atlas | 83.6% | MCP·도구 사용 |
| CharXiv Reasoning | 84.2% | 차트 추론 |
| GPQA Diamond | 90.4% | 박사급 과학 |
| MMMU-Pro | 81.2% | 멀티모달 이해 |
| 코딩·에이전틱 벤치마크 전 영역에서 Gemini 3.1 Pro 를 앞선다. |
활용 사례
핵심 포지셔닝: Flash 급 속도와 비용으로 수행하는 에이전틱·코딩 과제. "Flash 계열이 내놓은 가장 강력한 에이전틱·코딩 모델"이다.
- 다단계 에이전트 워크플로 (MCP Atlas 83.6%)
- 과학적 추론 (GPQA Diamond 90.4%)
- 코딩 과제 (Terminal-Bench 76.2%)
- 멀티모달 분석
가용성
Gemini API, Google AI Studio, Google Antigravity, Gemini 앱, Google 검색의 AI Mode.
비교
- Gemini 3.1 Pro: Gemini 3.5 Flash 가 더 낮은 비용과 4배 속도로 코딩·에이전틱·멀티모달 벤치마크에서 앞선다
- GPT-5.5 Instant: 둘 다 빠르고 비용 효율적인 프런티어 계층을 겨냥한다. Gemini 3.5 Flash 는 MCP Atlas 벤치마크를 명시하지만 GPT-5.5 Instant 는 에이전틱 벤치마크를 공개하지 않았다
- Claude Opus 4.7: Anthropic 플래그십 대 Google 의 Flash 계층 — 가격·성능 절충이 다르다
- Devstral 2: 공개 가중치 코딩 전문 모델(SWE-bench 72.2%) 대 Gemini 3.5 Flash 의 더 넓은 멀티모달·에이전틱 범위
상충 보고
-
게시된 가격이 카탈로그의 1차 제공자 엔드포인트와 어긋나며, 이 페이지의 수치를 유지한다.
spec-check실행 90 (2026-09-12) 이 보고한 값은 입력 $1.5 대 $0.75; 출력 $9 대 $4.50, 둘 다 2.0×, 대상은 Google (1차) 다 (source).스펙 행은 바꾸지 않았다.
CLAUDE.md에 따라 벤더 발표를 인용한 페이지는 벤더의 수치를 유지하며, 위 셀은 이 페이지가 인용한 발표에 충실하다. 빠져 있던 것은 공개 였고, 스키마가 요구하는 것도 그것이며, 이 항목이 그 자리를 채운다.확인되지 않은 것: 어느 수치가 옳은지, 그리고 카탈로그의 가격이 무엇에 대한 가격 인지 — 체크의 출력에는 티어도, 컨텍스트 구간도, 모달리티도, 과금 단위도 나오지 않는다. 비율은 두 셀에서 동시에 정확한 작은 정수배이고, 상충하는 여덟 페이지 가운데 여섯이 그렇다. 이는 여섯 건의 독립적인 오류라기보다 티어나 단위의 불일치에 가까운 모양이며, 패턴으로 기록할 뿐 설명으로 채택하지 않는다 (source).
2026-08-29 이후 모든 실행에서 빨간 Action 이 보고해 온 내용이고 — 25회 연속 — 2026-09-13 까지 어느 페이지에도 닿지 않았다.
openrouter.ai는 데일리 런의 샌드박스에서 차단돼 있어 여기서 카탈로그를 다시 읽어 판정할 수 없다. 이그레스가 되는 실행이 답할 문제다.
소스
- Google Blog launch
- llm-stats.com benchmarks
- Google I/O 2026 에서 발표 (2026-05-19) — Google DeepMind 참조
- Google — Gemini API pricing — 사양 수치 2026-07-27 확인