AI Trend Notifier
EN한
← wiki

$ cat wiki/models/gemini-3-5-flash-lite.md

Gemini 3.5 Flash-Lite

나란히 보기

스펙

AttributeValue
DeveloperGoogle DeepMind
Released2026-07-21
Announced2026-07-21
Context window1,048,576 토큰 (1M)
Pricing$0.30/M input · $2.50/M output
Licenseproprietary
AvailabilityGemini API, Google AI Studio, Vertex AI

벤치마크

BenchmarkGemini 3.5 Flash-LiteGemini 3.1 Flash-Lite (이전 세대)
Terminal-Bench 2.154%31%
GDM-MRCR v2 (롱컨텍스트)72.2%60.1%
GDPval-AA v21140642
AA Intelligence Index이전 세대 대비 +11점기준
과제당 소요 시간이전 세대의 약 절반기준
출력 속도350.2 t/sunknown

활용 사례

  • 고처리량·저지연 에이전틱 파이프라인 (에이전틱 검색, 문서 처리)
  • 하루 수백만 호출이 필요한 비용 민감 애플리케이션
  • 대규모 고속 분류·라우팅·요약

핵심 차별점

  • 가장 싼 프로덕션 Gemini 모델: 100만 토큰당 $0.30/$2.50
  • 속도: 350.2 t/s — 범주 중앙값(약 107 t/s)을 크게 웃돈다
  • 조절 가능한 thinking 수준: 빠른 추론과 깊은 추론 모드를 지원한다
  • Gemini 3.6 Flash 를 보완하는 고처리량 계층으로 자리한다

관련

상충 보고

  • 게시된 가격이 카탈로그의 1차 제공자 엔드포인트와 어긋나며, 이 페이지의 수치를 유지한다. spec-check 실행 90 (2026-09-12) 이 보고한 값은 입력 $0.3 대 $0.15; 출력 $2.5 대 $1.25, 둘 다 2.0×, 대상은 Google (1차) 다 (source).

    스펙 행은 바꾸지 않았다. CLAUDE.md 에 따라 벤더 발표를 인용한 페이지는 벤더의 수치를 유지하며, 위 셀은 이 페이지가 인용한 발표에 충실하다. 빠져 있던 것은 공개 였고, 스키마가 요구하는 것도 그것이며, 이 항목이 그 자리를 채운다.

    확인되지 않은 것: 어느 수치가 옳은지, 그리고 카탈로그의 가격이 무엇에 대한 가격 인지 — 체크의 출력에는 티어도, 컨텍스트 구간도, 모달리티도, 과금 단위도 나오지 않는다. 비율은 두 셀에서 동시에 정확한 작은 정수배이고, 상충하는 여덟 페이지 가운데 여섯이 그렇다. 이는 여섯 건의 독립적인 오류라기보다 티어나 단위의 불일치에 가까운 모양이며, 패턴으로 기록할 뿐 설명으로 채택하지 않는다 (source).

    2026-08-29 이후 모든 실행에서 빨간 Action 이 보고해 온 내용이고 — 25회 연속 — 2026-09-13 까지 어느 페이지에도 닿지 않았다. openrouter.ai 는 데일리 런의 샌드박스에서 차단돼 있어 여기서 카탈로그를 다시 읽어 판정할 수 없다. 이그레스가 되는 실행이 답할 문제다.

Referenced by

Sources