Gemini 3.7 Flash의 기술 사양
| 항목 | Gemini 3.7 Flash |
|---|---|
| 모델 ID | gemini-3.7-flash |
| 제공사 | |
| 컨텍스트 | 1,048,576 토큰 |
| 최대 출력 | 65,536 토큰 |
| 입력 | 텍스트 / 이미지 / 비디오 / 오디오 / PDF |
| 추론 | 낮음 / 보통 / 높음 |
| 함수 호출 | ✅ |
| 코드 실행 | ✅ |
| 검색 그라운딩 | ✅ |
| Google Maps 그라운딩 | ✅ |
| URL 컨텍스트 | ✅ |
| 파일 검색 | ✅ |
| 컴퓨터 사용 | 미리보기 |
| 지식 컷오프 | 2026년 3월 |
| 릴리스 | 2026년 8월 13일 |
Gemini 3.7 Flash란?
Gemini 3.7 Flash는 Google이 2026년 8월 13일에 공개한 Gemini 3 Flash 라인의 최신 버전입니다. Google은 이를 코딩과 AI 에이전트를 위한 가장 지능적인 Flash 주력 모델로 포지셔닝하며, 소프트웨어 엔지니어링, 웹 개발, 복잡한 지식 작업, 다단계 워크플로에 초점을 맞춘 개선을 제공한다고 설명합니다. Gemini 3.6 Flash 이후 3주 만에 출시되었으며, 개발자 피드백과 알고리즘 혁신의 결과로 소개됩니다.
주요 기능
- 1M-토큰 컨텍스트: 대규모 저장소, 장문서, 확장된 대화, 다단계 에이전트 기록을 지원합니다.
- 멀티모달 추론: 텍스트, 이미지, 비디오, 오디오, PDF 입력을 수용합니다.
- 구성 가능한 추론: 낮음, 보통, 높음 추론을 지원하며,
MINIMAL은 지원되지 않습니다. - 에이전트형 코딩: 디버깅, 이슈 해결, 1차 코드 정확도, 장기적 소프트웨어 엔지니어링에서 큰 향상을 제공합니다.
- 웹 및 UI 개발: 스크린샷, 이미지, 디자인 시스템에 대한 준수성이 강화되었습니다.
- 도구 기반 워크플로: 함수 호출, 코드 실행, 검색 그라운딩, Google Maps 그라운딩, URL 컨텍스트, 파일 검색, 컴퓨터 사용 미리보기.
- 문서 중심 지식 작업: 금융, 법률, 생명과학, PDF 이해, 엔터프라이즈 자동화에서 성능이 향상되었습니다.
벤치마크 성능
| 벤치마크 | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 56 | 52 | 55 | 57 |
| FrontierCode 1.1 Main | 43.6% | 34.4% | 42.7% | 41.3% |
| DeepSWE v1.1 | 65.3% | 49.0% | — | — |
| GDM-MRCR v2 (8-needle, 128K) | 97.0% | 91.8% | 81.5% | 93.5% |
| OSWorld-2.0 | 47.9% | 33.8% | — | 50.2% |
| Agent's Last Exam | 26.3% | 24.2% | 33.3% | 28.0% |
| HLE-Verified | 53.6% | 51.2% | 31.0% | 51.1% |
| LABBench2 | 82.1% | 76.1% | 80.1% | 81.2% |
Google는 또한 GDP.pdf에서 34.0% 대 22.0%, AutomationBench에서 30.4% 대 17.0%, WebDev Arena Elo에서 1588 대 1538(대상: Gemini 3.6 Flash)을 보고합니다.
Gemini 3.7 Flash vs Gemini 3.6 Flash vs Claude Sonnet 5
| 모델 | 포지셔닝 | 컨텍스트 | 주요 강점 |
|---|---|---|---|
| Gemini 3.7 Flash | 효율적인 에이전트형 주력 모델 | 1.05M | 코딩, 웹 개발, 멀티모달 에이전트, 장문맥 워크플로우 |
| Gemini 3.6 Flash | 이전 Flash 주력 모델 | 1M | 범용 에이전트 및 멀티모달 워크로드 |
| Claude Sonnet 5 | 상위급 추론/코딩 | 가변 | 코딩, 지식 작업, 추론 |
Gemini 3.7 Flash는 애플리케이션이 최전선 능력, 멀티모달 처리, 긴 컨텍스트, 도구 사용, 추론 경제성 간의 균형을 필요로 할 때 특히 매력적입니다.
제약 사항
MINIMAL추론은 사용할 수 없습니다.- 이미지 생성은 지원되지 않으며, 출력은 텍스트입니다.
- Gemini Live API는 지원되지 않습니다.
- 지식 컷오프는 2026년 3월입니다.
- Google은 환각 가능성, 간헐적 속도 저하, 타임아웃 문제를 언급합니다.
- 컴퓨터 사용은 현재 미리보기 기능입니다.
사용 사례
- 코딩 에이전트 및 저장소 규모의 소프트웨어 엔지니어링
- 스크린샷, 이미지, 디자인 시스템 기반의 웹 개발
- 엔터프라이즈 문서 및 지식 에이전트
- 멀티모달 워크플로 자동화
- 검색, 코드 실행, 함수 호출을 활용하는 도구 사용 에이전트
- 대규모 코드베이스와 문서 컬렉션의 장문맥 분석
- 구조화된 엔터프라이즈 자동화