Gemini 3.6 Flash의 기술 사양
| 항목 | Gemini 3.6 Flash |
|---|---|
| 제공자 | Google DeepMind |
| 모델 ID | gemini-3.6-flash |
| 모델 계열 | Gemini 3.x |
| 출시 상태 | 일반 제공(GA) |
| 입력 유형 | 텍스트, 이미지, 비디오, 오디오, PDF |
| 출력 유형 | 텍스트 |
| 컨텍스트 윈도우 | 1,048,576 토큰 |
| 최대 출력 | 65,536 토큰 |
| Thinking | 지원됨(중/높음) |
| 함수 호출 | 예 |
| 코드 실행 | 예 |
| 파일 검색 | 예 |
| URL 컨텍스트 | 예 |
| 검색 그라운딩 | 예 |
| 컴퓨터 사용 | 프리뷰 |
| 구조화된 출력 | 예 |
| 캐싱 | 지원됨 |
출처: Google Gemini API 문서.
Gemini 3.6 Flash란?
Gemini 3.6 Flash는 Google의 최신 프로덕션 준비 완료 Flash 모델로, Flash 시리즈가 지닌 낮은 지연 시간과 비용 효율성을 유지하면서 최전선 수준의 지능을 제공하도록 설계되었습니다. 코딩, 멀티모달 이해, 추론, 에이전트형 워크플로에 최적화되어 있습니다.
Gemini 3.5 Flash와 비교하면, 이 모델은 방대한 1 million-토큰 컨텍스트 윈도우를 지원하면서 코드 생성 품질, 추론 정확도, 도구 사용, 토큰 효율성을 개선했습니다. Google은 이를 AI 에이전트와 복잡한 자동화 시스템을 구축하는 개발자를 위한 기본 주력 모델로 포지셔닝하고 있습니다.
Gemini 3.6 Flash의 주요 기능
- 1M-토큰 긴 컨텍스트 처리를 지원합니다.
- 텍스트, 이미지, 비디오, 오디오, PDF 문서를 포함한 네이티브 멀티모달 입력.
- 코드 생성 및 소프트웨어 엔지니어링 작업에서 큰 향상.
- 함수 호출, 파일 검색, URL 컨텍스트, 검색 그라운딩, 컴퓨터 사용에 대한 기본 내장 지원.
- Gemini 3.5 Flash보다 더 높은 토큰 효율성으로, 품질을 유지하면서 추론 비용을 절감.
- 다단계 AI 에이전트와 자율 워크플로를 위해 설계됨.
벤치마크 성능
Google은 Gemini 3.6 Flash가 Gemini 3.5 Flash보다 코딩, 추論, 멀티모달 성능이 강력하며, 출력 토큰을 상당히 적게 사용한다고 보고합니다. 회사는 내부 코딩 및 에이전트형 벤치마크에서의 향상을 강조하며, DeepSWE와 같은 일부 소프트웨어 엔지니어링 평가에서 출력 토큰 사용량을 최대 **65%**까지 줄여 전체 추론 비용을 낮출 수 있다고 밝힙니다. 이번 릴리스에 대해서는 MMLU, GPQA, SWE-bench Verified와 같은 포괄적인 공개 벤치마크 표를 발표하지 않았습니다.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| 항목 | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| 출시 | 2026년 7월 21일(GA) | 2026년 초 | ~2026년 2월(프리뷰) |
| 포지셔닝 | 에이전트, 코딩, 멀티모달을 위한 효율적인 주력 모델 | 이전 세대 에이전트형 Flash 모델 | 고급 Pro 등급의 추론 |
| 가격(1M 토큰 기준) | 입력: $1.50출력: $7.50 | 입력: $1.50출력: $9.00 | 더 높음(예: 입력 ~$2 / 출력 $12) |
| 토큰 효율성 | 3.5 Flash 대비 출력 토큰 17% 감소; 단계/툴 호출 감소 | 기준선 | 에이전트형 워크플로에서 효율성 낮음 |
| 속도 | 높음(Flash 계열) | 높음 | Flash 모델보다 느림 |
| 컨텍스트 윈도우 | 1M 토큰 | 1M 토큰 | 유사할 가능성 높음 |
| 강점 | 코딩, 지식 작업, 멀티모달(차트/문서), 컴퓨터 사용, 에이전트형 효율성 | 에이전트형/코딩 밸런스 우수 | 복잡한 문제에 대한 더 깊은 추론 |
빠른 요약
- 3.6 Flash → 현재 대부분의 사용자에게 최적의 종합 선택: 더 빠르고, 작업당 더 저렴하며, 3.5 Flash보다 효율적이고, 많은 실전/에이전트형 벤치마크에서 3.1 Pro를 능가합니다.
- 3.5 Flash → 견고한 전작으로 여전히 유능하지만 3.6 Flash에 의해 대체되는 추세(출력 토큰 비용이 더 높고 효율성 낮음).
- 3.1 Pro → 일부 심층 추론 시나리오에서는 더 강력하지만 더 느리고 더 비싸며, 속도/효율성/다수의 실사용·에이전트형 작업에서 최신 Flash 모델에 전반적으로 뒤처집니다.
제한 사항
- 이미지 생성을 직접 지원하지 않습니다.
- 오디오 생성은 사용할 수 없습니다.
- 컴퓨터 사용은 여전히 프리뷰입니다.
- 일부 레거시 생성 파라미터(
temperature,top_p,top_k)는 새 API 인터페이스에서 제거되었습니다. - 최상의 성능은 최신 Gemini Interactions API를 통해 달성됩니다.
Gemini 3.6 Flash API에 액세스하는 방법
1단계: API 액세스 받기
cometAPI에 로그인하세요. 아직 사용자 아니라면 먼저 등록해 주세요. CometAPI console에 로그인합니다. 인터페이스의 액세스 자격 증명 API 키를 받습니다. 개인 센터의 API 토큰에서 “Add Token”을 클릭하고 토큰 키: sk-xxxxx를 발급받아 제출하세요.

2단계: Gemini 3.6 Flash API로 요청 보내기
“ gemini-3.6-flash" "gemini-3.6-flash-thinking” 엔드포인트를 선택해 API 요청을 보내고 요청 본문을 설정합니다. 요청 방법과 요청 본문은 당사 웹사이트 API 문서에서 확인할 수 있습니다. 또한 편의를 위해 Apifox 테스트를 제공합니다. 계정의 실제 CometAPI 키로 <YOUR_API_KEY>를 교체하세요. 베이스 URL은 Gemini Generating Content입니다.
질문 또는 요청을 content 필드에 삽입하세요—모델이 응답하는 내용입니다 . API 응답을 처리해 생성된 답변을 얻습니다.
3단계: 응답 처리
API는 생성된 텍스트, 출처, 안전성 메타데이터, 선택적 도구 출력 등을 포함하는 구조화된 후보 응답을 반환합니다.