GPT-6 Astra is now live on CometAPI →
technology/CometAPI 리서치

Gemini 3.8 Flash란 무엇인가? 사양, 벤치마크, 가격, 그리고 변경 사항

Gemini 3.8 Flash API 가격, 사양, 1M-토큰 컨텍스트, 벤치마크, 사고 수준, 멀티모달 입력, 도구, 제한사항, Gemini 3.7와의 비교를 살펴보세요

CometAPI
Mia MarenAI 모델 및 API 리서치 팀
업데이트됨 Sep 6, 2026 11 분 읽기
Gemini 3.8 Flash란 무엇인가? 사양, 벤치마크, 가격, 그리고 변경 사항
이 패턴 사용

첫 API 호출하기.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

요약

Gemini 3.8 Flash는 복잡한 코딩, 에이전트형 작업, 멀티모달 작업을 위한 Google의 프로덕션 Flash 업그레이드입니다. Gemini 3.7 Flash의 100만 토큰 컨텍스트 등급을 유지하면서, 더 깊은 추론, 더 지속적인 도구 사용, 장기 작업에서 더 높은 완료율에 초점을 둡니다.

핵심 요약

1,048,576개 입력 토큰과 65,536개 출력 토큰, 텍스트, 이미지, 비디오, 오디오, PDF 입력 지원.

• Google은 DeepSWE v1.1에서 73.7%를 보고했으며, 동일 비교에서 Gemini 3.7 Flash의 65.3% 대비 상승.

• 2026년 12월 31일까지 도입 표준 요금은 입력 100만 토큰당 $0.75, 출력 100만 토큰당 $3.75.

• 재시도, 검증, 멀티툴 실행이 유리한 더 어려운 작업에 업그레이드하고, 짧고 예측 가능하며 지연에 민감한 트래픽에는 3.7을 유지하세요.

Google은 2026년 9월 2일 Gemini 3.8 Flash를 출시했으며, Gemini 3.7 Flash 이후 3주 만입니다. Google은 이를 코딩, 에이전트, 멀티모달 추론, 전문 워크플로를 위한 가장 지능적인 Flash 모델로 포지셔닝합니다.

이번 릴리스는 단순한 컨텍스트 윈도 확장이 아닙니다. Gemini 3.7 Flash를 직접 기반으로 하여, 새로운 모델은 어려운 작업에 더 많은 연산을 투입하고, 추가 추론 단계를 수행하며, 도구를 더 지속적으로 사용합니다.

이 설계는 실무적 트레이드오프를 만듭니다. 장기 작업에서 더 강한 완료율을 보이지만, 작업당 추론 토큰과 지연 시간이 늘어날 수 있습니다. 이 가이드는 3.8 고유의 변화—사양, 공식 벤치마크 결과, 가격, 업그레이드 판단—에 초점을 맞추며, 이미 CometAPI에서 다룬 Gemini 3.7의 일반 기능 개요는 반복하지 않습니다.

Gemini 3.8 Flash란 무엇인가? 사양, 벤치마크, 가격, 그리고 변경 사항

공식 Google 출시 이미지 - Gemini 3.8 Flash 및 3.8 Flash Cyber

Gemini 3.8 Flash란?

Gemini 3.8 Flash는 장기 소프트웨어 엔지니어링, 자율 에이전트, 멀티모달 분석, 전문 지식 작업을 위한 Google의 프로덕션 Flash 모델입니다. 이 모델의 특징적 동작은 지속성입니다. 중간 결과를 점검하고, 도구를 반복 호출하며, 실패한 단계를 수정하고, 더 큰 목표를 향해 계속 진행할 수 있습니다.

이 모델은 Gemini API와 Google AI Studio를 통해 일반 제공됩니다. Google의 출시 발표에는 Gemini 앱, Gemini Enterprise Agent Platform, AI Mode, Google Antigravity 전반에서의 가용성도 포함됩니다.

Gemini 3.8 Flash 사양

기술적 범위는 Gemini 3.7 Flash 사용자에게 익숙한 수준을 유지합니다. 가장 유용한 프로덕션 사양을 아래에 요약했으며, 신호가 낮은 비지원 생성 모드의 전수 목록은 제외했습니다.

공식 사양Gemini 3.8 Flash
안정적 모델 IDgemini-3.8-flash
출시 상태일반 제공
최대 입력1,048,576 토큰
최대 출력65,536 토큰
입력 모달리티텍스트, 이미지, 비디오, 오디오, PDF
출력 모달리티텍스트
추론 레벨낮음, 중간, 높음; 기본값은 중간
핵심 도구함수 호출, 코드 실행, 구조화된 출력, 검색 그라운딩, URL 컨텍스트, 파일 검색
컴퓨터 사용프리뷰에서 지원
지식 컷오프일부 도메인은 2026년 3월; 일부 지식은 2025년 1월 수준에 제한될 수 있음

Google은 1,048,576 토큰 입력 한도와 65,536 토큰 출력 한도를 확인했습니다. 3.7이 동일한 컨텍스트 범위를 제공하기 때문에, 컨텍스트 크기만으로 마이그레이션할 이유는 없습니다. 업그레이드 근거는 추론 품질과 작업 완료에 있습니다.

Gemini 3.8 Flash의 새로운 점은?

Gemini 3.8 Flash는 이전 세대의 컨텍스트 용량을 유지하되, 모델이 추론하고 도구를 사용하며 긴 워크플로를 완료하는 방식을 변경합니다. 주요 차이는 네 가지 운영 동작에 해당합니다.

더 깊은 추론

Google에 따르면 모델은 작업이 어려워질 때 추가 추론 단계를 수행할 수 있습니다. 코딩 또는 리서치 에이전트는 중간 증거를 점검하고 접근을 수정하며, 첫 그럴듯한 답변에 안주하지 않고 결과를 검증할 수 있습니다.

에이전트적 실행

Gemini 3.8 Flash는 검색, 코드 실행, 함수 호출, 오류 점검, 복구를 포함하는 다단계 작업을 지속적으로 수행하도록 설계되었습니다. 이는 하나의 고립된 응답을 생산하는 것보다, 전체 도구 사용 워크플로를 완료하는 것이 성공에 중요한 경우 업그레이드의 의미가 큽니다.

추론 레벨

프로덕션 모델은 낮음, 중간, 높음의 추론 레벨을 노출하며, 기본값은 중간입니다. 팀은 일상적 요청에는 낮은 추론을 사용하고, 완료 품질이 지연이나 토큰 사용보다 중요한 작업에는 더 높은 추론을 예약할 수 있습니다.

멀티모달 워크플로

이 모델은 텍스트, 이미지, 비디오, 오디오, PDF를 함수 호출, 코드 실행, 검색 그라운딩, URL 컨텍스트, 구조화된 출력과 결합할 수 있습니다. 따라서 개선점은 새로운 미디어 유형이 아니라, 혼합 증거와 도구 전반에서 더 지속적인 추론입니다. 같은 출시에서 승인된 방어적 보안 작업을 위한 별도의 모델인 Gemini 3.8 Flash Cyber도 도입되었습니다.

Gemini 3.7 Flash에서 무엇이 바뀌었나?

이전 모델의 일반적인 기능과 배포 맥락은 CometAPI의 Gemini 3.7 Flash 개요를 참조하세요. 3.8 고유의 변경점은 더 좁고 운영적입니다.

더 지속적인 추론

Google은 Gemini 3.8 Flash가 어려운 작업에서 추가 추론 단계를 수행할 수 있다고 말합니다. 리포지토리 에이전트는 종속성을 점검하고, 여러 파일을 편집하고, 테스트를 실행하고, 실패를 진단하고, 패치를 수정한 뒤 다시 검증하는 과정을 처음 그럴듯한 답변에서 멈추지 않고 수행할 수 있습니다.

더 반복적인 도구 사용

증거가 바뀔 때 모델은 도구를 기꺼이 반복 호출합니다. 이는 브라우저 자동화, 리서치, 코딩, 문서 워크플로처럼 올바른 다음 단계가 이전 도구 결과에 의존하는 경우에 중요합니다.

더 높은 작업 수준의 품질, 잠재적으로 더 많은 토큰 사용

Google은 특히 더 높은 추론 레벨에서 모델이 더 많은 토큰을 소비할 수 있음을 경고합니다. 따라서 Gemini 3.7 Flash는 짧고 예측 가능한 트래픽에 효율 우선 옵션으로 남고, 3.8은 재시도와 검증이 완료 확률을 높이는 작업에 더 적합합니다.

컨텍스트 윈도 확장은 없음

두 세대 모두 동일한 100만 토큰 입력과 64K 토큰 출력 등급을 유지합니다. 업그레이드는 단순한 프롬프트 용량 증가가 아닌 동작상의 변화입니다.

Gemini 3.8 Flash vs Gemini 3.7 Flash - 비교 표 - 업그레이드 대상

두 세대는 동일한 컨텍스트 등급을 공유하므로, 업그레이드 결정은 프롬프트 용량이 아니라 작업 완료, 도구 지속성, 지연 시간, 토큰 사용을 기준으로 해야 합니다.

비교 차원Gemini 3.8 FlashGemini 3.7 Flash의사결정 영향
포지셔닝가장 지능적인 프로덕션 Flash 모델이전 세대의 효율 우선 Flash3.8은 더 어려운 엔드투엔드 작업을 목표로 함
컨텍스트 용량입력 1,048,576; 출력 65,536 토큰동일한 100만 입력 / 64K 출력 등급용량 기반 마이그레이션은 불필요
DeepSWE v1.173.7%65.3%3.8이 더 강한 코딩-에이전트 결과
추론 및 도구더 많은 추론 단계와 지속적인 멀티툴 실행짧고 예측 가능한 흐름에 더 적합재시도와 검증이 중요할 때 3.8이 더 바람직
토큰/지연 프로파일특히 높은 추론 레벨에서 더 많은 토큰을 사용할 수 있음일상 트래픽에 대체로 더 가벼움토큰 가격이 아닌 작업 완료당 비용을 벤치마크
최적 워크로드리포지토리 코딩, 리서치, 멀티모달 분석, 멀티툴 에이전트분류, 추출, 짧은 초안 작성, 안정적 자동화3.7을 전면 교체하지 말고 워크로드에 따라 라우팅

누가 업그레이드해야 하나?

리포지토리 단위 코딩, 멀티툴 자동화, 전문 리서치, 멀티모달 분석, 자주 프리미엄 모델로 격상되는 워크플로를 운영한다면 지금 Gemini 3.8 Flash를 평가하세요. 이미 신뢰성 있게 성공하는 짧고 반복적이며 지연에 민감한 작업에는 Gemini 3.7 Flash를 유지하세요.

실용적인 라우터는 어려운 작업이나 실패한 작업만 3.8로 보내고, 효율 우선 트래픽은 3.7에 유지할 수 있습니다. 기본 모델을 변경하기 전에 승인된 작업 비율, 엔드투엔드 지연, 도구 호출 수, 총 토큰을 측정하세요.

Gemini 3.8 Flash 공식 벤치마크 성능

Google이 공개한 평가는 장기 코딩, 터미널 작업, 전문 에이전트, 고급 추론, 컴퓨터 사용에서 가장 뚜렷한 향상을 보여줍니다.

Gemini 3.8 Flash란 무엇인가? 사양, 벤치마크, 가격, 그리고 변경 사항

Google DeepMind의 공식 Gemini 3.8 Flash 평가 그래픽

Gemini 3.8 Flash가 앞서는 분야

DeepSWE v1.1에서 73.7% 대 65.3%는 세대 간 8.4포인트 상승이며, Claude Opus 5의 74.0%에 거의 근접합니다. Terminal-Bench 2.1에서는 89.4%로, Opus 5에 표시된 89.1%를 소폭 상회합니다. Vals Finance Agent v2와 법률 에이전트 벤치마크도 Google의 비교에서 3.8에 유리합니다.

프리미엄 모델이 여전히 우세한 분야

결과가 보편적인 것은 아닙니다. Terminal-Bench 4.0에서는 Claude Opus 5가 51.8%에 도달하는 반면 Gemini 3.8 Flash는 19.1%이며, OSWorld-2.0에서는 75.4% 대 59.0%입니다. 증거는 Gemini 3.8 Flash의 비용-역량 이점을 지지하지만, 모든 프리미엄 프런티어 모델을 대체한다는 주장을 뒷받침하지는 않습니다.

벤치마크 평가

Gemini 3.8 Flash는 워크로드가 장기 코딩 또는 특화된 전문 에이전트에 가깝다면 가장 강력합니다. 어려운 컴퓨터 사용 환경과 일부 터미널 작업에서는 Claude Opus 5가 여전히 더 강한 선택입니다. 프로덕션 팀은 단일 벤치마크 평균이 아니라 승인된 작업 비율, 지연, 총 토큰 소비로 검증해야 합니다.

Gemini 3.8 Flash 가격 및 작업 완료당 비용

Gemini 3.8 Flash는 3.7과 동일한 도입 단계 토큰당 요금으로 출시되었지만, 3.8이 더 오래 추론할 수 있으므로 동일한 토큰 가격이 동일한 작업 비용을 보장하지는 않습니다.

Google 가격 모드입력 / 100만 토큰출력 / 100만 토큰캐시된 입력 / 100만 토큰
2026년 12월 31일까지 표준$0.75$3.75$0.075
2027년 1월 1일부터 표준$1.50$7.50$0.15
2026년 12월 31일까지 Batch$0.375$1.875$0.0375
2026년 12월 31일까지 Flex$0.375$1.875$0.0375

공식 가격 페이지는 출력 가격에 추론 토큰이 포함됨을 명시합니다. 승인된 작업당 비용을 평가하세요. 추가 추론이 실패한 실행이나 프리미엄 모델로의 폴백을 방지한다면 경제적일 수 있지만, 분류, 추출, 짧은 대화에는 낭비일 수 있습니다.

라우트입력 / 100만 토큰출력 / 100만 토큰
Google 도입 가격$0.75$3.75
CometAPI 게재 가격$0.60$3.00
명목상 차이20% 낮음20% 낮음

CometAPI의 Gemini 3.8 Flash 페이지는 현재 라우트 가격과 가용성을 제공합니다. 공급자 가격은 변경될 수 있으므로, 프로덕션 워크로드 예산 책정 전 라이브 모델 페이지에서 확인하세요.

Gemini 3.8 Flash vs Claude Opus 5 및 Sonnet 5

의사결정 차원Gemini 3.8 FlashGemini 3.7 FlashClaude Opus 5Claude Sonnet 5
포지셔닝고지능 Flash효율 우선 Flash프리미엄 프런티어 추론균형 잡힌 프로덕션 에이전트
컨텍스트 등급1M1M1M1M
장기 코딩DeepSWE에서 Opus 5에 근접강하지만 더 낮음전반적으로 가장 강함Google 표에서 Gemini 3.8보다 낮음
컴퓨터 사용개선됨낮음OSWorld-2.0에서 명확한 리더Google 표에서 Gemini 3.8보다 낮음
추론 동작지속적, 더 반복적더 효율 지향심층 프리미엄 추론품질과 속도의 균형
최적 적합비용 민감 복잡 에이전트대량 예측 가능한 작업가장 어려운 터미널/컴퓨터 사용 작업일반 프로덕션 에이전트

비교 결과는 워크로드에 따라 달라집니다. 재시도가 도움이 되는 복잡 작업에는 3.8을, 예측 가능한 대량 트래픽에는 3.7을 선택하세요. 컴퓨터 사용이나 터미널 능력이 최고 수준으로 필요해 프리미엄 경제성이 정당화된다면 Opus 5를, 균형 잡힌 Claude 배포가 바람직하다면 Sonnet 5를 테스트하세요.

Gemini 3.8 Flash 사용 사례: 무엇을 할 수 있나?

텍스트, 이미지, 비디오, 오디오, PDF 입력을 함수 호출, 코드 실행, 검색 그라운딩, URL 컨텍스트, 파일 검색, 구조화된 출력과 결합할 수 있습니다. 3.8 고유의 강점은 이러한 기능을 전체 워크플로 전반에 걸쳐 얼마나 지속적으로 연결하는지입니다.

코딩

소스 파일, 아키텍처 노트, 이슈 이력, 테스트 출력을 하나의 작업 컨텍스트로 제공합니다. 모델은 종속성을 점검하고, 여러 파일을 편집하고, 테스트를 실행하고, 실패를 진단하고, 패치를 수정한 뒤 결과를 검증할 수 있습니다. 최초 생성 패치만 평가하지 말고 실행당 승인된 수정 비율로 측정하세요.

에이전트

계획 수립, 다중 도구 호출, 변경된 상태 점검, 실패 단계 복구가 필요한 워크플로에 Gemini 3.8 Flash를 사용하세요. 프로덕션 에이전트는 도구 권한, 단계 제한, 승인 게이트, 감사 로그를 강제해 지속성이 통제되지 않은 행동으로 변질되지 않도록 해야 합니다.

리서치

PDF, 정책 문서, 공개 URL, 내부 증거를 결합하고 파일 검색과 근거 기반 검색(grounded retrieval)을 사용해 출처 비교 후 감사 가능한 브리프 또는 구조화 레코드를 반환합니다. 법률, 금융, 컴플라이언스 의사결정에는 출처 구절을 유지하고 사람 검토를 요구하세요.

멀티모달 워크플로

지원 또는 운영 파이프라인은 스크린샷, 녹취, 비디오, PDF, 텍스트를 결합해 관련 증거를 추출하고, 사례를 분류하며, 구조화된 인계 자료를 준비할 수 있습니다. 증거가 불완전하거나 상충할 때를 대비해 신뢰도 임계값과 에스컬레이션 규칙이 필수입니다.

컴퓨터 사용

브라우저 기반 워크플로에서 모델은 페이지를 해석하고, 다음 행동을 선택하며, 도구를 호출하고, 새로운 상태를 점검하고, 단계가 실패하면 복구할 수 있습니다. 컴퓨터 사용이 여전히 프리뷰이므로, 구매, 제출, 계정 변경 등 되돌릴 수 없는 행동에는 승인 게이트를 유지하세요.

한계

더 많은 추론은 토큰 소비와 지연을 증가시킬 수 있습니다. 공식 모델 카드는 환각과 간헐적 느림 또는 타임아웃도 언급합니다. 나열된 지식 컷오프에도 주의가 필요합니다. 일부 도메인은 2026년 3월이며, 일부 지식은 2025년 1월 수준에 제한될 수 있습니다.

이 모델은 텍스트를 생성하며, 네이티브 이미지나 오디오는 생성하지 않고 Live API를 지원하지 않습니다. Google의 자동 안전성 평가에서는 Multilingual Safety에서 5.4포인트 회귀(낮을수록 더 좋음)가 보고되어, 프로덕션 배포 전 다국어 테스트를 추가로 수행할 필요가 있습니다.

자주 묻는 질문

Gemini 3.8 Flash 모델 ID는 무엇인가요?

안정적 API 모델 ID는 gemini-3.8-flash입니다.

컨텍스트 윈도는 얼마나 큰가요?

최대 1,048,576개 입력 토큰과 65,536개 출력 토큰을 지원합니다.

Gemini 3.8 Flash가 Gemini 3.7 Flash보다 더 좋나요?

Google이 공개한 대부분의 에이전트 및 전문 벤치마크에서 더 강하지만, 간단한 작업에는 3.7이 더 효율적일 수 있습니다.

Claude Opus 5보다 더 좋나요?

Google의 비교에서 일부 코딩 결과는 거의 맞먹거나 소폭 앞서지만, Terminal-Bench 4.0과 OSWorld-2.0에서는 Opus 5가 크게 앞섭니다.

이미지나 오디오를 생성하나요?

아니요. 멀티모달 입력을 수용하지만 텍스트 출력만 반환합니다.

결론

Gemini 3.8 Flash는 3.7 기반 위에 구축된 추론-지속성 업그레이드이며, 더 큰 컨텍스트로의 재설계가 아닙니다. 가장 강한 증거는 장기 코딩과 특화된 에이전트에서 나타나며, 가장 명확한 격차는 Claude Opus 5가 앞설 수 있는 더 어려운 터미널 및 컴퓨터 사용 환경에 남아 있습니다.

프로덕션 팀에게 결정적 지표는 토큰당 가격이 아니라 승인된 작업당 비용입니다. 라우팅 기본값을 바꾸기 전에 CometAPI에서 Gemini 3.8 Flash를 3.7 및 관련 Claude 모델과 함께 자체 트레이스로 테스트하세요.

SEO 메타데이터

메타 제목: Gemini 3.8 Flash란? 사양, 벤치마크 및 가격

메타 설명: Gemini 3.8 Flash API 가격, 사양, 1M 토큰 컨텍스트, 벤치마크, 추론 레벨, 멀티모달 입력, 도구, 한계, Gemini 3.7 비교를 살펴보세요.

키워드: Gemini 3.8 Flash, Gemini 3.8 Flash API, Gemini 3.8, Gemini 3.8 Flash 벤치마크, Gemini 3.8 Flash 가격, Gemini 3.8 Flash vs Gemini 3.7 Flash, Gemini Flash, Google Gemini API, Gemini 코딩 모델, AI 에이전트 모델

URL 슬러그: what-is-gemini-3-8-flash

학습 계속하기

이 글을 다음 결정과 연결하세요.

모든 주제 보기
게시일 Sep 4, 2026
최종 업데이트 Sep 6, 2026
20 회 조회
명확성, 출처 표기 및 최신 API 용어에 대해 검토되었습니다.

AI 개발 비용을 20% 절감할 준비가 되셨나요?

몇 분 안에 무료로 시작하세요. 무료 체험 크레딧 제공. 신용카드 불필요.

더 보기