Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI →

Gemini 3.6 Flash API Fiyatlandırması & Geçiş Kılavuzu (2026)

CometAPI
Mia MarenJul 22, 2026
Gemini 3.6 Flash API Fiyatlandırması & Geçiş Kılavuzu (2026)

TL;DR

Gemini 3.6 Flash, girdi için $1.50/M ve çıktı için $7.50/M fiyatlandırılır; Gemini 3.5 Flash’a kıyasla daha düşük çıktı fiyatı ve bildirilen daha iyi kodlama ile ajan performansı sunar. Üretimde, karmaşık akıl yürütme ve ajanlar için 3.6 Flash kullanın; daha basit, yüksek hacimli iş yüklerini daha ucuz Gemini 3.5 Flash-Lite’a yönlendirin.

Gemini 3.6 Flash, yalnızca bir model kimliği güncellemesinden ibaret değildir.

Hâlihazırda Gemini 3.5 Flash kullanan geliştiriciler için asıl büyük değişim ekonomiktir. Google, girdi fiyatını 1 milyon token için $1.50 olarak aynı tuttu, çıktı fiyatını $9.00’dan $7.50’ye düşürdü ve çeşitli kodlama ile ajanik kıyaslamalarda daha iyi performans bildirdi.

Pratik soru, bu iyileştirmelerin üretim iş yüklerini taşımayı haklı çıkaracak kadar büyük olup olmadığıdır.

Yanıt iş yüküne bağlıdır. Kodlama ajanları, çok modlu analiz ve çok adımlı araç kullanımı, basit çıkarma veya sınıflandırmadan daha fazla fayda görebilir. Geçiş ayrıca yalnızca model adını değiştirdiğinizde gözden kaçması kolay olabilen birkaç API uyumluluk kontrolü gerektirir.

Bu kılavuz, Gemini 3.6 Flash API fiyatlandırmasını, ücretsiz katman erişimini, kıyaslama sonuçlarını, geçiş değişikliklerini, Python örneklerini ve üretim trafiğine geçmeden önce test edilmesi gerekenleri kapsar.

Gemini 3.6 Flash Nedir?

Gemini 3.6 Flash, kodlama, çok modlu akıl yürütme ve çok adımlı ajan iş akışları için Google’ın daha yeni Flash modelidir. 21 Temmuz 2026’da yayınlanan bu model, Google’ın Flash model katmanı içinde kalırken daha güçlü akıl yürütme ve ajanik performans gerektiren üretim iş yükleri için tasarlanmıştır.

Ana özellikleri şunları içerir:

ÖğeGemini 3.6 Flash
Model IDgemini-3.6-flash
Standart girdi fiyatı$1.50 / 1M tokens
Standart çıktı fiyatı$7.50 / 1M tokens
Standart önbellekli girdi$0.15 / 1M tokens
Varsayılan düşünme düzeyimedium
Girdi bağlamı1,048,576 tokens
Maksimum çıktı65,536 tokens
GirdilerMetin, görsel, video, ses, PDF
ÇıkışMetin
En uygun olduğu alanlarKodlama, çok modlu akıl yürütme, karmaşık ajanlar

Google, Gemini 3.6 Flash’ı kodlama, mekânsal ve çok modlu akıl yürütme ile çok adımlı ajanik görevler gibi iş yükleri için konumlandırıyor.

Model ayrıca function calling, yapılandırılmış çıktılar, kod yürütme, bağlam önbellekleme, File Search, URL context, Google Search grounding ve Google Maps grounding gibi özellikleri destekler.

En güncel özellikleri ve geçiş rehberini Google’ın latest Gemini model guide sayfasında inceleyebilirsiniz.

Önceki nesilden gelen geliştiriciler için CometAPI Gemini 3.5 Flash API guide iyi bir entegrasyon başlangıç noktası sağlar.

Gemini 3.6 Flash API’nin Maliyeti Ne Kadar?

Gemini 3.6 Flash, Google’ın Standart ücretli katmanında 1 milyon girdi tokenı başına $1.50 ve 1 milyon çıktı tokenı başına $7.50 tutarındadır.

Gemini 3.5 Flash ile karşılaştırıldığında, girdi fiyatı değişmezken, çıktı fiyatı 1 milyon token için $9.00’dan $7.50’ye düşürülmüştür (yaklaşık %16,7 azalma).

Google ayrıca Batch, Flex ve Priority işlemeyi sunar.

Gemini 3.6 Flash KatmanıGirdi / 1MÖnbellekli Girdi / 1MÇıktı / 1M
Standart$1.50$0.15$7.50
Batch$0.75$0.075$3.75
Flex$0.75$0.075$3.75
Priority$2.70$0.27$13.50

Önemli:** Düşünme token’ları, çıktı token’ı oranından faturalandırılır. Bu nedenle kısa görünen bir yanıt, son metin uzunluğunun düşündürdüğünden daha fazla faturalandırılabilir çıktı token’ı tüketebilir.

Bağlam önbellekleme, aynı büyük sistem yönergesini, depo bağlamını, belge setini veya konuşma geçmişini tekrar tekrar gönderen uygulamalar için de anlamlı fark yaratabilir.

Standart ücretli katmanda, Gemini 3.6 Flash önbellekli girdi maliyeti 1 milyon token için $0.15 olup normal girdi için $1.50 ile karşılaştırıldığında daha düşüktür.

Örnek: 15.000 Girdi Tokenı + 8.000 Çıktı Tokenı

15.000 girdi tokenı ve 8.000 çıktı tokenı kullanan bir görevi ele alalım.

ModelTahmini Maliyet
Gemini 3.5 Flash$0.0945
Aynı token hacmiyle Gemini 3.6 Flash$0.0825
%17 daha az çıktı tokenıyla Gemini 3.6 Flash$0.0723
Aynı token hacmiyle Gemini 3.5 Flash-Lite$0.0245

Aynı token kullanımıyla, bu örnekte Gemini 3.6 Flash, Gemini 3.5 Flash’a kıyasla yaklaşık %12,7 daha ucuzdur.

Google, Artificial Analysis Index üzerinde Gemini 3.6 Flash’ın %17 daha az çıktı tokenı kullandığını bildiriyor. Bir üretim iş yükü bu azalmayı yinelerse, bu örnekte modellenen tasarruf yaklaşık %23,5’e çıkabilir.

Google ayrıca DeepSWE üzerinde %65’e kadar daha az çıktı tokenı bildirmektedir. Bu rakamlar farklı iş yükülerini ölçer ve birbirinin yerine kullanılmamalıdır: %17, Artificial Analysis Index’e; %65 ise belirli bir kodlama kıyaslaması olan DeepSWE’ye atıfta bulunur.

Temel token maliyet hesabı:

Request cost =
(input tokens x input price + output tokens x output price) / 1,000,000

Ajanlar için gerçek maliyet daha geniştir:

Total task cost =
initial model call
+ retries
+ fallback calls
+ paid tools
+ grounding or search costs

Bu nedenle, token başına en ucuz model, bir görevi tamamlamak için her zaman en ucuz model olmayabilir.

Gemini 3.6 Flash Ücretsiz mi?

Evet. Google’ın mevcut Gemini Developer API fiyatlandırması, Gemini 3.6 Flash Standart kullanımı için Ücretsiz Katman erişimi listeler.

Ücretsiz katman erişimi sınırsız üretim kapasitesi anlamına gelmez. API sınırları, projeye ve kullanım katmanına bağlıdır; bu nedenle geliştiriciler, üçüncü taraf bir makaledeki sabit dakikadaki istek sayısı yerine kendi projelerine uygulanan hız sınırlarını kontrol etmelidir.

Üretim planlaması için kapasite tahminleri yaparken Google’ın güncel Gemini API pricing ve hız sınırı belgelerini kullanın.

Geliştiriciler, Gemini 3.6 Flash’a Gemini API ve Google AI Studio üzerinden erişebilir. Birden fazla modeli tek bir iş akışında kullanan ekipler, modeli CometAPI Gemini 3.6 Flash model page üzerinden de test edebilir.

Gemini 3.6 Flash, Gemini 3.5 Flash ile Nasıl Karşılaştırılır?

Google’ın yayımladığı sonuçlar, en büyük iyileştirmelerin kodlama, ajanik yürütme, bilgisayar kullanımı ve bilgi işinde olduğunu gösteriyor.

KıyaslamaGemini 3.6 FlashGemini 3.5 FlashDeğişim
DeepSWE%49.00%37.00+12,0 puan
MLE-Bench%63.90%49.70+14,2 puan
OSWorld-Verified%83.00%78.40+4,6 puan
GDPval-AA v21,4211,34972

Google ayrıca Gemini 3.6 Flash’ın, Gemini 3.5 Flash’a göre daha az akıl yürütme adımı, konuşma dönüşü ve araç çağrısı ile çok adımlı iş akışlarını tamamladığını söylüyor.

Şirket şunları bildiriyor:

  • Artificial Analysis Index’te %17 daha az çıktı tokenı.
  • DeepSWE’de %65’e kadar daha az çıktı tokenı.
  • Daha az istenmeyen kod düzenlemesi ve yürütme döngüsü.
  • Geliştirilmiş çok modlu ve mekânsal akıl yürütme.

Orijinal sonuçlar, Google’ın Gemini 3.6 Flash launch announcement duyurusunda mevcuttur.

Bu kıyaslamalar, özellikle bir isteğin birden fazla akıl yürütme turuna, araç çağrılarına ve düzeltmelere dönüşebildiği iş yükü türleri için 3.6 Flash’ı güçlü bir değerlendirme adayı yapar.

Ancak bunlar, kendi uygulamanızdaki testlerin yerine geçmemelidir.

Google ayrıca 3.6 Flash’ın, kod değişiklikleri yapmadan önce daha fazla programatik inceleme gerçekleştirebileceğini belirtiyor. Büyük bir depoda bu, doğruluğu artırabilir. Dar kapsamlı bir ön yüz düzenlemesinde ise gereksiz keşif ekleyebilir.

Açık dosya sınırları, kabul kriterleri ve uygulama talimatları hâlâ önemlidir.

Gemini 3.6 Flash ve Gemini 3.5 Flash-Lite: Hangisini Kullanmalısınız?

Gemini 3.6 Flash’ın test edilmeye değer olduğuna karar verdikten sonra, sıradaki soru her isteğin gerçekten buna ihtiyaç duyup duymadığıdır.

Birçok üretim sistemi için yanıt hayır olacaktır.

Gemini 3.5 Flash-Lite önemli ölçüde daha ucuzdur ve öngörülebilir, yüksek hacimli iş yükleri için daha iyi bir varsayılan olabilir.

ÖğeGemini 3.6 FlashGemini 3.5 Flash-Lite
Standart girdi fiyatı$1.50 / 1M tokens$0.30 / 1M tokens
Standart çıktı fiyatı$7.50 / 1M tokens$2.50 / 1M tokens
Standart önbellekli girdi$0.15 / 1M tokens$0.03 / 1M tokens
Varsayılan düşünme düzeyimediumminimal
En uygun olduğu alanlarKarmaşık akıl yürütme, kodlama, ajanlarÇıkarma, yönlendirme, sınıflandırma

Standart fiyatlandırmada, Flash-Lite girdi için , çıktı için daha ucuzdur.

Şunlar için önce Gemini 3.5 Flash-Lite ile başlayın:

  • Sınıflandırma
  • İstek yönlendirme
  • JSON ve yapılandırılmış çıkarım
  • Belge işleme
  • Veri dönüştürme
  • Ölçekli çeviri
  • Hafif ajanlar
  • Yüksek hacimli, tekrarlanabilir görevler

Pratik bir yönlendirme stratejisi şöyle görünebilir:

İş yüküİlk RotaYükseltme
Sınıflandırma veya yönlendirmeGemini 3.5 Flash-LiteDoğrulama hatasından sonra 3.6 Flash
Yapılandırılmış çıkarımGemini 3.5 Flash-LiteKarmaşık belgeler için 3.6 Flash
Hafif ajanGemini 3.5 Flash-LiteDüşünme düzeyini artırın veya 3.6 Flash
Çok dosyalı kodlamaGemini 3.6 FlashÇözülmezse daha güçlü yedek
Karmaşık araç iş akışıGemini 3.6 FlashAraç veya doğrulama hatasından sonra yedek
Çok modlu akıl yürütmeGemini 3.6 FlashGörev özelinde yedek

Karışık üretim trafiği için daha faydalı metrik şudur:

Cost per successful task =
(model calls + retries + tools + fallbacks) / accepted tasks

Ucuz bir ilk çağrı, tekrar tekrar başarısız olur ve sonunda daha güçlü bir model gerektirirse cazibesini yitirir.

Tersi de geçerlidir. Flash-Lite gerekli doğruluğu zaten sağlıyorsa, milyonlarca öngörülebilir sınıflandırma isteğini Gemini 3.6 Flash’a göndermenin pek anlamı yoktur.

Bu tür yönlendirmeye ihtiyaç duyan uygulamalar için, calling multiple AI models through an OpenAI-compatible base URL kılavuzumuza bakın.

Gemini 3.6 Flash’e Geçerken Neler Değişir?

Gemini 3.5 Flash’ten Gemini 3.6 Flash’e geçiş, model kimliğini değiştirmekten fazlasını gerektirir.

Geliştiriciler, üretim trafiğini taşımadan önce beş alanı gözden geçirmelidir: kullanımdan kaldırılan örnekleme parametreleri, düşünme kontrolleri, candidate_count, önceden doldurulmuş model turları ve function calling durumu.

1. temperature, top_p ve top_k öğelerini kaldırın

Google, bu örnekleme kontrollerini Gemini 3.6 Flash ve Gemini 3.5 Flash-Lite için kullanımdan kaldırdı:

generation_config = {
    "temperature": 0.7,
    "top_p": 0.9,
    "top_k": 40,
}

Yeni modeller şu anda bu parametreleri yok sayar. Google, gelecekteki Gemini model nesillerinin bu parametreler gönderildiğinde HTTP 400 hatası döndürebileceğini söylüyor.

Öngörülebilir çıktı formatları için, daha net sistem yönergeleri ve yapılandırılmış çıktılar kullanın.

2. thinking_budget yerine thinking_level kullanın

Gemini 3.6 Flash’ın varsayılanı medium düşünmedir.

Google’ın geçiş rehberi, sayısal thinking_budget yapılandırmalarından thinking_level’a geçişi önerir.

Gemini 3.5 Flash-Lite için varsayılan minimal olup, birçok yüksek hacimli çıkarım, sınıflandırma ve yönlendirme iş yükü için uygundur.

Görev çok adımlı akıl yürütme, kod yürütme veya araç kullanımı içerdiğinde daha yüksek düşünme düzeyleri test edilmelidir.

3. candidate_count öğesini kaldırın

Google, candidate_count’i Gemini 3.x’te desteklenmeyen olarak listeler.

Aynı üretim yapılandırmasını birden fazla model paylaştığında bu kolayca gözden kaçabilir. Üretim isteklerini taşımadan önce kaldırın.

4. Model turlarını önceden doldurmayı bırakın

İstekler artık boş olmayan bir model rol turuyla bitirilemez.

Eski bir uygulama şu tür bir payload kullanıyor olabilir:

{
  "contents": [
    {
      "role": "user",
      "parts": [{"text": "Translate 'Hello world' to Spanish."}]
    },
    {
      "role": "model",
      "parts": [{"text": "Translation:"}]
    }
  ]
}

Bu desen artık HTTP 400 döndürebilir.

Daha önce yanıt formatını zorlamak için önceden doldurmayı kullandıysanız, gereksinimi system_instruction içine taşıyın veya bunun yerine yapılandırılmış çıktılar kullanın.

5. Function calling ve çok turlu durumu yeniden test edin

Araç kullanan ajanların ayrı bir geçiş testi gerekir.

Google, Interactions API’de sunucu tarafı çok turlu durum için previous_interaction_id kullanılmasını önerir.

Bir fonksiyon sonucunu döndürürken hem fonksiyon adını hem de özgün çağrı kimliğini koruyun:

final_interaction = client.interactions.create(
    model="gemini-3.6-flash",
    previous_interaction_id=interaction.id,
    tools=tools,
    input=[
        {
            "type": "function_result",
            "name": step.name,
            "call_id": step.id,
            "result": [
                {
                    "type": "text",
                    "text": json.dumps(result),
                }
            ],
        }
    ],
)

generateContent kullanan uygulamalar ayrıca FunctionResponse payload’larını doğrulamalı ve geçiş sonrasında araç çağrısı hatalarını izlemelidir.

Güncel uygulama ayrıntıları için Google’ın latest-model migration guide ve function-calling documentation sayfalarına bakın.

Python’da Gemini 3.6 Flash Nasıl Çağrılır?

Google’ın GenAI SDK’sını kurun veya güncelleyin:

pip install -U google-genai

API anahtarınızı ayarlayın:

export GEMINI_API_KEY="your-api-key"

Ardından Gemini 3.6 Flash’ı çağırın:

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input=(
        "Review this migration plan and list the three "
        "highest-risk compatibility issues."
    ),
)

print(interaction.output_text)

Daha fazla akıl yürütme gerektiren bir görev için düşünme düzeyini yapılandırın:

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Analyze this multi-step debugging problem.",
    generation_config={
        "thinking_level": "medium",
    },
)

print(interaction.output_text)

Ana geçiş farkı şöyle özetlenebilir:

# Older shared configuration
old_config = {
    "temperature": 0.2,
    "top_p": 0.9,
    "top_k": 40,
    "candidate_count": 1,
    "thinking_budget": 4096,
}

# Gemini 3.6 Flash
new_config = {
    "thinking_level": "medium",
}

Daha yüksek bir düşünme düzeyinin her zaman daha iyi olduğunu varsaymayın. Kendi görevlerinizde gecikmeyi, token tüketimini ve tamamlama oranını ölçün.

Üretim Öncesi Gemini 3.6 Flash’ı Nasıl Test Etmelisiniz?

Gemini 3.6 Flash’ın üretim yığınınıza uygun olup olmadığına karar vermek için büyük bir herkese açık kıyas paketi gerekmez.

Daha iyi bir başlangıç noktası, gerçek trafiğinize benzeyen 30-50 yakın tarihli görevdir.

Şunların karmasını dahil edin:

  1. Kodlama ve hata ayıklama
  2. Çok adımlı araç kullanımı
  3. Çok modlu belgeler
  4. Veri çıkarımı
  5. Sınıflandırma ve yönlendirme

Aynı girdileri şunlardan geçirin:

  • Mevcut üretim modeliniz
  • Gemini 3.6 Flash
  • Gemini 3.5 Flash-Lite

İstemleri, araçları, doğrulayıcıları ve kabul kriterlerini değiştirmeyin.

Şunları izleyin:

  • Girdi token’ları
  • Çıktı ve düşünme token’ları
  • Gecikme
  • Araç çağrıları
  • Yeniden denemeler
  • Fonksiyon çağrısı hataları
  • Doğrulayıcıdan geçme oranı
  • İnsan düzeltme süresi
  • Nihai görev başarısı

Ardından kabul edilen bir sonuç üretmek için gereken toplam maliyeti karşılaştırın.

İlk denemede başarıya ulaşan $0.08’lik bir kodlama isteği, iki kez başarısız olan ve sonunda yükseltme gerektiren $0.02’lik bir isteğe göre daha ucuz olabilir.

Aynı zamanda, Flash-Lite güvenilir şekilde hallediyorsa basit bir sınıflandırma görevi için Gemini 3.6 Flash fiyatı ödemek mantıklı değildir.

Amaç, her istek için tek bir model bulmak değildir. Amaç, daha güçlü modelin yalnızca ek yeteneğinin sonucu gerçekten değiştirdiği yerlerde kullanılmasıdır.

Geliştiriciler, aynı değerlendirme setini kullanarak CometAPI üzerinden mevcut Gemini 3.6 Flash ve Gemini 3.5 Flash-Lite rotalarını karşılaştırabilirler.

SSS

Gemini 3.6 Flash API’nin maliyeti ne kadar?

Google’ın Standart ücretli oranı, 1 milyon girdi tokenı başına $1.50 ve 1 milyon çıktı tokenı başına $7.50’dir. Standart önbellekli girdi $0.15/M’dir. Batch ve Flex, girdi için $0.75/M ve çıktı için $3.75/M tutarındadır.

Gemini 3.6 Flash ücretsiz mi?

Evet. Google’ın mevcut Gemini Developer API fiyatlandırması, Gemini 3.6 Flash için Standart kullanımda Ücretsiz Katman listeler. Ücretsiz erişim, proje ve kullanım katmanı hız sınırlarına tabidir.

Gemini 3.6 Flash genel kullanıma açık mı?

Evet. Google, gemini-3.6-flash’ı 21 Temmuz 2026’da yayımladı ve Gemini API belgelerinde üretim modeli olarak listeliyor.

Gemini 3.6 Flash’ın bağlam penceresi nedir?

Gemini 3.6 Flash, 1,048,576 girdi tokenı ve 65,536 çıktı tokenı’na kadar destekler. Metin, görsel, video, ses ve PDF girişlerini kabul eder ve metin çıktı üretir.

Gemini 3.6 Flash, Gemini 3.5 Flash’tan daha mı ucuz?

Çıktı tokenları için evet. Her iki model de standart girdi tokenı için $1.50/M iken, Gemini 3.6 Flash çıktı fiyatını $9.00/M’den $7.50/M’ye düşürür.

Gemini 3.6 Flash mı, Gemini 3.5 Flash-Lite mı kullanmalıyım?

Kodlama kalitesi, çok modlu akıl yürütme veya karmaşık ajan yürütmesi başarısızlıkları ve tekrar denemeleri azaltabiliyorsa Gemini 3.6 Flash kullanın. Yüksek hacimli çıkarım, sınıflandırma, yönlendirme ve düşük maliyetin daha önemli olduğu öngörülebilir işlerde Flash-Lite ile başlayın.

Gemini 3.6 Flash’a geçmeden önce neleri değiştirmeliyim?

temperature, top_p, top_k ve candidate_count öğelerini kaldırın; thinking_budget’i thinking_level ile değiştirin; önceden doldurulmuş model turlarını bırakın; function calling ve çok turlu durum yönetimini yeniden test edin.

Son Değerlendirme

Gemini 3.6 Flash, kodlama, çok modlu çalışmalar veya ajan iş akışları için halihazırda Gemini 3.5 Flash kullanıyorsanız kıyaslamaya değerdir.

Çıktı fiyatı daha düşüktür ve Google’ın erken sonuçları, bazı iş yükülerinde daha az token ve daha az yürütme adımı gerektirebileceğini öne sürer. Tekrar tekrar akıl yürüten, araç çağıran ve hatalı eylemleri yeniden deneyen ajanlarda bu tasarruflar, manşet fiyat farkından daha önemli olabilir.

Ancak bu, her isteğin 3.6 Flash’a taşınması gerektiği anlamına gelmez.

Gemini 3.5 Flash-Lite çok daha ucuzdur ve çıkarım, sınıflandırma ve yönlendirme gibi öngörülebilir işler için tüm ihtiyacınızı karşılayabilir.

Daha iyi üretim stratejisi, her modeli ekonomik açıdan mantıklı olduğu yerde kullanmaktır: Basit, yüksek hacimli görevler için Flash-Lite; ilk denemede doğru bitirme şansını artırdığı yerlerde 3.6 Flash.

Sonuçta gerçekten önemli olanı ölçün: Kabul edilen bir yanıtı elde etmenin toplam maliyeti.

Her iki modeli aynı iş akışında karşılaştırmak için CometAPI üzerindeki Gemini 3.6 Flash model page ve Gemini 3.5 Flash-Lite model page sayfalarına bakın veya güncel model rotalarını CometAPI pricing page üzerinden inceleyin.

Yapay zeka geliştirme maliyetlerinizi %20 azaltmaya hazır mısınız?

Dakikalar içinde ücretsiz başlayın. Ücretsiz deneme kredileri dahildir. Kredi kartı gerekmez.

Devamını Oku