TL;DR
Güncellenmiş fiyatlandırma: GPT-5.6 Standard kısa bağlam ücretleri artık 1 milyon token başına Sol için $5 girdi / $30 çıktı, Terra için $2 / $12 ve Luna için $0.20 / $1.20.
30 Temmuz 2026'da OpenAI, GPT-5.6 Terra fiyatlarını %20 ve Luna fiyatlarını %80 düşürdü. Sol fiyatlandırması değişmedi.
Gizli maliyet etmenlerine dikkat edin: genel gpt-5.6 takma adı Sol'a yönlendirir, 272K girdi tokenını aşan istekler daha yüksek uzun bağlam ücretlerini kullanır ve tüm üç kademede çıktı tokenları hâlâ girdi tokenlarından 6× daha pahalıdır.
Gecikmeye duyarlı Sol iş yükleri için OpenAI’nin yeni Fast mode seçeneği, Standard fiyatın 2×’i karşılığında 2.5×’e kadar daha hızlı işlem sunar.
OpenAI API Fiyatlandırmasına Hızlı Bakış
Genel olarak OpenAI API fiyatlandırmasını arayan kullanıcılar için ilk soru genellikle şudur: aslında hangi güncel model için ödeme yapıyorum? Aşağıdaki tablo, GPT-5.6’yı daha yakından incelemeden önce birkaç güncel OpenAI metin modeline hızlı bir bakış sunar.
(> Fiyatlandırma güncellemesi — 30 Temmuz 2026: OpenAI, GPT-5.6 Terra API fiyatlarını %20 ve Luna fiyatlarını %80 düşürdü. Terra artık 1M girdi tokenı için $2 ve 1M çıktı tokenı için $12; Luna ise 1M girdi için $0.20 ve çıktı için $1.20. Sol fiyatlandırması değişmedi.)
| Model | Girdi / 1M token | Önbelleğe alınmış girdi | Çıktı / 1M token |
|---|---|---|---|
| gpt-5.6-sol | $5.00 | $0.50 | $30.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $12.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $1.20 |
| gpt-5.5 | $5.00 | $0.50 | $30.00 |
| gpt-5.4 | $2.50 | $0.25 | $15.00 |
| gpt-5.4-mini | $0.75 | $0.075 | $4.50 |
| gpt-5.4-nano | $0.20 | $0.02 | $1.25 |
Yeni fiyatıyla Luna, GPT-5.4 nano’nun $0.20 girdi oranını yakalarken, $1.25 yerine $1.20 ile biraz daha düşük bir çıktı oranı sunuyor.
Kaynak*:* OpenAI API fiyatlandırması
En önemli kalıp gözden kaçırması kolaydır: Sol, Terra ve Luna’da GPT-5.6 çıktı tokenları, girdi tokenlarına göre 6× daha pahalıdır. Bu nedenle uzun yanıtlar, gereğinden fazla konuşkan ajanlar ve akıl yürütme ağırlıklı iş akışları, istem uzunluğundaki küçük değişikliklerden daha hızlı maliyeti artırabilir.
GPT-5.6 ailesine daha geniş bir genel bakış—model yetenekleri, konumlandırma, kıyaslamalar, API erişimi ve temel lansman özellikleri dahil—için OpenAI'nin GPT-5.6 duyurusu veya CometAPI'nin GPT-5.6 rehberi. Bu makale özellikle fiyatlandırma, maliyet hesaplamaları ve gerçek API faturanızın değişmesine neden olabilecek etkenlere odaklanır.
GPT-5.6 Fiyatlandırması: Sol vs Terra vs Luna
GPT-5.6 üç fiyatlandırma kademesi sunar. OpenAI, Sol’u amiral gemisi rota, Terra’yı dengeli seçenek ve Luna’yı yüksek hacimli iş yükleri için daha düşük maliyetli kademe olarak konumlandırır.
Her modelin yeteneklerine, GPT-5.6 API’ye nasıl erişileceğine ve kullanım senaryolarına daha derin bir bakış için, GPT-5.6 model hakkındaki ayrıntılara buradan bakın.
≤272K girdi tokenı içeren istekler için GPT-5.6 Standard fiyatlandırması
| Model | Kısa girdi | Önbelleğe alınmış girdi | Önbellek yazımı | Kısa çıktı | Uzun girdi | Uzun önbelleğe alınmış girdi | Uzun önbellek yazımı | Uzun çıktı |
|---|---|---|---|---|---|---|---|---|
| gpt-5.6-sol | $5.00 | $0.50 | $6.25 | $30.00 | $10.00 | $1.00 | $12.50 | $45.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $2.50 | $12.00 | $4.00 | $0.40 | $5.00 | $18.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $0.25 | $1.20 | $0.40 | $0.04 | $0.50 | $1.80 |
Kaynak*:* OpenAI API fiyatlandırması
Uzun bağlam fiyatlandırması: 272K girdi tokenından fazla içeren istekler daha yüksek oranlar kullanır. Girdi, önbelleğe alınmış girdi ve önbellek yazımları 2×; çıktı ise 1.5× oranında faturalandırılır. Daha yüksek oranlar yalnızca 272K üzerindeki tokenlara değil, tüm isteğe uygulanır.
Mantıklı bir başlangıç noktası, daha basit ve yüksek hacimli görevler için Luna’yı, dengeli uygulama iş yükleri için Terra’yı ve en zor veya yüksek etkili görevler için Sol’u test etmektir. Bunlar evrensel öneriler değildir: doğruluk, yeniden denemeler, araç davranışı ve insan incelemesi, liste fiyatı farkından daha ağır basabilir.
Önemli bir takma ad detayı
OpenAI'nin model yönergeleri, genel gpt-5.6 takma adının gpt-5.6-sol’a yönlendiğini belirtir.
Bu, gpt-5.6 adresine gönderilen bir isteğin Sol fiyat kademesini kullandığı anlamına gelir. İş yükünüz Terra veya Luna’da iyi performans gösteriyorsa, genel takma adın en ucuz uygun kademeyi seçeceğini varsaymak yerine açık model kimliğini kullanın.
Örnek 1: Tipik bir API İsteği
Yaygın bir istek şeklinden başlayın:
- 1,000 girdi tokenı
- 500 çıktı tokenı
| Model | Aylık girdi maliyeti | Aylık çıktı maliyeti | Toplam |
|---|---|---|---|
| gpt-5.6-sol | $10,000 | $15,000 | $25,000 |
| gpt-5.6-terra | $4,000 | $6,000 | $10,000 |
| gpt-5.6-luna | $400 | $600 | $1,000 |
Bu iş yükünde Luna’nın yeni fiyatlandırması, tahmini aylık token faturasını $5,000’dan $1,000’a düşürürken, Terra $12,500’dan $10,000’a geriliyor.
Sol için hesaplama:
(1,000 / 1,000,000 × $5) + (500 / 1,000,000 × $30) = $0.020
Bu örnek ayrıca çıktı uzunluğunun neden önemli olduğunu gösterir. İstek, çıktı tokenlarından iki kat fazla girdi tokenı içerse de, çıktı kısmı Sol token maliyetinin %75’ini oluşturur çünkü çıktı, girdi oranının altı katı fiyatlandırılır.
Sohbet, ajanlar ve kod üretimi için gereksiz gevezeliği kontrol altına almak, bazen küçük bir sistem istemini kısaltmaktan daha fazla tasarruf sağlayabilir.
Örnek 2: Ölçekte Aylık Maliyet
Şimdi bir uygulamanın ayda 1 milyon istek işlediğini varsayalım; ortalama:
- istek başına 2,000 girdi tokenı
- istek başına 500 çıktı tokenı
Bu, ayda 2 milyar girdi tokenı ve 500 milyon çıktı tokenına eşittir.
| Model | Aylık girdi maliyeti | Aylık çıktı maliyeti | Toplam |
|---|---|---|---|
| gpt-5.6-sol | $10,000 | $15,000 | $25,000 |
| gpt-5.6-terra | $5,000 | $7,500 | $12,500 |
| gpt-5.6-luna | $2,000 | $3,000 | $5,000 |
Fark, yönlendirme testlerini haklı çıkaracak kadar büyüktür; ancak en düşük satır otomatik olarak en iyi üretim seçeneği değildir. Daha ucuz bir model daha fazla yeniden denemeye, başarısız göreve veya manuel incelemeye yol açarsa, toplam iş akışı maliyeti daha yüksek olabilir.
Uzun Bağlam Fiyatlandırması: 272K Tokenın Üzerinde Ne Olur?
GPT-5.6 modelleri 1.05M tokenlık bir bağlam penceresini destekler; ancak OpenAI, bir istek 272,000’den fazla girdi tokenı içerdiğinde daha yüksek oranlar uygular.
Bu uzun bağlamlı istekler için:
- girdi, kısa bağlam oranının 2×’iyle faturalandırılır
- önbelleğe alınmış girdi ve önbellek yazımları da 2×’dir
- çıktı 1.5× ile faturalandırılır
- Daha yüksek oranlar yalnızca 272K üzerindekilere değil, tüm isteğe uygulanır
Sol için bu, girdinin 1M token başına $5’ten $10’a, çıktının ise $30’dan $45’e değiştiği anlamına gelir. Aynı çarpan yapısı Terra ve Luna için de geçerlidir.
Bu, 272K eşiğine yakın bir maliyet uçurumu oluşturur. Eşiğe yakın iş yükleri için, isteği göndermeden önce yinelenen getirme parçalarını, bayat konuşma geçmişini, gereksiz depo dosyalarını veya gereğinden fazla ayrıntılı araç çıktısını azaltın. Ek token azaltma önerileri için OpenAI'nin maliyet optimizasyonu rehberine bakın.
Standard, Batch, Flex ve Priority Fiyatlandırması
Uygun GPT-5.6 metin iş yükleri için OpenAI birden fazla işlem katmanı sunar.
| Katman | Sol girdi/çıktı | Terra girdi/çıktı | Luna girdi/çıktı | Tipik kullanım |
|---|---|---|---|---|
| Standard | $5 / $30 | $2 / $12 | $0.20 / $1.20 | Normal eşzamanlı trafik |
| Batch | $2.50 / $15 | $1 / $6 | $0.10 / $0.60 | Çevrimdışı eşzamansız işler |
| Flex | $2.50 / $15 | $1 / $6 | $0.10 / $0.60 | Daha yavaş işlemeyi tolere edebilen maliyet duyarlı iş yükleri |
| Fast mode | $10 / $60 | $4 / $24 | $0.40 / $2.40 | Gecikmeye duyarlı kısa bağlam trafiği |
Batch ve Flex, Standard fiyatlandırmasına göre yaklaşık %50 daha ucuz olmaya devam eder. Priority Processing, 30 Temmuz 2026’da Fast mode olarak yeniden adlandırıldı; ancak service_tier: "priority" kullanan mevcut istekler uyumlu kalır.
GPT-5.6 Sol için Fast mode, model zekâsında değişiklik olmadan Standard’a göre 2× fiyata kadar 2.5× daha hızlı işlem sağlar. Kullanıcıya dönük gecikmenin prim ödemeyi haklı çıkaracak kadar önemli olduğu durumlar için en uygunudur.
İstem Önbellekleme: GPT-5.6 için Ne Zaman Tasarruf Sağlar?
GPT-5.6’da önbellek yazımları, normal girdi oranının 1.25×’i olarak fiyatlandırılır; eşleşen önbelleğe alınmış okumalar ise daha düşük önbelleğe alınmış girdi fiyatını alır.
Sol üzerinde yeniden kullanılabilir 100,000 tokenlık bir önek düşünün:
| Eylem | Maliyet |
|---|---|
| Bir kez normal, önbelleksiz girdi olarak işleme | $0.50 |
| Öneki önbelleğe yazma | $0.63 |
| Önbelleğe alınmış öneki sonradan okuma | $0.05 |
İki önbelleksiz kullanım $1.00 tutar. Bir önbellek yazımı artı bir eşleşen önbellekten okuma $0.675 tutar ve bu basitleştirilmiş örnekte $0.325 tasarruf sağlar.
Bu örneğin sınırı: Bu hesaplama yalnızca yeniden kullanılabilir öneğin girdi maliyetini karşılaştırır. Görünür yanıt metni olarak gösterilmese bile çıktı tokenlarını, diğer önbelleksiz girdileri, araçları veya yeniden denemeleri içermez. Gerçek tasarruf, öneğin önbellek gereksinimlerini karşılayıp karşılamadığına ve gerçekte ne sıklıkla yeniden kullanıldığına bağlıdır.
Bu nedenle önbellekleme, tekrarlanan eşleşen istekler alan uzun ve stabil istem önekleri için en kullanışlıdır. Hiç yeniden kullanılmayan bir önbellek yazımı, maliyeti azaltmak yerine artırır.
OpenAI'nin istem önbellekleme rehberi, önbellek yazım fiyatlandırması, önbellekten okumalar, açık kesme noktaları ve TTL davranışını belgeliyor.
OpenAI API Faturanızı Değiştirebilecek Diğer Maliyetler
Akıl yürütme tokenları ve Pro mode
Akıl yürütme tokenları, görünür yanıt metni olarak gösterilmeseler bile çıktı tokenları olarak faturalandırılır. Daha yüksek akıl yürütme ayarları bu nedenle toplam çıktı token kullanımını ve gecikmeyi artırabilir.
Desteklenen yerlerde, reasoning.mode = "pro" bir varsayılan maliyet tasarrufu veya kalite kuralı değil, kıyaslanacak bir yapılandırma olarak ele alınmalıdır. OpenAI bu mod için ayrı sabit bir Pro ek ücreti listelemez; maliyet etkisi, ortaya çıkan token kullanımından gelir. Mantıklı bir temel, temsilî görevlerde Standard ve Pro’yu test edip görev başarısını, toplam çıktı tokenlarını, gecikmeyi ve yeniden denemeleri karşılaştırmaktır.
Web araması ve diğer araçlar
OpenAI şu anda standart web aramasını 1,000 çağrı başına $10 olarak listeliyor; ayrıca arama içeriği tokenları seçilen modelin oranıyla faturalandırılır. Bu nedenle küçük bir Luna isteğinde iki web araması, isteğin model tokenlarından daha pahalıya mal olabilir.
OpenAI ayrıca akıl yürütme yapmayan modeller için ayrı bir web arama önizleme fiyatı olarak 1,000 çağrı başına $25 listeler; arama içeriği tokenları ücretsizdir. Her uç noktaya tek bir web arama oranı uygulamak yerine resmî fiyatlandırma sayfasında tam araç ve model kombinasyonunu kontrol edin.
Bölgesel işleme
5 Mart 2026 veya sonrasında yayımlanan modeller için uygun bölgesel işleme veya veri yerleşimi uç noktaları, OpenAI'nin fiyatlandırma sayfasına göre %10 ek maliyet taşır. Yerleşim gereklilikleri olan kurumsal ekipler bu faktörü bütçe tahminlerine dahil etmelidir.
OpenAI API Maliyetini Nasıl Hesaplarsınız?
Basit bir istek için:
Token maliyeti =
(girdi tokenları / 1M × girdi oranı)
- (çıktı tokenları / 1M × çıktı oranı)
Üretim planlaması için bunu aşağıdakileri içerecek şekilde genişletin:
Toplam iş akışı maliyeti =
önbelleksiz girdi
- önbelleğe alınmış girdi
- önbellek yazımları
- çıktı ve akıl yürütme tokenları
- araç ücretleri
- hizmet katmanı ayarlamaları
- uygulanabilirse bölgesel ek ücret
- yeniden denemeler ve geri dönüş istekleri
En faydalı KPI çoğu zaman şudur:
Başarılı görev başına maliyet = toplam iş akışı maliyeti / başarılı görevler
Bu, daha ucuz bir token oranının, daha fazla başarısızlığa veya inceleme işine de yol açtığında yapay olarak cazip görünmesini engeller.
Aşırı Ödemeden Doğru Modeli Nasıl Seçersiniz?
Fiyat tablosunu başlangıç noktası olarak kullanın, ardından gerçek görevlerde test edin.
- Görevi gerçekleştirebilecek en düşük maliyetli modelle başlayın. Luna, basit ve yüksek hacimli işler için mantıklı bir ilk test olabilir; ancak her çıkarım veya özetleme iş yükü için en iyi seçenek olacağını varsaymayın.
- Çıktı uzunluğunu ölçün. GPT-5.6 çıktı tokenları girdi tokenlarının 6×’i fiyatındadır; bu nedenle gevezelik dikkat gerektirir.
- 272K eşiğine dikkat edin. Eşiği aşmak, tüm istek için oranları değiştirir.
- Uygun, acil olmayan işler için Batch veya Flex kullanın. Üretim trafiğine taşımadan önce operasyonel kısıtları test edin.
- Yalnızca yeniden kullanılabilir önekleri önbelleğe alın. Uzun bir istemin önbelleğe alınması gerektiğini varsaymak yerine gerçek önbellek isabetlerini ölçün.
- Araçları ve yeniden denemeleri takip edin. Daha ucuz bir modelin sağladığı tasarrufları silebilirler.
Sağlayıcılar arasında rotaları karşılaştıran ekipler için, CometAPI fiyatlandırması canlı, modeller arası bir görünüm sunar. CometAPI Quickstart ve Cookbook, aynı test setini birden çok OpenAI uyumlu rota üzerinde çalıştırmak için kullanılabilir.
SSS
2026’da GPT-5.6’nın maliyeti ne kadar?
Fiyatlandırma modele bağlıdır. GPT-5.6 Standard kısa bağlam oranları, Luna için 1M token başına $1 girdi / $6 çıktı ile Sol için $5 / $30 arasında değişir. GPT-5.4 mini ve nano gibi daha düşük maliyetli modeller de mevcuttur. Güncel modeli OpenAI'nin canlı fiyatlandırma sayfasında kontrol edin.
ChatGPT API fiyatlandırması GPT-5.6 fiyatlandırmasıyla aynı mı?
“ChatGPT API fiyatlandırması” genellikle sohbet özellikli modeller için OpenAI API fiyatlandırmasını gayriresmî olarak ifade eder; ancak ChatGPT abonelikleri ve API faturalaması ayrı ürünlerdir. API kullanımı, belirli modele ve kullanım türüne göre fiyatlandırılır.
En ucuz GPT-5.6 modeli hangisi?
gpt-5.6-luna, 1M girdi tokenı için $0.20 ve 1M çıktı tokenı için $1.20 fiyatlandırılan en ucuz GPT-5.6 modelidir. OpenAI, 30 Temmuz’da her iki oranı da %80 düşürdü; bu da Luna’yı yüksek hacimli ajanlar, sınıflandırma, belge işleme ve iyi tanımlanmış araç iş akışları için önemli ölçüde daha ekonomik hâle getirir.
gpt-5.6 hangi modeli kullanır?
OpenAI'nin model yönergeleri, gpt-5.6 takma adının gpt-5.6-sol’a yönlendiğini belirtir. Bu kademeleri kullanmak istediğinizde açık Terra veya Luna model kimliklerini kullanın.
GPT-5.6 uzun bağlam fiyatlandırması ne zaman uygulanır?
Girdi 272,000 tokenı aştığında, GPT-5.6 tam istek için daha yüksek uzun bağlam oranlarını kullanır: girdiyle ilgili oranlar 2×, çıktı oranları 1.5× olur.
Batch ve Flex, GPT-5.6 için Standard’dan daha mı ucuz?
Uygun GPT-5.6 iş yükleri için listelenen Batch ve Flex token oranları, Standard’a göre yaklaşık %50 daha düşüktür. Farklı işlem özelliklerine sahiptirler; bu yüzden iş yükünün bu kısıtları tolere edebildiğini doğrulayın.
GPT-5.6 için önbellek yazımları ekstra maliyetli mi?
Evet. GPT-5.6 önbellek yazımları, normal girdi oranının 1.25×’iyle fiyatlandırılır; eşleşen önbellekten okumalar ise indirimli önbelleğe alınmış girdi oranını kullanır. Tasarruflar, gerçek yeniden kullanıma bağlıdır.
Kendi İş Yükünüzde GPT-5.6 Maliyetlerini Karşılaştırın
Fiyat tablosu bir başlangıçtır. Gerçek maliyetiniz, istemler, çıktı uzunluğu, önbellek isabet oranı, araçlar, yeniden denemeler ve görev başarısına bağlıdır.
CometAPI ile aynı iş yükünü kullanarak GPT-5.6 Sol, Terra, Luna ve diğer modelleri, tek bir OpenAI uyumlu API üzerinden test edebilirsiniz.
Sonraki adımlar: güncel model fiyatlarını karşılaştırın, CometAPI Quickstart’ı izleyin veya tekrar edilebilir model değerlendirmeleri oluşturmak için CometAPI Cookbook’u kullanın.
Kalite, gecikme ve güvenilirlik gereksinimlerinizi karşılamaya devam eden en düşük maliyetli rotayı seçin.
