GPT-6.1 Sol are now live on CometAPI →
technology/CometAPI araştırması

CometAPI'de Grok 4.7 API Fiyatlandırması: Resmi Temel, Maliyet Tahminleri ve Tasarruflar

Grok 4.7 API fiyatlarını CometAPI fiyatlandırmasıyla karşılaştırın, aylık harcamayı tahmin edin, önbellekleme, bağlam kontrolü ve uygulama düzeyinde çıktı üst sınırlarıyla yapay zeka uygulama maliyetlerini azaltın.

CometAPI
Bobby SpencerAI model ve API araştırma ekibi
Güncellendi Oct 1, 2026 10 dk okuma
CometAPI'de Grok 4.7 API Fiyatlandırması: Resmi Temel, Maliyet Tahminleri ve Tasarruflar
Bu kalıbı kullanın

İlk API çağrısını yapın.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

xAI, Grok 4.7'yi kodlama, ajan görevleri ve bilgi çalışmaları için öncü modeli olarak tanımlıyor; 500K belirteçlik bir bağlam penceresine sahip. xAI’nin güncel fiyatlandırma sayfasına göre, 200.000 istem belirtecinin altındaki doğrudan API oranları milyon başına girdi için $2.00, önbelleğe alınmış girdi için $0.50 ve çıktı için $6.00’dır. Bir istem 200.000 belirtece ulaştığında veya üzerine çıktığında, xAI sırasıyla $4.00, $1.00 ve $12.00 listeler. Bunlar xAI’nin doğrudan oranlarıdır; üçüncü taraf platformlar arasında evrensel bir fiyat değildir.

Gerçek harcama, başlıktaki girdi oranından daha fazlasına bağlıdır. Taze girdi, önbelleğe alınmış girdi, çıktı, yeniden denemeler, araç çağrıları ve bir ajan iş akışındaki model çağrılarının sayısı faturayı değiştirebilir. 200K istem eşiği özellikle önemlidir çünkü hem xAI hem de CometAPI bu sınır aşıldığında daha yüksek uzun bağlam oranları yayımlar.

Bu rehber önce xAI fiyatlandırma temelini oluşturur, ardından güncel CometAPI Grok 4.7 listelemesini karşılaştırır. 28 Eylül 2026 itibarıyla, CometAPI standart katmanda milyon başına taze girdi/cached girdi/çıktı belirteçleri için sırasıyla $1.60 / $0.40 / $4.80; uzun bağlam katmanında $3.20 / $0.80 / $9.60 listeler — xAI’nin karşılık gelen doğrudan oranlarından %20 daha düşüktür. Aşağıdaki bölümler iş yükü maliyetinin nasıl hesaplanacağını, israfın nasıl azaltılacağını ve modele CometAPI aracılığıyla nasıl erişileceğini açıklar. Tüm fiyatlar tarihlendirilmiş anlık görüntülerdir ve üretim kullanımı öncesinde yeniden kontrol edilmelidir.

xAI Doğrudan ve CometAPI Grok 4.7 Fiyatlandırması

xAI doğrudan oranları (USD, 1M belirteç başına)

Belirteç kategorisi200K istem belirteçlerinin altındaUzun bağlam (≥200K)
Taze girdi$2.00$4.00
Önbelleğe alınmış girdi$0.50$1.00
Çıktı$6.00$12.00

CometAPI oranları (USD, 1M belirteç başına)

Belirteç kategorisiCometAPI: 200K istem belirteçlerinin altındaCometAPI: uzun bağlam katmanı
Taze girdi$1.60 / 1M belirteç$3.20 / 1M belirteç
Önbelleğe alınmış girdi$0.40 / 1M belirteç$0.80 / 1M belirteç
Çıktı$4.80 / 1M belirteç$9.60 / 1M belirteç

200K istem sınırı önemlidir çünkü her iki platform da hâlihazırda Grok 4.7 için uzun bağlam oranlarını standart katman oranlarının iki katı olarak listeler. Bu, modelin yeteneğinde bir değişiklik değil, her bir API platformu tarafından belirlenen bir fiyatlandırma kuralıdır. Bir istek, uygulamanın tekrar tekrar büyük istemler göndermesi veya ajanın geçmişi kontrolsüz büyümesi nedeniyle daha pahalı hale gelir — yalnızca Grok 4.7’in 500K’lık bir bağlam penceresini desteklemesi nedeniyle değil.

Bütçeleme için, eşiğe ulaşması öngörülen herhangi bir isteği, etkin faturalandırma davranışı doğrulanana kadar uzun bağlam olarak ele alın. Model kullanılabilirliği ve fiyatlar değişebilir; bu nedenle üretim hesaplayıcıları kalıcı değerleri sabitlemek yerine xAI doğrudan fiyatlandırmasını ve güncel CometAPI model sayfasını yeniden kontrol etmelidir.

Grok 4.7 Maliyetini Tahmin Etme Formülü

Her bir belirteç kategorisini ayrı fiyatlayarak tek bir isteği tahmin edin:

request cost = (fresh input tokens × input rate + cached input tokens × cached rate + output tokens × output rate) ÷ 1,000,000

Ardından istek tahminini bir iş yükü tahminine dönüştürün:

monthly cost = request cost × requests per user × active users × days in billing period

Tek bir ortalama yerine gerçekçi bir yüzdelik kullanın. p50 tahmin normal bir isteği tanımlar, ancak p95 girdi ve çıktı uzunlukları faturayı çoğu zaman yönlendiren pahalı kuyruğu ortaya çıkarır. Ajan iş akışlarında, tamamlanan görev başına beklenen model çağrısı sayısıyla çarpın. Beş adımlı bir iş akışı, biri değil, beş faturalandırılabilir çağrıdır.

Örnek 1: Bir Destek Copilot'u

Varsayalım ki tek bir destek isteği 6.000 taze girdi belirteci gönderiyor ve 800 çıktı belirteci üretiyor. 200K eşiğinin altında kalır ve önbellek indirimi almaz.

  • Girdi: 6,000 × $1.60 ÷ 1,000,000 = $0.00960
  • Çıktı: 800 × $4.80 ÷ 1,000,000 = $0.00384
  • Toplam: istek başına $0.01344

Ayda 100.000 istekle, tahmini belirteç maliyeti $1,344’tür. Değerlendirme 400 belirteçlik bir yanıtın 800 belirteçlik bir yanıt kadar iyi performans gösterdiğini ortaya koyarsa, tahmin istek başına $0.01152’ye veya ayda $1,152’ye düşer. Bu tek çıktı sınırı, modeli değiştirmeden ayda yaklaşık $192 veya %14,3 tasarruf sağlar.

Bu yüzden çıktı kontrolü önemlidir. Listelenen CometAPI oranında, çıktı belirteçleri aynı katmandaki taze girdi belirteçlerinin üç katına mal olur.

Örnek 2: Kararlı 20K Belirteçlik Bir Öneki Yeniden Kullanma

Her isteğin 20.000 belirteçlik bir ürün kılavuzu, 2.000 belirteçlik yeni konuşma bağlamı ve 600 belirteçlik bir yanıt içerdiğini varsayalım.

Önbellek isabeti olmadan tahmin:

  • 22,000 taze girdi belirteci: $0.03520
  • 600 çıktı belirteci: $0.00288
  • Toplam: istek başına $0.03808

20.000 belirteçlik kararlı önek, önbelleğe alınmış girdi olarak faturalandırılır ve yalnızca 2.000 belirteç taze kalırsa, tahmin şöyle olur:

  • 20,000 önbelleğe alınmış girdi belirteci: $0.00800
  • 2,000 taze girdi belirteci: $0.00320
  • 600 çıktı belirteci: $0.00288
  • Toplam: istek başına $0.01408

100.000 istekle bu, $3,808 yerine $1,408 eder — tahmini $2,400 veya %63,0 tasarruf. Tasarruf otomatik değildir: ilk istek, değişmiş bir önek veya bir önbellek isabeti üretmeyen bir rota hâlâ taze girdi oranından faturalandırılabilir. Tahmini gerçekleşmiş tasarruf olarak ele almadan önce gerçek kullanım verilerinde önbellek-isabet belirteç sayısını doğrulayın.

Örnek 3: 200K’yı Aşmanın Maliyeti

210.000 istem belirteci ve 2.000 çıktı belirteci olan uzun süreli bir ajan isteğini düşünün. Listelenen uzun bağlam oranlarını kullanarak:

  • 210,000 taze girdi belirteci: $0.67200
  • 2,000 çıktı belirteci: $0.01920
  • Toplam: çalışma başına $0.69120

Bağlam sıkıştırma, alma filtreleme ve özet denetim noktaları istemi 2.000 belirteçlik aynı çıktıyı korurken 180.000 belirtece düşürürse, standart katman tahmini:

  • 180,000 taze girdi belirteci: $0.28800
  • 2,000 çıktı belirteci: $0.00960
  • Toplam: çalışma başına $0.29760

Fark çalışma başına $0.39360 veya yaklaşık %56,9’dur. 10.000 çalışma genelinde, tahmini tasarruf $3,936’dır. Çıkarılan ders, faydalı bağlamı silmek değildir. Yanıtı değiştiren bağlamı tutmak ve isteğin bir fiyat sınırını aşmasından önce geri kalanını özetlemek veya almak gerekir.

Çağrı Öncesi Tahminler için Bir Python Hesaplayıcı

Aşağıdaki işlev, CometAPI’nin hâlihazırda listelenen Grok 4.7 oranlarını kullanır. Toplam istem 200.000 belirtece ulaştığında uzun bağlam katmanını ihtiyatlı biçimde uygular.

from dataclasses import dataclass

@dataclass(frozen=True)
class Rates:
    input_per_million: float
    cached_input_per_million: float
    output_per_million: float

SHORT = Rates(1.60, 0.40, 4.80)
LONG = Rates(3.20, 0.80, 9.60)

def estimate_grok_47_cost(
    fresh_input_tokens: int,
    cached_input_tokens: int,
    max_output_tokens: int,
) -> float:
    prompt_tokens = fresh_input_tokens + cached_input_tokens
    rates = LONG if prompt_tokens >= 200_000 else SHORT

    return (
        fresh_input_tokens * rates.input_per_million
        + cached_input_tokens * rates.cached_input_per_million
        + max_output_tokens * rates.output_per_million
    ) / 1_000_000

estimate = estimate_grok_47_cost(
    fresh_input_tokens=2_000,
    cached_input_tokens=20_000,
    max_output_tokens=600,
)
print(f"Estimated upper bound: ${estimate:.5f}")

Bu bir planlama korumasıdır, fatura değildir. Nihai maliyet; gerçek girdi, önbelleğe alınmış girdi, çıktı, yeniden denemeler, araç çağrıları ve yürütme anındaki etkin fiyata bağlıdır. Her yanıttan sonra döndürülen belirteç kullanımı, model kimliği, istek durumu ve görev sonucunu depolayın. Bu değerleri sağlayıcının fatura kayıtlarıyla uzlaştırın.

Beklenen Etkiye Göre Sıralanmış Beş Grok 4.7 Maliyet Kontrolü

1. Tekrarlanan Bağlamı Önbelleğe Yetecek Kadar Kararlı Tutun

Statik talimatları, ürün belgelerini, şemaları ve yeniden kullanılabilir örnekleri istek-özgü içerikten önce yerleştirin. Büyük bir paylaşılan önek içinde, gerekli olmadıkça zaman damgalarını, kimlikleri, boşlukları veya sıralamayı değiştirmekten kaçının. xAI’nin Grok 4.7 rehberi, konuşmalar için kararlı önbellek-yönlendirme tanımlayıcılarını önerir; bir ara rota kullanırken, onlara güvenmeden önce hangi önbellek denetimlerinin ve kullanım alanlarının desteklendiğini doğrulayın.

Önbellek-isabet belirteçlerini ve iş yüküne göre önbellek-isabet oranını ölçün. Teorik bir önbellek indiriminin değeri, uygulama öneki sürekli değiştiriyorsa yoktur.

2. 200K’yi Hedef Değil, Mühendislik Bütçesi Olarak Görün

Eşik altındaki baş boşluğunu sistem talimatları, alınan pasajlar, araç sonuçları ve bir sonraki kullanıcı turu için ayırın. Bir ajan için, eski turları doğrulanmış bir özet hâline sıkıştırın ve ham dökümü model bağlamının dışında tutun. Alma için, her eşleşmeyi göndermek yerine pasajları eklemeden önce sıralayın ve yinelenenleri giderin.

İstem uzunluğu dağılımlarını izleyin ve p95 eşiğe yaklaşmadan uyarı verin. xAI’nin resmi tarifesine göre, bir istem 200K belirtece ulaştığında, bu istekteki tüm belirteçlere uzun bağlam oranları uygulanır. CometAPI de Grok 4.7 için ayrı, daha yüksek bir uzun bağlam katmanı listeler. Bunlar platform fiyatlandırma koşullarıdır, model yetenekleri değil.

3. Çıktıyı Sınırlandırın ve Akıl Yürütme Çabasını Bir Değerlendirme Setine Göre Ayarlayın

Ürüne uygun bir uygulama düzeyi çıktı sınırı belirleyin. Bir sınıflandırma sonucu onlarca belirteç gerektirebilir; bir destek yanıtı birkaç yüz belirteç gerektirebilir; bir araştırma raporu daha fazla gerektirebilir. Bu sınır, Grok 4.7 modelinin katı bir limiti değil; bir bütçe ve kullanıcı deneyimi kontrolüdür. xAI’nin 21 Eylül tarihli sürüm notları, Grok 4.7’nin metin çıktı sınırı olmadığını belirtir; bu, bir uygulamanın veya belirli bir API rotasının kendi istek sınırını uygulamasını engellemez. Kullandığınız rota ile herhangi bir uç nokta veya SDK tarafından uygulanan istek sınırını doğrulayın.

Grok 4.7 birden çok akıl yürütme çaba düzeyini destekler. Temsili bir değerlendirme setini geçen en düşük düzeyi kullanın ve daha yüksek çabayı ölçülebilir bir iyileştirme sağladığı görevlere ayırın. Değerlendirmesiz akıl yürütmeyi veya çıktıyı azaltmak, yeniden denemeler yaratabilir ve tasarrufu ortadan kaldırabilir.

4. Pahalı İstekleri API Çağrısından Önce Reddedin veya Yeniden Şekillendirin

Girdi boyutundan ve yapılandırılmış çıktı sınırından bir üst sınır tahmin edin. İstek ürün bütçesini aşıyorsa, uygulama kullanıcıdan görevi daraltmasını, yüklenen materyali özetlemesini, alınan bağlamı azaltmasını veya işi onaylı bir asenkron iş akışına taşımasını isteyebilir. Bu, maliyeti üretimden sonra keşfetmekten daha öngörülebilirdir.

Kabaca karakter-belirteç yaklaşımı, erken bir koruma olarak yararlı olabilir; ancak bir belirteçleyicinin veya gerçek kullanım verilerinin yerine geçmemelidir. Diller, kod, JSON ve biçimlendirme çok farklı belirteç yoğunlukları üretebilir.

5. Çağrı Başına Maliyet Değil, Başarılı Görev Başına Maliyeti Optimize Edin

İki kez doğrulamadan kalan daha ucuz bir çağrı, tek bir başarılı çağrıdan daha pahalı olabilir. Şunları takip edin:

  • kabul edilen yanıt başına maliyet;
  • tamamlanan ajan görevi başına maliyet;
  • yeniden deneme ve yedekleme maliyeti;
  • önbellek-isabet oranı ve önbelleğe alınmış belirteç payı;
  • p50 ve p95 istem ve çıktı belirteçleri;
  • kalite puanı, gecikme ve insan eskalasyon oranı.

Rutin trafik Grok 4.7’nin kalitesini veya bağlam kapasitesini gerektirmiyorsa, CometAPI’nin birleşik model kataloğu, uygulama yönetimli model geçişini kolaylaştırabilir. Yönlendirme kuralını açık tutun, her modeli aynı görev setinde değerlendirin ve yalnızca Grok 4.7’den fayda sağlayan istekleri bu rotaya gönderin.

Pratik Aylık Maliyet İncelemesi

Haftada bir, trafiği özelliğe göre gruplayın ve tahmini maliyeti gerçek kullanım ile karşılaştırın. Önce en fazla çıktı belirteçlerinden sorumlu özellikler, en büyük istemler ve en düşük önbellek-isabet oranı ile başlayın. Ardından ortanca isteği körlemesine optimize etmek yerine pahalı aykırı değerleri inceleyin.

SinyalOlası problemİlk aksiyon
Düşük önbelleğe alınmış belirteç payıPaylaşılan önek çok sık değişiyorYeniden kullanılabilir bağlamı stabilize edin ve sürümlendirin
İstemler 200K civarında kümeleniyorGeçmiş veya alma sınırsızSıkıştırın, sıralayın ve pay bırakın
Harcamayı çıktı domine ediyorYanıtlar ürünün ihtiyaç duyduğundan daha uzunSınırı düşürün ve yanıt kalitesini test edin
Yüksek yeniden deneme maliyetiDoğrulama, zaman aşımları veya istemler kararsızİlk çağrıdaki hata modunu düzeltin
Düşük maliyet ama zayıf görev tamamlamaOptimizasyon faydalı kaliteyi düşürdüKabul edilen sonuç başına maliyeti ölçün

CometAPI, Grok 4.7 Maliyet Modelinde Nereye Oturur

CometAPI’nin rolü, API platformu düzeyindedir: Grok 4.7’ye erişim sağlar, kendi belirteç oranlarını yayımlar ve OpenAI uyumlu bir giriş noktası belgelendirir. Bu, Grok 4.7’nin temel model yeteneklerini değiştirmez. Halihazırda OpenAI tarzı bir istemci kullanan ekipler, uç nokta uyumluluğuna tabi olarak, API anahtarını, temel URL’yi ve model kimliğini değiştirirken aynı istemci desenini koruyabilir.

28 Eylül 2026 itibarıyla, CometAPI’nin listelenen Grok 4.7 oranları hem standart hem de uzun bağlam katmanlarında xAI’nin karşılık gelen doğrudan oranlarının %20 altındadır. Bu bir platform-fiyat karşılaştırmasıdır, model kalitesi iddiası değildir. Üretime geçmeden önce, etkin model kimliğini, uç nokta parametrelerini, önbellek davranışını, hız sınırlarını, güvenilirliği, desteği ve faturalandırma koşullarını da doğrulayın.

Modeli test etmek için, güncel fiyatlandırma ve erişim ayrıntılarını CometAPI Grok 4.7 model sayfasında inceleyin. Fiyat tablosunu yapılandırmada tutun, her çağrıdan sonra gerçek kullanımı kaydedin ve model veya ürün davranışı değiştiğinde iş yükü tahminlerini yeniden çalıştırın.

SSS

CometAPI'de Grok 4.7’nin belirteç başına fiyatı nedir?

200K belirtecin altındaki istemler için, CometAPI hâlihazırda milyon başına taze girdi belirteçleri için $1.60, önbelleğe alınmış girdi belirteçleri için $0.40 ve çıktı belirteçleri için $4.80 listeler. Listelenen uzun bağlam oranları sırasıyla milyon başına $3.20, $0.80 ve $9.60’tır.

Bir Grok 4.7 API isteğinin maliyeti ne kadar?

Taze girdi, önbelleğe alınmış girdi, çıktı ve etkin bağlam katmanına bağlıdır. Her belirteç sayısını milyon başına oranıyla çarpın, sonuçları toplayın ve bir milyona bölün. Ayrıca yeniden denemeleri ve çok adımlı bir iş akışındaki her model çağrısını dahil edin.

Grok 4.7 API maliyetini azaltmanın en kolay yolu nedir?

En büyük ölçülen maliyet sürücüsüyle başlayın. Tekrarlanan uzun talimatlar genellikle önbellekten faydalanır; büyüyen ajan geçmişleri sıkıştırmadan fayda sağlar; fazla uzun yanıtlar daha düşük bir çıktı sınırından fayda sağlar. Her değişiklikten sonra kalitenin kabul edilebilir kaldığını doğrulayın.

500K’lık bağlam penceresi 500K belirteç göndermem gerektiği anlamına mı gelir?

Hayır. Bağlam penceresi bir kapasite sınırıdır, bir öneri değildir. xAI doğrudan fiyatlandırması ve CometAPI’nin güncel listelemesi, 200K istem eşiğinde daha yüksek uzun bağlam oranları kullanır; bu yüzden uygulamalar görev için gereken bağlamı göndermelidir.

Grok 4.7’yi çağırmadan önce maliyeti tahmin edebilir miyim?

Evet. Girdi belirteçlerini tahmin edin, doğru bağlam katmanını seçin, gerçekçi bir çıktı sınırı ekleyin ve üst sınırı hesaplayın. Çağrıdan sonra, raporlama ve optimizasyon için tahmini gerçek kullanım verileriyle değiştirin.

Öğrenmeye devam et

Bu makaleyi sonraki karara bağlayın.

Tüm konuları gör
Yayınlanma tarihi Oct 1, 2026
Son güncelleme Oct 1, 2026
0 görüntülenme
Netlik, kaynak ataması ve güncel API terminolojisi açısından gözden geçirildi.

Devamını Oku