SEO Meta Verileri
TL;DR
- Mevcut resmi API spesifikasyonu 400K bağlam penceresi, 128K azami çıktı, 16 Şubat 2026 bilgi kesimi, görsel girişi, akıl yürütme belirteçleri, akış (streaming), işlev çağırma, yapılandırılmış çıktılar ve geniş bir Responses API araç yüzeyi listeliyor.
GPT-5.6-Cyber Nedir?
OpenAI, GPT-5.6-Cyber'ı onaylı savunucular için amaç odaklı eğitilmiş en gelişmiş siber güvenlik modellerinin bir takma adı olarak tanımlar. Hedeflenen işler arasında ileri düzey yetkili zafiyet araştırması, exploit doğrulaması ve güvenlik testleri yer alır. Model, tüketiciye yönelik bir “hacking modu” olarak konumlandırılmamıştır; erişim Daybreak programı ve yetkilendirme kontrolleriyle yönetilir.
GPT-5.6-Cyber Temel Özellikleri
| Özellik | GPT-5.6-Cyber |
|---|---|
| Sağlayıcı | OpenAI |
| Model kimliği | gpt-5.6-cyber |
| Model sınıfı | Amaç odaklı eğitilmiş siber güvenlik akıl yürütme modeli |
| Temel model | GPT-5.6 Sol |
| Birincil erişim yolu | Daybreak Red / ayrı onay ve sağlama |
| Bağlam penceresi | 400,000 belirteç |
| Azami çıktı | 128,000 belirteç |
| Bilgi kesimi | 16 Şubat 2026 |
| Metin | Girdi ve çıktı |
| Görsel | Yalnızca girdi |
| Ses / video | Desteklenmiyor |
| Akıl yürütme belirteçleri | Desteklenir |
| Akış (Streaming) | Desteklenir |
| İşlev çağırma | Desteklenir |
| Yapılandırılmış çıktılar | Desteklenir |
| İnce ayar (Fine-tuning) | Desteklenmiyor |
| Responses API | Desteklenir |
| Chat Completions | Desteklenir |
OpenAI GPT-5.6-Cyber’ı Neden Oluşturdu?
OpenAI’nin Daybreak duyurusu dağıtım sorununu doğrudan açıklar: sistem düzeyi siber güvenlik korumaları kötüye kullanımı engelleyebilir, ancak meşru savunma çalışmalarını da bloke edebilir. Daybreak Blue, geniş savunma kullanımları için bu sürtünmeyi azaltır. Bununla birlikte, bu sistem düzeyi çitler kaldırılmış olsa dahi, Sol hâlâ model düzeyinde yüksek çift kullanımlı talepleri reddedebilir.
Daybreak Blue ile Daybreak Red
| Boyut | Daybreak Blue | Daybreak Red |
|---|---|---|
| Çekirdek model | GPT-5.6 Sol gibi sınır (frontier) genel amaçlı modeller | GPT-5.6-Cyber gibi amaç odaklı eğitilmiş siber güvenlik modelleri |
| En iyi başlangıç noktası | Çoğu savunucu için önerilir | İleri uzman iş akışlarına ihtiyaç duyan ekipler için |
| Tipik işler | Zafiyet keşfi, güvenli kod incelemesi, zararlı yazılım analizi, olay müdahalesi, yama doğrulaması | İleri zafiyet araştırması, exploit doğrulaması, sızma testi, red teaming |
| OpenAI değerlendirmesinde gelişmiş tamamlama oranı | Blue altında Sol için %2,0 | GPT-5.6-Cyber için %95,0 |
| Erişim | Onaylı savunucular | Daha riskli kullanım senaryosuna sahip onaylı savunucular |
| İşletim kontrolleri | Kimlik doğrulama, hesap güvenliği, izleme, onaylı kullanım kısıtlamaları, yasal beyanlar | Aynı çekirdek kontroller; izolasyon, kapsam kontrolleri ve inceleme ihtiyacı daha güçlü |
GPT-5.6-Cyber Kıyaslama Performansı
Gelişmiş Siber Güvenlik Tamamlama Oranı
| Model / erişim yapılandırması | Tamamlama oranı |
|---|---|
| GPT-5.6-Cyber — Daybreak Red | %95,0 |
| GPT-5.5-Cyber — Daybreak Red | %57,3 |
| GPT-5.6 Sol — Daybreak Blue | %2,0 |
| GPT-5.6 Sol — korumalar etkin | %1,5 |
ExploitGym
GPT-5.6 sistem kartı, temel Sol ailesinin kontrollü exploit geliştirme alanında zaten ne kadar güçlü olduğuna dair faydalı bir bağlam sunar. Cyber duyurusu, uzman modelin ExploitGym’de bu Sol taban çizgisinin ötesine geçtiğini bildirir.
Sıfır Gün Keşfi Değerlendirmesi
OpenAI’nin dahili sıfır gün değerlendirmesi, her modele açık kaynaklı bir deponun mevcut sürümünü verip azami etkiye sahip kavram kanıtı exploit’ler ve teknik bir yazı üretmesini ister. Puanlama; ciddiyet, etki, kalibrasyon ve rapor kalitesini kapsar. Daybreak Red ile GPT-5.6-Cyber, bu değerlendirmede Daybreak Blue ile GPT-5.6 Sol’u geride bıraktı.
Zafiyet Keşfi ve Rapor Yazımı
OpenAI’nin Zafiyet Keşfi ve Rapor Yazımı değerlendirmesinde her iki GPT-5.6 varyantı da GPT-5.5-Cyber’a göre iyileşme gösterdi, ancak GPT-5.6-Cyber, GPT-5.6 Sol’un altında puan aldı. OpenAI, aradaki farkı kısmen Cyber’ın daha kısa ve daha az ayrıntılı zafiyet raporları üretmesine bağlar.
ExploitBench
ExploitBench, savunma korumaları etkin kalırken bir ajanın bir V8 zafiyetini tam bir exploite dönüştürüp dönüştüremeyeceğini değerlendirir. GPT-5.6 Sol, standart 300 turluk yapılandırmada en iyi performansı gösterir ve belirteç kullanımında daha verimlidir; 600 turda Sol ile Cyber arasındaki fark daralır.
| Değerlendirme | GPT-5.6-Cyber sonucu | Sonucun anlamı |
|---|---|---|
| Gelişmiş Siber Güvenlik Tamamlama Oranı | %95,0; GPT-5.5-Cyber’a göre +37,7 puan | Belirli ileri düzey istek setinde çok daha düşük ret sürtünmesi |
| ExploitGym | GPT-5.6 Sol ve GPT-5.5-Cyber’ı geride bırakır | Kontrollü exploit geliştirme uzmanlığında daha güçlü |
| Dahili sıfır gün keşfi | GPT-5.6 Sol’u (Daybreak Blue) geçer | OpenAI’nin dahili eval’ında daha iyi uzmanlaşmış yeni zafiyet araştırması |
| Zafiyet Keşfi + Rapor Yazımı | GPT-5.6 Sol’un altında; eski Cyber tabanının üzerinde | Bazı uçtan uca raporlama işlerinde Sol daha güçlü |
| ExploitBench — 300 tur | Sol’un altında | Standart zor exploit ayarında Sol daha güçlü ve belirteç açısından daha verimli |
| ExploitBench — 600 tur | Fark daralır | Daha fazla ajan bütçesi, Cyber’ın farkın bir kısmını kapatmasına yardımcı olur |
%95 Skoru Gerçekte Ne Anlama Geliyor?
%95,0 rakamı bir tamamlama oranıdır; doğruluk, exploit başarısı veya zafiyet tespiti skoru değildir. GPT-5.6-Cyber’ın exploit zincirleri, kimlik doğrulama atlatma, ayrıcalık yükseltme ve ilgili senaryoları içeren ileri düzey siber güvenlik isteklerine ne sıklıkla yanıt verdiğini ölçer. Bunu ExploitGym, sıfır gün değerlendirmesi, rapor yazım kalitesi ve ExploitBench ile birlikte okuyun.
GPT-5.6-Cyber vs GPT-5.6 Sol vs GPT-5.5-Cyber
| Boyut | GPT-5.6-Cyber | GPT-5.6 Sol | GPT-5.5-Cyber |
|---|---|---|---|
| Konumlandırma | Siber güvenlik uzmanı | Genel amiral gemisi | Önceki uzman nesil |
| Temel | GPT-5.6 Sol üzerine kurulu | GPT-5.6 ailesinin amiral gemisi | GPT-5.5 nesli |
| Birincil erişim | Daybreak Red / onaylı erişim | Standart API ve Daybreak Blue | Daybreak Red / güvenilir erişim |
| Bağlam penceresi | 400K | 1,05M | Burada karşılaştırılmadı |
| Azami çıktı | 128K | 128K | Burada karşılaştırılmadı |
| Gelişmiş Siber Tamamlama | %95,0 | Blue için %2,0 / standart için %1,5 | %57,3 |
| ExploitGym | OpenAI’nin Cyber duyurusundaki üçlü arasında en iyi | Cyber’ın altında | Cyber’ın altında |
| Dahili sıfır gün eval | Sol Blue’u geçer | Cyber’ın altında | Daha erken taban çizgisi |
| Zafiyet raporu kalitesi | Daha kısa / daha az ayrıntılı olabilir | Alıntılanan rapor yazımı eval’ında iki 5.6 varyantının en iyisi | Her iki 5.6 varyantının altında |
| ExploitBench — 300 tur | Sol’un altında | En iyi / belirteç açısından daha verimli | Daha düşük taban |
| Genel amaçlı akıl yürütme | Uzmanlaşmış | En iyi uyum | Uzmanlaşmış |
GPT-5.6-Cyber’ı seçin darboğaz, onaylı bir ortamda ileri siber uzmanlık ya da ret sürtünmesi ise. Daha geniş profesyonel akıl yürütme, çok daha büyük bağlam, daha güçlü uzun biçim raporlama veya güvenlik ve güvenlik dışı iş yüklerini tek modelle kapsama ihtiyacı olduğunda GPT-5.6 Sol tercih edin.
Karar rehberi: GPT-5.6-Cyber, GPT-5.6 Sol’dan evrensel olarak daha iyi değildir. Onaylı iş, exploit odaklı uzmanlaşmaya, sıfır gün araştırmasına veya daha düşük ret sürtünmesine bağlı olduğunda Cyber’ı seçin. Daha geniş profesyonel akıl yürütme, daha büyük bağlam, daha güçlü rapor yazımı ve güvenliği genel mühendislikle karıştıran iş yükleri için Sol’u seçin. Olgun bir yığın, derin exploit doğrulamasını Cyber’a yönlendirirken kod incelemesi, uzun bağlamlı araştırmalar, raporlama ve genel mühendisliği Sol üzerinde tutabilir.
Gerçek Dünyada GPT-5.6-Cyber ile Bulunan Zafiyetler
OpenAI, GPT-5.6-Cyber’ı Chrome’un kullandığı JavaScript motoru V8’i araştırmak için kullandığını bildiriyor. Araştırma, bellek bozmayı ve V8 heap sandbox’ından kaçışı zincirleyebilen iki daha önce bilinmeyen zafiyeti ortaya çıkardı; bulgular doğrulandı ve koordineli ifşa ile Google’a raporlandı.
Google, OpenAI’nin yüksek ciddiyetli bir V8 optimize edici-derleyici hatası olarak tanımladığı CVE-2026-15903’ü düzeltti. Tamsayı dönüştürme sırasında atlanan bir güvenlik kontrolü beklenmedik derecede büyük bir değer üretebilir, bir sınır denetiminin atlanmasına izin verebilir ve amaçlanan nesnenin dışında bellek erişimini etkinleştirebilir. Heap sandbox’ından kaçmak için ikinci bir zafiyet gerekliydi.
CVE-2026-15903 exploit-zinciri genel bakışı. Kaynak: OpenAI.
OpenAI ayrıca modelin şunları tespit etmek için kullanıldığını bildiriyor:
- Popüler bir mobil işletim sisteminde en az beş zafiyet; aralarında güvenilmeyen bir uygulamadan yerel ayrıcalık yükseltmeye giden bir zincir dahil.
- Popüler bir veritabanında uzaktan kod çalıştırmaya giden bir yol içeren üç kritik zafiyet.
- Popüler bir işletim sistemi çekirdeğinde ayrıcalık yükseltmeye yol açabilecek 400’den fazla zafiyet.
Bu ek sayılar, devam eden ifşa ve düzeltme çalışmaları kapsamında OpenAI’nin raporladığı bulgular olmaya devam etmektedir; karşılık gelen duyurular mevcut olmadıkça bunlar kamuya açık bir CVE envanteri olarak sunulmamalıdır.
GPT-5.6-Cyber Özellikleri ve Araç Desteği
| Yetenek | Destek |
|---|---|
| Metin girdi/çıktı | Desteklenir |
| Görsel girdi | Desteklenir |
| Akıl yürütme belirteçleri | Desteklenir |
| Akış (Streaming) | Desteklenir |
| İşlev çağırma | Desteklenir |
| Yapılandırılmış çıktılar | Desteklenir |
| Web araması | Desteklenir |
| Dosya araması | Desteklenir |
| Görüntü oluşturma aracı | Desteklenir |
| Code Interpreter | Desteklenir |
| Barındırılan kabuk | Desteklenir |
| Apply Patch | Desteklenir |
| Skills | Desteklenir |
| Bilgisayar kullanımı | Desteklenir |
| MCP | Desteklenir |
| Araç arama | Desteklenir |
| İnce ayar (Fine-tuning) | Desteklenmiyor |
Bunun önemi: modern zafiyet araştırması bir ajan döngüsüdür. Modelin bir depoyu incelemesi, kaynak üzerinde akıl yürütmesi, kodu yalıtılmış bir ortamda çalıştırması, bir hipotezi doğrulaması, bir yamayı düzenlemesi ve yeniden test etmesi gerekebilir. Bu nedenle araç desteği, statik kıyas puanları kadar önemlidir.
GPT-5.6-Cyber Fiyatlandırması
OpenAI’nin mevcut resmi fiyatlandırması milyon başına girdi belirteçleri için $12,50, önbelleğe alınmış girdi belirteçleri için $1,25 ve çıktı belirteçleri için $75’tir. 272K’dan fazla girdi belirteci içeren istekler, tam istek için girdi tarafında 2×, çıktı tarafında 1,5× fiyatlandırılır ve önbellek yazımları önbelleksiz girdi oranının 1,25×’i üzerinden ücretlendirilir.
| Fiyatlandırma metriği | OpenAI resmi |
|---|---|
| Girdi | $12,50 / 1M belirteç |
| Önbellekli girdi | $1,25 / 1M belirteç |
| Çıktı | $75,00 / 1M belirteç |
| Uzun-bağlam kuralı | >272K girdi: tam istek için 2× girdi ve 1,5× çıktı |
CometAPI şu anda aynı model sayfasında gösterilen mevcut OpenAI liste fiyatlarına göre %20 indirimle milyon başına $10 girdi ve $60 çıktı listeliyor. Üretime geçmeden önce canlı model sayfası kontrol edilmelidir; çünkü kullanıma sunma sırasında erişilebilirlik ve yönlendirme durumu değişebilir.
| Fiyat | CometAPI | OpenAI resmi | Fark |
|---|---|---|---|
| Girdi | $10 / 1M | $12,50 / 1M | %20 daha düşük |
| Çıktı | $60 / 1M | $75 / 1M | %20 daha düşük |
GPT-5.6-Cyber’a Nasıl Erişilir
Uygulamada, ekipler şunları planlamalıdır:
- Kimlik doğrulama ve hesap güvenliği gereksinimleri.
- Test edilecek sistemler ve eylemler için açıkça tanımlanmış yetkili kapsam.
- İzleme, onaylı kullanım kısıtlamaları ve yasal beyanlar.
- Daha riskli güvenlik iş akışları için sandbox veya yalıtılmış ortamlar.
- Yükseltilmiş izin gerektiren araç çağrıları için insan incelemesi veya otomatik inceleme.
- 1 Eylül 2026’dan itibaren bireysel Daybreak hesapları için donanım güvenlik anahtarları.
CometAPI ile GPT-5.6-Cyber Nasıl Kullanılır
CometAPI'nin GPT-5.6 Cyber sayfası model kimliğini ve OpenAI uyumlu uç noktaları listeler. Erişim yine de hesabın onaylı siber yetkisine bağlıdır. Aşağıdaki örnekler, dar kapsamlı ve yetkilendirilmiş değerlendirme istemleri kullanır.
Python
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.responses.create(
model="gpt-5.6-cyber",
input=(
"Within the explicitly authorized scope, review this security "
"assessment and prioritize remediation. Do not test any system."
),
)
print(response.output_text)
Bash (cURL)
curl https://api.cometapi.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_KEY" \
-d '{
"model": "gpt-5.6-cyber",
"input": "Within the authorized scope, review this assessment and prioritize remediation."
}'
GPT-5.6-Cyber için En İyi Kullanım Senaryoları
İleri Düzey Zafiyet Araştırması
En net uyum, amacın onaylı bir araştırma kapsamı altında ciddi zafiyetleri belirlemek, çoğaltmak ve doğrulamak olduğu, tanıdık olmayan kod tabanlarının sürekli analizidir. Dahili sıfır gün değerlendirmesi ve OpenAI’nin V8 çalışması bu kullanım alanına işaret eder.
Kontrollü Ortamlarda Exploit Doğrulaması
ExploitGym, bilinen zafiyetleri kontrollü ortamlarda çalışan kod yürütmeye dönüştürme üzerine tasarlanmıştır. Bu, savunma ekibinin bir bulgunun gerçekten istismar edilebilir olup olmadığını önceliklendirmeden önce belirlemesi gerektiğinde Cyber’ı ilgili kılar.
Sızma Testi ve Red-Team Araştırması
Yetkili sızma testi ve red teaming, genel modeller için niyet belirsizliği yaratır. Daybreak Red, doğrulanmış erişim ve işletim kontrolleriyle bu belirsizliği giderir; uzman modelin teknik olarak gerekli işlerin daha fazlasını, bu davranışı evrensel olarak erişilebilir kılmadan tamamlamasına olanak tanır.
Yama Doğrulaması
Uzman exploit odaklı bir model, bir yamanın savunmasız yolu kapatıp kapatmadığını, alternatif yürütme yollarının kalıp kalmadığını ve regresyon testlerinin güvenlik sınırını kapsayıp kapsamadığını test etmeye yardımcı olabilir. Bu, zafiyet keşfinin savunmacı bir tamamlayıcısıdır.
Ajan Tabanlı Güvenlik Otomasyonu
GPT-5.6-Cyber Sınırlamaları
- Başlıkta geçen %95 sonucu bir tamamlama metriğidir; doğruluk skoru değildir.
- Cyber’ın 400K bağlam penceresi, Sol’un 1,05M bağlam penceresinden çok daha küçüktür.
- Model kasıtlı olarak onayla sınırlandırılmıştır ve yetkili işler için tasarlanmıştır; bu nedenle yalnızca bir model kimliğine bakarak genel erişilebilirlik varsayılmamalıdır.
- Kamuya açık CVE’ler dışında gerçek dünya zafiyet sayıları, bağımsız duyurular veya satıcı kayıtları mevcut olana kadar OpenAI’nin raporladığı bulgular olarak tanımlanmalıdır.
Güvenlik ve Hazırlık
Operasyonel çıkarım basittir: daha güçlü model kabiliyeti, daha güçlü sistem kontrolleriyle eşleştirilmelidir. OpenAI’nin kendi rehberi, sandboxing, izleme, açık kapsam ve yükseltilmiş eylemlerin incelenmesini vurgular. Üretim güvenlik ekipleri için bu kontroller, bir isteme bırakılmak yerine altyapı ve politika ile uygulanmalıdır.
Sonuç
GPT-5.6-Cyber, onaylı savunucular tarafından ileri düzey, yetkili zafiyet araştırması, exploit doğrulaması ve güvenlik testleri için amaç odaklı eğitilmiş bir modeldir. %95,0’lık Gelişmiş Siber Güvenlik Tamamlama Oranı, ret sürtünmesinin belirgin şekilde azaldığını gösterirken, daha geniş değerlendirme seti gerçek ödünleşimleri ortaya koyar: Cyber seçili uzman testlerde önde, ancak GPT-5.6 Sol, bazı rapor yazımı ve standart ExploitBench iş yüklerinde daha güçlü kalır.
Çoğu ekip, Daybreak Blue ve GPT-5.6 Sol ile başlamalıdır. Yalnızca yetkili iş akışı daha derin exploit odaklı uzmanlaşmayı gerektirdiğinde Daybreak Red ve GPT-5.6-Cyber talep edin ve bu erişimi açık kapsam, izolasyon, izleme ve yükseltilmiş eylemlerin incelenmesiyle eşleştirin.
SSS
GPT-5.6-Cyber nedir?
GPT-5.6-Cyber, Daybreak Red aracılığıyla ileri düzey, yetkili zafiyet araştırması, exploit doğrulaması ve güvenlik testleri yürüten onaylı savunucular için OpenAI’nin amaç odaklı eğitilmiş siber güvenlik model takma adıdır.
GPT-5.6-Cyber ne zaman duyuruldu?
OpenAI, GPT-5.6-Cyber’ı ve genişletilen Daybreak programını 10 Ağustos 2026’da duyurdu.
GPT-5.6-Cyber’ın bağlam penceresi nedir?
Mevcut resmi model dokümantasyonu 400.000 belirteçlik bağlam penceresi ve 128.000 belirteçlik azami çıktıyı listeler.
GPT-5.6-Cyber’ın maliyeti nedir?
OpenAI şu anda girdi için $12,50/M, önbellekli girdi için $1,25/M ve çıktı için $75/M listeliyor. CometAPI model sayfasında şu anda girdi için $10/M ve çıktı için $60/M listeliyor.
GPT-5.6-Cyber, GPT-5.6 Sol’dan daha mı iyi?
Evrensel olarak değil. Cyber, ExploitGym ve dahili bir sıfır gün test gibi seçili uzman değerlendirmelerde önde gelirken, Sol alıntılanan zafiyet rapor yazımı değerlendirmesinde ve standart 300 turluk ExploitBench ayarında daha iyi performans gösterir.
%95 kıyas ne anlama geliyor?
Modelin ileri düzey siber güvenlik isteklerini tamamlayıp tamamlamadığını ölçer. Bu bir %95 doğruluk, exploit başarısı veya zafiyet tespiti isabet oranı değildir.
Bu, modelin ileri düzey istekleri tamamlayıp tamamlamadığını ölçen Gelişmiş Siber Güvenlik Tamamlama Oranıdır. %95 exploit başarısı veya zafiyet tespiti isabet oranı değildir.
Herkes GPT-5.6-Cyber’ı kullanabilir mi?
Hayır. OpenAI, modelin yetkili güvenlik çalışmaları için Daybreak üzerinden ayrı onay ve sağlama gerektirdiğini belirtir.
GPT-5.6-Cyber model kimliği nedir?
Resmi model kimliği gpt-5.6-cyber’dır. Erişim, ayrı Daybreak onayı ve sağlama gerektirir.
GPT-5.6-Cyber araçları destekliyor mu?
Evet. Mevcut Responses API dokümantasyonu; web araması, dosya araması, görüntü oluşturma, Code Interpreter, barındırılan kabuk, Apply Patch, Skills, bilgisayar kullanımı, MCP ve araç aramasını listeler.
- GPT-5.6-Cyber, GPT-5.6 Sol için evrensel bir ikame değil uzman bir modeldir. İleri düzey yetkili zafiyet araştırması, exploit doğrulaması, sızma testi ve ilgili güvenlik iş akışları için ayarlanmıştır.
- Başlık Gelişmiş Siber Güvenlik Tamamlama Oranı %95,0; Daybreak Blue üzerinden GPT-5.6 Sol için %2,0, standart korunmuş GPT-5.6 Sol için %1,5 ve GPT-5.5-Cyber için %57,3’tür.
- OpenAI, GPT-5.6-Cyber’ın ExploitGym’de GPT-5.6 Sol’u ve GPT-5.5-Cyber’ı geçtiğini ve dahili bir sıfır gün değerlendirmesinde Sol’u geride bıraktığını bildirirken, Sol’un standart 300 turluk ExploitBench ayarında ve zafiyet keşfi artı rapor yazımında daha iyi olduğunu belirtir.
- Resmi fiyatlandırma, milyon başına girdi $12,50, önbellekli girdi $1,25 ve çıktı $75’tir. CometAPI, GPT-5.6 Cyber model sayfasında şu anda girdi için $10/M ve çıktı için $60/M listeler.
- GPT-5.6 Sol, alıntılanan zafiyet raporlaması değerlendirmesi ve standart 300 turluk ExploitBench yapılandırması dahil önemli değerlendirmelerde hâlâ öndedir.
- OpenAI, GPT-5.6-Cyber’ın Sol’a kıyasla daha geniş bir akıl yürütme bütçesi kullanma eğiliminde olduğunu, bunun da belirteç kullanımını artırabileceğini not eder.
