gpt-oss-20b-free'nin teknik özellikleri
| Özellik | gpt-oss-20b |
|---|---|
| Sağlayıcı | OpenAI |
| Model ailesi | gpt-oss açık ağırlıklı akıl yürütme modelleri |
| Model | gpt-oss-20b-free |
| CometAPI'deki Model Kimliği | gpt-oss-20b-free |
| Mimari | Uzmanlar Karışımı (MoE) |
| Toplam parametre sayısı | 21B |
| Etkin parametreler | 3.6B |
| Bağlam penceresi | 131,072 belirteç |
| Maksimum çıktı belirteci sayısı | 131,072 |
| Girdi / çıktı | Metin girişi, metin çıkışı |
| Akıl yürütme çabası | Düşük, orta, yüksek |
| Lisans | Apache 2.0, gpt-oss kullanım politikasına tabidir |
| Fonksiyon çağırma | Desteklenir |
| Yapılandırılmış çıktılar | Desteklenir |
| Akış | Desteklenir |
| İnce ayar | Açık araçlar/altyapı üzerinden desteklenir |
| Yerel dağıtım hedefi | Yerel, edge, özel altyapı veya barındırılan çıkarım |
| Bilgi kesim tarihi | 1 Haziran 2024 |
gpt-oss-20b nedir?
gpt-oss-20b, gpt-oss ailesindeki OpenAI'nin daha küçük açık ağırlıklı akıl yürütme modelidir. CometAPI ayrıca gpt-oss-20b'yi ücretsiz kullanım için sunar; kimlik gpt-oss-20b-free'dir. Toplam 21 milyar parametreye sahiptir ancak çıkarım gereksinimlerini azaltırken önemli ölçüde akıl yürütme kapasitesini korumak için Mixture-of-Experts mimarisini kullanarak her ileri geçişte yaklaşık 3.6 milyar parametreyi etkinleştirir. OpenAI, modeli en büyük mülkiyetli modellerinin doğrudan bir yedeği yerine daha düşük gecikme, yerel ve uzmanlaşmış iş yükleri için konumlandırmaktadır.
Model yalnızca metindir ve akıl yürütme ile ajan tabanlı iş akışları için tasarlanmıştır. Açık ağırlıklar indirilebilir, özelleştirilebilir, ince ayar yapılabilir ve geliştiricinin kontrol ettiği altyapıda dağıtılabilir. OpenAI ve Hugging Face, modeli yaklaşık 16 GB bellek içerisinde çalıştırmaya olanak tanıyan yerel MXFP4 nicemlemeyi belgelemiştir; bu da model sınıfı için alışılmadık derecede erişilebilir kılar.
gpt-oss-20b'nin başlıca özellikleri
- Verimli MoE mimarisi: Her ileri geçişte yalnızca 3.6B etkin parametreyle toplam 21B parametre; daha düşük gecikme ve daha düşük dağıtım gereksinimlerini hedefler.
- Yapılandırılabilir akıl yürütme: Geliştiriciler, yanıt gecikmesi ve hesaplamayı akıl yürütme kalitesiyle takas etmek için düşük, orta veya yüksek akıl yürütme çabasını seçebilir.
- Ajan tabanlı araç kullanımı: Sunucu çalışma zamanı bu araçları sunduğunda model, fonksiyon çağırma, web taraması, Python çalıştırma ve yapılandırılmış çıktıları içeren iş akışlarını destekler.
- Açık ağırlıklı özelleştirme: Apache 2.0 lisansı, gpt-oss kullanım politikasına tabi olarak geniş kapsamlı değişiklik ve ticari dağıtıma izin verir.
- Yerel ve özel dağıtım: Model, yerel veya özel ortamlar dahil olmak üzere geliştiricilerin kontrol ettiği altyapıda çalışacak şekilde tasarlanmıştır.
- Uzun bağlam: Üretim model belgeleri, 131,072-belirteçlik bir bağlam penceresi ve 131,072 maksimum çıktı belirteci sınırı listeler.
gpt-oss-20b'nin kıyaslama performansı
OpenAI'nin yayımladığı değerlendirme sonuçları, gpt-oss-20b'nin boyutuna göre özellikle matematiksel akıl yürütme ve kodlamada güçlü olduğunu gösteriyor. Yüksek akıl yürütme çabası ve araçlarla, AIME 2025'te %98,7, AIME 2024'te %96,0, SWE-Bench Verified'da %60,7 ve Tau-Bench Retail'de %54,8 elde eder. Bilgi ve akıl yürütme değerlendirmelerinde OpenAI, MMLU'da %85,3, araçsız GPQA Diamond'da %71,5 ve araçlarla Humanity's Last Exam'de %17,3 bildirmektedir. Sonuçlar akıl yürütme düzeyi ve araç erişimine göre önemli ölçüde değiştiğinden, bu sayıların evrensel üretim doğruluk oranları olarak ele alınmaması gerekir.
| Kıyaslama | gpt-oss-20b sonucu | Değerlendirme koşulu |
|---|---|---|
| AIME 2024 | %96,0 | Yüksek akıl yürütme, araçlarla |
| AIME 2025 | %98,7 | Yüksek akıl yürütme, araçlarla |
| GPQA Diamond | %71,5 | Yüksek akıl yürütme, araçsız |
| MMLU | %85,3 | Yüksek akıl yürütme |
| SWE-Bench Verified | %60,7 | Yüksek akıl yürütme |
| Tau-Bench Retail | %54,8 | Yüksek akıl yürütme |
| Humanity's Last Exam | %17,3 | Yüksek akıl yürütme, araçlarla |
OpenAI'nin kendi karşılaştırması, gpt-oss-20b'yi birkaç değerlendirme kategorisinde o3-mini'ye yakın konumlandırırken, daha büyük gpt-oss-120b genellikle geniş bilgi ve ajan tabanlı iş yüklerinde avantajlıdır.
gpt-oss-20b vs gpt-oss-120b vs o3-mini
| Model | Birincil avantaj | Bağlam | En uygun kullanım |
|---|---|---|---|
| gpt-oss-20b | Verimli açık ağırlıklı akıl yürütme | 131K | Yerel çıkarım, kodlama, matematik, özelleşmiş ajanlar |
| gpt-oss-120b | Daha yüksek genel yetenek | 131K | Daha talepkâr akıl yürütme ve üretim iş yükleri |
| o3-mini | Mülkiyetli akıl yürütme modeli | Dağıtıma göre değişir | Açık ağırlıkların gerekmediği yönetilen akıl yürütme |
Pratik fark, dağıtım kontrolüdür. Geliştiricilerin açık ağırlıklar, yerel/özel yürütme, özelleştirme veya nispeten mütevazı donanım gereksinimleri istediği durumlarda gpt-oss-20b daha iyi bir seçenektir. Genel akıl yürütme ve bilgi performansının daha yüksek olduğu durumlarda gpt-oss-120b, daha büyük bir dağıtım ayak izini haklı çıkardığında tercih edilir.
gpt-oss-20b'nin sınırlamaları
gpt-oss-20b yalnızca metindir ve görüntü, ses veya video girdilerini doğal olarak kabul etmez. Daha küçük parametre sayısı ayrıca, gpt-oss-120b ile karşılaştırıldığında bazı bilgi ağırlıklı ve ajan tabanlı değerlendirmelerde bir performans farkı yaratır. Buna ek olarak, açık ağırlıklı dağıtım daha fazla operasyonel sorumluluğu geliştiriciye devreder: barındırma, ölçekleme, izleme, güvenlik kontrolleri ve çalışma zamanı yapılandırması, tamamen yönetilen bir mülkiyetli API ile aynı şekilde ele alınmaz.
OpenAI ayrıca, geliştiricilerin ağırlıkları değiştirebilmesi veya ince ayar yapabilmesi nedeniyle açık ağırlıklı modellerin barındırılan modellere kıyasla farklı bir güvenlik profiline sahip olduğunu belirtir. Bu nedenle üretim dağıtımlarında uygun uygulama düzeyi güvenlik önlemleri ve erişim kontrolleri eklenmelidir.
gpt-oss-20b için kullanım örnekleri
gpt-oss-20b şu alanlarda güçlü bir uyum sağlar:
- Yerel kodlama asistanları: Geliştiricilerin kodu mülkiyetli, barındırılan bir modele göndermeden akıl yürütme ve kod üretimi istemesi.
- Matematiksel ve teknik akıl yürütme: Zor problemler için yüksek akıl yürütme çabasının etkinleştirilebildiği durumlar.
- Özel kurumsal iş yükleri: Kontrollü bir ortam içinde dağıtım gerektiren senaryolar.
- Araç kullanan ajanlar: Modelin fonksiyon çağırma, Python çalıştırma, web araması veya uygulamaya özgü araçlarla birleştirildiği iş akışları.
- İnce ayarlı alan asistanları: Açık ağırlıkların, yönetilen mülkiyetli bir modele erişimden daha değerli olduğu durumlar.
- Kaynak kısıtlı çıkarım: MXFP4 nicemleme ile etkinleştirilen yaklaşık 16 GB bellek hedefinin önemli olduğu durumlar.
CometAPI üzerinden gpt-oss-20b'ye erişim
CometAPI şu anda gpt-oss-20b-free'yi bir OpenAI modeli olarak listeler ve onu 3.6B etkin parametreli, 128K sınıfı bağlamlı 21B parametreli açık kaynaklı bir MoE model olarak tanımlar. Ücretsizdir ve modeli CometAPI'nin birleşik API'si aracılığıyla sunar. CometAPI değişiklik günlüğü, modelin OpenAI sohbet standart formatını izlediğini belirtir.
CometAPI entegrasyonu için genel iş akışı, bir CometAPI anahtarı oluşturmak, CometAPI temel URL'sini kullanmak ve istekte model adını göndermektir. CometAPI, OpenAI-SDK uyumlu entegrasyonu belgelendirir ve şu anda hızlı başlangıç temel URL'si olarak https://api.cometapi.com/v1 adresini listeler.