المواصفات التقنية لـ gpt-oss-20b-free
| المواصفة | gpt-oss-20b |
|---|---|
| المزوّد | OpenAI |
| عائلة النماذج | نماذج استدلال مفتوحة الأوزان gpt-oss |
| النموذج | gpt-oss-20b-free |
| معرّف النموذج في CometAPI | gpt-oss-20b-free |
| البنية | مزيج الخبراء (MoE) |
| إجمالي المعاملات | 21B |
| المعاملات النشطة | 3.6B |
| نافذة السياق | 131,072 رمز |
| الحد الأقصى لرموز الإخراج | 131,072 |
| الإدخال / الإخراج | نص وارد، نص صادر |
| جهد الاستدلال | منخفض، متوسّط، مرتفع |
| الترخيص | Apache 2.0، وفقًا لسياسة استخدام gpt-oss |
| استدعاء الدوال | مدعوم |
| المخرجات المُهيكلة | مدعومة |
| البث المتدفق | مدعوم |
| الضبط الدقيق | مدعوم عبر أدوات/بُنى تحتية مفتوحة |
| هدف النشر الأصلي | محلي، طرفي (Edge)، بنية تحتية خاصة، أو استدلال مُستضاف |
| حدّ المعرفة | 1 يونيو 2024 |
ما هو gpt-oss-20b؟
gpt-oss-20b هو نموذج الاستدلال مفتوح الأوزان الأصغر من OpenAI ضمن عائلة gpt-oss. كما تتيح CometAPI استخدام gpt-oss-20b مجانًا؛ ومعرّفه هو gpt-oss-20b-free. يحتوي على 21 مليار معامل إجماليًا لكنه يفعّل حوالي 3.6 مليار معامل في كل تمريرة أمامية، باستخدام بنية مزيج الخبراء لتقليل متطلبات الاستدلال مع الحفاظ على قدرة استدلال كبيرة. تضعه OpenAI لسيناريوهات الكمون المنخفض والبيئات المحلية والمتخصصة بدلًا من أن يكون بديلًا مباشرًا لأكبر نماذجها المملوكة.
النموذج نصي فقط ومصمّم للاستدلال وسير عمل الوكلاء. يمكن تنزيل الأوزان المفتوحة وتخصيصها وضبطها دقيقًا ونشرها على بنية تحتية يتحكم بها المطوّر. توثق OpenAI وHugging Face تكميم MXFP4 الأصلي الذي يسمح بتشغيل النموذج ضمن نحو 16 GB من الذاكرة، ما يجعله متاحًا على نحو غير معتاد لفئة النماذج بهذا الحجم من المعاملات.
الميزات الرئيسية لـ gpt-oss-20b
- بنية MoE فعّالة: 21B من المعاملات الإجمالية مع 3.6B معاملات نشطة في كل تمريرة أمامية، لاستهداف زمن استجابة أقل ومتطلبات نشر أخف.
- استدلال قابل للتهيئة: يمكن للمطورين اختيار جهد استدلال منخفض أو متوسط أو مرتفع للموازنة بين زمن الاستجابة وجودة الاستدلال.
- استخدام الأدوات بأسلوب وكيل: يدعم النموذج سير عمل يشمل استدعاء الدوال، وتصفّح الويب، وتنفيذ Python، والمخرجات المُهيكلة عندما يوفّر زمن التشغيل أدوات مُمكَّنة.
- تخصيص بأوزان مفتوحة: يتيح ترخيص Apache 2.0 تعديلات واسعة ونشرًا تجاريًا، مع الالتزام بسياسة استخدام gpt-oss.
- نشر محلي وخاص: مُعد للتشغيل على بنية تحتية يتحكم بها المطورون، بما في ذلك البيئات المحلية أو الخاصة.
- سياق طويل: توثّق نسخة الإنتاج نافذة سياق بحجم 131,072 رمزًا وحدًا أقصى لمخرجات 131,072 رمزًا.
أداء gpt-oss-20b على المعايير
تُظهر نتائج التقييم المنشورة من OpenAI أن gpt-oss-20b قوي بشكل خاص في الاستدلال الرياضي والبرمجة نسبةً إلى حجمه. عند جهد استدلال مرتفع مع الأدوات، يصل إلى 98.7% في AIME 2025، و96.0% في AIME 2024، و60.7% في SWE-Bench Verified، و54.8% في Tau-Bench Retail. وعلى اختبارات المعرفة والاستدلال، تُبلغ OpenAI عن 85.3% في MMLU، و71.5% في GPQA Diamond دون أدوات، و17.3% في Humanity's Last Exam مع الأدوات. تختلف النتائج بشكل كبير باختلاف جهد الاستدلال وإتاحة الأدوات، لذا لا ينبغي اعتبار هذه الأرقام معدلات دقة إنتاجية عامة.
| المعيار | نتيجة gpt-oss-20b | شرط التقييم |
|---|---|---|
| AIME 2024 | 96.0% | جهد استدلال مرتفع، مع أدوات |
| AIME 2025 | 98.7% | جهد استدلال مرتفع، مع أدوات |
| GPQA Diamond | 71.5% | جهد استدلال مرتفع، دون أدوات |
| MMLU | 85.3% | جهد استدلال مرتفع |
| SWE-Bench Verified | 60.7% | جهد استدلال مرتفع |
| Tau-Bench Retail | 54.8% | جهد استدلال مرتفع |
| Humanity's Last Exam | 17.3% | جهد استدلال مرتفع، مع أدوات |
تقارن OpenAI النموذج gpt-oss-20b مباشرةً مع o3-mini في عدة فئات تقييم، بينما يتفوّق gpt-oss-120b الأكبر عمومًا في المعرفة الواسعة وسير عمل الوكلاء.
gpt-oss-20b مقابل gpt-oss-120b مقابل o3-mini
| النموذج | الميزة الأساسية | السياق | أفضل ملاءمة |
|---|---|---|---|
| gpt-oss-20b | استدلال فعّال مفتوح الأوزان | 131K | استدلال محلي، ترميز، رياضيات، وكلاء متخصصون |
| gpt-oss-120b | قدرة إجمالية أعلى | 131K | استدلال ومتطلبات إنتاجية أكثر demanding |
| o3-mini | نموذج استدلال احتكاري | يختلف حسب النشر | استدلال مُدار حيث لا تُشترط الأوزان المفتوحة |
التمييز العملي يكمن في التحكم بالنشر. يُعد gpt-oss-20b الخيار الأفضل عندما يحتاج المطورون إلى أوزان مفتوحة، وتنفيذ محلي/خاص، وتخصيص، أو متطلبات عتاد معتدلة نسبيًا. أما gpt-oss-120b فيُفضَّل عندما تبرّر القدرة العامة الأعلى والاداء في المعرفة والاستدلال تكلفة نشر أكبر.
قيود gpt-oss-20b
gpt-oss-20b نصي فقط ولا يقبل مدخلات صور أو صوت أو فيديو بشكل أصيل. كما أن عدد معامِلاته الأصغر يخلق فجوة أداء في بعض تقييمات المعرفة المكثفة وسير عمل الوكلاء مقارنةً بـ gpt-oss-120b. إضافةً إلى ذلك، ينقل النشر بأوزان مفتوحة مزيدًا من المسؤولية التشغيلية إلى المطور: الاستضافة، التوسّع، الرصد، ضوابط السلامة، وتكوين زمن التشغيل لا تُدار بالطريقة نفسها عبر واجهة API مُدارة بالكامل.
تشير OpenAI أيضًا إلى أن نماذج الأوزان المفتوحة لها ملف أمني مختلف عن النماذج المُستضافة لأن المطورين يمكنهم تعديل الأوزان أو ضبطها دقيقًا. لذا ينبغي أن تضيف عمليات الإنتاج ضوابط أمان مناسبة على مستوى التطبيق وآليات للتحكم في الوصول.
حالات استخدام gpt-oss-20b
- مساعدو برمجة محليون حيث يريد المطورون الاستدلال وتوليد الشيفرة دون إرسال الشيفرة إلى نموذج مُستضاف احتكاري.
- الاستدلال الرياضي والتقني حيث يمكن تفعيل جهد استدلال مرتفع للمسائل الصعبة.
- أعباء عمل مؤسساتية خاصة تتطلّب النشر داخل بيئة مُتحكم بها.
- وكلاء يستخدمون الأدوات يجمعون بين النموذج واستدعاء الدوال، وتنفيذ Python، وبحث الويب، أو أدوات تطبيقية خاصة.
- مساعدين مضبوطين دقيقًا لمجالات محددة حيث تكون الأوزان المفتوحة أكثر قيمة من الاعتماد على نموذج مُستضاف احتكاري.
- استدلال مقيد الموارد حيث تهمّ القدرة على العمل ضمن نحو 16 GB من الذاكرة التي يتيحها تكميم MXFP4.
الوصول إلى gpt-oss-20b عبر CometAPI
تدرج CometAPI حاليًا gpt-oss-20b-free كنموذج من OpenAI وتصفه بأنه نموذج MoE مفتوح المصدر بعدد معاملات 21B و3.6B معاملات نشطة وسياق من فئة 128K. وهو مجاني الاستخدام ويُعرض عبر واجهة CometAPI الموحّدة. يذكر سجل تغييرات CometAPI أن النموذج يتّبع تنسيق دردشة OpenAI القياسي.
للتكامل مع CometAPI، سير العمل العام هو إنشاء مفتاح CometAPI، واستخدام عنوان الأساس لـ CometAPI، وتمرير اسم النموذج في الطلب. توثّق CometAPI تكاملًا متوافقًا مع OpenAI SDK وتدرج حاليًا https://api.cometapi.com/v1 كعنوان أساس للانطلاق السريع.