GPT-Realtime-2 هو أكثر نماذجنا الصوتية قدرةً في الوقت الحقيقي. يدعم تفاعلات من كلام إلى كلام بجهد استدلالي قابل للتخصيص، وقدرة أقوى على اتباع التعليمات، واستخدامًا أكثر موثوقية للأدوات ضمن عمليات سير عمل معقّدة للوكلاء الصوتيين.

ابدأ باستخدام GPT-5.6 Sol للاستدلال المعقد والبرمجة، واختر GPT-5.6 Terra للموازنة بين الذكاء والتكلفة، أو استخدم GPT-5.6 Luna لأعباء العمل ذات الحجم الكبير والحساسة للتكلفة.

GPT Image 2 هو نموذج توليد صور متقدّم من OpenAI لتوليد الصور وتحريرها بسرعة وجودة عاليتين. وهو يدعم أحجام صور مرنة ومدخلات صور عالية الدقة.

GPT-5.5 Pro يجمع بين ذكاء متقدّم من الطراز الأحدث، والدقة، والكفاءة لمعالجة التحديات المعقّدة. من تطوير البرمجيات وتحليل البيانات إلى البحث ودعم اتخاذ القرار، يقدّم مساعدة بمستوى الخبراء بسرعة واتساق.
.jpeg&w=3840&q=75)
Model 5.5 هو نموذج ذكاء اصطناعي من الجيل التالي، مصمَّم لتحقيق استدلال أقوى، واستجابات أسرع، ودقة محسّنة عبر مجموعة واسعة من المهام. يتفوق في فهم التعليمات المعقدة، وتوليد محتوى عالي الجودة، وتقديم المساعدة في البرمجة والتحليل وحل المشكلات.

GPT-5.4 Nano هو نموذج ذكاء اصطناعي فائق الخفة مُصمَّم لتحقيق أقصى سرعة وكفاءة. وهو مُحسَّن للمهام البسيطة، والتفاعلات في الوقت الحقيقي، وعمليات النشر واسعة النطاق حيث يُعد انخفاض زمن الاستجابة والاستهلاك الأدنى للموارد من المتطلبات الأساسية.

GPT-5.4 Mini هو نموذج ذكاء اصطناعي خفيف الوزن وفعّال مُحسَّن للسرعة والإنتاجية اليومية. يوفّر قدرات محادثة موثوقة، وتوليد المحتوى، والمساعدة في المهام، مع الحفاظ على زمن استجابة منخفض واستهلاك موارد منخفض.

GPT-5.4 Pro هو نموذج ذكاء اصطناعي عالي الأداء مصمم للتطبيقات المهنية والتجارية. يوفر قدرات استدلال قوية، ودقة موثوقة، وتنفيذًا فعالًا عبر مهام مثل إنشاء المحتوى، والبرمجة، والبحث، وتحليل البيانات.

GPT Image 2 ALL هو نموذج شامل لتوليد الصور، مصمم للتعامل مع نطاق واسع من المهام البصرية الإبداعية والمهنية. يجمع بين إنشاء صور عالية الجودة، وفهم متقدم للمطالبات، ودعم مرن للأنماط لتقديم نتائج استثنائية عبر حالات استخدام متنوعة.

يتفوّق GPT-5.5 في كتابة الشفرة البرمجية، والبحث عبر الإنترنت، وتحليل البيانات، وتنفيذ العمليات عبر أدوات متعددة. ولا يقتصر الأمر على تحسين استقلاليته في التعامل مع المهام المعقّدة متعددة الخطوات، بل يعزّز أيضاً قدرات الاستدلال وكفاءة التنفيذ بصورة ملحوظة، مع الحفاظ على زمن استجابة مماثل لسابقه، مما يمثّل خطوة مهمة نحو أتمتة الأعمال المكتبية بالذكاء الاصطناعي.

Sora 2 Pro هو نموذج توليد الوسائط الأكثر تقدمًا وقوة لدينا، وقادر على توليد مقاطع فيديو بصوت متزامن. يمكنه إنشاء مقاطع فيديو مفصلة وديناميكية بالاعتماد على اللغة الطبيعية أو الصور.

نموذج توليد فيديو فائق القوة، مع مؤثرات صوتية، ويدعم نمط المحادثة.

GPT-5.4 هو النموذج الطليعي للعمل المهني المعقّد. Reasoning.effort يدعم: none (default), low, medium, high و xhigh.

نموذج GPT-5.3 Instant المستخدم في ChatGPT

أفضل نموذج صوتي لإدخال وإخراج الصوت مع Chat Completions.

أفضل نموذج صوتي لإدخال الصوت وإخراج الصوت.

GPT-5.3-Codex محسّن للمهام البرمجية المعتمدة على الوكلاء في Codex أو بيئات مماثلة. يدعم GPT-5.3-Codex إعدادات جهد الاستدلال low وmedium وhigh وxhigh.

GPT-Image-1.5 هو نموذج الصور الخاص بـ OpenAI ضمن عائلة GPT Image. إنه نموذج GPT متعدد الوسائط أصلاً، مصمم لتوليد الصور من الموجهات النصية وإجراء تعديلات عالية الدقة على الصور المُدخلة مع اتباع تعليمات المستخدم عن كثب.

gpt-5.2-pro هو العضو الأعلى قدرة والموجّه لبيئات الإنتاج ضمن عائلة GPT-5.2 من OpenAI، والمتاح عبر Responses API لأعباء العمل التي تتطلب أعلى مستوى من الدقة، واستدلالاً متعدد الخطوات، واستخداماً واسعاً للأدوات، وأكبر مخصصات للسياق ومعدل الإنتاجية التي توفرها OpenAI.
GPT-5.1 Chat هو نموذج لغوي حواري مُكيَّف بالتعليمات للاستخدامات العامة في المحادثة والاستدلال والكتابة. يدعم الحوار متعدد الجولات، والتلخيص، والصياغة، والإجابة عن الأسئلة المعتمدة على قاعدة معرفة، ومساعدة برمجية خفيفة للمساعدين داخل التطبيقات، وأتمتة الدعم، ومساعدي سير العمل. تشمل أبرز الجوانب التقنية مواءمة مُحسَّنة للدردشة، ومخرجات قابلة للتحكم ومنظمة، ومسارات تكامل لاستدعاء الأدوات وتدفقات الاسترجاع عند توفرها.
GPT-5.1 هو نموذج لغوي مضبوط بالتعليمات للأغراض العامة يركّز على توليد النصوص والاستدلال عبر سير عمل المنتجات. يدعم الحوارات متعددة الجولات، وتنسيق المخرجات المهيكلة، والمهام الموجّهة نحو الشفرة مثل الصياغة وإعادة هيكلة الشفرة والشرح. تشمل الاستخدامات النموذجية مساعدي الدردشة، والأسئلة والأجوبة المعززة بالاسترجاع، وتحويل البيانات، والأتمتة بأسلوب الوكيل باستخدام الأدوات أو واجهات برمجة التطبيقات عند توفّر الدعم. تشمل أبرز الجوانب التقنية نمطًا يتمحور حول النص، واتباع التعليمات، ومخرجات بأسلوب JSON، والتوافق مع استدعاء الدوال في أطر الأوركسترة الشائعة.
إصدار مُحسَّن من حيث التكلفة من GPT Image 1. إنه نموذج لغوي متعدد الوسائط أصلاً يقبل مدخلات نصية وصورية وينتج مخرجات صورية.
يعد GPT-5 أقوى نموذج برمجة لدى OpenAI حتى الآن. يظهر تحسينات كبيرة في إنشاء واجهات أمامية معقدة وتصحيح أخطاء قواعد الشيفرة الكبيرة. يمكنه تحويل الأفكار إلى واقع بنتائج بديهية وجذابة بصرياً، فينشئ مواقع وتطبيقات وألعاباً جميلة ومتجاوبة بحس جمالي مرهف، وكل ذلك من موجه واحد. كما أشار المختبرون الأوائل إلى خياراته التصميمية، مع فهم أعمق لعناصر مثل التباعد، والطباعة، والفراغ الأبيض.
GPT-5 Nano هو نموذج ذكاء اصطناعي مُقدَّم من OpenAI.
GPT-5 mini هو عضو في عائلة GPT-5 من OpenAI، محسّن من حيث التكلفة وزمن الاستجابة، ومصمم لتقديم الكثير من مزايا GPT-5 في العمل متعدد الوسائط واتباع التعليمات بتكلفة أقل بكثير لاستخدامات الإنتاج على نطاق واسع. إنه يستهدف البيئات التي تكون فيها الإنتاجية، والتسعير المتوقع لكل رمز، وسرعة الاستجابة هي القيود الأساسية، مع الاستمرار في تقديم قدرات قوية للأغراض العامة.
قريبًا
gpt-4o-image يولّد صورًا كمخرجات، مع إمكانية استخدام الصور كمدخلات.

GPT-5.2 هي مجموعة نماذج متعددة الأنماط (Instant, Thinking, Pro) مُهندَسة لفهم أفضل للسياقات الطويلة، وقدرات أقوى في البرمجة واستخدام الأدوات، وأداء أعلى بشكل ملموس في المعايير المهنية لـ“العمل المعرفي”.
OpenAI o3‑pro هو إصدار "pro" من نموذج o3 للاستدلال، مصمم للتفكير لفترة أطول وتقديم الإجابات الأكثر موثوقية من خلال توظيف تعلم التعزيز الخاص بسلسلة‑التفكير وإرساء معايير قياسية متقدمة جديدة على أحدث ما توصلت إليه التقنية عبر مجالات مثل العلوم والبرمجة والأعمال—بينما يدمج ذاتيًا أدوات مثل البحث على الويب، وتحليل الملفات، وتنفيذ Python، والاستدلال البصري ضمن واجهة برمجة التطبيقات.

تحويل النص إلى كلام من OpenAI

تحويل الكلام إلى نص، وإنشاء ترجمات
GPT-4o mini TTS هو نموذج تحويل النص إلى كلام قائم على الشبكات العصبية، مصمم لتوليد صوت طبيعي بزمن استجابة منخفض في التطبيقات الموجهة للمستخدمين. يحول النص إلى كلام بصوت طبيعي مع أصوات قابلة للاختيار، ومخرجات متعددة الصيغ، وتركيب صوتي متدفق لتجارب سريعة الاستجابة. تشمل الاستخدامات النموذجية المساعدات الصوتية، وIVR وتدفقات الاتصال، وقراءة المنتجات بصوت عالٍ، والتعليق الصوتي للوسائط. تشمل أبرز الجوانب التقنية البث المعتمد على API والتصدير إلى صيغ صوتية شائعة مثل MP3 وWAV.
GPT-4o Transcribe هو نموذج لتحويل الصوت إلى نص للتعرّف على الكلام متعدد اللغات ومنخفض الكمون. يدعم البثّ الآني والتفريغ الدُفعي من صيغ الصوت الشائعة، مع علامات ترقيم وتقسيم للجمل. تشمل الاستخدامات النموذجية الترجمة النصية المباشرة، ومدخلات المساعد الصوتي، وملاحظات الاجتماعات، وتفريغ تسجيلات الوسائط أو المكالمات. تشمل أبرز الجوانب التقنية دعم نمطية الصوت، ومعالجة المحتوى الطويل، وواجهات برمجة تطبيقات ملائمة لسير العمل التفاعلي وعلى جانب الخادم.
GPT-4o mini Search Preview هو نموذج متعدد الوسائط مُصغّر ضمن عائلة GPT-4o، مصمَّم للتفاعلات الموجَّهة نحو البحث وتدفّقات عمل الاسترجاع. يفسّر الاستعلامات ويعيد صياغتها، ويولّد إجابات موجزة، ويمكنه إسناد الإجابات عبر بحث خارجي عند تكامله من خلال استدعاء الأدوات/الدوال. تشمل الاستخدامات النموذجية مساعدي البحث داخل المنتج، والأسئلة والأجوبة لقواعد المعرفة، والاكتشاف في التجارة الإلكترونية، وفهم الاستعلام لأغراض الترتيب والتوجيه. تشمل أبرز الجوانب التقنية مدخلات نصية وصورية، واتباع التعليمات، وتنسيقات مخرجات منظَّمة، وتكامل استخدام الأدوات ضمن خطوط أنابيب RAG.
GPT-4o mini Audio Preview هو نموذج متعدد الوسائط مدمج لبناء تطبيقات صوتية محادثية. يدعم إدخال الصوت وإخراجه جنباً إلى جنب مع النص، مما يمكّن من التعرف على الكلام، وتوليد الكلام، وحوارات نصية-صوتية مختلطة مع استدعاء الأدوات/الدوال لتنفيذ إجراءات مُهيكلة. تشمل الاستخدامات النموذجية المساعدين الصوتيين، النسخ المتدفق مع التلخيص، سير عمل أنظمة الرد الصوتي التفاعلي (IVR) وروبوتات المكالمات، ومساعدين داخل التطبيقات مزوّدين بقدرات صوتية. وتتضمن أبرز الجوانب التقنية إدخال/إخراج الصوت، الاستجابات المتدفقة، اتباع التعليمات، والتكامل عبر واجهات برمجة تطبيقات الدردشة والأدوات.
GPT-4o mini Realtime Preview هو نموذج متعدد الوسائط في الزمن الحقيقي للتجارب التفاعلية الصوتية والبصرية. يتعامل مع الكلام والنصوص والصور عبر مدخلات ومخرجات متدفقة، مع دعم استدعاء الأدوات/الدوال لتنفيذ إجراءات مرتكزة إلى الأدوات. تشمل الاستخدامات الشائعة المساعدات الصوتية، معالجة المكالمات الحية، إنشاء تسميات توضيحية في الزمن الحقيقي، والإجابة عن الأسئلة البصرية اعتماداً على محتوى الكاميرا أو الشاشة. تشمل أبرز الجوانب التقنية الصوت ثنائي الاتجاه، الفهم البصري، الاستجابات المتدفقة، والمخرجات المنظمة عبر الدوال.

GPT-4o mini Audio هو نموذج متعدد الوسائط لتفاعلات الصوت والنص. يقوم بالتعرّف على الكلام والترجمة والتحويل من نص إلى كلام، ويتّبع التعليمات، ويمكنه استدعاء الأدوات لتنفيذ إجراءات منظّمة مع استجابات متدفّقة. تشمل الاستخدامات النموذجية المساعدين الصوتيين في الوقت الحقيقي، والعناوين النصية الحية والترجمة الحية، وتلخيص المكالمات، والتطبيقات المُتحكَّم بها صوتيًا. تشمل أبرز الجوانب التقنية إدخال وإخراج الصوت، والاستجابات المتدفّقة، واستدعاء الدوال، ومخرجات JSON منظّمة.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
نموذج ذكاء اصطناعي متقدم لتوليد الصور من الأوصاف النصية.
New version of DALL-E for image generation.
O4-mini هو نموذج ذكاء اصطناعي تقدمه OpenAI.
O3-mini هو نموذج ذكاء اصطناعي مقدم من OpenAI.
O3 هو نموذج ذكاء اصطناعي تقدمه OpenAI.
O1-pro is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b هو نموذج ذكاء اصطناعي مقدم من cloudflare-workers-ai.
gpt-oss-120b هو نموذج للذكاء الاصطناعي مقدم من cloudflare-workers-ai.
GPT-4o mini هو نموذج ذكاء اصطناعي مقدم من OpenAI.
GPT-4o هو أكثر نماذج OpenAI متعددة الوسائط تقدماً، وهو أسرع وأقل تكلفة من GPT-4 Turbo، ويتمتع بقدرات بصرية أقوى. يمتلك هذا النموذج سياقاً بحجم 128K وتاريخ توقف المعرفة في أكتوبر 2023. تدعم النماذج في سلسلة 1106 وما بعدها tool_calls و function_call. يدعم هذا النموذج طول سياق أقصى يبلغ 128,000 رمزاً.
GPT-4.1 nano هو نموذج ذكاء اصطناعي توفره OpenAI. gpt-4.1-nano: يتميز بنافذة سياق أكبر—تدعم ما يصل إلى 1 مليون رمز سياقي وقادرة على الاستفادة بشكل أفضل من ذلك السياق بفضل تحسين فهم السياقات الطويلة. لديه تاريخ حدّ معرفة محدّث حتى يونيو 2024. يدعم هذا النموذج طول سياق أقصى يبلغ 1,047,576 رمزًا.
GPT-4.1 mini هو نموذج ذكاء اصطناعي مقدم من OpenAI. gpt-4.1-mini: قفزة كبيرة في أداء النماذج الصغيرة، متفوقًا حتى على GPT-4o في العديد من الاختبارات المعيارية. يوازي أو يتفوق على GPT-4o في تقييمات الذكاء مع خفض زمن الاستجابة بنحو النصف والتكلفة بنسبة 83%. يدعم هذا النموذج طول سياق أقصى يبلغ 1,047,576 رمزًا.
GPT-4.1 هو نموذج ذكاء اصطناعي مُقدَّم من OpenAI. gpt-4.1-nano: يتميّز بنافذة سياق أكبر — تدعم ما يصل إلى 1 مليون من رموز السياق وتمكّن من الاستفادة بشكل أفضل من ذلك السياق من خلال فهم مُحسَّن للسياقات الطويلة. لديه تاريخ توقّف للمعرفة مُحدَّث إلى يونيو 2024. يدعم هذا النموذج طول سياق أقصى يبلغ 1,047,576 رمزًا.
coming soon