GPT-Realtime-2.1 updates GPT-Realtime-2 with improved alphanumeric recognition, silence and noise handling, and interruption behavior. It supports speech-to-speech interactions with configurable reasoning effort, instruction following, and tool use for complex voice-agent workflows.
استخدم التقدير السريع أعلاه لعملية تشغيل واحدة، ثم راجع المقارنة الكاملة بين أسعار CometAPI والأسعار الرسمية.
استكشف الأسعار التنافسية لـ GPT-Realtime-2.1، المصمم ليناسب الميزانيات المختلفة واحتياجات الاستخدام المتنوعة. تضمن خططنا المرنة أن تدفع فقط مقابل ما تستخدمه، مما يجعل من السهل التوسع مع نمو متطلباتك. اكتشف كيف يمكن لـ GPT-Realtime-2.1 تحسين مشاريعك مع الحفاظ على التكاليف قابلة للإدارة.
| Model | Comet Price (USD / M Tokens) | Official Price (USD / M Tokens) | Discount |
|---|---|---|---|
| gpt-realtime-2.1 | مدخل:$3.2/M الإخراج:$19.2/M | مدخل:$4/M الإخراج:$24/M | -20% |
| gpt-realtime-2.1-mini | مدخل:$0.48/M الإخراج:$2.88/M | مدخل:$0.6/M الإخراج:$3.6/M | -20% |
انسخ نقطة نهاية ونموذج كود يعملان، ثم افتح المرجع الكامل للواجهة عند الحاجة إلى جميع المعلمات.
قم بالمصادقة مرة واحدة، واستدعِ نقطة نهاية النموذج، وحافظ على نفس سير عمل الفوترة والمراقبة عبر جميع المزودين.
احصل على أكواد نماذجية شاملة وموارد API لـ GPT-Realtime-2.1 لتبسيط عملية التكامل الخاصة بك. توفر وثائقنا التفصيلية إرشادات خطوة بخطوة، مما يساعدك على الاستفادة من الإمكانات الكاملة لـ GPT-Realtime-2.1 في مشاريعك.
راجع أهم بيانات النموذج قبل اختيار البنية أو تقدير حِمل الإنتاج.
استخدم GPT-Realtime-2.1 في سير عمل إنتاجي يناسب إمكانياته في audio، ثم قارن البدائل قبل الالتزام بتكامل طويل الأمد.
توليد الكلام والموسيقى والصوت
تجارب صوتية وإنتاج الوسائط
سير عمل صوتي آلي على نطاق واسع
قارن نماذج أخرى متاحة عبر CometAPI من حيث الجودة وزمن الاستجابة والإمكانيات والسعر.
أفضل نموذج صوتي لإدخال وإخراج الصوت مع Chat Completions.
GPT-Realtime-2 هو أكثر نماذجنا الصوتية قدرةً في الوقت الحقيقي. يدعم تفاعلات من كلام إلى كلام بجهد استدلالي قابل للتخصيص، وقدرة أقوى على اتباع التعليمات، واستخدامًا أكثر موثوقية للأدوات ضمن عمليات سير عمل معقّدة للوكلاء الصوتيين.
أفضل نموذج صوتي لإدخال الصوت وإخراج الصوت.
تحويل النص إلى كلام من OpenAI
[تركيب الكلام] أُطلقت حديثًا: تحويل النص إلى صوت بمستوى البث عبر الإنترنت، مع ميزة المعاينة ● يمكن في الوقت نفسه توليد audio_id، لاستخدامه مع أي Keling API.
Kling تحويل الفيديو إلى صوت
راجع بيانات النبض الحي وتوفر نقطة النهاية وأزمنة الاستجابة المُلاحَظة قبل الانتقال إلى الإنتاج.
راجع معرّفات النماذج المتاحة قبل تثبيت تكامل الإنتاج.