Sora 2 OpenAI کا پہلا عام دستیابی والا text-to-video ماڈل ہے، جسے آفیشل OpenAI API اور بڑھتے ہوئے ایگریگیٹر روٹس کے ذریعے پروگراماتی طور پر استعمال کیا جا سکتا ہے۔ قیمت گذاری ماڈل متن کے ماڈلز سے مختلف ہے (بلنگ ٹوکن کے بجائے تیار کردہ ویڈیو کے فی سیکنڈ کے حساب سے ہوتی ہے)، اور انضمام سے پہلے ڈویلپرز کے عملی سوالات LLM API کے مقابلے مختلف ہوتے ہیں۔ ایک کلپ کی حقیقی لاگت کیا بنتی ہے؟ جینریشن میں کتنا وقت لگتا ہے؟ ریٹ لمٹس کیا ہیں؟ جب آپ OpenAI کی بجائے کسی ایگریگیٹر کے ذریعے Sora تک رسائی لیتے ہیں تو کیا بدلتا ہے؟
یہ مضمون وہ ریفرنس ہے جو ہم چاہتے تھے کہ اس وقت موجود ہو جب ہم نے اپنی ویڈیو جنریشن فیچرز کی اسکوپنگ شروع کی۔ یہ تحریر اس ڈویلپر کے لیے ترتیب دی گئی ہے جو "کیا Sora دلچسپ ہے؟" سے آگے بڑھ چکا ہے اور اب اسے یہ جواب دینا ہے کہ "اس کی قیمت کیا ہوگی، انضمام میں کیا درکار ہوگا، اور کمٹ کرنے سے پہلے مجھے کیا جاننا چاہیے؟"
مختصر خلاصہ: Sora 2 (اسٹینڈرڈ ماڈل) کی قیمت 720p پر تیار کردہ ویڈیو کے فی سیکنڈ $0.10 ہے۔ Sora 2 Pro کی قیمت 720p پر فی سیکنڈ $0.30 یا 1024p پر فی سیکنڈ $0.50 ہے۔ ایک عام 10 سیکنڈ کلپ اسٹینڈرڈ ماڈل پر $1.00 اور Pro پر HD میں $5.00 بنتا ہے۔ جینریشن وقت غیر ہم زمانی (async) ہے؛ 5–10 سیکنڈ کلپ کے لیے 30–90 سیکنڈ وال کلاک وقت متوقع رکھیں۔ رسائی کے لیے کم از کم usage tier 2 والا ادائیگی شدہ OpenAI اکاؤنٹ درکار ہے۔
2026 میں Sora API تک رسائی کی حالت
Sora 2 نے 7 اکتوبر 2025 کو OpenAI API میں لانچ کیا، اور اس کے بعد سے رسائی مسلسل دستیاب ہے۔ ماڈل آئیڈینٹیفائر sora-2 ہے (موجودہ اسنیپ شاٹ ID: sora-2-2025-12-08)، اور اس کی زیادہ فیڈیلیٹی والی قسم sora-2-pro ہے۔ دونوں text-to-video اور image-to-video جینریشن کی سپورٹ کرتے ہیں، ہم آہنگ آڈیو آؤٹ پٹ کے ساتھ۔ 10 جنوری 2026 سے ChatGPT پروڈکٹ کے ذریعے فری ٹئیر کنزیومر رسائی ختم کر دی گئی، جس سے ڈویلپر گریڈ Sora کا استعمال یا تو ادائیگی شدہ ChatGPT سبسکرپشنز یا براہِ راست API رسائی پر مرکوز ہو گیا۔
Sora کو پروگراماتی طور پر استعمال کرنے کے تین راستے ہیں:
- OpenAI direct API. بنیادی راستہ۔ فی سیکنڈ بلنگ، صرف ادائیگی شدہ، Sora ماڈل تک رسائی کھولنے کے لیے کم از کم $10 کا ٹاپ اپ کر کے usage tier 2 درکار۔ SDK اور REST API دونوں سپورٹڈ۔
- Azure OpenAI. Microsoft کا انٹرپرائز راستہ، جو OpenAI کی آفیشل ریٹس کی عکاسی کرتا ہے، Azure سبسکرپشن اوورہیڈ اور انٹرپرائز کمپلائنس فیچرز کے ساتھ۔ فی سیکنڈ قیمت یکساں؛ آپریشنل سطح مختلف۔
- Aggregators. ایسی سروسز جو Sora کو اپنی متحدہ API کے پیچھے ظاہر کرتی ہیں۔ زیادہ تر ایگریگیٹرز OpenAI کی فی سیکنڈ قیمت کو برابری پر پاس تھرو کرتے ہیں؛ قدر آپریشنل ہوتی ہے (ایک کریڈینشل، ایک بل، اور وہی SDK جو آپ کے ٹیکسٹ ماڈلز کے لیے ہے)۔ کچھ ایگریگیٹرز اپنی ٹیرف ساختیں بھی پیش کرتے ہیں، جن پر ہم آگے بات کریں گے۔
Sora 2 کی ویڈیو کے فی سیکنڈ قیمت
Sora کی قیمت ماڈل ٹئیر اور آؤٹ پٹ ریزولوشن کے مطابق ترتیب دی گئی ہے، جس میں فی سیکنڈ ریٹ کلپ کے دورانیے سے ضرب دے کر جینریشن لاگت نکلتی ہے۔ مئی 2026 کے مطابق OpenAI کی آفیشل پرائسنگ پیج سے تصدیق شدہ:
| Model | Resolution | Supported durations | Price per second | 10-second clip |
|---|---|---|---|---|
| Sora 2 (standard) | 720p | 4s, 8s, 12s | $0.10 | $1.00 |
| Sora 2 Pro | 720p | 10s, 15s, 25s | $0.30 | $3.00 |
| Sora 2 Pro | 1024p (1792×1024) | 10s, 15s, 25s | $0.50 | $5.00 |
قیمت کے ڈھانچے سے متعلق نوٹس. قیمت ان پٹ کے بجائے آؤٹ پٹ پر مبنی ہے؛ Sora کے لیے ان پٹ ٹوکن پر مبنی بلنگ نہیں ہے جیسا کہ ٹیکسٹ ماڈلز میں ہوتی ہے۔ امیج کنڈیشننگ (جینریشن کو اینکر کرنے کے لیے حوالہ جاتی تصویر دینا) فی سیکنڈ ریٹ نہیں بدلتی۔ ہر ماڈل ٹئیر کے دورانیے کے اختیارات فکسڈ ہیں: آپ اسٹینڈرڈ ماڈل پر 7 سیکنڈ کا کلپ نہیں مانگ سکتے، صرف 4، 8 یا 12 سیکنڈ۔
دو عملی مضمرات جنہیں واضح کرنا مفید ہے۔ اول: قیمت گذاری ماڈل LLM بل کے بجائے ویڈیو رینڈرنگ بل سے زیادہ قریب ہے۔ لاگت آؤٹ پٹ کے دورانیے سے متعین ہوتی ہے، نہ کہ آپ کے پرامپٹ کی پیچیدگی یا ٹوکن گنتی سے۔ دوم: HD پر Sora 2 اور Sora 2 Pro کے درمیان فی سیکنڈ لاگت کا فرق 5x ہے: 10 سیکنڈ کلپ اسٹینڈرڈ پر $1.00 اور Pro پر 1024p پر $5.00 ہے۔ کام کے لیے درست ٹئیر کا انتخاب آپ کے پاس سب سے بڑا کاسٹ لیور ہے، اور یہ سوچ سمجھ کر طے کرنا چاہیے کہ کن ورک لوڈز کو واقعی Pro کی اعلیٰ فیڈیلیٹی درکار ہے۔
ریٹ لمٹس اور کوٹہ
Sora کی ریٹ لمٹس OpenAI کے معیاری usage-tier نظام پر منظم ہیں۔ خاص طور پر Sora کے لیے اہم نکات:
- کم از کم ٹئیر کی ضرورت: Tier 2، جسے کم از کم $10 API کریڈٹ ٹاپ اپ کر کے حاصل کیا جاتا ہے۔ Tier 1 (نئے اکاؤنٹس کے لیے ڈیفالٹ) میں Sora ماڈلز تک رسائی شامل نہیں۔
- متوازی جینریشن کی حدیں: OpenAI کی ریٹ لمٹ دستاویزات کے مطابق، بیک وقت ویڈیو جینریشن ٹئیر کے لحاظ سے محدود ہے، نچلے ٹئیرز پر معمولاً چند in-flight جینریشنز، جو usage tier کے ساتھ بڑھتی ہیں۔ حتمی حد فی اکاؤنٹ مقرر ہوتی ہے اور OpenAI ڈیش بورڈ پر نظر آتی ہے۔ ہائی والیوم ورک لوڈز کے لیے، پہلے دن سے tier-3 یا tier-4 کی منصوبہ بندی کریں۔
- کوٹہ درخواستیں: ڈیفالٹ ٹئیر حدود سے بلند کنکرنسی لمٹس OpenAI کے rate-limit increase فارم کے ذریعے مانگی جا سکتی ہیں۔ منظوری ورک لوڈ مخصوص اور فوری نہیں ہوتی؛ پروڈکشن لانچز کے لیے جن میں مانگ کے قابلِ پیش گوئی اسپائکس ہوں، لانچ سے کئی ہفتے پہلے درخواست دیں۔
جاننے کے قابل: Sora پر ریٹ لمٹس اسی اکاؤنٹ کے ٹیکسٹ ماڈلز کی ریٹ لمٹس سے الگ پول ہوتی ہیں۔ اگر ایک ٹیم Sora پر بھاری ٹریفک چلا رہی ہے تو وہ اپنے GPT-5.5 کالز کے دستیاب ریٹ بجٹ کو متاثر نہیں کرتی۔ بالعکس، بڑے GPT-৫.۵ ٹریفک سے Sora کا بجٹ نہیں گھٹتا۔ دونوں کو الگ صلاحیتی سوالات کے طور پر پلان کریں۔
جینریشن وقت: حقیقت میں کیا توقع رکھیں
Sora بنیادی طور پر غیر ہم زمانی ہے۔ آپ جینریشن درخواست بھیجتے ہیں، ایک جاب ID واپس ملتا ہے، اور تکمیل کے لیے پول کرتے ہیں (یا ویب ہُک سے کال بیک لیتے ہیں)۔ درخواست سے تکمیل تک وال کلاک وقت آؤٹ پٹ کے دورانیے اور ریزولوشن، OpenAI انفراسٹرکچر پر موجودہ لوڈ، اور کیا جاب آپ کے اکاؤنٹ پر دوسروں کے پیچھے قطار میں ہے، پر منحصر ہے۔
مشاہدہ شدہ رویے کی بنیاد پر حقیقت پسندانہ توقعات:
| Output | Typical wall-clock time | Notes |
|---|---|---|
| Sora 2 standard, 4s @ 720p | 20–45 سیکنڈ | تیز ترین راستہ؛ آئٹریشن کے لیے موزوں |
| Sora 2 standard, 8s @ 720p | 40–90 سیکنڈ | سب سے عام پروڈکشن دورانیہ |
| Sora 2 standard, 12s @ 720p | 60–120 سیکنڈ | لانگ فارم سوشل کنٹینٹ |
| Sora 2 Pro, 10s @ 720p | 60–150 سیکنڈ | پریمیم کوالٹی؛ لاگت تقریباً 3x |
| Sora 2 Pro, 15s @ 1024p | 120–240 سیکنڈ | فل HD، پیک اوقات میں لمبی قطار دیکھی گئی |
| Sora 2 Pro, 25s @ 1024p | 200–360 سیکنڈ | زیادہ سے زیادہ دورانیہ؛ قیمت خطی طور پر بڑھتی ہے |
دو آپریشنل نتائج:
- یوزر فیسنگ لیٹنسی بجٹس پر نئی سوچ درکار ہے۔ اگر آپ کی پراڈکٹ میں ویڈیو جینریشن کا احساس صارف کی کارروائی سے فوری جڑا ہونا چاہیے، تو مختصر کلپس کے لیے 30–90 سیکنڈ کے انتظار کا مطلب ہے کہ آپ کو ایسا UX چاہیے جو اس وقفے کو سنبھالے: پیش رفت کے اشارئیے، ایسا متوازی کام جو یوزر ویڈیو جینریشن کے دوران کر سکے، یا متوقع منظرناموں کے لیے پیشگی جینریشن۔ Sora کو ہم زمانی API کال سمجھنا ٹیموں کی سب سے عام معمارانہ غلطی ہے۔
- Polling بمقابلہ Webhooks اہم ہے۔ سادہ پولنگ (اسٹیٹس اینڈ پوائنٹ کو تیز رفتاری سے ہِٹ کرنا) آپ کے ریٹ لمٹ بجٹ اور ماڈل کی کمپیوٹ دونوں ضائع کرتی ہے۔ exponential backoff with jitter استعمال کریں، یا اگر ماحول سپورٹ کرے تو webhook callbacks سیٹ کریں۔ پروڈکشن میں کارگر پولنگ پیٹرن یہ ہے کہ پہلے منٹ میں ہر 10 سیکنڈ پر پول کریں، پھر اس کے بعد ہر 30 سیکنڈ پر، اور درخواست کردہ دورانیے کی ماڈل کی متوقع بالائی حد پر ایک سخت ٹائم آؤٹ رکھیں۔
سپورٹڈ پیرا میٹرز اور پرامپٹ اسٹرکچر
Sora کی API سطح DALL-E 3 جیسے امیج جینریشن ماڈلز کے مقابلے دانستہ طور پر سادہ ہے۔ کم ڈائلز ہیں، لیکن جو ہیں وہ اہم ہیں۔ اہم پیرا میٹرز:
- model: sora-2 یا sora-2-pro۔ انتخاب، جیسا کہ اوپر قیمتوں کی جدول میں دکھایا گیا، قیمت اور دستیاب دورانیہ/ریزولوشن کے اختیارات دونوں طے کرتا ہے۔
- prompt: من چاہی متن جو منظر کی وضاحت کرتا ہے۔ Sora سینیمیٹک ڈائریکشن (کیمرہ اینگلز، موومنٹ، لائٹنگ)، کرداروں کی حرکات، اور ماحولیاتی تفصیلات سنبھالتا ہے۔ ماڈل پرامپٹ اسٹرکچر کے لیے حساس ہے: پہلے منظر قائم کریں، پھر ایکشن، پھر تکنیکی ڈائریکشن — یہ طریقہ ایک گھنے ایک پیراگراف کے مقابلے زیادہ قابلِ اعتماد نتائج دیتا ہے۔
- image: امیج ٹو ویڈیو جینریشن کے لیے اختیاری حوالہ جاتی تصویر۔ حوالہ پہلی فریم اینکر کا کردار ادا کرتا ہے؛ ماڈل اسی نقطہ آغاز سے حرکت پیدا کرتا ہے۔ پروڈکٹ ڈیموز، کردار کی تسلسل، اور ایسے منظرنامے جہاں سبجیکٹ کی ساکن شکل غیر قابلِ سمجھوتہ ہو، کے لیے مفید۔
- duration: دورانیہ سیکنڈز میں۔ منتخب ماڈل کے ڈسکریٹ اختیارات تک محدود (sora-2 کے لیے 4/8/12، sora-2-pro کے لیے 10/15/25)۔ لاگت دورانیے کے ساتھ خطی بڑھتی ہے۔
- size: ریزولوشن۔ اسٹینڈرڈ ماڈل پر 720x1280 (پورٹریٹ) یا 1280x720 (لینڈ اسکیپ)؛ Pro پر اس میں 1024x1792 / 1792x1024 کا اضافہ۔ اسپیکٹ ریشو سائز کے انتخاب سے مضمر ہوتا ہے۔
نمایاں غیر موجودگی. Sora فی الحال پبلک API کے ذریعے seed کنٹرول فراہم نہیں کرتا (لہٰذا رن در رن قابلِ تولیدیت کی ضمانت نہیں)، اور نہ ہی Midjourney یا دیگر امیج ماڈلز کی طرح انفرادی اسٹائل کنٹرولز ایکسپوز کرتا ہے۔ ماڈل رائے رکھنے والا ہے؛ پیرا میٹر ٹیوننگ کے بجائے پرامپٹ انجینئرنگ بنیادی لیور ہے۔
OpenAI Python SDK استعمال کرتے ہوئے Sora 2 جینریشن درخواست کی ایک سادہ مثال:
| from openai import OpenAIimport timeclient = OpenAI(api_key="YOUR_API_KEY")# ویڈیو جینریشن جاب تخلیق کریںjob = client.videos.create(model="sora-2",prompt=("سورج نکلتے وقت برف سے ڈھکے پہاڑ کا ایک وائیڈ اینگل شاٹ۔ ""جیسے ہی پہلی روشنی چوٹی کو چھوتی ہے، کیمرہ آہستہ آہستہ بائیں طرف ٹریک کرتا ہے۔ ""سینیمیٹک، گولڈن آور، 4K معیار کی لائٹنگ۔"),size="1280x720",duration=8,)# تکمیل کے لیے پول کریںwhile True:job = client.videos.retrieve(job.id)if job.status == "completed":video_url = job.output[0].urlbreakelif job.status == "failed":raise RuntimeError(f"جنریشن ناکام ہوئی: {job.error}")print(f"موجودہ اسٹیٹس: {job.status}")time.sleep(10)print(f"ویڈیو تیار: {video_url}") |
|---|
لاگت کے عملی مثالیں
فی سیکنڈ قیمت گذاری لاگت کو قابلِ پیش گوئی بناتی ہے، مگر تب جب آپ اپنے ورک لوڈ کی ساخت واضح کر لیں۔ تین نمائندہ منظرنامے:
منظرنامہ 1: SaaS لینڈنگ پیج کے لیے مختصر پروڈکٹ ڈیمو
5 سیکنڈ کا کلپ جو پروڈکٹ UI کو ایکشن میں دکھاتا ہے، ایک بار تیار کر کے مارکیٹنگ سائٹ پر ہیرو ویڈیو کے طور پر استعمال ہوگا۔ آپ پبلش کرنے سے پہلے اطمینان کے لیے 5–10 بار آئٹریٹ کرنے کی توقع رکھتے ہیں۔
Sora 2 اسٹینڈرڈ پر 720p کی لاگت: 5s × $0.10 = $0.50 فی جینریشن۔ فائنل کٹ تک پہنچنے کے لیے 8 آئٹریشنز کے ساتھ: $4.00۔ فائنل شائع شدہ ورژن کے لیے Sora 2 Pro پر 1024p میں لاگت: 5s × $0.50 = $2.50 (سنگل ٹیک)۔ کل پروجیکٹ لاگت: آئٹریشن رنز اور HD فائنل ملا کر تقریباً $6.50۔
منظرنامہ 2: ایک مارکیٹنگ مہم کے لیے 50 کلپس کا بیچ
50 منفرد 8 سیکنڈ کے پروڈکٹ کلپس، ہر ایک مختلف فیچر ڈسکرپشن پر مبنی، سب Sora 2 اسٹینڈرڈ پر 720p میں۔ کوئی آئٹریشن بجٹ نہیں؛ پہلی جینریشن قبول۔
لاگت: 50 × 8s × $0.10 = $40.00۔ جو کلپس پہلی بار میں درست نہ آئیں ان کے لیے 30% آئٹریشن بجٹ شامل کریں (50 × 0.30 = 15 ری ٹرائز × 8s × $0.10 = $12)۔ کل: مہم کے لیے تقریباً $52.00۔
منظرنامہ 3: کنزیومر پروڈکٹ میں یوزر جنریٹڈ ویڈیو فیچر
آپ کی ایپ میں صارفین ڈیمانڈ پر 6 سیکنڈ کے کلپس بناتے ہیں، Sora 2 اسٹینڈرڈ پر 720p میں۔ اوسط استعمال: روزانہ 1,000 کلپس۔ آپ صارفین سے فی جینریشن $0.50 چارج کرتے ہیں اور لاگت کے فرق کو یونٹ مارجن کے طور پر قبول کرتے ہیں۔
فی یوزر کلپ لاگت: 6s × $0.10 = $0.60۔ یوزر پرائسنگ $0.50 ہونے کے ساتھ، یہ ورک لوڈ اسٹینڈرڈ ٹئیر پر خسارے کا باعث ہے: ہر جینریشن کی لاگت صارف کے ادا کردہ سے $0.10 زیادہ ہے۔ 720p اسٹینڈرڈ ٹئیر میں سربسر ہونے کے لیے کم از کم یوزر پرائسنگ $0.65 درکار ہے، انفراسٹرکچر اوورہیڈ سے پہلے۔ 30,000 کلپس ماہانہ پر: ماہانہ Sora بل $18,000۔ یہ وہی یونٹ اکنامکس چیک ہے جو کسی بھی یوزر فیسنگ ویڈیو فیچر لانچ کرنے سے پہلے کرنا چاہیے۔
خلاصہ تینوں منظرناموں میں: ویڈیو جینریشن واقعی مارکیٹنگ اور ایک مرتبہ کے کنٹینٹ ورک لوڈز کے لیے قابلِ استطاعت ہے، جہاں آئٹریشن کی گنتی محدود ہو اور لاگت فی فائنل ایسٹ اہم میٹرک ہو۔ یوزر فیسنگ فیچرز میں بڑے پیمانے پر یہ زیادہ چیلنجنگ ہے، جہاں فی جینریشن لاگت کو یوزر کی ادا کردہ قیمت اور پروڈکٹ اوورہیڈ سے اوپر آنا ہوتا ہے۔ کمٹ کرنے سے پہلے واضح کریں کہ آپ کس ورک لوڈ کی قیمت لگا رہے ہیں۔
براہِ راست OpenAI رسائی بمقابلہ ایگریگیٹر رسائی
جب Sora متعدد راستوں کے ذریعے دستیاب ہے، تو زیادہ تر ٹیموں کے لیے عملی سوال یہ ہے کہ کس راستے کے خلاف انضمام کیا جائے۔ حقیقی جواب آپ کے باقی اسٹیک پر منحصر ہے۔
کیا چیزیں یکساں ہیں
آؤٹ پٹ کوالٹی، ماڈل سطح پر جینریشن وقت، سپورٹڈ پیرا میٹرز، اور فی سیکنڈ قیمت عموماً راستے سے قطع نظر یکساں ہوتے ہیں، کیونکہ بیشتر ایگریگیٹرز OpenAI کی فی سیکنڈ قیمت کو برابری پر پاس تھرو کرتے ہیں، اور ماڈل خود وہی ہوتا ہے۔ اگر آپ صرف آؤٹ پٹ کوالٹی کی بنیاد پر راستہ چن رہے ہیں، تو انتخاب برابر ہے۔
کیا چیزیں مختلف ہیں
- بلنگ سطح۔ براہِ راست OpenAI رسائی آپ کے OpenAI اکاؤنٹ کے ذریعے بل کرتی ہے؛ ایگریگیٹرز اپنی کریڈٹ یا سبسکرپشن سسٹم کے ذریعے بل کرتے ہیں۔ ان ٹیموں کے لیے جو پہلے ہی ٹیکسٹ ماڈل استعمال کے لیے OpenAI بلنگ سنبھالتی ہیں، براہِ راست راستہ کوئی نیا اضافہ نہیں۔ جو ٹیمیں ملٹی پرووائیڈر ورک لوڈز چلا رہی ہیں (Anthropic کے LLMs، Black Forest Labs کے امیج ماڈلز، ویڈیو کے لیے Sora)، ان کے لیے ایگریگیٹر یہ سب ایک ہی انوائس پر یکجا کرتا ہے۔
- Observability. OpenAI کا ڈیش بورڈ Sora استعمال کو ریکویسٹ لیول پر صاف دکھاتا ہے۔ ایگریگیٹر ڈیش بورڈز میں ویڈیو جینریشن ورک لوڈز کے ہینڈلنگ کا معیار مختلف ہوتا ہے؛ کچھ کے پاس ویڈیو کے لیے مخصوص اوبزرویبلٹی ہوتی ہے؛ دیگر ویڈیو کو جنرک API کال کی طرح برتتے ہیں۔ اگر اوبزرویبلٹی ترجیح ہے تو کمٹ کرنے سے پہلے جانچنا مفید ہے۔
- ریٹ لمٹ پولنگ۔ براہِ راست OpenAI پر آپ کی Sora ریٹ لمٹس آپ کے OpenAI اکاؤنٹ اور ٹئیر سے جڑی ہوتی ہیں۔ ایگریگیٹر پر کچھ صورتوں میں لمٹس ایگریگیٹر کے کسٹمر بیس میں پول کی جاتی ہیں، یا بعض میں فی کسٹمر تفویض۔ ہائی والیوم پروڈکشن ورک لوڈز کے لیے، انضمام سے پہلے ایگریگیٹر سے پوچھیں کہ وہ ریٹ لمٹ الاٹمنٹ کیسے ہینڈل کرتے ہیں۔
- جغرافیائی اور کمپلائنس پہلو۔ براہِ راست OpenAI پر پراسیسنگ OpenAI کے انفراسٹرکچر سے ہوتی ہے، ان ڈیٹا ریذیڈنسی آپشنز کے ساتھ جو OpenAI فراہم کرتا ہے۔ کچھ ایگریگیٹرز ایسے دائرہ اختیار میں مقیم ہیں جہاں ڈیٹا ریذیڈنسی قواعد مختلف ہیں؛ دیگر ہر حال میں درخواستیں OpenAI کے US انفراسٹرکچر سے روٹ کرتے ہیں۔ ریگولیٹڈ ورک لوڈز کے لیے یہ فیصلہ کن ہوتا ہے، اور یہ وہ چیز ہے جسے ایگریگیٹر کی سیلز ٹیم سے تحریری طور پر پوچھنا چاہیے۔
CometAPI کہاں فِٹ ہوتا ہے
CometAPI ایک ہی OpenAI-مطابق اینڈ پوائنٹ کے پیچھے Sora 2 اور Sora 2 Pro کو 500+ دیگر ماڈلز کے ساتھ ظاہر کرتا ہے، ایک کریڈینشل اور متحدہ بلنگ کے ساتھ۔ CometAPI پر Sora کی قیمت OpenAI کے فی سیکنڈ ریٹس کے مطابق رہتی ہے؛ آپریشنل قدر یہ ہے کہ آپ Sora کے استعمال کو اپنے باقی ماڈل ٹریفک کے ساتھ ایک ہی انوائس پر اکٹھا کر لیتے ہیں۔ جو ٹیمیں ملا جلا ورک لوڈ چلاتی ہیں (متعدد پرووائیڈرز کے ٹیکسٹ ماڈلز، امیج جینریشن، اور Sora ویڈیو)، ان کے لیے یہی بنیادی دلیل ہے۔ جو ٹیمیں صرف Sora اور ایک دو ٹیکسٹ ماڈلز استعمال کرتی ہیں، ان کے لیے آپریشنل بچت کم ہوتی ہے اور براہِ راست OpenAI رسائی ایک قابلِ دفاع انتخاب ہے۔
پروڈکشن کے لیے غور طلب باتیں
چند پیٹرنز جو Sora کو پروڈکشن ٹریفک کے قریب لانے سے پہلے درست کرنا قابلِ قدر ہیں:
- Async جاب لائف سائیکل ہینڈلنگ۔ ہر Sora جینریشن کو ریکویسٹ نہیں بلکہ لانگ رننگ جاب کے طور پر برتیں۔ تخلیق پر فوری طور پر جاب ID محفوظ کریں؛ سرور ری اسٹارٹ کو اس قابل بنا کر سروائیو کریں کہ in-flight جابز کے لیے پولنگ دوبارہ شروع کر سکیں؛ وہ کیس ہینڈل کریں جہاں آپ کا ورکر آف لائن ہو تو جاب مکمل ہو جائے۔ یہ معیاری ڈسٹریبیوٹڈ سسٹمز ہائیجین ہے مگر اکثر ابتدا میں نظر انداز ہو جاتی ہے کیونکہ Sora ٹیم کا پہلا async API انضمام ہوتا ہے۔
- Webhook ترجیح، Polling بیک اپ۔ اگر پلیٹ فارم تکمیل ایونٹس کے لیے ویب ہُکس سپورٹ کرتا ہے (OpenAI API کرتا ہے)، تو انہیں استعمال کریں۔ ویب ہُکس پولنگ کی ضرورت ختم کرتے ہیں اور آپ کے ریٹ لمٹ دباؤ اور اسٹیٹس چیکس کی ضائع شدہ کمپیوٹ دونوں کو کم کرتے ہیں۔ پولنگ ان ماحول کے لیے بیک اپ ہے جو ویب ہُک اینڈ پوائنٹ ایکسپوز نہیں کر سکتے۔
- ایسے ناکامی کے موڈز جو پیسے لگاتے ہیں۔ OpenAI ناکام جینریشنز پر بل نہیں کرتا، مگر جزوی تکمیلیں اور دوبارہ بھیجی گئی درخواستیں جو دوسری بار کامیاب ہوں، لاگت اٹھاتی ہیں۔ پروڈکشن میں، ہر ری ٹرائے کی لاگت لاگ کریں اور اگر آپ کی ری ٹرائے ریٹ توقعات سے بڑھ جائے تو الرٹ کریں، کیونکہ یہ عموماً اس بات کا اشارہ ہوتا ہے کہ آپ جو پرامپٹس بھیج رہے ہیں ان میں کنٹینٹ پالیسی کا مسئلہ ہے، جسے بل جذب کرنے کے بجائے پرامپٹ لیئر پر ٹھیک کرنا سستا ہے۔
- کنٹینٹ پالیسی اور پروڈکشن ڈپلائمنٹ۔ Sora، OpenAI کی یوزج پالیسیز کے تابع ہے، جو مخصوص کیٹیگریز کے کنٹینٹ کو محدود کرتی ہیں۔ پروڈکشن ڈپلائمنٹس (خصوصاً یوزر فیسنگ جہاں پرامپٹ جزوی طور پر صارف کے کنٹرول میں ہو) کے لیے، OpenAI کی آفیشل کنٹینٹ پالیسی دستاویزات کا جائزہ لیں اور مطابق گارڈ ریلز ڈیزائن کریں۔ OpenAI کی پالیسی سے لنک کرنا درست حوالہ ہے؛ وہ دستاویزات اصل ماخذ ہیں اور اس مضمون کے مقابلے زیادہ کثرت سے بدلتی ہیں۔
پہلے کیا بنائیں
Sora کے وہ ورک لوڈز جو آج پروڈکشن کے لیے تیار ہیں، جو سرحد پر ہیں، اور جو قبل از وقت ہیں — ان کی دیانت دارانہ درجہ بندی:
آج پروڈکشن کے لیے تیار
مارکیٹنگ اور کریئیٹو کنٹینٹ ورک لوڈز جہاں آئٹریشن محدود ہے اور فی فائنل ایسٹ لاگت درست میٹرک ہے۔ پروڈکٹ ڈیمو ویڈیوز، سوشل میڈیا مہماتی کنٹینٹ، لینڈنگ پیجز کے لیے ہیرو ویڈیوز، اندرونی ٹریننگ مواد۔ اکنامکس کام کرتے ہیں، ناکامی کے موڈز سمجھ میں آ چکے ہیں، اور لیٹنسی کی کہانی (مختصر کلپس کے لیے 30–90 سیکنڈ) اس وقت قابلِ قبول ہے جب انسان لوپ میں کنٹینٹ ٹیم ہو نہ کہ اختتامی صارف۔
سرحد پر
یوزر فیسنگ ویڈیو جینریشن فیچرز جہاں فی کلپ لاگت کو یوزر کی ادا کردہ قیمت سے اوپر آنا ہوتا ہے۔ یہ قابلِ عمل ہے مگر محتاط یونٹ اکنامکس درکار ہیں: صارفین کے قابلِ درخواست دورانیے پر حد لگائیں، بطور ڈیفالٹ Sora 2 اسٹینڈرڈ 720p استعمال کریں، ایسی قیمت لیں جس میں فی کلپ لاگت کے اوپر مارجن ہو۔ 2026 کے اوائل کی کنزیومر ویڈیو جینریشن ایپس کی لہر زیادہ تر اسی زمرے میں ہے، اور جن کی معیشت پائیدار ہے وہ سب صارفین کے قابلِ جنریشن کو دانستہ طور پر محدود کر رہی ہیں۔
قبل از وقت
لانگ فارم ویڈیو بڑے پیمانے پر (25 سیکنڈ سے اوپر، کیونکہ یہ Sora کی موجودہ دورانیہ حد ہے)، بہت زیادہ والیوم والے حقیقی وقت کے منظرنامے جہاں وال کلاک لیٹنسی ڈالرز سے زیادہ اہم ہو، اور ایسی ایپلی کیشنز جو فریم لیول کنٹرول یا seed پر مبنی قابلِ تولیدیت کی توقع رکھتی ہیں۔ یہ وہ ورک لوڈز ہیں جنہیں Sora کی صلاحیتی سطح کے پھیلنے پر دوبارہ دیکھنا چاہیے، آج زبردستی فٹ نہیں کرنا چاہیے۔
فریمینگ: Sora 2 واقعی ان کنٹینٹ ورک لوڈز کے لیے پروڈکشن کے قابل ہے جن میں انسان لوپ میں ہو۔ یہ یوزر فیسنگ فیچرز کے لیے قابلِ عمل ہے بشرطیکہ یونٹ اکنامکس دانستہ ہوں۔ یہ لانگ فارم ویڈیو اور ان کیسز کے لیے قبل از وقت ہے جنہیں وہ پیرا میٹرز درکار ہیں جو Sora ابھی ظاہر نہیں کرتا۔ آج کے لیے جو تیار ہے اس کے مطابق بنائیں؛ جو ابھی نہیں وہ ٹریک کریں۔
اپنے ورک لوڈ پر آزمانا چاہیں: تمام Sora 2 اور Sora 2 Pro ورژنز CometAPI پر دستیاب ہیں، ان ٹیکسٹ ماڈلز کے ساتھ جنہیں آپ پہلے سے استعمال کر رہے ہو سکتے ہیں۔ مفت ٹرائل کریڈٹ آپ کو معیاری قیمتوں پر چند کلپس جینریٹ کرنے دیتا ہے، بس اپنے موجودہ OpenAI-مطابق کلائنٹ کو CometAPI اینڈ پوائنٹ کی طرف موڑنے کے سوا کوئی سیٹ اپ درکار نہیں۔
