kling-image-recognize کی تکنیکی خصوصیات
| مواصفات | تفصیلات |
|---|---|
| Model ID | kling-image-recognize |
| زمرہ | تصویری شناخت / ملٹی موڈل تجزیہ |
| بنیادی صلاحیت | ڈاؤن اسٹریم تخلیقی ورک فلو کے لیے تصویری عناصر کی شناخت کرتا ہے، جن میں کثیر-تصویر حوالہ جاتی ویڈیو جنریشن اور ملٹی موڈل ویڈیو ایڈیٹنگ شامل ہیں |
| ان پٹ کی قسم | تصویر بطور ان پٹ |
| آؤٹ پٹ کی قسم | ساختہ شناختی نتائج |
| پہچان کا دائرہ کار | موضوعات، چہرے، لباس اور دیگر بصری عناصر |
| نتائج کی تعداد | اگر دستیاب ہوں تو فی درخواست زیادہ سے زیادہ 4 سیٹ نتائج لوٹا سکتا ہے |
| استعمال کی صورتیں | بصری اثاثوں کا تجزیہ، ویڈیو جنریشن کے لیے حوالہ کی تیاری، ایڈیٹنگ پائپ لائنز کے لیے مواد کی فہم، موضوع اور ملبوسات کی شناخت |
kling-image-recognize کیا ہے؟
kling-image-recognize ایک Keling تصویری عنصر شناخت API ہے جو بصری مواد کا تجزیہ کر کے تصویر کے اندر موجود اہم عناصر کی نشاندہی کرتا ہے۔ یہ خاص طور پر اُن ورک فلو میں مفید ہے جن میں کثیر-تصویر حوالہ جاتی ویڈیو جنریشن یا ملٹی موڈل ویڈیو ایڈیٹنگ شامل ہو، جہاں ماخذ تصاویر کے مواد کی سمجھ ایک اہم قبل از کارروائی مرحلہ ہوتی ہے۔
یہ ماڈل موضوعات، چہروں، لباس اور متعلقہ تصویری اجزا جیسے مختلف بصری خواص کو پہچان سکتا ہے۔ ان پٹ کے مطابق، یہ ایک ہی درخواست میں زیادہ سے زیادہ 4 سیٹ شناختی نتائج فراہم کر سکتا ہے، جس سے ڈویلپرز کو ممکنہ متعدد ڈیٹیکشنز یا تشریحات حاصل کرنے میں مدد ملتی ہے جہاں دستیاب ہوں۔
kling-image-recognize کی اہم خصوصیات
- تصویری عناصر کی شناخت: ان پٹ تصویر میں موجود اہم بصری عناصر کا پتا لگاتا اور شناخت کرتا ہے۔
- موضوع کا تجزیہ: بنیادی موضوعات کو پہچانتا ہے جنہیں بعد ازاں میڈیا جنریشن یا ایڈیٹنگ ورک فلو میں استعمال کیا جا سکتا ہے۔
- چہرہ شناخت کی معاونت: تصویر میں چہرے موجود ہونے کی صورت میں چہرہ سے متعلق شناختی نتائج اخذ کرتا ہے۔
- لباس کی شناخت: ملبوسات اور لباس سے متعلق عناصر کا سراغ لگا کر زیادہ تفصیلی بصری فہم میں مدد دیتا ہے۔
- کثیر-تصویر حوالہ جاتی ورک فلو کی معاونت: ویڈیو جنریشن پائپ لائنز میں استعمال ہونے والی تصویری حوالہ جات کی تیاری اور تجزیے کے لیے مفید۔
- ملٹی موڈل ویڈیو ایڈیٹنگ سے مطابقت: اُن ایڈیٹنگ منظرناموں کو تقویت دیتا ہے جہاں تبدیلی یا ترکیب سے پہلے تصویر کے مواد کی سمجھ ضروری ہو۔
- فی درخواست متعدد نتائج کے سیٹ: اگر دستیاب ہوں تو فی درخواست زیادہ سے زیادہ 4 سیٹ نتائج حاصل کیے جا سکتے ہیں، جس سے زیادہ بھرپور شناختی آؤٹ پٹ ملتا ہے۔
- انضمام کے لیے موزوں API استعمال: خودکار میڈیا تجزیہ اور تخلیقی ایپلیکیشن پائپ لائنز بنانے والے ڈویلپرز کے لیے مناسب۔
kling-image-recognize تک رسائی اور انضمام کا طریقہ
مرحلہ 1: API Key کے لیے سائن اپ کریں
شروع کرنے کے لیے CometAPI پلیٹ فارم پر سائن اپ کریں اور ڈیش بورڈ سے اپنی API key جنریٹ کریں۔ کلید حاصل کرنے کے بعد اسے محفوظ رکھیں اور kling-image-recognize API کو بھیجی جانے والی ہر درخواست میں توثیق کے لیے استعمال کریں۔
مرحلہ 2: kling-image-recognize API کو درخواستیں بھیجیں
جب آپ کے پاس API key ہو، تو CometAPI اینڈ پوائنٹ پر kling-image-recognize کو بطور ماڈل ID استعمال کرتے ہوئے درخواست بھیجیں۔ اپنی توثیقی ہیڈرز شامل کریں اور اپنی ایپلیکیشن کے ورک فلو کے مطابق درکار تصویری ان پٹ پےلوڈ فراہم کریں۔
curl --request POST \
--url https://api.cometapi.com/v1/responses \
--header "Authorization: Bearer YOUR_COMETAPI_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "kling-image-recognize",
"input": [
{
"role": "user",
"content": [
{
"type": "input_text",
"text": "Recognize the main visual elements in this image."
},
{
"type": "input_image",
"image_url": "YOUR_IMAGE_URL"
}
]
}
]
}'
مرحلہ 3: نتائج حاصل کریں اور توثیق کریں
جمع کرانے کے بعد، API kling-image-recognize کے تیار کردہ شناختی نتائج واپس کرتی ہے۔ اپنی ایپلیکیشن میں ریسپانس کو پارس کریں، شناخت شدہ موضوعات یا خصوصیات کی توثیق کریں، اور لوٹائے گئے ڈیٹا کو ویڈیو جنریشن، ایڈیٹنگ یا دیگر ڈاؤن اسٹریم خودکار کاموں میں استعمال کے لیے محفوظ کریں۔