Spesifikasi Teknis kling-image-recognize
| Spesifikasi | Rincian |
|---|---|
| ID Model | kling-image-recognize |
| Kategori | Pengenalan gambar / analisis multimodal |
| Kemampuan Utama | Mengenali elemen gambar untuk alur kerja kreatif hilir, termasuk pembuatan video referensi multi-gambar dan pengeditan video multimodal |
| Jenis Input | Input gambar |
| Jenis Output | Hasil pengenalan terstruktur |
| Cakupan Pengenalan | Subjek, wajah, pakaian, dan elemen visual lainnya |
| Volume Hasil | Dapat mengembalikan hingga 4 set hasil per permintaan, jika tersedia |
| Kasus Penggunaan | Analisis aset visual, penyiapan referensi untuk pembuatan video, pemahaman konten untuk pipeline pengeditan, pengenalan subjek dan pakaian |
Apa itu kling-image-recognize?
kling-image-recognize adalah API pengenalan elemen gambar Keling yang dirancang untuk menganalisis konten visual dan mengidentifikasi elemen penting dalam sebuah gambar. API ini sangat berguna dalam alur kerja yang memerlukan pembuatan video referensi multi-gambar atau pengeditan video multimodal, di mana pemahaman atas isi gambar sumber merupakan langkah praproses yang penting.
Model ini dapat mengenali beragam atribut visual seperti subjek, wajah, pakaian, dan komponen gambar terkait. Bergantung pada input, model dapat menyediakan hingga 4 set hasil pengenalan dalam satu permintaan, membantu pengembang menangkap beberapa kemungkinan deteksi atau interpretasi jika tersedia.
Fitur utama kling-image-recognize
- Pengenalan elemen gambar: Mendeteksi dan mengidentifikasi elemen visual penting yang terdapat dalam gambar input.
- Analisis subjek: Mengenali subjek utama yang dapat digunakan dalam alur kerja pembuatan atau pengeditan media hilir.
- Dukungan pengenalan wajah: Mengambil hasil pengenalan terkait wajah ketika wajah hadir dalam gambar.
- Identifikasi pakaian: Mendeteksi pakaian dan elemen terkaitnya untuk mendukung pemahaman visual yang lebih mendetail.
- Dukungan alur kerja referensi multi-gambar: Berguna untuk menyiapkan dan menganalisis referensi gambar yang digunakan dalam pipeline pembuatan video.
- Kesesuaian dengan pengeditan video multimodal: Mendukung skenario pengeditan di mana konten gambar perlu dipahami sebelum transformasi atau komposisi.
- Beberapa set hasil per permintaan: Dapat memperoleh hingga 4 set hasil per permintaan, jika tersedia, sehingga menghasilkan keluaran pengenalan yang lebih kaya.
- Penggunaan API yang ramah integrasi: Cocok untuk pengembang yang membangun analisis media otomatis dan pipeline aplikasi kreatif.
Cara mengakses dan mengintegrasikan kling-image-recognize
Langkah 1: Daftar untuk Kunci API
Untuk memulai, daftar di platform CometAPI dan buat kunci API Anda dari dasbor. Setelah memperoleh kunci, simpan dengan aman dan gunakan untuk mengautentikasi setiap permintaan ke API kling-image-recognize.
Langkah 2: Kirim permintaan ke API kling-image-recognize
Setelah memiliki kunci API, kirim permintaan ke endpoint CometAPI dengan menggunakan kling-image-recognize sebagai ID model. Sertakan header autentikasi Anda dan sediakan payload input gambar yang diperlukan sesuai alur kerja aplikasi Anda.
curl --request POST \
--url https://api.cometapi.com/v1/responses \
--header "Authorization: Bearer YOUR_COMETAPI_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "kling-image-recognize",
"input": [
{
"role": "user",
"content": [
{
"type": "input_text",
"text": "Recognize the main visual elements in this image."
},
{
"type": "input_image",
"image_url": "YOUR_IMAGE_URL"
}
]
}
]
}'
Langkah 3: Ambil dan verifikasi hasil
Setelah pengiriman, API akan mengembalikan hasil pengenalan yang dihasilkan oleh kling-image-recognize. Urai respons di aplikasi Anda, verifikasi subjek atau atribut yang terdeteksi, dan simpan data yang dikembalikan untuk digunakan dalam pembuatan video, pengeditan, atau tugas otomasi hilir lainnya.