kling-image-recognize Teknik Özellikleri
| Özellik | Ayrıntılar |
|---|---|
| Model Kimliği | kling-image-recognize |
| Kategori | Görüntü tanıma / çoklu modal analiz |
| Temel Yetenek | Birden çok görüntü referanslı video üretimi ve çoklu modal video düzenleme dahil, sonraki aşamadaki yaratıcı iş akışları için görüntü öğelerini tanır |
| Girdi Türü | Görüntü girdisi |
| Çıktı Türü | Yapılandırılmış tanıma sonuçları |
| Tanıma Kapsamı | Özneler, yüzler, kıyafetler ve diğer görsel öğeler |
| Sonuç Miktarı | Uygun olduğunda, istek başına en fazla 4 sonuç seti döndürebilir |
| Kullanım Senaryoları | Görsel varlık analizi, video üretimi için referans hazırlığı, düzenleme iş akışları için içerik anlama, özne ve kıyafet tanıma |
kling-image-recognize nedir?
kling-image-recognize, görsel içeriği analiz etmek ve bir görüntü içindeki önemli öğeleri belirlemek üzere tasarlanmış bir Keling görüntü öğesi tanıma API’sidir. Kaynak görüntülerin içeriğinin anlaşılmasının önemli bir ön işleme adımı olduğu, birden çok görüntü referanslı video üretimi veya çoklu modal video düzenleme gerektiren iş akışlarında özellikle kullanışlıdır.
Model, özneler, yüzler, kıyafetler ve ilgili görüntü bileşenleri gibi çeşitli görsel nitelikleri tanıyabilir. Girdiye bağlı olarak, tek bir istekte en fazla 4 tanıma sonucu seti sağlayabilir; bu da mevcut olduğunda geliştiricilerin birden fazla olası tespiti veya yorumu yakalamasına yardımcı olur.
kling-image-recognize'in başlıca özellikleri
- Görüntü öğesi tanıma: Girdi görüntüsünde yer alan önemli görsel öğeleri tespit eder ve tanımlar.
- Özne analizi: Sonraki aşamadaki medya üretimi veya düzenleme iş akışlarında kullanılabilecek birincil özneleri tanır.
- Yüz tanıma desteği: Görüntüde yüzler bulunduğunda yüze ilişkin tanıma sonuçlarını çıkarır.
- Kıyafet belirleme: Daha ayrıntılı görsel anlayışı desteklemek için giysi ve kıyafetle ilgili öğeleri tespit eder.
- Çok görüntülü referans iş akışı desteği: Video üretim iş akışlarında kullanılan görüntü referanslarını hazırlamak ve analiz etmek için yararlıdır.
- Çoklu modal video düzenleme uyumluluğu: Dönüşüm veya kompozisyon öncesinde görüntü içeriğinin anlaşılması gereken düzenleme senaryolarını destekler.
- İstek başına birden fazla sonuç seti: Uygun olduğunda istek başına en fazla 4 sonuç seti elde edebilir; bu da daha zengin tanıma çıktıları sağlar.
- Entegrasyon dostu API kullanımı: Otomatikleştirilmiş medya analizi ve yaratıcı uygulama iş akışları oluşturan geliştiriciler için uygundur.
kling-image-recognize’e nasıl erişilir ve entegre edilir
Adım 1: API anahtarı için kaydolun
Başlamak için CometAPI platformunda kaydolun ve panodan API anahtarınızı oluşturun. Anahtarınızı aldıktan sonra onu güvenli bir şekilde saklayın ve kling-image-recognize API’sine gönderdiğiniz her isteği kimlik doğrulamak için kullanın.
Adım 2: kling-image-recognize API’sine istek gönderin
API anahtarınızı aldıktan sonra, model kimliği olarak kling-image-recognize kullanarak CometAPI uç noktasına istekler gönderin. Kimlik doğrulama başlıklarınızı ekleyin ve uygulama iş akışınıza göre gerekli görüntü girdi yükünü sağlayın.
curl --request POST \
--url https://api.cometapi.com/v1/responses \
--header "Authorization: Bearer YOUR_COMETAPI_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "kling-image-recognize",
"input": [
{
"role": "user",
"content": [
{
"type": "input_text",
"text": "Recognize the main visual elements in this image."
},
{
"type": "input_image",
"image_url": "YOUR_IMAGE_URL"
}
]
}
]
}'
Adım 3: Sonuçları alın ve doğrulayın
Gönderdikten sonra, API kling-image-recognize tarafından üretilen tanıma sonuçlarını döndürür. Yanıtı uygulamanızda ayrıştırın, tespit edilen özneleri veya nitelikleri doğrulayın ve döndürülen verileri video üretimi, düzenleme veya diğer sonraki otomasyon görevlerinde kullanmak üzere depolayın.