Spécifications techniques de kling-image-recognize
| Spécification | Détails |
|---|---|
| ID du modèle | kling-image-recognize |
| Catégorie | Reconnaissance d’images / analyse multimodale |
| Capacité principale | Reconnaît les éléments d’image pour des workflows créatifs en aval, y compris la génération de vidéos à partir de références multi-images et le montage vidéo multimodal |
| Type d’entrée | Image en entrée |
| Type de sortie | Résultats de reconnaissance structurés |
| Portée de reconnaissance | Sujets, visages, vêtements et autres éléments visuels |
| Volume des résultats | Peut renvoyer jusqu’à 4 ensembles de résultats par requête, le cas échéant |
| Cas d’utilisation | Analyse des ressources visuelles, préparation de références pour la génération vidéo, compréhension du contenu pour les pipelines de montage, reconnaissance des sujets et des vêtements |
Qu’est-ce que kling-image-recognize ?
kling-image-recognize est une API de reconnaissance des éléments d’image de Keling conçue pour analyser le contenu visuel et identifier les éléments importants d’une image. Elle est particulièrement utile dans des workflows nécessitant la génération de vidéos à partir de références multi-images ou le montage vidéo multimodal, où la compréhension du contenu des images sources constitue une étape de prétraitement importante.
Le modèle peut reconnaître un éventail d’attributs visuels tels que les sujets, les visages, les vêtements et des composants d’image associés. En fonction de l’entrée, il peut fournir jusqu’à 4 ensembles de résultats de reconnaissance dans une seule requête, aidant les développeurs à capturer plusieurs détections ou interprétations possibles, le cas échéant.
Principales fonctionnalités de kling-image-recognize
- Reconnaissance des éléments d’image : Détecte et identifie les éléments visuels importants contenus dans une image en entrée.
- Analyse des sujets : Reconnaît les sujets principaux pouvant être utilisés dans des workflows de génération ou de montage en aval.
- Prise en charge de la reconnaissance des visages : Extrait des résultats de reconnaissance liés aux visages lorsqu’ils sont présents dans l’image.
- Identification des vêtements : Détecte les vêtements et les éléments associés pour une compréhension visuelle plus détaillée.
- Prise en charge des workflows de référence multi-images : Utile pour préparer et analyser des références d’images utilisées dans des pipelines de génération vidéo.
- Compatibilité avec le montage vidéo multimodal : Alimente des scénarios de montage où le contenu de l’image doit être compris avant transformation ou composition.
- Jeux de résultats multiples par requête : Peut obtenir jusqu’à 4 ensembles de résultats par requête, le cas échéant, afin d’enrichir la sortie de reconnaissance.
- Utilisation de l’API adaptée à l’intégration : Convient aux développeurs qui construisent des pipelines d’analyse média automatisés et des applications créatives.
Comment accéder à et intégrer kling-image-recognize
Étape 1 : Inscrivez-vous pour obtenir une clé API
Pour commencer, inscrivez-vous sur la plateforme CometAPI et générez votre clé API depuis le tableau de bord. Après avoir obtenu votre clé, stockez-la en toute sécurité et utilisez-la pour authentifier chaque requête vers l’API kling-image-recognize.
Étape 2 : Envoyer des requêtes à l’API kling-image-recognize
Une fois votre clé API obtenue, envoyez des requêtes vers le point de terminaison CometAPI en utilisant kling-image-recognize comme ID de modèle. Incluez vos en-têtes d’authentification et fournissez la charge utile d’image requise en fonction du workflow de votre application.
curl --request POST \
--url https://api.cometapi.com/v1/responses \
--header "Authorization: Bearer YOUR_COMETAPI_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "kling-image-recognize",
"input": [
{
"role": "user",
"content": [
{
"type": "input_text",
"text": "Recognize the main visual elements in this image."
},
{
"type": "input_image",
"image_url": "YOUR_IMAGE_URL"
}
]
}
]
}'
Étape 3 : Récupérer et vérifier les résultats
Après soumission, l’API renvoie les résultats de reconnaissance générés par kling-image-recognize. Analysez la réponse dans votre application, vérifiez les sujets ou attributs détectés et stockez les données renvoyées pour les utiliser dans la génération vidéo, le montage ou d’autres tâches d’automatisation en aval.