Especificaciones técnicas de kling-image-recognize
| Especificación | Detalles |
|---|---|
| Model ID | kling-image-recognize |
| Categoría | Reconocimiento de imágenes / análisis multimodal |
| Capacidad principal | Reconoce elementos de la imagen para flujos de trabajo creativos posteriores, incluyendo generación de video con referencias de múltiples imágenes y edición de video multimodal |
| Tipo de entrada | Entrada de imagen |
| Tipo de salida | Resultados de reconocimiento estructurados |
| Alcance del reconocimiento | Sujetos, rostros, vestimenta y otros elementos visuales |
| Volumen de resultados | Puede devolver hasta 4 conjuntos de resultados por solicitud, si están disponibles |
| Casos de uso | Análisis de recursos visuales, preparación de referencias para generación de video, comprensión de contenido para flujos de edición, reconocimiento de sujetos y prendas |
¿Qué es kling-image-recognize?
kling-image-recognize es una API de reconocimiento de elementos de imagen de Keling diseñada para analizar contenido visual e identificar elementos importantes dentro de una imagen. Es especialmente útil en flujos de trabajo que requieren generación de video con referencias de múltiples imágenes o edición de video multimodal, donde comprender el contenido de las imágenes de origen es un paso de preprocesamiento importante.
El modelo puede reconocer una variedad de atributos visuales como sujetos, rostros, vestimenta y componentes de imagen relacionados. Según la entrada, puede proporcionar hasta 4 conjuntos de resultados de reconocimiento en una sola solicitud, ayudando a los desarrolladores a capturar múltiples detecciones o interpretaciones posibles cuando estén disponibles.
Funciones principales de kling-image-recognize
- Reconocimiento de elementos de imagen: Detecta e identifica elementos visuales importantes contenidos en una imagen de entrada.
- Análisis de sujetos: Reconoce los sujetos principales que pueden usarse en flujos de trabajo posteriores de generación o edición de medios.
- Compatibilidad con reconocimiento facial: Extrae resultados de reconocimiento relacionados con rostros cuando hay rostros presentes en la imagen.
- Identificación de vestimenta: Detecta prendas y elementos relacionados con la vestimenta para respaldar una comprensión visual más detallada.
- Compatibilidad con flujos de trabajo de referencias de múltiples imágenes: Útil para preparar y analizar referencias de imágenes utilizadas en canalizaciones de generación de video.
- Compatibilidad con edición de video multimodal: Ayuda a habilitar escenarios de edición donde es necesario comprender el contenido de la imagen antes de la transformación o composición.
- Múltiples conjuntos de resultados por solicitud: Puede obtener hasta 4 conjuntos de resultados por solicitud, si están disponibles, lo que permite un reconocimiento más rico.
- Uso de API fácil de integrar: Adecuado para desarrolladores que construyen canalizaciones automatizadas de análisis de medios y aplicaciones creativas.
Cómo acceder e integrar kling-image-recognize
Paso 1: Regístrate para obtener una clave de API
Para comenzar, regístrate en la plataforma CometAPI y genera tu clave de API desde el panel. Después de obtener tu clave, almacénala de forma segura y úsala para autenticar cada solicitud a la API de kling-image-recognize.
Paso 2: Envía solicitudes a la API de kling-image-recognize
Una vez que tengas tu clave de API, envía solicitudes al endpoint de CometAPI usando kling-image-recognize como el ID del modelo. Incluye tus encabezados de autenticación y proporciona la carga útil de entrada de imagen requerida según el flujo de trabajo de tu aplicación.
curl --request POST \
--url https://api.cometapi.com/v1/responses \
--header "Authorization: Bearer YOUR_COMETAPI_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "kling-image-recognize",
"input": [
{
"role": "user",
"content": [
{
"type": "input_text",
"text": "Recognize the main visual elements in this image."
},
{
"type": "input_image",
"image_url": "YOUR_IMAGE_URL"
}
]
}
]
}'
Paso 3: Recupera y verifica los resultados
Tras el envío, la API devuelve resultados de reconocimiento generados por kling-image-recognize. Analiza la respuesta en tu aplicación, verifica los sujetos o atributos detectados y almacena los datos devueltos para usarlos en generación de video, edición u otras tareas de automatización posteriores.