Tekniske spesifikasjoner for kling-image-recognize
| Spesifikasjon | Detaljer |
|---|---|
| Modell-ID | kling-image-recognize |
| Kategori | Bildegjenkjenning / multimodal analyse |
| Primær funksjon | Gjenkjenner bildeelementer for etterfølgende kreative arbeidsflyter, inkludert videogenerering basert på flere bildereferanser og multimodal videoredigering |
| Inndatatype | Bildeinndata |
| Utdatatype | Strukturerte gjenkjenningsresultater |
| Gjenkjenningsomfang | Motiver, ansikter, klær og andre visuelle elementer |
| Antall resultater | Kan returnere opptil 4 sett med resultater per forespørsel, hvis tilgjengelig |
| Bruksområder | Analyse av visuelle ressurser, forberedelse av referanser for videogenerering, innholdsforståelse for redigeringsflyter, gjenkjenning av motiver og bekledning |
Hva er kling-image-recognize?
kling-image-recognize er et Keling-API for gjenkjenning av bildeelementer, utviklet for å analysere visuelt innhold og identifisere viktige elementer i et bilde. Det er spesielt nyttig i arbeidsflyter som krever videogenerering basert på flere bildereferanser eller multimodal videoredigering, der forståelse av innholdet i kildebildene er et viktig trinn i forbehandlingen.
Modellen kan gjenkjenne en rekke visuelle attributter som motiver, ansikter, klær og relaterte bildekomponenter. Avhengig av inndata kan den levere opptil 4 sett med gjenkjenningsresultater i én enkelt forespørsel, noe som hjelper utviklere å fange flere mulige deteksjoner eller tolkninger når de er tilgjengelige.
Hovedfunksjoner for kling-image-recognize
- Gjenkjenning av bildeelementer: Oppdager og identifiserer viktige visuelle elementer i et inndatabilde.
- Motivanalyse: Gjenkjenner primære motiver som kan brukes i etterfølgende arbeidsflyter for mediagenerering eller redigering.
- Støtte for ansiktsgjenkjenning: Henter ut ansiktsrelaterte gjenkjenningsresultater når ansikter er til stede i bildet.
- Identifisering av bekledning: Oppdager klær og klesrelaterte elementer for å støtte en mer detaljert visuell forståelse.
- Støtte for arbeidsflyter med flere bildereferanser: Nyttig for å forberede og analysere bildereferanser som brukes i videogenereringsflyter.
- Kompatibilitet med multimodal videoredigering: Støtter redigeringsscenarier der bildekinnhold må forstås før transformasjon eller sammensetning.
- Flere resultatsett per forespørsel: Kan hente opptil 4 sett med resultater per forespørsel, hvis tilgjengelig, som gir rikere gjenkjenningsresultater.
- Integrasjonsvennlig API-bruk: Egnet for utviklere som bygger automatiserte arbeidsflyter for medieanalyse og kreative applikasjoner.
Slik får du tilgang til og integrerer kling-image-recognize
Trinn 1: Registrer deg for en API-nøkkel
For å komme i gang, registrer deg på CometAPI-plattformen og generer API-nøkkelen din i dashbordet. Når du har fått nøkkelen, lagre den sikkert og bruk den til å autentisere hver forespørsel til kling-image-recognize-API-et.
Trinn 2: Send forespørsler til kling-image-recognize-API-et
Når du har API-nøkkelen din, send forespørsler til CometAPI-endepunktet med kling-image-recognize som modell-ID. Inkluder autentiseringsheadere og oppgi nødvendig bildepayload basert på appens arbeidsflyt.
curl --request POST \
--url https://api.cometapi.com/v1/responses \
--header "Authorization: Bearer YOUR_COMETAPI_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "kling-image-recognize",
"input": [
{
"role": "user",
"content": [
{
"type": "input_text",
"text": "Recognize the main visual elements in this image."
},
{
"type": "input_image",
"image_url": "YOUR_IMAGE_URL"
}
]
}
]
}'
Trinn 3: Hent og verifiser resultater
Etter innsending returnerer API-et gjenkjenningsresultater generert av kling-image-recognize. Parse responsen i applikasjonen din, verifiser de oppdagede motivene eller attributtene, og lagre de returnerte dataene for bruk i videogenerering, redigering eller andre etterfølgende automatiseringsoppgaver.