kling-image-recognize 的技術規格
| Specification | Details |
|---|---|
| Model ID | kling-image-recognize |
| Category | 圖像識別 / 多模態分析 |
| Primary Capability | 識別圖像元素以用於下游創意工作流程,包括多圖像參考影片生成與多模態影片編輯 |
| Input Type | 圖像輸入 |
| Output Type | 結構化識別結果 |
| Recognition Scope | 主體、臉部、服裝及其他視覺元素 |
| Result Volume | 每次請求最多可返回 4 組結果(若可用) |
| Use Cases | 視覺素材分析、影片生成的參考準備、剪輯流程的內容理解、主體與服裝識別 |
什麼是 kling-image-recognize?
kling-image-recognize 是一個 Keling 圖像元素識別 API,旨在分析視覺內容並識別圖像中的重要元素。它在需要多圖像參考影片生成或多模態影片編輯的工作流程中特別有用,因為理解來源圖像內容是重要的前置處理步驟。
該模型可識別包括主體、臉部、服裝等在內的一系列視覺屬性及相關圖像組件。根據輸入情況,它在單次請求中最多可提供 4 組識別結果,幫助開發者在可用時捕捉多種可能的檢測或解讀。
kling-image-recognize 的主要功能
- 圖像元素識別:檢測並識別輸入圖像中包含的重要視覺元素。
- 主體分析:識別可用於下游媒體生成或編輯工作流程的主要主體。
- 臉部識別支援:在圖像包含臉部時提取與臉部相關的識別結果。
- 服裝識別:檢測服裝與服飾相關元素,以支持更細緻的視覺理解。
- 多圖像參考工作流程支援:適用於為影片生成管線準備與分析圖像參考。
- 多模態影片編輯相容性:支持在轉換或合成前需要理解圖像內容的編輯場景。
- 單次請求多組結果:若可用,每次請求最多可獲得 4 組結果,提供更豐富的識別輸出。
- 易於整合的 API 用法:適合建置自動化媒體分析與創意應用管線的開發者。
如何存取並整合 kling-image-recognize
步驟 1:註冊並取得 API 金鑰
首先,請在 CometAPI 平台註冊,並在儀表板中建立您的 API 金鑰。取得金鑰後,請妥善保存,並用於對 kling-image-recognize API 的每一次請求進行驗證。
步驟 2:向 kling-image-recognize API 發送請求
獲得 API 金鑰後,使用 kling-image-recognize 作為模型 ID,向 CometAPI 端點發送請求。包含驗證標頭,並根據您的應用工作流程提供所需的圖像輸入載荷。
curl --request POST \
--url https://api.cometapi.com/v1/responses \
--header "Authorization: Bearer YOUR_COMETAPI_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "kling-image-recognize",
"input": [
{
"role": "user",
"content": [
{
"type": "input_text",
"text": "Recognize the main visual elements in this image."
},
{
"type": "input_image",
"image_url": "YOUR_IMAGE_URL"
}
]
}
]
}'
步驟 3:擷取並驗證結果
提交後,API 會返回由 kling-image-recognize 生成的識別結果。在您的應用中解析回應,驗證已檢出的主體或屬性,並儲存返回的資料,以用於影片生成、編輯或其他下游自動化任務。