flux-pro-1-0-canny 的技術規格
| 規格 | 詳細資訊 |
|---|---|
| 模型 ID | flux-pro-1-0-canny |
| 模型家族 | FLUX.1 Canny [pro] |
| 提供方 / 來源 | Black Forest Labs’ FLUX 家族,亦可透過第三方推理平台(如 Replicate 與 fal)使用。 |
| 模態 | 圖像到圖像 / 使用文字提示加上 Canny 邊緣控制圖像的受控圖像生成。 |
| 核心控制方法 | 使用 Canny 邊緣檢測以保留結構的引導。 |
| 主要使用情境 | 素描轉圖像、在保留構圖前提下的重新貼圖、受控風格遷移,以及具建築或版面約束的視覺化。 |
| 輸入類型 | 提示文字加上一張控制圖像/邊緣圖;公開部署常見的執行時參數包括步數、引導強度、種子、輸出格式與安全相關控制。 |
| 輸出 | 依循所提供邊緣圖結構生成的圖像檔。 |
| 推理模式 | 在 FLUX 風格的 API 上通常採用非同步提交任務並輪詢結果。 |
什麼是 flux-pro-1-0-canny?
flux-pro-1-0-canny 是 CometAPI 用於標識 FLUX.1 Canny [pro] 模型的平台識別符,該模型屬於 FLUX 生態中的專業導向、以邊緣為引導的圖像生成模型。其核心能力是使用 Canny 邊緣檢測作為結構性條件信號,讓模型在回應自然語言提示的同時,生成遵循輸入圖像構圖與輪廓的新圖像。
在實務上,這個模型面向希望比標準文字生圖獲得更多控制力的使用者。你可以不僅僅以文字描述,而是提供素描、提取的邊緣圖或構圖參考,並要求模型以不同的風格、材質處理或場景脈絡進行渲染。公開的模型說明一致認為,它在轉換任務中對於保留版面與結構特別有用。
由於底層的 FLUX API 常採用提交任務加輪詢的方式,與此類模型的整合通常構建為非同步流程:提交請求、收到任務 ID,待處理完成後再取得結果。
flux-pro-1-0-canny 的主要特性
- 以邊緣引導的結構控制:模型使用 Canny 邊緣圖,在生成過程中保留來源圖像的構圖、輪廓與主要形體。
- 由提示驅動的再風格化:可將受邊緣控制的輸入與文字提示結合,在不破壞原始結構的前提下改變外觀、氛圍、材質或藝術風格。
- 高度契合素描轉圖像流程:公開範例與說明強調可將素描或由邊緣導出的引導轉化為打磨完成、可投入生產的視覺作品。
- 保留構圖的重新貼圖:非常適合在保持版面穩定的同時為場景或物件重新貼圖,適用於產品、概念與環境視覺化流程。
- 實用的參數控制:該模型的公開 API 通常提供推理設定,如擴散步數、引導強度、種子、輸出格式與安全容忍度,以便重現與調校。
- 對生產環境友好的 API 行為:FLUX API 的整合指引強調基於端點的任務提交與結果輪詢,與後端自動化與應用管線高度契合。
如何存取並整合 flux-pro-1-0-canny
步驟 1:註冊以取得 API 金鑰
在 CometAPI 註冊,並於儀表板產生你的 API 金鑰。在應用程式中以環境變數安全儲存並載入,然後再向 flux-pro-1-0-canny API 發出請求。
步驟 2:向 flux-pro-1-0-canny API 發送請求
使用 CometAPI 與 FLUX 相容的端點 POST /flux/v1/{model}。
curl https://api.cometapi.com/flux/v1/flux-pro-1-0-canny \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "A breathtaking landscape painting with golden hour lighting",
"width": 1024,
"height": 768,
"steps": 20,
"prompt_upsampling": true
}'
步驟 3:擷取並驗證結果
API 會回傳一個任務 ID。透過輪詢 GET /flux/v1/get_result?id={task_id} 以檢查生成狀態,完成後擷取輸出圖像。