GPT-6.1 Sol are now live on CometAPI →
ai-model/CometAPI 研究

如何使用 FLUX 3 API:完整開發者指南

請提供需要翻譯成繁體中文的原始內容(可為純文本、HTML、Markdown、JSON、XML、CSV 或程式碼片段等),我將在保留原始結構與技術元素不變的前提下進行翻譯。

CometAPI
Deon GoodwinAI 模型與 API 研究團隊
更新於 Oct 4, 2026 8 分鐘閱讀
如何使用 FLUX 3 API:完整開發者指南
套用此模式

發出第一個 API 請求。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

快速解答

FLUX 3 是 Black Forest Labs 的多模態影片模型,支援文字轉影片與圖像轉影片,並提供同步音訊。於 CometAPI 上,生產模型 ID 為 flux-3。已驗證的非同步工作流程使用 POST /v1/videos 建立任務,使用 GET /v1/videos/{task_id} 輪詢狀態,並以 GET /v1/videos/{task_id}/content 下載完成的 MP4。

可用性更新(2026 年 9 月 24 日驗證):Black Forest Labs 已將 FLUX 3 Video 從 7 月的早期存取進一步推向一般可用,並於 2026 年 8 月 4 日透過 BFL API 與特定合作夥伴發布首批文字轉影片與圖像轉影片功能。CometAPI 於 2026 年 8 月 13 日在其 Video API 格式中新增生產模型 ID flux-3。請以 BFL 發布公告 與 CometAPI 的即時模型頁面作為可用性、欄位與價格的權威來源。

自 FLUX 3 早期存取以來有何變化?

重點變化在於作業層面的可用性。先前的報導聚焦於 7 月的申請制發放;BFL 於 8 月的發布引入可呼叫的影片端點、公開的限制,以及生產定價。CometAPI 隨後透過其統一的 Video API 工作流程提供 flux-3。

CometAPI 較早的文章 FLUX 3 API: Availability, Early Access, Video & Dev 對於發佈歷史與 7 月初步評估仍具參考價值。更廣泛的比較可見於 Best AI Video APIs in 2026。本指南將上述主題簡化,聚焦於可運作的請求、輪詢、提示撰寫、成本控管與生產處理。

什麼是 FLUX 3?

FLUX 3 是 BFL 的多模態模型家族,涵蓋影片、音訊、影像與動作相關預測。目前的影片版本透過單一供應商原生端點支援文字轉影片、圖像轉影片與影片延續。

對影片開發者而言,重點能力包括最長 20 秒、24 fps,HD 或 Full HD 輸出、同步音訊、多語言語音與對嘴同步、單次生成的多鏡頭,以及最多 10 個鎖定的關鍵影格以用於圖像轉影片控制。

FLUX 3 API 規格

規格BFL 官方規格CometAPI 整合
主要工作流程文字轉影片、圖像轉影片、影片延續列出文字轉影片與圖像轉影片
最長時長T2V/I2V 為 5–20 秒;V2V 為 5–15 秒透過即時快速入門值送出網關請求
畫面格率24 fps供應商輸出
解析度原生 rHD;透過影片升頻器支援 FHD。BFL 目前的 FLUX 3 Video 文件未列出 4K/UHD。所謂「最高 4MP」規格適用於 FLUX.2 影像模型,非 FLUX 3 Video。列出 720p 與 1080p 定價
原生音訊是;預設啟用輸出功能取決於當前整合
影像控制原生 I2V 支援 1–10 個關鍵影格請驗證目前網關的參考影像映射
長寬比21:9、2:1、16:9、4:3、1:1、3:4、9:16快速入門使用如 1280x720 之類的明確尺寸
呼叫方式非同步建立 → 輪詢 → 下載
CometAPI 模型 ID—flux-3

FLUX 3 Video 表現如何?

BFL 報告其在全對全的人類偏好評估中,文字轉影片的 Elo 分數為 1135。在同一份公布的比較中,FLUX 3 與 Seedance 2.0 在圖像轉影片偏好上並列,並且領先其他受測模型。

這些結果有助於定位,但它們是供應商自行執行的人類偏好評估,而非獨立的生產級基準。它們未衡量網關延遲、佇列可靠性、成本一致性或重複生成穩定性,因此生產團隊仍應以自身提示集進行評估。

FLUX 3 基準表現

指標發布結果詮釋
文字轉影片全對全 Elo1135BFL 報告 FLUX 3 在其內部比較中領先
圖像轉影片偏好與 Seedance 2.0 持平方向性的供應商結果,非第三方排行榜
評估類型人類偏好衡量感知輸出品質,而非 API 基礎設施

如何使用 FLUX 3 API:完整開發者指南

來源:Black Forest Labs — FLUX 3 Video, Part 1: Generation。*

使用 FLUX 3 API 前需要準備什麼

  • 一個 CometAPI 帳號與儲存在後端環境變數中的 API 金鑰。
  • 一段明確定義主體、動作、鏡頭方向、氛圍,以及所需音訊或對白的提示。
  • 可持久的作業處理流程,因為影片生成是非同步的。
  • 足夠的額度以進行迭代測試;計費取決於生成時長與解析度。

請在 CometAPI 的 API 控制台建立金鑰。不要將其放入前端 JavaScript、行動裝置打包檔、公開版本庫或螢幕截圖中。

FLUX 3 模型 ID 與端點

操作方法與端點目的
建立影片POST https://api.cometapi.com/v1/videos提交生成任務
查詢任務GET https://api.cometapi.com/v1/videos/{task\_id}讀取狀態與進度
下載輸出GET https://api.cometapi.com/v1/videos/{task\_id}/content下載完成的 MP4

如何在 CometAPI 中使用 FLUX 3 API

步驟 1:設定 API 金鑰

在 macOS 或 Linux 上:

export COMETAPI_KEY="your_api_key"

在 Windows PowerShell 上:

$env:COMETAPI_KEY="your_api_key"

步驟 2:建立 FLUX 3 影片

目前的 FLUX 3 快速入門 使用 multipart 請求,包含 model、prompt、seconds 與 size。下列範例請求一段 5 秒、720p 的影片:

curl https://api.cometapi.com/v1/videos \
  -H "Authorization: Bearer $COMETAPI_KEY" \
  -F "model=flux-3" \
  -F "prompt=A paper boat glides across a still pond in soft morning light" \
  -F "seconds=5" \
  -F "size=1280x720"

此請求會啟動一個作業。不要設計成於相同的 HTTP 回應中接收完成的 MP4。

步驟 3:保存任務 ID

建立請求成功後立即保存識別碼:

{
  "id": "video_task_id",
  "status": "queued"
}

在開始輪詢前,將任務 ID 與使用者或作業記錄一併保存。即使程序重啟,也不應遺失已被計費的生成。

步驟 4:輪詢影片狀態

curl https://api.cometapi.com/v1/videos/{task_id} \
  -H "Authorization: Bearer $COMETAPI_KEY"

以約 10 秒的間隔開始。將 completed、succeeded 或 success 視為終止的成功狀態;將 failed、failure、cancelled 或 canceled 視為終止的失敗狀態。

步驟 5:下載 MP4

curl https://api.cometapi.com/v1/videos/{task_id}/content \
  -H "Authorization: Bearer $COMETAPI_KEY" \
  --output flux3_output.mp4

完成後,將檔案複製到自有的物件儲存或媒體管線,而非將暫時的供應商 URL 作為永久資產。

使用 Python 完成 FLUX 3 影片生成工作流程

以下範例將建立作業、保存其 ID、輪詢至完成、檢查失敗狀態、驗證 MP4 簽名,並將輸出寫入磁碟。

import os
import time
from pathlib import Path

import requests

api_key = os.environ["COMETAPI_KEY"]
base_url = "https://api.cometapi.com"
headers = {"Authorization": f"Bearer {api_key}"}

response = requests.post(
    f"{base_url}/v1/videos",
    headers=headers,
    files={
        "model": (None, "flux-3"),
        "prompt": (
            None,
            "A product bottle rotates slowly on wet black stone, "
            "soft rim lighting, macro lens, realistic reflections.",
        ),
        "seconds": (None, "5"),
        "size": (None, "1280x720"),
    },
    timeout=120,
)
response.raise_for_status()

task = response.json()
data = task.get("data") or {}
task_id = (
    task.get("id")
    or task.get("task_id")
    or data.get("id")
    or data.get("task_id")
)
if not task_id:
    raise RuntimeError(f"Create response has no task ID: {task}")

while True:
    response = requests.get(
        f"{base_url}/v1/videos/{task_id}",
        headers=headers,
        timeout=60,
    )
    response.raise_for_status()
    task = response.json()
    data = task.get("data") or {}
    status = str(task.get("status") or data.get("status") or "").lower()
    progress = task.get("progress") or data.get("progress") or "unknown"
    print(f"Status: {status or 'unknown'}; progress: {progress}")

    if status in {"failed", "failure", "cancelled", "canceled"}:
        raise RuntimeError(f"Video generation failed: {task}")
    if status in {"completed", "succeeded", "success"} or progress == "100%":
        break
    time.sleep(10)

response = requests.get(
    f"{base_url}/v1/videos/{task_id}/content",
    headers=headers,
    timeout=300,
)
response.raise_for_status()
video = response.content

if len(video) < 12 or video[4:8] != b"ftyp":
    raise RuntimeError("Content response is not a non-empty MP4 file")

output_dir = Path("output")
output_dir.mkdir(parents=True, exist_ok=True)
output_path = output_dir / f"{task_id}.mp4"
output_path.write_bytes(video)
print(f"Saved: {output_path} ({len(video)} bytes)")

如何使用圖像轉影片與關鍵影格

CometAPI 的 FLUX 3 頁面列示支援圖像轉影片。其目前公開範例展示的是文字轉影片,因此在假設可沿用其他模型的參考影像欄位之前,請先確認即時的網關文件。

BFL 的原生 API 明確指出:圖像轉影片透過 mode i2v 與 keyframes 欄位 實現。單一影像可固定起始影格,兩張影像可固定開始與結束,多達十張按時間排列的影像可為連續片段建立分鏡。

BFL 原生關鍵影格範例

curl -X POST https://api.bfl.ai/v1/flux-3-video \
  -H "x-key: $BFL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "mode": "i2v",
    "prompt": "They sprint through the lantern-lit alley as the camera tracks behind them.",
    "keyframes": [
      [0, "data:image/png;base64,<first-frame>"],
      [8, "data:image/png;base64,<last-frame>"]
    ],
    "duration": 8
  }'

請分離供應商原生與網關參數的轉接層。BFL 使用 mode、keyframes、start_video、resolution 與 draft 等欄位;CometAPI 的已驗證範例則使用 model、prompt、seconds 與 size。

FLUX 3 API 參數說明

參數API控制內容實務建議
modelCometAPI模型選擇使用 flux-3
prompt兩者皆有場景、動作、鏡頭、音訊描述隨時間變化的可見內容
secondsCometAPI 範例請求的片段長度調校期間可先以 5–8 秒起步
sizeCometAPI 範例輸出尺寸以 1280x720 作為經濟測試的起點
modeBFL 原生t2v / i2v / v2v / draft_enhance若網關未映射,勿送此欄位
durationBFL 原生T2V/I2V 為 5–20 秒;V2V 為 5–15 秒原生 API 支援 auto
resolutionBFL 原生hd 或 fhd;目前未列出 4K/UHDFHD 透過影片升頻器完成
generate_audioBFL 原生同步音訊開關預設為 true
draftBFL 原生快速預覽模式以較低成本進行創意迭代

如何撰寫更好的 FLUX 3 提示

BFL 的影片提示指南建議明確指示主體與動作、鏡頭、場景與氛圍、運動品質與連續性。對於以音訊為主的場景,請指定對白、聲線、音效與環境音。

實用提示結構

Subject + Environment + Action + Camera + Lighting
+ Dialogue/Voice + Sound Effects + Ambience + Constraints

電影風格提示

A lone cyclist rides through a rain-soaked neon street at midnight.
The camera begins low beside the rear wheel, then rises into a smooth tracking shot.
Reflections stretch across wet asphalt under moving cyan and magenta light.
Audio: steady rainfall, chain noise, distant traffic, no music, no dialogue.
Keep the same rider, bicycle, jacket, and weather throughout the shot.

產品影片提示

A premium stainless-steel espresso machine stands on a dark stone counter.
Begin with a macro close-up of water droplets on the metal housing.
Orbit clockwise as the machine brews; steam catches warm side light.
Finish on a clean three-quarter hero angle with the cup in the foreground.
Audio: pump vibration, steam hiss, ceramic contact, quiet cafe ambience.
Do not change the product shape, logo placement, material, or color.

對白與原生音訊提示

A young chef works alone in a compact Tokyo ramen shop at night.
Start close on boiling broth, then pull back as the chef sets down a bowl.
Warm tungsten lighting, natural reflections, documentary handheld motion.
The chef quietly says in Japanese: 「お待たせしました。」
Audio: bubbling broth, soft rain outside, distant street traffic.
No subtitles and no background music.

像「make a cinematic ramen shop video」這樣的提示,對運動、取景、聲音與連續性沒有明確描述。具體的指令能產生更可測試的生產簡報。

FLUX 3 API 定價

BFL 的定價依工作流程而定:完整的文字轉影片與圖像轉影片在 HD 為 $0.17/s,FHD 為 $0.29/s,HD 草稿模式為 $0.06/s。影片延續在 HD 為 $0.43/s,FHD 為 $0.54/s,HD 草稿為 $0.12/s。CometAPI 目前列示 flux-3 在 720p 為 $0.136/s、1080p 為 $0.232/s。大批量之前請核對即時價格。

供應商 / 工作流程HD / 720p 完整FHD / 1080p 完整草稿5 s 完整渲染10 s 完整渲染
BFL T2V$0.17/s$0.29/s$0.06/s (HD)$0.85 / $1.45$1.70 / $2.90
BFL I2V$0.17/s$0.29/s$0.06/s (HD)$0.85 / $1.45$1.70 / $2.90
BFL V2V continuation$0.43/s$0.54/s$0.12/s (HD)$2.15 / $2.70$4.30 / $5.40
CometAPI flux-3$0.136/s$0.232/s未列出$0.68 / $1.16$1.36 / $2.32

閱讀最後兩欄:數值以 HD/720p 在前、FHD/1080p 在後。

如何降低迭代成本

  • 先以 720p 原型,再將選定提示移至 1080p。
  • 使用 5 秒片段驗證構圖、運動與提示解讀。
  • 每次只更動一個主要提示變數。
  • 使用 BFL 原生 API 時,先以草稿模式測試,再進行全品質渲染。
  • 將成功的提示與參考決策儲存在應用程式中繼資料。

FLUX 3 vs Wan 3.0 vs Seedance 2.5

請依工作流程比較 FLUX 3、Wan 3.0 與 Seedance 2.5,而非尋找單一的「通用贏家」。權威規格連結見下表表頭。

維度FLUX 3
官方規格
Wan 3.0
官方規格
Seedance 2.5
官方規格
最長片段最長 20 秒(T2V/I2V)最長 30 秒最長 30 秒
同步音訊是是是
文字轉影片是是是
圖像轉影片是是是
參考策略最多 10 個原生關鍵影格廣泛多模態與 Omni-Reference 工作流大量多模態參考容量
延續/編輯原生 BFL v2v 延續長片段與編輯工作流程延展與編輯工作流程
獨特強項運動邏輯、多鏡頭場景、同步視聽輸出輸入廣度與 30 秒生成較長、以參考控制為主的敘事
CometAPI 起始價格$0.136/s$0.04/s$0.0824/s
最適用具真實運動、同步聲音、多鏡頭邏輯、原生關鍵影格或延續以多種輸入起手且重視 30 秒時長較長、強身份/產品/風格控制的敘事

定價說明:起始價格不代表可直接對比的品質或解析度。請使用各模型即時頁面的解析度細目表進行預算編列。

你該選哪個 Video API?

  • 若需真實的運動、同步音訊、多鏡頭邏輯、原生關鍵影格或延續,選擇 FLUX 3。
  • 當工作流程以多種輸入開始且 30 秒生成窗口重要時,選擇 Wan 3.0。
  • 對於較長、參考密集且重視身份、產品與風格控制的敘事,選擇 Seedance 2.5。

FLUX 3 API 生產最佳實務

將非同步作業持久化

提交後立即保存任務 ID。伺服器重啟或工作重試不應因應用程式遺失原始任務而迫使使用者再次付費。

避免過於頻繁的輪詢

除非即時文件另有建議,先以約 10 秒的間隔開始。每秒輪詢會增加請求壓力,而無法實質改善體驗。

驗證下載內容

在標記資產完成前,請檢查內容長度與 MP4 簽名。成功的 HTTP 回應不等於回傳內容一定是有效影片。

分離原生與網關綱要

為 BFL 原生與 CometAPI 請求維護各自的轉接器。避免 mode、keyframes、start_video 等原生欄位外洩至期望 model、prompt、seconds、size 的網關呼叫中。

儲存完整失敗脈絡

記錄 HTTP 狀態、回應本文、任務 ID、模型 ID、提示版本、尺寸、時長與內部作業 ID。請遮蔽 API 金鑰。

上線前使用小型評測集

建立 10–30 個具代表性的提示,涵蓋鏡頭運動、人物、產品、文字圖形、對白、高運動場景與所需長寬比。當模型或整合版本變更時,跑同一組評測,並重複重要提示,因為影片生成具有隨機性。

常見問題

CometAPI 上的 FLUX 3 模型 ID 是什麼?

目前的模型 ID 為 flux-3。

FLUX 3 使用哪個 CometAPI 端點?

已驗證的 Video API 工作流程使用 POST /v1/videos,接著 GET /v1/videos/{task_id} 與 GET /v1/videos/{task_id}/content。

FLUX 3 是同步的嗎?

不是。請將其視為非同步作業:提交、保存任務 ID、輪詢並下載。

FLUX 3 能生成多長?

BFL 文件記載:T2V/I2V 為 5–20 秒;延續為 5–15 秒。

FLUX 3 會生成音訊嗎?

會。BFL 文件記載其原生 API 中同步音訊預設啟用。

FLUX 3 支援圖像轉影片嗎?

支援。CometAPI 列示支援圖像轉影片,而 BFL 原生 API 透過 i2v 模式與 keyframes 實作。

我可以直接透過 CometAPI 使用 BFL 的 keyframes 嗎?

不要這樣假設。請求綱要不同;在上線前請先確認 CometAPI 的即時快速入門。

在 CometAPI 上,一段 5 秒的 FLUX 3 影片要多少費用?

依目前 CometAPI 列示,5 秒在 720p 為 $0.68、在 1080p 為 $1.16。請參見上方的整合定價表以取得即時參考連結。

FLUX 3 比 Wan 3.0 或 Seedance 2.5 更好嗎?

視工作流程而定。FLUX 3 在運動一致的視聽鏡頭,以及 BFL 原生的關鍵影格或延續控制上具優勢;Wan 3.0 強調輸入廣度;Seedance 2.5 強調較長、參考密集的敘事。

結論

FLUX 3 目前在 CometAPI 上提供可運作的非同步 Video API 路徑,而 BFL 的原生文件則提供關鍵影格、延續、音訊與草稿模式等更深層控制。

安全的整合路徑相當直觀:先以短時長 720p 的文字轉影片請求開始,保存任務 ID、保守地輪詢、下載並驗證 MP4,接著加入提示範本、儲存、重試邏輯與可重複的評測集。分離原生與網關綱要,並在硬編碼欄位或價格前核對即時模型頁面。

繼續學習

把這篇文章連到下一個決策。

查看所有主題
發布於 Oct 4, 2026
最後更新 Oct 4, 2026
0 次瀏覽
已審核內容清晰度、來源標註與最新 API 術語。

閱讀更多