คำตอบฉบับย่อ
FLUX 3 คือโมเดลวิดีโอมัลติโหมดของ Black Forest Labs สำหรับการสร้างวิดีโอจากข้อความ (text-to-video) และจากภาพ (image-to-video) พร้อมเสียงที่ซิงก์กัน บน CometAPI ใช้รหัสโมเดลสำหรับงานโปรดักชันคือ flux-3 เวิร์กโฟลว์แบบอะซิงโครนัสที่ยืนยันแล้ว ใช้ POST /v1/videos เพื่อสร้างงาน, GET /v1/videos/{task_id} เพื่อตรวจสอบสถานะ และ GET /v1/videos/{task_id}/content เพื่อดาวน์โหลดไฟล์ MP4 ที่เสร็จสมบูรณ์
อัปเดตความพร้อมใช้งาน (ตรวจยืนยันเมื่อ 24 กันยายน 2026): Black Forest Labs ได้ย้าย FLUX 3 Video พ้นเฟส Early Access เดือนกรกฎาคม และเปิดตัวเวอร์ชันเริ่มต้นสำหรับ text-to-video และ image-to-video ให้ใช้งานทั่วไปผ่าน BFL API และพาร์ทเนอร์ที่เลือกตั้งแต่ 4 สิงหาคม 2026 CometAPI เพิ่มรหัสโมเดลโปรดักชัน flux-3 ในรูปแบบ Video API เมื่อวันที่ 13 สิงหาคม 2026 โปรดใช้ ประกาศเปิดตัวของ BFL และหน้ารายการโมเดลสดของ CometAPI เป็นแหล่งอ้างอิงหลักสำหรับสถานะความพร้อมใช้งาน ฟิลด์ และราคา
มีอะไรเปลี่ยนไปตั้งแต่ช่วง Early Access ของ FLUX 3?
การเปลี่ยนแปลงสำคัญคือความพร้อมใช้งานเชิงปฏิบัติการ ช่วงต้นโฟกัสอยู่ที่การเปิดรับสมัครใช้งานในเดือนกรกฎาคม แต่การเปิดตัวของ BFL ในเดือนสิงหาคมได้เพิ่มเอ็นด์พอยต์วิดีโอที่เรียกใช้งานได้จริง ข้อจำกัดที่เผยแพร่ และการตั้งราคาโปรดักชัน จากนั้น CometAPI จึงเปิด flux-3 ผ่านเวิร์กโฟลว์ Video API แบบรวมของตน
บทความก่อนหน้าของ CometAPI, FLUX 3 API: Availability, Early Access, Video & Dev, ยังคงเป็นประโยชน์สำหรับประวัติการเปิดตัวและการประเมินเบื้องต้นในเดือนกรกฎาคม การเปรียบเทียบที่กว้างขึ้น Best AI Video APIs in 2026 ครอบคลุมการคัดเลือกในระดับตลาด เอกสารฉบับนี้จะย่อประเด็นเหล่านั้นและเน้นคำขอที่ใช้งานได้ การโพลลิง โปรम्पต์ การควบคุมต้นทุน และการใช้งานระดับโปรดักชัน
FLUX 3 คืออะไร?
FLUX 3 คือครอบครัวโมเดลมัลติโหมดของ BFL สำหรับวิดีโอ เสียง ภาพ และการคาดการณ์ที่เกี่ยวข้องกับการกระทำ เวอร์ชันวิดีโอปัจจุบันรองรับ text-to-video, image-to-video และ video continuation ผ่านเอ็นด์พอยต์เนทีฟของผู้ให้บริการเพียงจุดเดียว
สำหรับนักพัฒนาวิดีโอ ความสามารถเด่นได้แก่ ความยาวสูงสุด 20 วินาทีที่ 24 fps เอาต์พุตแบบ HD หรือ Full HD เสียงที่ซิงก์ พูดได้หลายภาษาแบบลิปซิงก์ หลายช็อตในการสร้างครั้งเดียว และคีย์เฟรมอ้างอิงภาพได้สูงสุดสิบเฟรมเพื่อคุมภาพในการทำ image-to-video
สเปกของ FLUX 3 API
| สเปก | สเปกทางการของ BFL | การอินทิเกรตกับ CometAPI |
|---|---|---|
| เวิร์กโฟลว์หลัก | Text-to-video, image-to-video, video continuation | ระบุ Text-to-video และ image-to-video |
| ระยะเวลาสูงสุด | 5–20 วินาทีสำหรับ T2V/I2V; 5–15 วินาทีสำหรับ V2V | ใช้ค่าจาก quickstart เวอร์ชันสดสำหรับคำขอเกตเวย์ |
| อัตราเฟรม | 24 fps | เป็นไปตามเอาต์พุตของผู้ให้บริการ |
| ความละเอียด | rHD โดยกำเนิด; FHD ผ่านตัว upsampler วิดีโอ เอกสาร FLUX 3 Video ปัจจุบันของ BFL ไม่ได้ระบุเอาต์พุต 4K/UHD สเปก “สูงสุด 4MP” ใช้กับโมเดลภาพ FLUX.2 ไม่ใช่ FLUX 3 Video | ระบุราคาสำหรับ 720p และ 1080p |
| เสียงเนทีฟ | มี; เปิดใช้งานตามค่าเริ่มต้น | คุณสมบัติเอาต์พุตขึ้นกับการอินทิเกรตที่ใช้งาน |
| การควบคุมด้วยภาพ | 1–10 คีย์เฟรมใน I2V แบบเนทีฟ | ตรวจสอบการแม็ประหว่างเกตเวย์กับ reference-image ปัจจุบัน |
| อัตราส่วนภาพ | 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, 9:16 | quickstart ใช้มิติเจาะจง เช่น 1280x720 |
| การเรียกใช้งาน | อะซิงโครนัส | สร้าง → โพลลิง → ดาวน์โหลด |
| รหัสโมเดล CometAPI | — | flux-3 |
FLUX 3 Video ดีแค่ไหน?
BFL รายงานคะแนน Elo สำหรับ text-to-video ที่ 1135 ในการประเมินความชอบของมนุษย์แบบทุกคู่เทียบทุกคู่ ในการเปรียบเทียบที่เผยแพร่เดียวกัน FLUX 3 ทำคะแนนเสมอ Seedance 2.0 ในภาพสู่วิดีโอ และอยู่เหนือโมเดลอื่นที่ทดสอบ
ผลลัพธ์เหล่านี้เป็นหลักฐานเพื่อการจัดวางตำแหน่งที่มีประโยชน์ แต่เป็น การประเมินโดยผู้ขาย ไม่ใช่เกณฑ์มาตรฐานโปรดักชันจากบุคคลที่สาม และไม่ได้วัด latency ผ่านเกตเวย์ ความเสถียรของคิว ความคงที่ของต้นทุน หรือความเสถียรของผลลัพธ์ซ้ำ ดังนั้นทีมโปรดักชันควรประเมินชุดโปรम्पต์ของตนเอง
ผลการทดสอบตามเกณฑ์ของ FLUX 3
| ตัวชี้วัด | ผลลัพธ์ที่เผยแพร่ | การตีความ |
|---|---|---|
| คะแนน Elo แบบทุกคู่สำหรับ T2V | 1135 | BFL รายงานว่า FLUX 3 นำในการเปรียบเทียบภายในของตน |
| ความชอบสำหรับ I2V | เสมอกับ Seedance 2.0 | ผลจากผู้ขายเชิงทิศทาง ไม่ใช่กระดานจัดอันดับของบุคคลที่สาม |
| ประเภทการประเมิน | ความชอบของมนุษย์ | วัดคุณภาพเอาต์พุตตามการรับรู้ ไม่ใช่โครงสร้างพื้นฐาน API |

ที่มา: Black Forest Labs — FLUX 3 Video, Part 1: Generation.
สิ่งที่ต้องมีเพื่อใช้งาน FLUX 3 API
- บัญชี CometAPI และ API key ที่เก็บในตัวแปรสภาพแวดล้อมบนแบ็กเอนด์
- โปรम्पต์ที่กำหนดหัวเรื่อง การเคลื่อนไหว ทิศทางกล้อง บรรยากาศ และเสียงหรือบทพูดที่ต้องการ
- เส้นทางจัดการงานที่ทนทาน เพราะการสร้างวิดีโอเป็นแบบอะซิงโครนัส
- เครดิตเพียงพอสำหรับการทดสอบแบบวนซ้ำ; มีการคิดค่าบริการตามความยาวและความละเอียดที่สร้าง
สร้างคีย์ในแดชบอร์ด API ของ CometAPI อย่าใส่คีย์ไว้ใน JavaScript ฝั่งหน้าเว็บ ชุดแอปบนมือถือ ที่เก็บสาธารณะ หรือภาพหน้าจอ
รหัสโมเดลและเอ็นด์พอยต์ของ FLUX 3
| การดำเนินการ | เมธอดและเอ็นด์พอยต์ | วัตถุประสงค์ |
|---|---|---|
| สร้างวิดีโอ | POST https://api.cometapi.com/v1/videos | ส่งงานสร้างวิดีโอ |
| ตรวจสอบงาน | GET https://api.cometapi.com/v1/videos/{task\_id} | อ่านสถานะและความคืบหน้า |
| ดาวน์โหลดผลลัพธ์ | GET https://api.cometapi.com/v1/videos/{task\_id}/content | ดาวน์โหลดไฟล์ MP4 ที่เสร็จสมบูรณ์ |
วิธีใช้ FLUX 3 API กับ CometAPI
ขั้นตอนที่ 1: ตั้งค่า API Key ของคุณ
บน macOS หรือ Linux:
export COMETAPI_KEY="your_api_key"
บน Windows PowerShell:
$env:COMETAPI_KEY="your_api_key"
ขั้นตอนที่ 2: สร้างวิดีโอ FLUX 3
FLUX 3 quickstart ปัจจุบันใช้คำขอแบบ multipart ที่มี model, prompt, seconds และ size ตัวอย่างนี้ร้องขอคลิป 5 วินาทีที่ 720p:
curl https://api.cometapi.com/v1/videos \
-H "Authorization: Bearer $COMETAPI_KEY" \
-F "model=flux-3" \
-F "prompt=A paper boat glides across a still pond in soft morning light" \
-F "seconds=5" \
-F "size=1280x720"
คำขอนี้เริ่มงาน อย่าออกแบบแอปพลิเคชันให้คาดหวังว่าจะได้รับ MP4 ที่เสร็จสมบูรณ์ใน HTTP response เดียวกัน
ขั้นตอนที่ 3: บันทึก Task ID
บันทึกตัวระบุทันทีหลังจากคำขอสร้างสำเร็จ:
{
"id": "video_task_id",
"status": "queued"
}
จัดเก็บ task ID ร่วมกับผู้ใช้หรือเรคอร์ดงานก่อนเริ่มโพลลิง การรีสตาร์ทกระบวนการไม่ควรทำให้การสร้างที่ถูกคิดค่าบริการไปแล้วสูญหาย
ขั้นตอนที่ 4: โพลลิงสถานะวิดีโอ
curl https://api.cometapi.com/v1/videos/{task_id} \
-H "Authorization: Bearer $COMETAPI_KEY"
เริ่มด้วยช่วงเวลาโพลลิงระดับกลาง เช่น ทุกสิบวินาที จัดการสถานะ completed, succeeded หรือ success เป็นสถานะสำเร็จสุดท้าย; จัดการ failed, failure, cancelled หรือ canceled เป็นสถานะล้มเหลวสุดท้าย
ขั้นตอนที่ 5: ดาวน์โหลด MP4
curl https://api.cometapi.com/v1/videos/{task_id}/content \
-H "Authorization: Bearer $COMETAPI_KEY" \
--output flux3_output.mp4
หลังเสร็จสิ้น ให้คัดลอกไฟล์ไปยัง object storage หรือไปป์ไลน์สื่อของคุณเอง แทนที่จะเก็บ URL ชั่วคราวของผู้ให้บริการเป็นแอสเซ็ตถาวร
เวิร์กโฟลว์ Python แบบสมบูรณ์สำหรับการสร้างวิดีโอ FLUX 3
ตัวอย่างต่อไปนี้สร้างงาน บันทึก ID โพลลิงจนเสร็จสิ้น ตรวจสอบสถานะล้มเหลว ตรวจสอบลายเซ็น MP4 และเขียนเอาต์พุตลงดิสก์
import os
import time
from pathlib import Path
import requests
api_key = os.environ["COMETAPI_KEY"]
base_url = "https://api.cometapi.com"
headers = {"Authorization": f"Bearer {api_key}"}
response = requests.post(
f"{base_url}/v1/videos",
headers=headers,
files={
"model": (None, "flux-3"),
"prompt": (
None,
"A product bottle rotates slowly on wet black stone, "
"soft rim lighting, macro lens, realistic reflections.",
),
"seconds": (None, "5"),
"size": (None, "1280x720"),
},
timeout=120,
)
response.raise_for_status()
task = response.json()
data = task.get("data") or {}
task_id = (
task.get("id")
or task.get("task_id")
or data.get("id")
or data.get("task_id")
)
if not task_id:
raise RuntimeError(f"Create response has no task ID: {task}")
while True:
response = requests.get(
f"{base_url}/v1/videos/{task_id}",
headers=headers,
timeout=60,
)
response.raise_for_status()
task = response.json()
data = task.get("data") or {}
status = str(task.get("status") or data.get("status") or "").lower()
progress = task.get("progress") or data.get("progress") or "unknown"
print(f"Status: {status or 'unknown'}; progress: {progress}")
if status in {"failed", "failure", "cancelled", "canceled"}:
raise RuntimeError(f"Video generation failed: {task}")
if status in {"completed", "succeeded", "success"} or progress == "100%":
break
time.sleep(10)
response = requests.get(
f"{base_url}/v1/videos/{task_id}/content",
headers=headers,
timeout=300,
)
response.raise_for_status()
video = response.content
if len(video) < 12 or video[4:8] != b"ftyp":
raise RuntimeError("Content response is not a non-empty MP4 file")
output_dir = Path("output")
output_dir.mkdir(parents=True, exist_ok=True)
output_path = output_dir / f"{task_id}.mp4"
output_path.write_bytes(video)
print(f"Saved: {output_path} ({len(video)} bytes)")
วิธีใช้ Image-to-Video และ Keyframes
หน้าของ FLUX 3 บน CometAPI ระบุว่ารองรับ image-to-video ตัวอย่างสาธารณะปัจจุบันสาธิต text-to-video ดังนั้นจึงควรตรวจสอบเอกสารอ้างอิงของเกตเวย์สดก่อนที่จะถือว่าฟิลด์ reference-image ที่คัดลอกจากโมเดลอื่นจะใช้ได้โดยไม่ต้องแก้ไข
API แบบเนทีฟของ BFL ระบุชัดเจน: image-to-video ใช้ โหมด i2v และฟิลด์ keyframes ภาพเดียวตรึงเฟรมเริ่มต้น สองภาพตรึงต้นและท้าย และได้สูงสุดสิบภาพแบบกำหนดเวลาเพื่อสตอรี่บอร์ดคลิปต่อเนื่อง
ตัวอย่างคีย์เฟรมแบบเนทีฟของ BFL
curl -X POST https://api.bfl.ai/v1/flux-3-video \
-H "x-key: $BFL_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"mode": "i2v",
"prompt": "They sprint through the lantern-lit alley as the camera tracks behind them.",
"keyframes": [
[0, "data:image/png;base64,<first-frame>"],
[8, "data:image/png;base64,<last-frame>"]
],
"duration": 8
}'
แยกพารามิเตอร์ของผู้ให้บริการเนทีฟและของเกตเวย์ออกเป็นอะแดปเตอร์คนละชุด BFL ใช้ฟิลด์อย่าง mode, keyframes, start_video, resolution และ draft; ตัวอย่างที่ยืนยันของ CometAPI ใช้ model, prompt, seconds และ size
คำอธิบายพารามิเตอร์ของ FLUX 3 API
| พารามิเตอร์ | API | ควบคุมอะไร | แนวปฏิบัติจริง |
|---|---|---|---|
| model | CometAPI | การเลือกโมเดล | ใช้ flux-3 |
| prompt | ทั้งคู่ | ซีน แอ็กชัน กล้อง เสียง | อธิบายการเปลี่ยนแปลงที่มองเห็นได้ตามเวลา |
| seconds | ตัวอย่าง CometAPI | ความยาวคลิปที่ร้องขอ | เริ่มที่ 5–8 วินาทีระหว่างปรับแต่ง |
| size | ตัวอย่าง CometAPI | มิติเอาต์พุต | เริ่มที่ 1280x720 เพื่อลดต้นทุน |
| mode | BFL เนทีฟ | t2v / i2v / v2v / draft_enhance | อย่าส่ง เว้นแต่เกตเวย์จะรองรับการแม็ป |
| duration | BFL เนทีฟ | 5–20 วินาทีสำหรับ T2V/I2V; 5–15 วินาทีสำหรับ V2V | รองรับ auto ใน API เนทีฟ |
| resolution | BFL เนทีฟ | hd หรือ fhd; ปัจจุบันยังไม่ระบุ 4K/UHD สำหรับ FLUX 3 Video | FHD เสร็จผ่านตัว upsampler วิดีโอ |
| generate_audio | BFL เนทีฟ | เปิด/ปิดเสียงที่ซิงก์ | ค่าเริ่มต้นคือ true |
| draft | BFL เนทีฟ | โหมดพรีวิวความเร็วสูง | ใช้เพื่อลดต้นทุนระหว่างการสร้างสรรค์ |
วิธีเขียนโปรम्पต์ FLUX 3 ให้ดียิ่งขึ้น
คู่มือการเขียนโปรम्पต์วิดีโอของ BFL video prompting guide แนะนำให้ระบุหัวเรื่องและการกระทำ กล้อง ฉากและบรรยากาศ คุณภาพการเคลื่อนไหว และความต่อเนื่องอย่างชัดเจน สำหรับซีนที่นำด้วยเสียง ให้ระบุบทพูด เสียงผู้พูด เอฟเฟกต์เสียง และบรรยากาศเสียง
โครงสร้างโปรम्पต์เชิงปฏิบัติ
Subject + Environment + Action + Camera + Lighting
+ Dialogue/Voice + Sound Effects + Ambience + Constraints
Cinematic Prompt
A lone cyclist rides through a rain-soaked neon street at midnight.
The camera begins low beside the rear wheel, then rises into a smooth tracking shot.
Reflections stretch across wet asphalt under moving cyan and magenta light.
Audio: steady rainfall, chain noise, distant traffic, no music, no dialogue.
Keep the same rider, bicycle, jacket, and weather throughout the shot.
Product Video Prompt
A premium stainless-steel espresso machine stands on a dark stone counter.
Begin with a macro close-up of water droplets on the metal housing.
Orbit clockwise as the machine brews; steam catches warm side light.
Finish on a clean three-quarter hero angle with the cup in the foreground.
Audio: pump vibration, steam hiss, ceramic contact, quiet cafe ambience.
Do not change the product shape, logo placement, material, or color.
Dialogue and Native-Audio Prompt
A young chef works alone in a compact Tokyo ramen shop at night.
Start close on boiling broth, then pull back as the chef sets down a bowl.
Warm tungsten lighting, natural reflections, documentary handheld motion.
The chef quietly says in Japanese: 「お待たせしました。」
Audio: bubbling broth, soft rain outside, distant street traffic.
No subtitles and no background music.
โปรम्पต์อย่างเช่น “make a cinematic ramen shop video” ทิ้งให้การเคลื่อนไหว การจัดเฟรม เสียง และความต่อเนื่องไม่ถูกระบุ โปรดสั่งงานอย่างชัดเจนเพื่อให้ได้บรีฟที่ทดสอบได้ในระดับโปรดักชัน
การตั้งราคา FLUX 3 API
การตั้งราคาของ BFL แยกตามเวิร์กโฟลว์: การเรนเดอร์เต็มสำหรับ text-to-video และ image-to-video อยู่ที่ $0.17/วินาที ใน HD หรือ $0.29/วินาที ใน FHD โดยโหมด Draft แบบ HD อยู่ที่ $0.06/วินาที Video continuation อยู่ที่ $0.43/วินาที ใน HD หรือ $0.54/วินาที ใน FHD โดย Draft แบบ HD อยู่ที่ $0.12/วินาที ขณะที่ CometAPI ระบุ flux-3 ไว้ที่ $0.136/วินาที สำหรับ 720p และ $0.232/วินาที สำหรับ 1080p โปรดตรวจสอบราคาสดก่อนรันงานชุดใหญ่
| ผู้ให้บริการ / เวิร์กโฟลว์ | เรนเดอร์เต็ม HD / 720p | เรนเดอร์เต็ม FHD / 1080p | Draft | เรนเดอร์เต็ม 5 วินาที | เรนเดอร์เต็ม 10 วินาที |
|---|---|---|---|---|---|
| BFL T2V | $0.17/s | $0.29/s | $0.06/s (HD) | $0.85 / $1.45 | $1.70 / $2.90 |
| BFL I2V | $0.17/s | $0.29/s | $0.06/s (HD) | $0.85 / $1.45 | $1.70 / $2.90 |
| BFL V2V continuation | $0.43/s | $0.54/s | $0.12/s (HD) | $2.15 / $2.70 | $4.30 / $5.40 |
| CometAPI flux-3 | $0.136/s | $0.232/s | Not listed | $0.68 / $1.16 | $1.36 / $2.32 |
การอ่านสองคอลัมน์สุดท้าย: แสดงค่าแบบ HD/720p ก่อน และ FHD/1080p เป็นลำดับที่สอง
วิธีลดต้นทุนการลองซ้ำ
- สร้างต้นแบบที่ 720p ก่อนย้ายโปรम्पต์ที่คัดเลือกไปเป็น 1080p
- ใช้คลิป 5 วินาทีเพื่อตรวจสอบองค์ประกอบ การเคลื่อนไหว และการตีความโปรम्पต์
- เปลี่ยนตัวแปรหลักของโปรम्पต์ทีละตัว
- เมื่อใช้ API เนทีฟของ BFL ให้ทดสอบโหมด Draft ก่อนเรนเดอร์เต็มคุณภาพ
- เก็บโปรम्पต์และการตัดสินใจอ้างอิงที่ประสบความสำเร็จไว้ในเมทาดาทาของแอปพลิเคชัน
FLUX 3 เทียบกับ Wan 3.0 และ Seedance 2.5
เปรียบเทียบ FLUX 3, Wan 3.0 และ Seedance 2.5 ตามเวิร์กโฟลว์ แทนที่จะมองหาผู้ชนะหนึ่งเดียว ลิงก์สเปกที่เป็นทางการยังคงเป็นแหล่งอ้างอิงที่เชื่อถือได้ในส่วนหัวของตารางด้านล่าง
| มิติ | FLUX 3 สเปกทางการ | Wan 3.0 สเปกทางการ | Seedance 2.5 สเปกทางการ |
|---|---|---|---|
| ความยาวคลิปสูงสุด | สูงสุด 20 วินาทีสำหรับ T2V/I2V | สูงสุด 30 วินาที | สูงสุด 30 วินาที |
| เสียงที่ซิงก์ | มี | มี | มี |
| Text-to-video | มี | มี | มี |
| Image-to-video | มี | มี | มี |
| กลยุทธ์อ้างอิง | คีย์เฟรมเนทีฟได้สูงสุด 10 เฟรม | เวิร์กโฟลว์มัลติโหมดกว้างและ Omni-Reference | ความจุอ้างอิงมัลติโหมดขนาดใหญ่ |
| การต่อ/แก้ไข | continuation แบบ v2v ของ BFL โดยเนทีฟ | เวิร์กโฟลว์แบบยาวและแก้ไขได้ | เวิร์กโฟลว์ขยายและแก้ไข |
| จุดเด่นเฉพาะ | ตรรกะการเคลื่อนไหว ซีนหลายช็อต เอาต์พุตภาพและเสียงที่ซิงก์ | ความกว้างของอินพุตและการสร้าง 30 วินาที | การเล่าเรื่องยาวและควบคุมอ้างอิงได้แน่น |
| ราคาเริ่มต้น CometAPI | $0.136/s | $0.04/s | $0.0824/s |
| เหมาะที่สุดสำหรับ | ช็อตภาพและเสียงสมจริง การเคลื่อนไหวดี ซีนหลายช็อต คีย์เฟรมเนทีฟ หรือ continuation | ไปป์ไลน์โปรดักชันมัลติโหมดแบบ all-in-one | การเล่าเรื่องยาวที่อ้างอิงหนัก คุมเอกลักษณ์/สินค้า/สไตล์ |
หมายเหตุเรื่องราคา: ราคาเริ่มต้นไม่ใช่การเปรียบเทียบแบบแอปเปิลต่อแอปเปิลด้านคุณภาพหรือความละเอียด ให้ใช้ตารางราคาตามความละเอียดบนหน้ารุ่นสดของแต่ละโมเดลเพื่อวางแผนงบประมาณ
ควรเลือก Video API ตัวไหน?
- เลือก FLUX 3 สำหรับช็อตภาพและเสียงที่เคลื่อนไหวสมจริง เสียงซิงก์ ตรรกะหลายช็อต คีย์เฟรมเนทีฟ หรือ continuation
- เลือก Wan 3.0 เมื่อต้องเริ่มเวิร์กโฟลว์ด้วยอินพุตหลากหลายและต้องการหน้าต่างการสร้าง 30 วินาที
- เลือก Seedance 2.5 สำหรับการเล่าเรื่องยาวที่อ้างอิงหนัก คุมตัวตนสินค้าและสไตล์ได้แข็งแรง
แนวปฏิบัติที่ดีในการใช้ FLUX 3 API ระดับโปรดักชัน
เก็บสถานะงานอะซิงโครนัสอย่างทนทาน
บันทึก task ID ทันทีหลังส่งงาน การรีสตาร์ทเซิร์ฟเวอร์หรือการรีทรายของเวิร์กเกอร์ไม่ควรทำให้ผู้ใช้ต้องจ่ายซ้ำเพราะแอปลืมงานเดิม
หลีกเลี่ยงการโพลลิงถี่เกินไป
เริ่มราวสิบวินาทีต่อครั้ง เว้นแต่เอกสารสดจะแนะนำเป็นอย่างอื่น โพลลิงทุกวินาทีเพิ่มโหลดคำขอโดยไม่ทำให้ประสบการณ์ดีขึ้นอย่างมีนัยสำคัญ
ตรวจสอบไฟล์ที่ดาวน์โหลด
ตรวจความยาวเนื้อหาและลายเซ็น MP4 ก่อนทำเครื่องหมายว่าแอสเซ็ตเสร็จสมบูรณ์ HTTP response ที่สำเร็จไม่เสมอไปว่าจะเป็นไฟล์วิดีโอที่ถูกต้อง
แยกสคีมาของเนทีฟและเกตเวย์
คงอะแดปเตอร์แยกกันสำหรับคำขอ BFL เนทีฟและ CometAPI ป้องกันฟิลด์เนทีฟอย่าง mode, keyframes และ start_video รั่วไปยังคำขอของเกตเวย์ที่คาดหวัง model, prompt, seconds และ size
จัดเก็บบริบทความล้มเหลวอย่างครบถ้วน
บันทึก HTTP status, เนื้อหา response, task ID, model ID, เวอร์ชันโปรम्पต์, ขนาด, ระยะเวลา และ internal job ID ปิดบัง API key
ใช้ชุดประเมินขนาดเล็กก่อนปล่อยจริง
สร้างโปรम्पต์ตัวแทน 10–30 รายการที่ครอบคลุมการเคลื่อนไหวของกล้อง บุคคล สินค้า ไทพ์กราฟี บทพูด ซีนที่เคลื่อนไหวสูง และอัตราส่วนภาพที่ต้องการ รันชุดเดิมเมื่อรุ่นโมเดลหรือเวอร์ชันการอินทิเกรตเปลี่ยน และทำซ้ำโปรम्पต์สำคัญเพราะการสร้างวิดีโอมีความสุ่ม
คำถามที่พบบ่อย
รหัสโมเดล FLUX 3 บน CometAPI คืออะไร?
FLUX 3 ใช้เอ็นด์พอยต์ใดบน CometAPI?
เวิร์กโฟลว์ Video API ที่ยืนยันแล้ว ใช้ POST /v1/videos ตามด้วย GET /v1/videos/{task_id} และ GET /v1/videos/{task_id}/content
FLUX 3 เป็นแบบ synchronous ไหม?
ไม่ เป็นงาน อะซิงโครนัส: ส่งคำขอ เก็บ task ID โพลลิง และดาวน์โหลด
FLUX 3 สร้างได้นานแค่ไหน?
BFL ระบุ 5–20 วินาทีสำหรับ T2V/I2V และ 5–15 วินาทีสำหรับ continuation
FLUX 3 สร้างเสียงได้หรือไม่?
ได้ BFL ระบุว่า เสียงแบบซิงก์เปิดโดยค่าเริ่มต้น ใน API เนทีฟของตน
FLUX 3 รองรับ image-to-video หรือไม่?
รองรับ CometAPI ระบุ การรองรับ image-to-video ในขณะที่ API เนทีฟของ BFL ใช้งานผ่านโหมด i2v และ keyframes
ใช้คีย์เฟรมของ BFL ผ่าน CometAPI ได้โดยไม่เปลี่ยนแปลงหรือไม่?
อย่าคาดหวังเช่นนั้น สคีมาคำขอแตกต่างกัน; ตรวจสอบ quickstart สดของ CometAPI ก่อนจัดส่งเวิร์กโฟลว์อ้างอิงภาพผ่านเกตเวย์
วิดีโอ FLUX 3 ความยาว 5 วินาที บน CometAPI มีค่าใช้จ่ายเท่าไร?
ตามอัตราปัจจุบันที่ CometAPI ระบุ 5 วินาทีอยู่ที่ $0.68 ที่ 720p หรือ $1.16 ที่ 1080p ดูตารางราคาที่รวมไว้ด้านบนสำหรับลิงก์อ้างอิงสด
FLUX 3 ดีกว่า Wan 3.0 หรือ Seedance 2.5 หรือไม่?
ขึ้นอยู่กับเวิร์กโฟลว์ FLUX 3 โดดเด่นสำหรับช็อตภาพและเสียงที่เคลื่อนไหวสมจริงและซิงก์กัน พร้อมคีย์เฟรมเนทีฟหรือ continuation; Wan 3.0 เน้นความกว้างของอินพุต; Seedance 2.5 เน้นการเล่าเรื่องยาวที่อ้างอิงหนัก
บทสรุป
FLUX 3 มีเส้นทาง Video API แบบอะซิงโครนัสที่ใช้งานได้บน CometAPI ขณะที่เอกสารเนทีฟของ BFL เผยให้เห็นการควบคุมที่ลึกขึ้นสำหรับคีย์เฟรม การต่อวิดีโอ เสียง และโหมด Draft
เส้นทางอินทิเกรตที่ปลอดภัยนั้นตรงไปตรงมา: เริ่มด้วยคำขอ text-to-video สั้น 720p เก็บ task ID โพลลิงอย่างพอเหมาะ ดาวน์โหลดและตรวจสอบ MP4 แล้วจึงเพิ่มเทมเพลตโปรम्पต์ ระบบจัดเก็บ ตรรกะรีทราย และชุดประเมินผลที่ทำซ้ำได้ แยกสคีมาเนทีฟและเกตเวย์ออกจากกัน และตรวจสอบหน้ารุ่นสดก่อนฮาร์ดโค้ดฟิลด์หรือราคา
