📘 ข้อกำหนดทาง技术ของ Grok Imagine Video
| ข้อกำหนด | รายละเอียด |
|---|---|
| รหัสรุ่น | grok-imagine-video |
| ผู้ให้บริการ | xAI |
| ประเภท | AI สำหรับการสร้างและตัดต่อวิดีโอ |
| ประเภทอินพุต | ข้อความ (พรอมต์); ตัวเลือกเสริมเป็นภาพหรือวิดีโอ พรอมต์ข้อความ (ภาษาธรรมชาติ); ตัวเลือกอินพุตเป็นภาพ (ภาพ→วิดีโอ); ตัวเลือก video_url สำหรับแก้ไขคลิปที่มีอยู่ ความยาวสูงสุดของวิดีโออินพุตเพื่อการแก้ไขแตกต่างกันตามเอ็นด์พอยต์ — มีรายงาน ~8.7 วินาทีสำหรับบางโฟลว์การแก้ไข |
| ประเภทเอาต์พุต | วิดีโอ .mp4 ผ่าน URL ชั่วคราว |
| ช่วงความยาว (สร้าง) | 1–15 วินาที |
| ความละเอียด | 480p, 720p (ปรับค่าได้) |
| อัตราส่วนภาพ | 1:1, 16:9, 9:16 |
| รองรับการแก้ไข | ใช่ — ทำให้เคลื่อนไหวและปรับแก้วิดีโอได้สูงสุด 8.7 วินาที |
| การกลั่นกรอง | มีระบบกลั่นกรองเนื้อหาในตัว |
| การคิดราคา | คิดค่าบริการตามวินาที แตกต่างกันตามความละเอียด |
🚀 Grok Imagine Video คืออะไร?
Grok Imagine Video คือโมเดล AI ขั้นสูงของ xAI สำหรับการสร้างและตัดต่อวิดีโอ ซึ่งให้บริการผ่าน CometAPI ช่วยให้นักพัฒนาสามารถสร้างวิดีโอแบบสั้นและปรับแต่งได้จากพรอมต์ภาษาธรรมชาติ และเลือกทำให้ภาพนิ่งเคลื่อนไหวหรือแก้ไขคลิปที่มีอยู่ได้ โมเดลรองรับการกำหนดความยาวเอาต์พุต ความละเอียด และอัตราส่วนภาพ พร้อมระบบกลั่นกรองเนื้อหาในตัวเพื่อให้สอดคล้องกับนโยบาย
🧠คุณสมบัติหลัก (สิ่งที่ทำให้ Grok Imagine แตกต่าง)
- เสียงในตัว + ซิงก์ริมฝีปาก: สร้างเสียงบรรยากาศ เอฟเฟ็กต์ และคำพูด/บรรยายสั้นๆ โดยซิงก์ริมฝีปากได้ใกล้เคียง
- ภาพ→วิดีโอ / การแก้ไขด้วยพรอมต์: ทำให้ภาพนิ่งเคลื่อนไหวหรือแก้ไขฟุตเทจที่มีอยู่ผ่านพรอมต์ข้อความ (ลบ/แทนที่วัตถุ ปรับเวลา ปรับสไตล์)
- วนซ้ำรวดเร็ว & หน่วงต่ำ: ออกแบบมาเพื่อรอบฟีดแบ็กที่รวดเร็ว เหมาะกับเวิร์กโฟลว์สร้างสรรค์และการทำต้นแบบผลิตภัณฑ์
- API ระดับโปรดักชัน: Imagine API เปิดเอ็นด์พอยต์แบบโปรแกรมสำหรับการสร้างแบบแบตช์ การผสานเข้ากับสายงานตัดต่อ และการควบคุมระดับองค์กร
- โหมด/สไตล์ที่หลากหลาย: มีโหมดสำหรับผู้ใช้ (ตัวอย่างที่มีรายงาน: Normal / Fun / Spicy หรือพรีเซ็ตที่คล้ายกัน) เพื่อชี้นำสไตล์หรือระดับความยืดหยุ่นของผลลัพธ์ (หมายเหตุ: โหมด “Spicy” ในอดีตเปิดใช้งาน NSFW)
| โมเดล (บริษัท) | ความละเอียดสูงสุด (สาธารณะ) | ความยาวคลิปสูงสุด (สาธารณะ) | มีเสียงในตัวหรือไม่? | จุดเด่น | ข้อควรทราบ |
|---|---|---|---|---|---|
| Grok Imagine (xAI) | 720p | 6–15 วินาที | ใช่ | วนซ้ำรวดเร็ว ต้นทุน/เวลาแฝงดี การแก้ไขแบบผสานในตัว มีเสียงในตัว | จำกัดที่ 720p; ประเด็นด้านการกลั่นกรอง; ความสมจริงแปรผัน |
| Sora (OpenAI) | 720p–1080p (ขึ้นกับระดับ) | สั้น (6–15 วินาที) | ใช่ | ความคมชัดภาพสูง; ผสานการทำงานกับชุดเครื่องมือ OpenAI ได้ดี | มีค่าใช้จ่ายสูงกว่า; การกลั่นกรอง/การควบคุมมีข้อจำกัด |
| Veo (Google DeepMind) | สูงสุดถึง 1080p+ | สั้น (แปรผัน) | ใช่ | โฟโตเรียลิสติกเด่น การเคลื่อนไหวเสถียร | ต้นทุนสูงกว่า; การทดลองใช้สาธารณะน้อยกว่า |
| Runway Gen-4.5 | 1080p+ | สั้น (แปรผัน) | ใช่ | ได้รับการใช้งานในอุตสาหกรรมสำหรับเวิร์กโฟลว์สร้างสรรค์ ความเที่ยงตรงสูง | มีค่าใช้จ่ายสูงกว่า; เน้นเครื่องมือสำหรับงานสร้างสรรค์ |
| Vidu / Kling / Pika (various specialists) | สูงสุดถึง 1080p | สั้น (แปรผัน) | คละกัน | บางรายมีฟีเจอร์เฉพาะทาง (Smart Cuts, การเชื่อมช็อตหลายช็อต) | การรองรับเสียงแตกต่างกัน; ความพร้อมใช้ของ API ต่างกัน |
⚠️ ข้อจำกัด
- ความยาววิดีโอสูงสุดจำกัดที่ 15 วินาที
- การแก้ไขจะคงความยาววิดีโอต้นฉบับไว้ (≤ 8.7 วินาที)
- URL ที่สร้างขึ้นมีอายุสั้น — โปรดดาวน์โหลดโดยเร็ว
วิธีเข้าถึงและผสานรวม Grok Imagine Video
ขั้นตอนที่ 1: สมัครเพื่อรับ API Key
เข้าสู่ระบบที่ cometapi.com หากยังไม่เป็นผู้ใช้ของเรา โปรดลงทะเบียนก่อน เข้าสู่ CometAPI console ของคุณ รับ API key สำหรับการเข้าถึงอินเทอร์เฟซ คลิก “Add Token” ที่ส่วน API token ในศูนย์ส่วนบุคคล รับ token key: sk-xxxxx แล้วส่ง
ขั้นตอนที่ 2: ส่งคำขอไปยัง Grok Imagine Video API
เลือกเอ็นด์พอยต์ “grok-imagine-video” เพื่อส่งคำขอ API และกำหนด request body วิธีการและ request body สามารถดูได้จากเอกสาร API บนเว็บไซต์ของเรา เว็บไซต์ยังมีการทดสอบผ่าน Apifox เพื่อความสะดวกของคุณ แทนที่ <YOUR_API_KEY> ด้วยคีย์ CometAPI จริงจากบัญชีของคุณ ตำแหน่งที่เรียกใช้: GROKการสร้างวิดีโอ และ แก้ไขวิดีโอ
ขั้นตอนที่ 3: ส่งคำขอไปยัง Grok Imagine Video API
ป้อนข้อความหรืออัปโหลดภาพ(คุณสามารถให้ภาพต้นทางเพื่อทำให้เคลื่อนไหวได้ตามต้องการ) Grok Imagine AI API จะวิเคราะห์อินพุตของคุณและเตรียมเนื้อหาสำหรับ url รองรับทั้งการแปลงข้อความเป็นวิดีโอและภาพเป็นวิดีโอ
สามารถส่งภาพต้นทางได้ดังนี้:
- URL สาธารณะที่ชี้ไปยังภาพ
- Data URI ที่เข้ารหัสแบบ base64 (เช่น
data:image/jpeg;base64,<YOUR_BASE64_IMAGE>)
ขั้นตอนที่ 4: ดึงและตรวจสอบผลลัพธ์
ประมวลผลการตอบสนองจาก API เพื่อรับผลลัพธ์ที่สร้างขึ้น หลังจากประมวลผลแล้ว API จะตอบกลับด้วยสถานะงานและข้อมูลเอาต์พุต ระบบจะส่งคืน request_id ทันทีเมื่อส่งคำขอ; ใช้เอ็นด์พอยต์ GET เพื่อตรวจสอบสถานะและดึงวิดีโอที่สร้างขึ้น การแก้ไขวิดีโอเป็นแบบอะซิงโครนัส คุณอาจต้องเรียกตรวจสอบเอ็นด์พอยต์นี้หลายครั้งจนกว่าภารกิจจะเสร็จสิ้น โปรดดาวน์โหลดโดยเร็ว