ข้อมูลจำเพาะทาง技术ของ kling-audio-text-to-audio
| ข้อมูลจำเพาะ | รายละเอียด |
|---|---|
| รหัสโมเดล | kling-audio-text-to-audio |
| ประเภทโมเดล | การสร้างเสียง |
| อินพุต | พรอมต์ข้อความ |
| เอาต์พุต | เสียงที่สร้างขึ้น |
| รูปแบบสื่อ | ข้อความเป็นเสียง |
| คำอธิบายแบบย่อ | Kling ข้อความเป็นเสียง |
kling-audio-text-to-audio คืออะไร?
kling-audio-text-to-audio เป็นโมเดลแปลงข้อความเป็นเสียงที่ใช้งานผ่าน CometAPI ออกแบบให้รับพรอมต์แบบข้อความเป็นอินพุตและสร้างเอาต์พุตเสียงตามคำอธิบายที่ให้ไว้ จึงเหมาะสำหรับเวิร์กโฟลว์ที่ต้องการสร้างเสียงแบบอัตโนมัติจากคำสั่งภาษาธรรมชาติ
โมเดลนี้สามารถใช้กับงานต่างๆ เช่น การทำต้นแบบเสียงเชิงสร้างสรรค์ การระดมแนวคิดสำหรับซาวด์แทร็ก การสร้างเอฟเฟ็กต์เสียง และประสบการณ์ผลิตภัณฑ์อื่นๆ ที่ต้องการการสังเคราะห์เสียงโดยขับเคลื่อนด้วยข้อความ ผ่าน CometAPI นักพัฒนาสามารถเข้าถึง kling-audio-text-to-audio ด้วยอินเทอร์เฟซ API ที่มีรูปแบบสม่ำเสมอและบูรณาการเข้ากับเครื่องมือ แอป และไปป์ไลน์ของตนได้
คุณสมบัติหลักของ kling-audio-text-to-audio
- การสร้างเสียงจากข้อความ: แปลงพรอมต์ภาษาธรรมชาติให้เป็นเอาต์พุตเสียง
- เวิร์กโฟลว์แบบใช้พรอมต์อย่างง่าย: ช่วยให้นักพัฒนาสร้างเสียงได้ด้วยคำสั่งข้อความที่ตรงไปตรงมา
- การบูรณาการพร้อมใช้งานผ่าน API: เข้าถึงได้ผ่าน CometAPI เพื่อใช้งานในแอปพลิเคชันและบริการแบ็กเอนด์
- เคสการใช้งานเชิงสร้างสรรค์: รองรับการทดลองสำหรับสื่อ การทำต้นแบบ และประสบการณ์เชิงโต้ตอบ
- การเข้าถึงแพลตฟอร์มแบบรวมศูนย์: สอดคล้องกับรูปแบบการเข้าถึงโมเดลมาตรฐานของ CometAPI เพื่อให้ใช้งานได้ง่ายขึ้น
วิธีเข้าถึงและบูรณาการ kling-audio-text-to-audio
ขั้นตอนที่ 1: ลงทะเบียนเพื่อรับ API Key
ลงทะเบียนบน CometAPI และสร้าง API key จากแดชบอร์ด เมื่อได้รับ key แล้ว ให้เก็บรักษาอย่างปลอดภัยและใช้สำหรับยืนยันตัวตนในการส่งคำขอไปยังแพลตฟอร์ม CometAPI
ขั้นตอนที่ 2: ส่งคำขอไปยัง API ของ kling-audio-text-to-audio
ใช้เอนด์พอยต์ Kling audio ของ CometAPI ที่ POST /kling/v1/audio/text-to-audio.
curl https://api.cometapi.com/kling/v1/audio/text-to-audio \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "Gentle rain on a tin roof with distant thunder.",
"duration": 10
}'
ขั้นตอนที่ 3: ดึงและตรวจสอบผลลัพธ์
API จะส่งคืน task ID ให้ ให้เรียกเอนด์พอยต์สถานะงานเป็นระยะเพื่อดูว่าเมื่อการสร้างเสียงเสร็จสิ้น และดึง URL ของผลลัพธ์ออกมา