TL;DR: CometAPI Changelog บันทึก ID โมเดลใหม่ 15 รายการในเดือนสิงหาคม 2026 ครอบคลุมงานข้อความ มัลติโหมด ภาพ และวิดีโอ เริ่มจาก Seedance 2.5 หรือ Wan3.0 สำหรับวิดีโอ, GLM 5.3 Flash สำหรับงานมัลติโหมดที่เน้นประหยัดต้นทุน, และ Gemini 3.7 Flash สำหรับงานโค้ดและบริบทยาว จากนั้นตรวจสอบหน้ารายการโมเดลสด เส้นทาง API และราคา ก่อนนำขึ้นใช้งานจริง
CometAPI เพิ่มโมเดล AI อะไรใหม่ในเดือนสิงหาคม 2026?
สรุปรวมโมเดลเดือนสิงหาคม 2026 ของ CometAPI มีประโยชน์เพราะแต่ละโมเดลใช้งานภายใต้คีย์ API เดียวและเวิร์กโฟลว์การเรียกเก็บเงินเดียว มี ID แค็ตตาล็อกที่เสถียร ปลายทาง (endpoint) ที่มีเอกสาร และกำหนดราคาแยกตามโมเดล นักพัฒนาสามารถสลับ ID โมเดลได้โดยไม่ต้องสร้างอินทิเกรชันใหม่ทั้งหมด พร้อมยังใช้รูปแบบคำขอแบบ native หรือแบบเข้ากันได้ที่เหมาะกับผู้ให้บริการแต่ละรายมากที่สุด
ณ วันที่ 1 กันยายน 2026 CometAPI Changelog อย่างเป็นทางการ เป็นแหล่งอ้างอิงเวลาเปิดตัวในเดือนสิงหาคม และบันทึก ID โมเดลใหม่ 15 รายการ ครอบคลุมการให้เหตุผลเชิงข้อความ ความเข้าใจด้านภาพ การสร้างภาพ และวิดีโอ โดย Models Catalog และหน้ารายการโมเดลแต่ละตัวเป็นแหล่งข้อมูลสถานะความพร้อมใช้งานและราคาในปัจจุบัน โมเดลที่ควรทดสอบก่อน ได้แก่ Seedance 2.5 สำหรับวิดีโอแบบมัลติโหมด, Wan3.0 สำหรับเวิร์กโฟลว์วิดีโอเพื่อการผลิต, GLM 5.3 Flash สำหรับการให้เหตุผลแบบมัลติโหมดที่คุ้มค่า และ Gemini 3.7 Flash สำหรับงานโค้ดและบริบทยาว
สรุปการเปิดตัวโมเดล CometAPI เดือนสิงหาคม 2026
| Model / ID | Modality | Current CometAPI Price (as of Sep 3, 2026) | Recommended Endpoint |
|---|---|---|---|
| Gemini 3.7 Flash gemini-3.7-flash | มัลติโหมด → ข้อความ | $0.60 อินพุต / $3.00 เอาต์พุต ต่อ 1M tokens | POST /v1beta/models/{model}:generateContent |
| Grok 4.6 grok-4.6 | ข้อความ, ภาพ → ข้อความ | $1.60 อินพุต / $4.80 เอาต์พุต ต่อ 1M tokens | POST /v1/chat/completions POST /v1/responses |
| GLM 5.3 glm-5.3 | ข้อความ → ข้อความ | $1.12 อินพุต / $3.528 เอาต์พุต ต่อ 1M tokens | POST /v1/chat/completions |
| DeepSeek V4 Flash Vision deepseek-v4-flash-vision | ข้อความ, ภาพ → ข้อความ | $0.352 อินพุต / $1.056 เอาต์พุต ต่อ 1M tokens | POST /v1/chat/completions |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | ข้อความ, ภาพ → ภาพ | $0.032 ต่อคำขอ | POST /v1/images/generations |
| GLM 5.3 Flash glm-5.3-flash | ข้อความ, ภาพ, วิดีโอ → ข้อความ | $0.06 อินพุต / $0.20 เอาต์พุต ต่อ 1M tokens | POST /v1/chat/completions |
| Seedance 2.5 seedance-2-5 | มัลติโหมด → วิดีโอ | เริ่มจาก $0.0824/s; คิดค่าบริการละเอียด: $0.103/s (480p), $0.231/s (720p) | POST /v1/videos |
| Qwen3.8 Max qwen3.8-max | มัลติโหมด → ข้อความ | $1.60 อินพุต / $4.80 เอาต์พุต ต่อ 1M tokens | POST /v1/chat/completions POST /v1/responses |
| MiniMax H3 minimax-h3 | ข้อความ, ภาพ, วิดีโอ, เสียง → วิดีโอ | เริ่มจาก $0.064/s; อัตราที่ระบุ: $0.08/s (768p), $0.13/s (2K) | POST /v1/videos GET /v1/videos/{task_id} |
| DeepSeek V4 Pro 0813 deepseek-v4-pro-0813 | ข้อความ → ข้อความ | $0.528 อินพุต / $1.584 เอาต์พุต / $0.0176 การอ่านแคช ต่อ 1M tokens; 2× ในช่วงเวลา UTC ที่ระบุ | POST /v1/chat/completions |
| FLUX 3 flux-3 | มัลติโหมด → วิดีโอ | $0.136/s (720p); $0.232/s (1080p) | POST /v1/videos GET /v1/videos/{task_id} |
| Qwen3.8 2.4T A95B qwen3.8-2.4t-a95b | ข้อความ → ข้อความ | $1.60 อินพุต / $4.80 เอาต์พุต ต่อ 1M tokens | POST /v1/chat/completions |
| Grok Imagine Video 1.5 grok-imagine-video-1.5 | ข้อความ, ภาพ → วิดีโอ | อินพุตภาพ $0.008; เอาต์พุต $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p) | POST /grok/v1/videos/generations GET /grok/v1/videos/{request_id} |
| Wan3.0 wan3.0 | ข้อความ, ภาพ → วิดีโอ | เริ่มจาก $0.04/s; อัตราที่ระบุ: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p) | POST /v1/videos |
| Qwen3.8 Flash qwen3.8-flash | มัลติโหมด → ข้อความ | $0.12 อินพุต / $0.376001 เอาต์พุต ต่อ 1M tokens | POST /v1/chat/completions |
ตารางนี้เน้นโมเดลลำดับความสำคัญจากรายการเพิ่ม 15 รายการใน CometAPI August Changelog รวมถึงราคาส่วนลดจำกัดเวลาตามที่ CometAPI ระบุ เนื่องจากการอ้างอิงเบนช์มาร์กมาจากผู้ให้บริการและวันที่เปิดตัวต่างกัน ให้ใช้แค็ตตาล็อกเพื่อการค้นหาและวางแผนอินทิเกรชัน มากกว่าการใช้เป็นสกอร์การ์ดเปรียบเทียบโดยตรง
การอัปเดตราคาเพียงอย่างเดียวสำหรับ gpt-5.6-sol และ minimax-m3 รวมถึงการปรับบริการสำหรับโมเดล DeepSeek ที่มีอยู่ ไม่ถูกนับเป็นการเปิดตัวใหม่
4 โมเดลเด่นในเดือนสิงหาคมที่แนะนำ
แค็ตตาล็อกเดือนสิงหาคมกว้างขวาง แต่มีสี่โมเดลที่โดดเด่นสำหรับงานต่างประเภท คำแนะนำด้านล่างมุ่งเน้นความเหมาะสมเชิงปฏิบัติแทนการย้ำตารางราคา กรุณายืนยันอัตราแบบสดและรูปแบบคำขอบนหน้ารายการโมเดลก่อนใช้งานจริง
Seedance 2.5: วิดีโอมัลติโหมดที่ยาวขึ้น
เนื่องจากค่าบริการวิดีโอคิดตามวินาทีและแตกต่างตามความละเอียด โปรดเก็บบันทึกวันที่อ้างอิงและลิงก์กลับไปยังหน้ารายการโมเดลแบบสด สำหรับ Seedance 2.5 คลิป 480p มีค่าใช้จ่าย $0.103 ต่อวินาที ขณะที่คลิป 720p มีค่าใช้จ่าย $0.231 ต่อวินาที—มากกว่าสองเท่า—ดังนั้นควรวางงบประมาณตามความละเอียดที่เวิร์กโหลดของคุณใช้งานจริง
Wan3.0: วิดีโอระดับโปรดักชันในราคาเริ่มต้นที่ต่ำกว่า
Wan3.0 พร้อมใช้งานสำหรับเวิร์กโฟลว์ text-to-video และ image-to-video เป็นทางเลือกที่เหมาะสมเมื่อทีมต้องการ endpoint แบบอะซิงโครนัสสำหรับงานโปรดักชัน การคิดค่าบริการต่อวินาทีที่คาดการณ์ได้ และพื้นที่สำหรับเปรียบเทียบความเร็ว คุณภาพการเคลื่อนไหว และความละเอียดกับโมเดลวิดีโออื่นๆ
GLM 5.3 Flash: การให้เหตุผลแบบมัลติโหมดที่ประหยัด
GLM 5.3 Flash เป็นตัวเลือกเน้นต้นทุนสำหรับปริมาณงานสูงด้านความเข้าใจข้อความและภาพ ทดสอบกับงานสกัดข้อมูล การตอบคำถามจากภาพ การช่วยเขียนโค้ด และขั้นตอนเอเจนต์ที่ความหน่วงต่ำและต้นทุนสำคัญกว่าประสิทธิภาพเบนช์มาร์กสูงสุด
Kimi K3: งานโค้ดและความรู้บริบทยาว
Kimi K3 เปิดตัวในเดือนกรกฎาคมแต่ยังคงเป็นหนึ่งในโมเดลที่เกี่ยวข้องที่สุดในเดือนสิงหาคม ช่องบริบทหนึ่งล้านโทเคนและเส้นทางแชทที่เข้ากันได้กับ OpenAI ทำให้เหมาะกับคลังซอร์สโค้ดขนาดใหญ่ การสังเคราะห์งานวิจัย และเวิร์กโฟลว์โค้ดยาวๆ
ควรใช้โมเดล AI ใหม่ตัวไหนตามกรณีการใช้งาน?
Gemini 3.7 Flash: งานโค้ดและบริบทยาว
สัญญาณที่เผยแพร่เน้นวิศวกรรมซอฟต์แวร์และงานความรู้ แต่การทดสอบที่เป็นประโยชน์จริงคือคลังหรือชุดเอกสารของคุณเอง รันชุดพรอมป์ตคงที่ บันทึกอัตรางานที่ยอมรับได้ ความหน่วง และโทเคนที่คิดค่าบริการ จากนั้นเปรียบเทียบผลลัพธ์กับโมเดลที่คุณใช้อยู่
โมเดลวิดีโอ: การเคลื่อนไหว ความซื่อต่อภาพอ้างอิง และต้นทุนต่อคลิปที่ผ่านการตรวจรับ
สำหรับ Seedance 2.5, Wan3.0 และ MiniMax H3 ให้ใช้พรอมป์ต ระยะเวลา อัตราส่วนภาพ และภาพอ้างอิงเดียวกัน ให้คะแนนความสม่ำเสมอของการเคลื่อนไหว ความสอดคล้องกับพรอมป์ต อาร์ติแฟกต์ภาพ เวลาในการสร้าง และต้นทุนต่อคลิปที่ผ่านการตรวจรับ
โมเดลมัลติโหมด: ความแม่นยำมาก่อนบริบทสูงสุด
สำหรับ GLM 5.3 Flash, DeepSeek V4 Flash Vision และ Gemini 3.7 Flash ให้ทดสอบสกรีนช็อต กราฟ เอกสาร PDF และอินพุตข้อความ-ภาพผสม ช่องบริบทขนาดใหญ่มีความสำคัญก็ต่อเมื่อโมเดลดึงหลักฐานที่ถูกต้องและให้คำตอบที่เสถียร
DeepSeek V4 Flash Vision: ใช้สำหรับเอเจนต์โค้ดที่มองเห็นได้ การวิเคราะห์กราฟ สกรีนช็อต และอินพุตอัตโนมัติผ่านเบราว์เซอร์ ทำเบนช์มาร์กกับงานข้อความ-ภาพผสมของคุณเอง และเปรียบเทียบความแม่นยำ ความหน่วง และโทเคนที่คิดค่าบริการก่อนนำไปใช้จริง
Grok Imagine Image 2.0: ใช้สำหรับไปป์ไลน์สร้างภาพพร้อมแก้ไข รองรับหลายอัตราส่วนภาพ งานครีเอทีฟสำหรับสินค้า และการปรับแบบอ้างอิง ตั้งงบประมาณตามคุณภาพและความละเอียดที่เวิร์กโหลดของคุณต้องการ ไม่ใช่เพียงราคาตั้งต้นที่ต่ำที่สุด
กำลังมาใน CometAPI: รายการเฝ้าดู
ณ วันที่ 3 กันยายน 2026 รายการเฝ้าดูนี้รวมเฉพาะโมเดลที่หน้าของ CometAPI ถูกระบุว่า Coming Soon ให้ถือว่า ID โมเดล เส้นทาง และราคาเป็นข้อมูลชั่วคราวจนกว่าแค็ตตาล็อกจะยืนยันการเข้าถึงในโปรดักชัน
| Model | Model ID | Status | Decision |
|---|---|---|---|
| Qwen-Image-3.0 | qwen-image-3.0 | Coming Soon | เฝ้าติดตาม; อย่าวางแผนทราฟฟิกโปรดักชันในตอนนี้ |
| Veo 4 | veo4 | Coming Soon | รอเส้นทางและการเรียกเก็บเงินที่ยืนยันก่อนใช้งานโปรดักชัน |
เรียกใช้ API ที่เข้ากันได้กับ OpenAI และแบบ native ผ่าน CometAPI อย่างไร?
CometAPI ใช้คีย์ API เดียวและเวิร์กโฟลว์การเรียกเก็บเงินเดียว แต่ไม่ได้บังคับให้ผู้ให้บริการทุกเจ้ามาอยู่ในรูปแบบคำขอเดียว ใช้หน้ารายการโมเดลเพื่อเลือกเส้นทางที่เหมาะสมที่สุด: การสร้างเนื้อหาแบบ native ของ Gemini สำหรับ Gemini, เส้นทางแชทที่เข้ากันได้กับ OpenAI สำหรับ LLM หลายตัว, endpoint สำหรับภาพสำหรับโมเดลภาพ และ API วิดีโอแบบอะซิงโครนัสสำหรับโมเดลวิดีโอ ตัวอย่าง POST สั้นๆ ด้านล่างแสดงเพียงเส้นทางและฟิลด์โมเดล ดู API documentation สำหรับพารามิเตอร์ทั้งหมด
- ตัวอย่าง LLM ข้อความและมัลติโหมด: POST https://api.cometapi.com/v1beta/models/gemini-3.7-flash:generateContent
- การสร้างภาพ: POST
https://api.cometapi.com/v1/images/generations - การสร้างวิดีโอ: POST
https://api.cometapi.com/v1/videos
เส้นทาง POST จะเปลี่ยนไปตามรูปแบบสื่อ Gemini รองรับทั้ง /v1beta/models/{model}:generateContent แบบ native และรูปแบบที่เข้ากันได้; Grok Imagine Image 2.0 ใช้ /v1/images/generations; และ Seedance 2.5 ใช้ /v1/videos ตามด้วยการ polling สถานะงาน ใช้ Text API, Image API และ Video API เป็นแหล่งข้อมูลอ้างอิง
คำถามที่พบบ่อย
นักพัฒนาควรเลือกตัวรวม API AI (aggregator) ใดดีที่สุด?
ขึ้นอยู่กับว่าคุณต้องการเฉพาะ LLM ข้อความหรือสแตกที่ครอบคลุมข้อความ ภาพ เสียง และวิดีโอ ประเมินแต่ละ aggregator จาก ID โมเดลที่พร้อมใช้งาน ความเข้ากันได้ของ endpoint การมองเห็นการใช้งาน การรองรับ fallback ความโปร่งใสด้านการเรียกเก็บเงิน และความสดใหม่ของแค็ตตาล็อก CometAPI ควรอยู่ในรายชื่อลองพิจารณาเมื่อความสำคัญคือคีย์เดียวและเวิร์กโฟลว์การเรียกเก็บเงินเดียวครอบคลุมหลายรูปแบบสื่อ
โมเดลเดือนสิงหาคม 2026 ใดบ้างที่ใช้งานได้จริงบน CometAPI?
ณ วันที่ 1 กันยายน Changelog เดือนสิงหาคมบันทึก ID โมเดลใหม่ 15 รายการ รายการเต็ม รูปแบบที่รองรับ และหมายเหตุราคา สรุปอยู่ในตารางด้านบน โปรดตรวจสอบ Models Catalog ก่อนดีพลอย เพราะความพร้อมใช้งาน นามแฝง และราคาอาจเปลี่ยนแปลงได้
สามารถสลับผู้ให้บริการโดยไม่ต้องเปลี่ยน SDK ทั้งหมดได้หรือไม่?
ได้บ่อยครั้ง แต่อาจไม่เสมอไป โมเดลข้อความจำนวนมากรองรับ /v1/chat/completions ขณะที่ Gemini ยังสามารถใช้เส้นทางการสร้างเนื้อหาแบบ native และโมเดลสื่อจะใช้ endpoint ด้านภาพ แบบเรียลไทม์ หรือวิดีโอ CometAPI คงคีย์เดียวและเวิร์กโฟลว์การเรียกเก็บเงินเดียวระหว่างรูปแบบเหล่านี้ ทำให้การสลับผู้ให้บริการง่ายขึ้นแม้รูปแบบคำขอจะไม่เหมือนกัน
การสร้างวิดีโอทำงานอย่างไร?
การสร้างวิดีโอเป็นแบบอะซิงโครนัส สร้างงาน เก็บ task ID ที่ส่งคืน แล้วทำการ polling หรือรับ webhook จนกว่างานจะสำเร็จหรือ ล้มเหลว หลังจากเสร็จสิ้นแล้วจึงให้แอปพลิเคชันดึงและบันทึกผลลัพธ์
ควรตรวจสอบ ID โมเดลและราคาบ่อยแค่ไหน?
ตรวจสอบก่อนการอินทิเกรต ก่อนการเปิดใช้งานโปรดักชัน และก่อนชุดงานขนาดใหญ่ ระบบอัตโนมัติควรบันทึก ID โมเดลและสแน็ปช็อตราคาที่ใช้สำหรับการประมาณต้นทุนของแต่ละงานด้วย เพื่อไม่ให้การเปลี่ยนแปลงในแค็ตตาล็อกภายหลังไปเขียนทับประวัติการตัดสินใจดีพลอย
สรุป
การเพิ่ม 15 โมเดลในเดือนสิงหาคมของ CometAPI ขยายตัวเลือกเชิงปฏิบัติสำหรับงานโค้ด วิชวล ภาพ และวิดีโอ โดยยังคงคีย์เดียวและเวิร์กโฟลว์การเรียกเก็บเงินเดียว เริ่มจาก Seedance 2.5, Wan3.0, GLM 5.3 Flash หรือ Gemini 3.7 Flash ตามเวิร์กโหลด จากนั้นโปรโมตโมเดลหลังจากการทดสอบพรอมป์ตคงที่วัดคุณภาพ ความหน่วง ความน่าเชื่อถือ และต้นทุนที่เรียกเก็บจริง
