TL;DR: CometAPI Changelog ghi nhận 15 ID mô hình mới trong tháng 8/2026 cho các khối lượng công việc văn bản, đa phương thức, hình ảnh và video. Bắt đầu với Seedance 2.5 hoặc Wan3.0 cho video, GLM 5.3 Flash cho công việc đa phương thức tối ưu chi phí, và Gemini 3.7 Flash cho lập trình và tác vụ ngữ cảnh dài; sau đó xác minh trang mô hình đang hoạt động, điểm cuối và giá trước khi triển khai.
CometAPI đã thêm những mô hình AI nào vào tháng 8 năm 2026?
Tổng hợp mô hình tháng 8/2026 của CometAPI hữu ích vì mỗi mô hình đều dùng chung một khóa API và một quy trình thanh toán, với ID danh mục ổn định, điểm cuối được tài liệu hóa và giá theo từng mô hình. Nhà phát triển có thể đổi ID mô hình mà không cần xây dựng lại toàn bộ tích hợp, đồng thời vẫn dùng định dạng yêu cầu gốc hoặc tương thích phù hợp nhất với từng nhà cung cấp.
Tính đến ngày 1 tháng 9 năm 2026, CometAPI Changelog chính thức là nguồn cho thời điểm phát hành tháng 8 và ghi nhận 15 ID mô hình mới trải rộng các hạng mục suy luận văn bản, hiểu biết thị giác, tạo ảnh và video. Models Catalog và trang mô hình riêng lẻ vẫn là nguồn cho tình trạng khả dụng và giá hiện tại. Các mô hình nên ưu tiên thử trước gồm Seedance 2.5 cho video đa phương thức, Wan3.0 cho quy trình video sản xuất, GLM 5.3 Flash cho suy luận đa phương thức tối ưu chi phí, và Gemini 3.7 Flash cho lập trình và công việc ngữ cảnh dài.
Tóm tắt phát hành mô hình CometAPI tháng 8/2026
| Mô hình / ID | Phương thức | Giá CometAPI hiện tại (tính đến ngày 3 tháng 9, 2026) | Điểm cuối khuyến nghị |
|---|---|---|---|
| Gemini 3.7 Flash gemini-3.7-flash | Đa phương thức → văn bản | $0.60 input / $3.00 output trên 1M tokens | POST /v1beta/models/{model}:generateContent |
| Grok 4.6 grok-4.6 | Văn bản, hình ảnh → văn bản | $1.60 input / $4.80 output trên 1M tokens | POST /v1/chat/completions POST /v1/responses |
| GLM 5.3 glm-5.3 | Văn bản → văn bản | $1.12 input / $3.528 output trên 1M tokens | POST /v1/chat/completions |
| DeepSeek V4 Flash Vision deepseek-v4-flash-vision | Văn bản, hình ảnh → văn bản | $0.352 input / $1.056 output trên 1M tokens | POST /v1/chat/completions |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | Văn bản, hình ảnh → hình ảnh | $0.032 mỗi yêu cầu | POST /v1/images/generations |
| GLM 5.3 Flash glm-5.3-flash | Văn bản, hình ảnh, video → văn bản | $0.06 input / $0.20 output trên 1M tokens | POST /v1/chat/completions |
| Seedance 2.5 seedance-2-5 | Đa phương thức → video | Từ $0.0824/s; chi tiết tính phí: $0.103/s (480p), $0.231/s (720p) | POST /v1/videos |
| Qwen3.8 Max qwen3.8-max | Đa phương thức → văn bản | $1.60 input / $4.80 output trên 1M tokens | POST /v1/chat/completions POST /v1/responses |
| MiniMax H3 minimax-h3 | Văn bản, hình ảnh, video, âm thanh → video | Từ $0.064/s; mức niêm yết: $0.08/s (768p), $0.13/s (2K) | POST /v1/videos GET /v1/videos/{task_id} |
| DeepSeek V4 Pro 0813 deepseek-v4-pro-0813 | Văn bản → văn bản | $0.528 input / $1.584 output / $0.0176 cache read trên 1M tokens; 2× trong các khung giờ UTC đã nêu | POST /v1/chat/completions |
| FLUX 3 flux-3 | Đa phương thức → video | $0.136/s (720p); $0.232/s (1080p) | POST /v1/videos GET /v1/videos/{task_id} |
| Qwen3.8 2.4T A95B qwen3.8-2.4t-a95b | Văn bản → văn bản | $1.60 input / $4.80 output trên 1M tokens | POST /v1/chat/completions |
| Grok Imagine Video 1.5 grok-imagine-video-1.5 | Văn bản, hình ảnh → video | Đầu vào hình ảnh $0.008; đầu ra $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p) | POST /grok/v1/videos/generations GET /grok/v1/videos/{request_id} |
| Wan3.0 wan3.0 | Văn bản, hình ảnh → video | Từ $0.04/s; mức niêm yết: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p) | POST /v1/videos |
| Qwen3.8 Flash qwen3.8-flash | Đa phương thức → văn bản | $0.12 input / $0.376001 output trên 1M tokens | POST /v1/chat/completions |
Bảng này nhấn mạnh các mô hình ưu tiên từ 15 bổ sung được ghi trong CometAPI August Changelog, bao gồm cả giá chiết khấu theo thời gian khi CometAPI nêu rõ. Vì các tuyên bố benchmark đến từ nhiều nhà cung cấp và thời điểm phát hành khác nhau, hãy dùng catalog để khám phá và lập kế hoạch tích hợp thay vì coi là bảng so sánh trực tiếp phổ quát.
Các cập nhật chỉ về giá cho gpt-5.6-sol và minimax-m3, cùng các điều chỉnh dịch vụ cho các mô hình DeepSeek hiện có, không được tính là phát hành mới.
4 mô hình tháng 8 tôi khuyến nghị
Danh mục tháng 8 rất rộng, nhưng bốn mô hình nổi bật cho các khối lượng công việc khác nhau. Các khuyến nghị dưới đây tập trung vào sự phù hợp thực tế thay vì lặp lại bảng giá; hãy xác nhận mức giá và định dạng yêu cầu đang hiệu lực trên trang mô hình trước khi dùng trong sản xuất.
Seedance 2.5: Video đa phương thức dài hơn
Vì giá video được tính theo giây và thay đổi theo độ phân giải, hãy lưu lại ngày chụp nhanh và liên kết về trang mô hình đang hoạt động. Với Seedance 2.5, clip 480p có giá $0.103 mỗi giây trong khi clip 720p là $0.231 mỗi giây—hơn gấp đôi—vì vậy hãy lập ngân sách theo độ phân giải thực sự mà khối lượng công việc của bạn sử dụng.
Wan3.0: Video sản xuất với chi phí vào thấp hơn
Wan3.0 hiện đã hoạt động cho quy trình văn bản-sang-video và hình ảnh-sang-video. Đây là lựa chọn thực tế khi nhóm cần điểm cuối sản xuất bất đồng bộ, tính phí dự đoán theo giây và không gian để so sánh tốc độ, chất lượng chuyển động và độ phân giải với các mô hình video khác.
GLM 5.3 Flash: Suy luận đa phương thức tối ưu chi phí
GLM 5.3 Flash là lựa chọn tập trung chi phí cho khối lượng văn bản lớn và hiểu hình ảnh. Hãy thử cho trích xuất, hỏi đáp thị giác, hỗ trợ lập trình và các bước agent nơi độ trễ và chi phí quan trọng hơn hiệu năng benchmark tối đa.
Kimi K3: Lập trình ngữ cảnh dài và công việc tri thức
Kimi K3 ra mắt tháng 7 nhưng vẫn là một trong những mô hình phù hợp nhất để áp dụng trong tháng 8. Cửa sổ ngữ cảnh một triệu token và tuyến chat tương thích OpenAI khiến nó hữu ích cho kho mã lớn, tổng hợp nghiên cứu và quy trình lập trình kéo dài.
Nên dùng mô hình AI mới nào cho từng trường hợp sử dụng?
Gemini 3.7 Flash: Lập trình và công việc ngữ cảnh dài
Các tín hiệu công bố nhấn mạnh kỹ nghệ phần mềm và công việc tri thức, nhưng bài thử sản xuất hữu ích là kho mã hoặc bộ tài liệu của chính bạn. Chạy một bộ prompt cố định, ghi nhận tỷ lệ tác vụ được chấp nhận, độ trễ và token tính phí, rồi so sánh kết quả với mô hình bạn đang dùng.
Các mô hình video: Chuyển động, độ trung thực tham chiếu và chi phí trên mỗi clip được chấp nhận
Với Seedance 2.5, Wan3.0 và MiniMax H3, hãy dùng cùng một prompt, thời lượng, tỷ lệ khung hình và ảnh tham chiếu. Chấm điểm tính nhất quán chuyển động, tuân thủ prompt, hiện tượng ảnh, thời gian tạo và chi phí cho mỗi clip vượt qua kiểm duyệt.
Mô hình đa phương thức: Ưu tiên độ chính xác trước kích thước ngữ cảnh tối đa
Với GLM 5.3 Flash, DeepSeek V4 Flash Vision và Gemini 3.7 Flash, hãy thử với ảnh chụp màn hình, biểu đồ, PDF và đầu vào văn bản-hình ảnh. Cửa sổ ngữ cảnh lớn chỉ có ý nghĩa khi mô hình truy xuất đúng bằng chứng và đưa ra câu trả lời ổn định.
DeepSeek V4 Flash Vision: Dùng cho agent lập trình dựa trên thị giác, phân tích biểu đồ, ảnh chụp màn hình và đầu vào tự động hóa trình duyệt. Đánh giá trên các tác vụ văn bản-hình ảnh của chính bạn và so sánh độ chính xác, độ trễ, token tính phí trước khi áp dụng vào sản xuất.
Grok Imagine Image 2.0: Dùng cho pipeline tạo + chỉnh sửa, nhiều tỷ lệ khung hình, sáng tạo sản phẩm và lặp dựa trên tham chiếu. Lập ngân sách từ chất lượng và độ phân giải mà khối lượng công việc của bạn yêu cầu, không chỉ mức giá khởi điểm thấp nhất.
Sắp có trên CometAPI: Danh sách theo dõi
Tính đến ngày 3 tháng 9 năm 2026, danh sách theo dõi này chỉ bao gồm các mô hình có trang CometAPI được đánh dấu Coming Soon. Xem các ID mô hình, tuyến và giá là tạm thời cho đến khi catalog xác nhận quyền truy cập sản xuất đang hoạt động.
| Mô hình | ID mô hình | Trạng thái | Khuyến nghị |
|---|---|---|---|
| Qwen-Image-3.0 | qwen-image-3.0 | Sắp ra mắt | Theo dõi; chưa lập kế hoạch lưu lượng sản xuất. |
| Veo 4 | veo4 | Sắp ra mắt | Chờ tuyến hoạt động và tính phí được xác nhận trước khi dùng sản xuất. |
Gọi API tương thích OpenAI và API gốc với CometAPI như thế nào?
CometAPI dùng một khóa API và một quy trình thanh toán, nhưng không ép mọi nhà cung cấp vào một dạng yêu cầu duy nhất. Hãy dùng trang mô hình để chọn tuyến phù hợp nhất: tạo nội dung gốc của Gemini cho Gemini, chat tương thích OpenAI cho nhiều LLM, điểm cuối hình ảnh cho mô hình ảnh và API video bất đồng bộ cho mô hình video. Các ví dụ POST ngắn dưới đây chỉ thể hiện tuyến và trường model; xem tài liệu API để biết đầy đủ tham số.
- Ví dụ LLM văn bản và đa phương thức: POST https://api.cometapi.com/v1beta/models/gemini-3.7-flash:generateContent
- Tạo hình ảnh: POST
https://api.cometapi.com/v1/images/generations - Tạo video: POST
https://api.cometapi.com/v1/videos
Tuyến POST thay đổi theo phương thức. Gemini hỗ trợ tuyến gốc /v1beta/models/{model}:generateContent cũng như các mẫu tương thích; Grok Imagine Image 2.0 dùng /v1/images/generations; và Seedance 2.5 dùng /v1/videos, sau đó là thăm dò trạng thái tác vụ. Hãy dùng Text API, Image API và Video API làm nguồn tham chiếu.
Câu hỏi thường gặp (FAQ)
Những trình tổng hợp API AI tốt nhất cho nhà phát triển là gì?
Lựa chọn tốt nhất phụ thuộc vào việc bạn chỉ cần LLM văn bản hay một ngăn xếp rộng hơn gồm văn bản, hình ảnh, âm thanh và video. Đánh giá từng trình tổng hợp dựa trên ID mô hình đang hoạt động, khả năng tương thích điểm cuối, khả năng quan sát sử dụng, hỗ trợ fallback, tính minh bạch về thanh toán và độ mới của catalog. CometAPI đáng để đưa vào danh sách rút gọn khi ưu tiên là một khóa và một quy trình thanh toán cho nhiều phương thức.
Những mô hình tháng 8/2026 nào thực sự đang hoạt động trên CometAPI?
Tính đến ngày 1 tháng 9, Changelog tháng 8 ghi nhận 15 ID mô hình mới. Danh sách đầy đủ, định dạng hỗ trợ và ghi chú về giá được tóm tắt trong bảng ở trên. Hãy kiểm tra lại Models Catalog trước khi triển khai vì khả dụng, bí danh và giá có thể thay đổi.
Tôi có thể đổi nhà cung cấp mà không cần thay cả SDK không?
Thường là có, nhưng không phải lúc nào cũng vậy. Nhiều mô hình văn bản hỗ trợ /v1/chat/completions, trong khi Gemini cũng có thể dùng tuyến tạo nội dung gốc và các mô hình media dùng điểm cuối hình ảnh, realtime hoặc video. CometAPI giữ một khóa và một quy trình thanh toán trên các định dạng này, nên việc đổi nhà cung cấp đơn giản hơn ngay cả khi phần thân yêu cầu không hoàn toàn giống nhau.
Tạo video hoạt động như thế nào?
Tạo video là bất đồng bộ. Tạo tác vụ, lưu ID tác vụ trả về, sau đó thăm dò hoặc nhận webhook cho đến khi tác vụ thành công hoặc thất bại. Chỉ sau khi hoàn tất, ứng dụng mới nên truy xuất và lưu kết quả.
Bao lâu nên kiểm tra lại ID mô hình và giá?
Kiểm tra trước khi tích hợp, trước khi triển khai sản xuất và trước bất kỳ lô lớn nào. Hệ thống tự động cũng nên ghi nhật ký chính xác ID mô hình và ảnh chụp giá được dùng cho mỗi ước tính chi phí để những thay đổi sau này trong catalog không ghi lại lịch sử quyết định triển khai.
Kết luận
15 bổ sung trong tháng 8 của CometAPI mở rộng các lựa chọn thực tế cho lập trình, thị giác, hình ảnh và video, đồng thời giữ một khóa và một quy trình thanh toán. Bắt đầu với Seedance 2.5, Wan3.0, GLM 5.3 Flash hoặc Gemini 3.7 Flash tùy khối lượng công việc, rồi nâng mô hình lên sản xuất chỉ sau khi các bài test prompt cố định đo lường chất lượng, độ trễ, độ tin cậy và chi phí tính phí.
