DeepSeek Vision and Grok Imagine models are now live on CometAPI →
Qwen3.8-Max
Aliyun
Q
Thế hệ Text

Qwen3.8-Max

qwen3.8-max
Mô hình Texttext-to-textimage-to-textpdf-to-textvideo-to-text

Qwen3.8-Max là mô hình ngôn ngữ lớn chủ lực của Alibaba Qwen, được thiết kế cho suy luận nâng cao, các quy trình tác tử, hiểu đa phương thức và các ứng dụng AI quy mô doanh nghiệp. Nó có 2.4T tham số, áp dụng kiến trúc MoE, hỗ trợ chuyển đổi giữa chế độ tư duy và chế độ suy luận nhanh, có thể xử lý nhiều định dạng nội dung, và thể hiện xuất sắc trong các bối cảnh như kỹ thuật lập trình, công việc văn phòng chuyên nghiệp và suy luận logic phức tạp, chỉ xếp sau Fable 5 của Anthropic.

Từ
$1.6/1M tokens
Xem mô hình
Happy Horse 1.1
Aliyun
Phổ biến
Q
Thế hệ Video

Happy Horse 1.1

happyhorse-1.1
Mô hình VideoPhổ biếntext-to-videoimage-to-video

HappyHorse 1.1 là một mô hình tạo video đa phương thức, được thiết kế cho sáng tạo nội dung chuyên nghiệp, quảng cáo, phim ngắn, sản xuất nội dung cho mạng xã hội và kể chuyện. Nó mở rộng các khả năng của HappyHorse 1.0 — vốn đã thu hút sự chú ý đáng kể sau khi xếp hạng cao trong các đánh giá độc lập về tạo video — với tính nhất quán giữa các cảnh mạnh hơn và độ trung thực hình ảnh được cải thiện.

Từ
$0.112/s
Xem mô hình
Happy Horse 1.0
Aliyun
Q
Thế hệ Video

Happy Horse 1.0

happyhorse-1.0
Mô hình Videotext-to-videoimage-to-video

Happy Horse 1.0 — Một mô hình tạo sinh âm thanh–hình ảnh chất lượng cao, hỗ trợ tạo video từ văn bản và từ hình ảnh. Hệ thống có thể tạo phần hình ảnh, âm thanh và khẩu hình được đồng bộ, phù hợp cho phim ngắn, ấn phẩm quảng cáo và video giới thiệu sản phẩm.

Từ
$0.112/s
Xem mô hình
Qwen3.7 Plus
Aliyun
Q
Thế hệ Text

Qwen3.7 Plus

qwen3.7-plus
Mô hình Texttext-to-text

Qwen3.7 Plus là một mô hình ngôn ngữ lớn hiệu suất cao do Alibaba Cloud phát triển. Mô hình hỗ trợ hiểu ngữ cảnh dài tối đa 128K token, gọi hàm và các tác vụ đa ngôn ngữ. Được thiết kế cho các kịch bản suy luận phức tạp, lập trình và làm theo hướng dẫn.

Từ
$0.32/1M tokens
Xem mô hình
Qwen3.7-Max
Aliyun
Q
Thế hệ Text

Qwen3.7-Max

qwen3.7-max
Mô hình Texttext-to-text

Thế mạnh cốt lõi của Qwen3.7-Max nằm ở bề rộng lẫn chiều sâu trong các năng lực tác tử của nó. Trong lập trình, nó xử lý mọi thứ từ lập mẫu front-end đến các dự án kỹ thuật phức tạp gồm nhiều tệp. Đối với công việc văn phòng và năng suất làm việc, nó cho phép tự động hóa quy trình làm việc thông qua tích hợp MCP và cộng tác đa tác tử. Trong quá trình thực thi tự động dài hạn, nó duy trì được lập luận nhất quán xuyên suốt một thử nghiệm tối ưu hóa kernel hoàn toàn tự động kéo dài 35 giờ, liên quan đến hơn 1,000 lần gọi công cụ — thuyết phục cho thấy khả năng thực thi bền bỉ, ổn định. Hơn nữa, nó mang lại khả năng khái quát hóa mạnh mẽ và nhất quán giữa nhiều framework, vận hành đáng tin cậy dù được triển khai trong Claude Code, OpenClaw, Qwen Code hoặc các framework khác.

Từ
$2/1M tokens
Xem mô hình
Q

Wan2.7

Aliyun
Q
Thế hệ Video

Wan2.7

wan2.7
Mô hình Videotext-to-videoimage-to-video

Wan2.7 là một mô hình tạo video được thiết kế để tổng hợp hình ảnh chất lượng cao và nâng cao độ nhất quán chuyển động. Nó phù hợp cho việc sáng tạo nội dung điện ảnh và các quy trình làm việc sản xuất video chuyên nghiệp.

Từ
$0.08/s
Xem mô hình
Q

Wan2.6

Aliyun
Q
Thế hệ Video

Wan2.6

wan2.6
Mô hình Videoimage-to-videotext-to-video

Wan2.6 là một mô hình tạo video được thiết kế nhằm mang lại quá trình tổng hợp video ổn định và hiệu quả. Nó cung cấp chất lượng hình ảnh đáng tin cậy cùng khả năng tạo chuyển động mượt mà cho các nhiệm vụ tạo video nói chung.

Từ
$0.08/s
Xem mô hình
Qwen3.6-Plus
Aliyun
Q
Thế hệ Text

Qwen3.6-Plus

qwen3.6-plus
Mô hình Texttext-to-text

Qwen 3.6-Plus hiện đã ra mắt, với khả năng phát triển mã được nâng cấp và hiệu suất nhận dạng, suy luận đa phương thức được cải thiện, giúp trải nghiệm Vibe Coding còn tốt hơn nữa.

Từ
$0.4/1M tokens
Xem mô hình
Q

Qwen Image

Aliyun
Q
Thế hệ Image

Qwen Image

qwen-image
Mô hình Imagetext-to-image

Qwen-Image là một mô hình nền tảng tạo sinh hình ảnh mang tính cách mạng, được phát hành vào năm 2025 bởi đội ngũ Tongyi Qianwen của Alibaba. Với quy mô tham số 20 tỷ, nó dựa trên kiến trúc MMDiT (Multimodal Diffusion Transformer). Mô hình đã đạt được những bước đột phá đáng kể trong kết xuất văn bản phức tạp và chỉnh sửa hình ảnh chính xác, cho thấy hiệu năng vượt trội, đặc biệt trong kết xuất văn bản tiếng Trung. Được dịch bằng DeepL.com (phiên bản miễn phí)

Từ
$0.028/request
Xem mô hình
Q

qwen-image-2

Aliyun
Sắp ra mắt
Q
Thế hệ Image

qwen-image-2

qwen-image-2
Mô hình ImageSắp ra mắttext-to-image

qwen-image-2 sắp ra mắt

Từ
Sắp ra mắt
Xem mô hình
Q

qwen3-vl-30b-a3b

Aliyun
Q
Thế hệ Text

qwen3-vl-30b-a3b

qwen3-vl-30b-a3b
Mô hình Texttext-to-textNgữ cảnh 2M

Qwen3-VL-30B-A3B là một mô hình AI đa phương thức tối tân thuộc gia đình Qwen3 AI, được phát triển bởi đội ngũ Qwen của Alibaba. Mô hình này được thiết kế để hợp nhất khả năng hiểu ngôn ngữ và nhận thức thị giác — bao gồm văn bản, hình ảnh và video — trong một mô hình nền tảng duy nhất.

Từ
$0.12/1M tokens
Xem mô hình
Q

qwen3-vl-32b

Aliyun
Q
Thế hệ Text

qwen3-vl-32b

qwen3-vl-32b
Mô hình Texttext-to-text

Qwen3-VL-32B là biến thể dense với 32 tỷ tham số trong họ mô hình thị giác-ngôn ngữ Qwen3 của Alibaba. Đây là một Transformer đa phương thức (thị giác + ngôn ngữ + video) được thiết kế cho nhận thức hợp nhất, suy luận với ngữ cảnh dài, OCR mạnh mẽ và định vị trực quan, cũng như các quy trình làm việc dạng agent/được công cụ hóa.

Từ
$0.24/1M tokens
Xem mô hình
Q

qwen3-vl-235b-a22b

Aliyun
Q
Thế hệ Text

qwen3-vl-235b-a22b

qwen3-vl-235b-a22b
Mô hình Texttext-to-textNgữ cảnh 2M

qwen3-vl-235b-a22b là một mô hình đa phương thức hợp nhất khả năng tạo văn bản mạnh mẽ với khả năng hiểu thị giác cho hình ảnh và video. Biến thể Instruct của nó tối ưu hóa việc tuân theo hướng dẫn cho các tác vụ đa phương thức nói chung. Nó vượt trội trong nhận thức các danh mục thế giới thực/giả lập, định vị không gian 2D/3D và khả năng hiểu thị giác dạng dài, đạt kết quả cạnh tranh trên các bộ điểm chuẩn đa phương thức.

Từ
$0.24/1M tokens
Xem mô hình
Q

qwen3-30b-a3b

Aliyun
Q
Mô hình AI

qwen3-30b-a3b

qwen3-30b-a3b
Mô hình AI

Có 3 tỷ tham số, cân bằng giữa hiệu năng và yêu cầu tài nguyên, phù hợp với các ứng dụng cấp doanh nghiệp. - Mô hình này có thể sử dụng MoE hoặc các kiến trúc tối ưu hóa khác, phù hợp cho các kịch bản cần xử lý hiệu quả các tác vụ phức tạp, chẳng hạn như dịch vụ khách hàng thông minh và tạo nội dung.

Từ
$0.12/1M tokens
Xem mô hình
Q

qwen3-coder-plus

Aliyun
Q
Mô hình AI

qwen3-coder-plus

qwen3-coder-plus
Mô hình AI

Khám phá API của qwen3-coder-plus.

Từ
$0.52/1M tokens
Xem mô hình
Q

qwen3-coder-480b-a35b-instruct

Aliyun
Q
Mô hình AI

qwen3-coder-480b-a35b-instruct

qwen3-coder-480b-a35b-instruct
Mô hình AI

Khám phá API của qwen3-coder-480b-a35b-instruct.

Từ
$0.24/1M tokens
Xem mô hình
Q

qwen3-coder

Aliyun
Q
Mô hình AI

qwen3-coder

qwen3-coder
Mô hình AI

CometAPI’s qwen3-coder is an affordable, OpenAI-compatible coding model API for Qwen3 Coder, optimized for code generation, debugging, and repository-level engineering workflows with ~20% lower pricing.

Từ
$0.24/1M tokens
Xem mô hình
Q

qwen3-235b-a22b

Aliyun
Q
Mô hình AI

qwen3-235b-a22b

qwen3-235b-a22b
Mô hình AIInference,Tool,131.1K

Qwen3-235B-A22B is the flagship model of the Qwen3 series, with 23.5 billion parameters, using a Mixture of Experts (MoE) architecture. - Particularly suitable for complex tasks requiring high-performance Inference, such as coding, mathematics, and Multimodal applications.

Từ
$0.336/1M tokens
Xem mô hình
Qwen-Image-3.0
Aliyun
Sắp ra mắt
Q
Thế hệ Image

Qwen-Image-3.0

qwen-image-3.0
Mô hình ImageSắp ra mắtimage-editingtext-to-image

sắp ra mắt

Từ
Sắp ra mắt
Xem mô hình
Q

Wan3.0

Aliyun
Sắp ra mắt
Q
Thế hệ Video

Wan3.0

wan3.0
Mô hình VideoSắp ra mắttext-to-videoimage-to-video

coming soon

Từ
Sắp ra mắt
Xem mô hình
Q

Qwen3.6-Max-Preview

Aliyun
Sắp ra mắt
Q
Thế hệ Text

Qwen3.6-Max-Preview

qwen3.6-max-preview
Mô hình TextSắp ra mắttext-to-text

Qwen3.6-Max-Preview Compared with Qwen3.6-Plus, this preview version brings stronger world knowledge and instruction compliance capabilities, as well as significantly improved agent programming performance on multiple benchmarks

Từ
Sắp ra mắt
Xem mô hình