
Qwen 3.8 Max có giá $2/M cho đầu vào và $6/M cho đầu ra. So sánh phí bộ nhớ đệm (cache), chi phí công cụ, ví dụ thực tế, giới hạn và lời khuyên chuyển đổi từ Qwen 3.7.

Vào đêm Giao thừa Tết Nguyên đán (16–17 tháng 2, 2026), Alibaba Group phát hành mô hình thế hệ tiếp theo, Qwen 3.5 — một mô hình đa phương thức, hỗ trợ tác nhân, được định vị cho cái mà công ty gọi là kỷ nguyên “agentic AI”. Các tin bài trong ngành nhấn mạnh những tuyên bố về cải thiện đáng kể về hiệu quả và chi phí, cùng sự hỗ trợ nhanh chóng từ các nhà cung cấp phần cứng và đám mây. CometAPI là một lựa chọn dành cho các nhà phát triển muốn truy cập API được lưu trữ hoặc tích hợp tương thích với OpenAI, trong khi AMD công bố hỗ trợ GPU Day-0 cho mô hình này trên dòng Instinct của hãng. ByteDance là một trong những đối thủ nội địa chủ chốt đã phát hành các bản nâng cấp trong khoảng thời gian nghỉ lễ tương tự. OpenAI vẫn là điểm tham chiếu để so sánh trong các điểm chuẩn và phong cách tích hợp.

Qwen3.5 mới của Alibaba là một bước tiến lớn — nó thu hẹp khoảng cách với, và trong một số tác vụ tác tử / đa phương thức tuyên bố đạt mức tương đương hoặc có lợi thế so với, một số mô hình tiên phong mã nguồn đóng trên một số benchmark công khai và kiểm thử nội bộ. Tuy nhiên, “vượt trội” còn phụ thuộc vào tác vụ: ở mảng sử dụng công cụ theo kiểu tác tử, hiểu tài liệu/video đa phương thức, và chi phí cho mỗi lần suy luận, Qwen3.5 được báo cáo là cực kỳ cạnh tranh (và trong một số biểu đồ của nhà cung cấp còn dẫn trước). Điểm rút ra thực tiễn: Qwen3.5 dường như là một đối thủ tuyến đầu thực sự vào đầu năm 2026 — đối với nhiều trường hợp sử dụng doanh nghiệp theo kiểu tác tử và đa phương thức, nay đã khả thi như một lựa chọn chính.
Qwen3-Max-Thinking của Alibaba — biến thể “thinking” trong đại gia đình Qwen3 — đã trở thành một trong những câu chuyện nổi bật nhất trong lĩnh vực AI năm nay: một mô hình đầu bảng với hơn một nghìn tỷ tham số, được tinh chỉnh cho lập luận sâu, hiểu ngữ cảnh dài và các quy trình tác tử. Tóm lại, đây là động thái của nhà cung cấp nhằm mang đến cho các ứng dụng một chế độ tư duy “System-2” chậm hơn, dễ truy vết hơn: mô hình không chỉ trả lời mà còn có thể hiển thị (và sử dụng) các bước, công cụ và các kiểm tra trung gian theo cách có kiểm soát.

Nhóm Qwen của Alibaba đã phát hành Qwen3-Max-Preview (Hướng dẫn) — mô hình lớn nhất của công ty cho đến nay, với hơn 1 nghìn tỷ tham số — và đã tạo ra nó

Qwen3-Max-Preview là mô hình xem trước chủ lực mới nhất của Alibaba trong dòng sản phẩm Qwen3 — một mô hình theo phong cách Hỗn hợp Chuyên gia (MoE) với hơn một nghìn tỷ tham số, cùng cửa sổ ngữ cảnh mã thông báo siêu dài 262k, được phát hành dưới dạng xem trước cho doanh nghiệp/đám mây. Mô hình này hướng đến *lý luận sâu sắc, hiểu tài liệu dài, mã hóa và quy trình làm việc của tác nhân.

Tiến bộ mới nhất của Alibaba trong lĩnh vực trí tuệ nhân tạo, Qwen3-Coder, đánh dấu một cột mốc quan trọng trong bối cảnh phát triển nhanh chóng của phần mềm do AI điều khiển

API Qwen3-Coder là API tạo và hoàn thiện mã dựa trên mô hình ngôn ngữ Qwen3 của Alibaba, được tối ưu hóa cho các tác vụ phát triển phần mềm như viết, hiểu và gỡ lỗi mã trên nhiều ngôn ngữ lập trình.