
AUTO
CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.
Choose your path
Choose your path
Tìm kiếm và so sánh các mô hình văn bản, hình ảnh, video và âm thanh từ các nhà cung cấp hàng đầu. Xem tính năng và giá cả, sau đó tích hợp chỉ với một API key.

CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.

Khám phá API của MiniMax-M3.1-Flash-Preview.

MiMo-V2.6-Pro-UltraSpeed là phiên bản phục vụ độ trễ thấp của MiMo-V2.6-Pro của Xiaomi, được thiết kế cho các ứng dụng trong đó khả năng suy luận của mẫu Pro cần được kết hợp với tốc độ tạo đầu ra nhanh hơn đáng kể.

GPT-6 Sol (gpt-6-sol) là một mô hình suy luận GPT-6 của OpenAI, được thiết kế cho lập trình phức tạp, các quy trình tác nhân và công việc tri thức đòi hỏi cao. OpenAI mô tả nó là một mô hình phục vụ lập trình phức tạp và các quy trình tác nhân, với khả năng suy luận thích ứng, xử lý ngữ cảnh dài, đầu vào hình ảnh và khả năng truy cập một bộ công cụ đa dạng thông qua Responses API.

GPT-6 Luna (gpt-6-luna) là mô hình GPT-6 hiệu quả của OpenAI dành cho các tác vụ tập trung và khối lượng lớn. OpenAI định vị Luna thấp hơn GPT-6 Sol trong họ GPT-6, nhấn mạnh tính hiệu quả, tính tái lập và việc sử dụng trong sản xuất nhạy cảm về chi phí.

MiMo-V2.6-Flash là mô hình tập trung vào hiệu quả trong dòng MiMo-V2.6 của Xiaomi. Đây là một mô hình suy luận đa phương thức gốc, được thiết kế cho các lượt gọi tần suất cao, khối lượng công việc quy mô lớn, lập trình, tự động hóa và các tác vụ tác nhân dài hạn.

MiMo-V2.6-Pro là mô hình suy luận chủ lực của Xiaomi MiMo trong dòng MiMo-V2.6. Đây là một mô hình toàn mô thức nguyên sinh được thiết kế cho các công việc phức tạp, dài hạn trong các lĩnh vực như kỹ thuật phần mềm, nghiên cứu, an ninh mạng, quy trình dựa trên tác nhân, phân tích đa phương thức và sáng tạo nội dung.

Hy-Image 3.5 Preview (hy-image-v3.5-preview) là mô hình tạo ảnh chuyên nghiệp của Tencent Hunyuan, tập trung vào tạo ảnh từ văn bản, tạo ảnh dựa trên tham chiếu và chỉnh sửa hình ảnh đa vòng.

Grok Build 0.1 là mô hình chuyên biệt của xAI dành cho lập trình hướng tác nhân và kỹ thuật phần mềm.

Claude Opus 5.5 được phát hành vào ngày 22 tháng 9 năm 2026 và được thiết kế cho lập trình tác nhân tự chủ chạy lâu và công việc tri thức.

Trí tuệ thế hệ mới cho các tác nhân hoạt động lâu dài

MiniMax H3 Max là một biến thể cao cấp của dòng H3 tạo video của MiniMax. Các tích hợp H3 Max được tài liệu hóa hỗ trợ tạo video từ văn bản và từ hình ảnh. Các tài liệu chính thức về H3 của MiniMax mô tả hệ thống H3 tổng thể là một mô hình video đa phương thức toàn diện với âm thanh stereo gốc.

Sắp ra mắt

Grok 4.7 là mô hình tiên phong của SpaceXAI dành cho lập trình, các tác vụ agentic và công việc tri thức. Nó kế nhiệm Grok 4.6 và sử dụng một mô hình cơ sở lớn hơn cùng với quá trình huấn luyện bằng học tăng cường dài hơn, tập trung vào các tác vụ khó, kéo dài nhiều giờ.

Claude Opus 5.2 có thể đang được thử nghiệm giới hạn trên Claude Code. Dưới đây là những gì các nguồn rò rỉ cho biết, những gì vẫn chưa được xác minh, và cách truy cập CometAPI sẽ hoạt động sau khi phát hành.

Khám phá API của Gemini 4 Pro.

Bản phát hành Grok 4.20 giới thiệu kiến trúc đa tác nhân (nhiều tác nhân chuyên biệt được điều phối theo thời gian thực), các chế độ ngữ cảnh được mở rộng, và các cải tiến tập trung vào khả năng tuân thủ hướng dẫn, giảm ảo giác, cùng đầu ra có cấu trúc/được hỗ trợ công cụ.

GPT-6 Astra, mô hình chủ lực dành cho suy luận phức tạp và lập trình. Hãy chọn GPT-5.6 Terra để cân bằng giữa năng lực và chi phí,

Tạo video từ prompt văn bản, làm động ảnh tĩnh hoặc chỉnh sửa video hiện có bằng ngôn ngữ tự nhiên. API hỗ trợ cấu hình thời lượng, tỷ lệ khung hình và độ phân giải cho các video được tạo — với SDK tự động xử lý việc thăm dò bất đồng bộ.

Khám phá API của Jev.

Từ xác minh nhanh đến đầu ra mang chất điện ảnh, phí được tính dựa trên thời lượng video được tạo, lựa chọn độ phân giải phù hợp, và biến mỗi lượt tạo thành một quy tắc hoạt động về đầu tư sáng tạo có kế hoạch

Grok Imagine Image 2.0, mô hình AI tạo sinh và chỉnh sửa hình ảnh đã được nâng cấp

GLM-5.3-FlashX is Z.ai's high-speed API serving variant of GLM-5.3-Flash, designed for applications where model capability needs to be paired with lower response latency and high generation throughput.

GPT Image 2 là mô hình tạo sinh hình ảnh tối tân của openai, cho phép tạo sinh và chỉnh sửa hình ảnh nhanh, chất lượng cao. Nó hỗ trợ các kích thước hình ảnh linh hoạt và đầu vào hình ảnh có độ trung thực cao.

Qwen3.8-Omni-Flash (qwen3.8-omni-flash) là mô hình toàn phương thức gốc của Alibaba Cloud dành cho việc hiểu âm thanh/video và phân tích nội dung đa phương thức.

GLM-5.3-Flash là mô hình đa phương thức nguyên sinh đầu tiên trong dòng GLM-5, mang lại năng lực trí tuệ mạnh hơn so với GLM-5.2 đồng thời duy trì một kiến trúc cực kỳ hiệu quả về chi phí.

minimax-h3 là một mô hình tạo video mới, được thiết kế cho sản xuất sáng tạo chất lượng cao. Mô hình cung cấp khả năng hiểu prompt được cải thiện, độ nhất quán hình ảnh cao hơn, chuyển động mượt mà hơn và khả năng kiểm soát bằng ảnh tham chiếu linh hoạt hơn, phục vụ các quy trình tạo video mang tính điện ảnh.

Tạo hình ảnh từ lời nhắc văn bản với các mô hình Grok Imagine. API hỗ trợ tạo theo lô nhiều hình ảnh và kiểm soát tỷ lệ khung hình và độ phân giải.

Gemini 3.8 Flash là mô hình Gemini dạng nhẹ thế hệ mới, với mục tiêu đạt được sự cân bằng tốt hơn giữa tốc độ, chi phí và khả năng lập trình.

FLUX 3 - Mô hình thế giới thực: Hướng tới các mô hình dòng đa phương thức như xương sống của trí thông minh thị giác.

Minimax-m3 là một mô hình AI đa phương thức được thiết kế cho khả năng suy luận mạnh mẽ, đối thoại tự nhiên và tạo nội dung sáng tạo. Nó mang lại hiệu năng cân bằng trên các tác vụ hiểu văn bản và hình ảnh, khiến nó phù hợp cho các ứng dụng AI mục đích chung.

MiniMax-M2.7 cung cấp cùng mức độ thông minh hàng đầu như phiên bản tiêu chuẩn—bao gồm tự tiến hóa đệ quy và năng suất làm việc văn phòng ở cấp độ chuyên gia—nhưng được thiết kế cho các ứng dụng yêu cầu độ trễ dưới một giây và tốc độ sinh token cao. Tận dụng kiến trúc xương sống suy luận được tăng cường, tốc độ đầu ra của nó nhanh hơn 66% so với mô hình tiêu chuẩn (đạt 100 tps). Đây là lựa chọn ưu tiên cho các trợ lý lập trình tương tác, việc thực thi vòng lặp tác tử theo thời gian thực và các quy trình doanh nghiệp thông lượng cao với yêu cầu nghiêm ngặt về thời gian hoàn tất.