Thông số kỹ thuật của Grok 4.6
| Mục | Grok 4.6 |
|---|---|
| Nhà cung cấp | xAI |
| ID mô hình | grok-4.6 |
| Loại mô hình | Mô hình suy luận đa phương thức tuyến đầu và tác nhân |
| Thế mạnh chính | Tác nhân chạy dài, lập trình, công việc tri thức, xây dựng ứng dụng tương tác/thị giác |
| Phương thức đầu vào | Văn bản và hình ảnh |
| Phương thức đầu ra | Văn bản |
| Cửa sổ ngữ cảnh | 500,000 token |
| Mốc kiến thức | 1 tháng 2, 2026 |
| Giới hạn đầu ra | Không có giới hạn đầu ra văn bản được xAI công bố |
| Suy luận | low, medium, high (mặc định), xhigh |
| API | Responses API, Chat Completions |
| Công cụ | Gọi hàm, tìm kiếm web, X search, thực thi mã |
| Giá API | $2 / 1M token đầu vào; $6 / 1M token đầu ra |
| Biến thể nhanh | Có sẵn với mức giá gấp 2× tiêu chuẩn |
| Ngày phát hành | 12 tháng 8, 2026 |
Grok 4.6 là gì?
Grok 4.6 là mô hình tuyến đầu mới nhất của xAI tập trung vào trí tuệ tác nhân.
Khác biệt so với chatbot truyền thống là quan trọng.
xAI nhấn mạnh khả năng của mô hình trong việc bám trụ các dự án phức tạp lâu hơn, làm việc trên nhiều codebase, nghiên cứu các chủ đề chưa quen thuộc, xây dựng ứng dụng và tự kiểm chứng kết quả của mình.
Điều này khiến Grok 4.6 đặc biệt phù hợp với thị trường tác nhân lập trình AI và tác nhân tự động đang mở rộng nhanh chóng.
Tính năng chính của Grok 4.6
- Thực thi tác nhân chạy dài: Grok 4.6 được huấn luyện để duy trì công việc phức tạp qua nhiều bước thay vì chỉ tối ưu cho trả lời một lượt.
- Lập trình mang tính tác nhân: Nhắm tới kỹ nghệ phần mềm cấp kho mã, sinh mã, gỡ lỗi, kiểm thử lặp và môi trường lập trình chuyên biệt theo miền.
- Nghiên cứu công việc tri thức: Mô hình có thể nghiên cứu lĩnh vực chưa quen thuộc, tổ chức thông tin, suy luận qua yêu cầu phức tạp và chuyển phát hiện thành sản phẩm cụ thể.
- Xây dựng ứng dụng trực quan và tương tác: xAI báo cáo kết quả lượt đầu mạnh hơn cho các dự án trực quan và tương tác, gồm chuyển ý tưởng sản phẩm thành ứng dụng hoạt động và tinh chỉnh qua vòng phản hồi.
- Tự kiểm thử và tự xác minh: Trên các hành trình dài, xAI quan sát nhiều hành vi mô hình tự kiểm tra công việc trước khi tiếp tục.
- Sử dụng công cụ nguyên bản: Grok 4.6 hỗ trợ gọi hàm, tìm kiếm web, X search và thực thi mã qua API.
- Suy luận có thể cấu hình: Nhà phát triển có thể chọn mức nỗ lực suy luận
low,medium,highhoặcxhigh, giúp mô hình thích ứng với tải công việc nhạy độ trễ và suy luận sâu.
Hiệu năng benchmark của Grok 4.6
xAI cho biết Grok 4.6 ngang bằng GPT-5.6 Sol trên Artificial Analysis Intelligence Index, một chỉ số tổng hợp của chín benchmark. Các kết quả công bố mạnh nhất gồm:
| Benchmark | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
Những con số này đến từ thông báo ra mắt ngày 12 tháng 8 của xAI. xAI lưu ý rằng số liệu từ bên thứ ba được lấy từ thẻ hệ thống nhà phát triển hoặc bảng xếp hạng benchmark công khai, nên kết quả so sánh giữa các mô hình cần được diễn giải cùng phương pháp đánh giá và thiết lập mô hình.
Grok 4.6 so với Grok 4.5, GPT-5.6 Sol và Claude Fable 5
| Mô hình | Định vị chính | Ngữ cảnh | AA Intelligence | Hồ sơ mã hóa/tác nhân |
|---|---|---|---|---|
| Grok 4.6 | Tác nhân chạy dài, lập trình, công việc tri thức | 500K | 61 | Mạnh về lập trình mang tính tác nhân và quy trình dự án tương tác |
| Grok 4.5 | Mô hình tổng quát tuyến đầu và lập trình nhanh | 500K | 56 | Nền tảng mạnh cho lập trình và luồng tác nhân |
| GPT-5.6 Sol | Suy luận tổng quát tuyến đầu và tác nhân | Ngữ cảnh của đối thủ công bố thay đổi theo triển khai | 61 | Mạnh ở DeepSWE và Terminal-Bench |
| Claude Fable 5 | Công việc tri thức tuyến đầu và lập trình | Ngữ cảnh của đối thủ công bố thay đổi theo triển khai | 62 | Rất mạnh ở CursorBench, FrontierCode, APEX-SWE |
Grok 4.6 hấp dẫn nhất khi tải công việc cần thực thi liên tục thay vì một phản hồi chất lượng cao duy nhất. Đặc biệt phù hợp cho nhà phát triển xây dựng tác nhân lặp lại việc nghiên cứu, gọi công cụ, chỉnh sửa mã, kiểm thử kết quả và tiếp tục từ ngữ cảnh tích lũy. Claude Fable 5 vẫn có lợi thế trên một số benchmark lập trình và tác nhân đã công bố, trong khi GPT-5.6 Sol dẫn trước Grok 4.6 ở DeepSWE và Terminal-Bench theo so sánh của xAI.
Hạn chế và lưu ý
- Kết quả benchmark phụ thuộc nhiệm vụ: Grok 4.6 không phải luôn là mô hình điểm cao nhất. Kết quả công bố cho thấy điểm mạnh và điểm yếu rõ ràng trên các đánh giá tác nhân khác nhau.
- Tải công việc chạy dài có thể tiêu tốn nhiều token: Cửa sổ ngữ cảnh lớn và việc dùng công cụ lặp có thể tăng tổng mức tiêu thụ suy luận ngay cả khi giá theo token cạnh tranh.
- Cấu hình công cụ là quan trọng: Tìm kiếm web, X search, thực thi mã và gọi hàm yêu cầu kiến trúc ứng dụng có thể xử lý an toàn quyền công cụ và dữ liệu trả về.
- Mốc kiến thức: Mốc tài liệu là 1 tháng 2, 2026. Với thông tin mới hơn, nhà phát triển nên dùng công cụ truy hồi hoặc tìm kiếm web thích hợp thay vì dựa vào kiến thức tĩnh của mô hình.
- Bộ nhớ đệm cần cấu hình có chủ đích: xAI khuyến nghị
prompt_cache_keycho Responses API vàx-grok-conv-idcho Chat Completions để cải thiện độ tin cậy trúng bộ nhớ đệm.
Trường hợp sử dụng Grok 4.6
- Tác nhân lập trình tự chủ — phân tích kho mã, hiện thực, gỡ lỗi, kiểm thử và sửa lỗi lặp.
- Dựng mẫu sản phẩm — chuyển yêu cầu sản phẩm tổng quát thành ứng dụng tương tác hoạt động.
- Tác nhân nghiên cứu kỹ thuật — nghiên cứu các miền kỹ thuật chưa quen và tạo deliverable có cấu trúc.
- Trợ lý đồng hành cho nhà phát triển — sinh mã, rà soát, gỡ lỗi và quy trình phát triển nhiều bước.
- Tự động hóa công việc tri thức — phân tích tài liệu, tổng hợp thông tin, lập kế hoạch và tạo đầu ra có cấu trúc.
- Trợ lý dùng công cụ — ứng dụng kết hợp suy luận của mô hình với tìm kiếm web, X search, thực thi mã và các lệnh gọi hàm tùy chỉnh.
Cách truy cập API Grok 4.6
Với các ứng dụng đã sử dụng lớp API hợp nhất của CometAPI, hãy dùng ID mô hình Grok 4.6 do CometAPI cung cấp và tuân theo endpoint/lược đồ hiện tại trong tài liệu API của CometAPI. Điều này có thể giảm khối lượng tích hợp theo nhà cung cấp khi ứng dụng cần chuyển đổi giữa các LLM tuyến đầu.
Quy trình điển hình:
- Tạo hoặc đăng nhập tài khoản CometAPI.
- Tạo token API trong bảng điều khiển CometAPI.
- Chọn endpoint mô hình
grok-4.6. - Gửi yêu cầu qua endpoint của CometAPI bằng lược đồ yêu cầu được tài liệu hóa cho mô hình.
- Xử lý văn bản trả về, lệnh gọi công cụ hoặc đầu ra có cấu trúc trong ứng dụng của bạn.