Thông số kỹ thuật của Grok 4.7
| Thông số | Grok 4.7 |
|---|---|
| Nhà cung cấp | xAI / SpaceXAI |
| ID mô hình | grok-4.7 |
| Ngày phát hành | 21 tháng 9, 2026 |
| Trọng tâm chính | Lập trình, tác vụ agentic, công việc tri thức |
| Phương thức đầu vào | Văn bản, hình ảnh |
| Phương thức đầu ra | Văn bản |
| Cửa sổ ngữ cảnh | 500,000 tokens |
| Giới hạn đầu ra | xAI không nêu giới hạn đầu ra văn bản |
| Mức độ suy luận | low, medium, high, xhigh; mặc định là high |
| API | Responses API, Chat Completions |
| Công cụ | Function calling, web search, X search, code execution |
| Mốc tri thức | Tháng 5 năm 2026 |
| Batch API | Không được hỗ trợ |
Grok 4.7 là mô hình tiên phong của xAI dành cho lập trình, tác vụ agentic và công việc tri thức. ID mô hình chính thức của API là grok-4.7. xAI công bố cửa sổ ngữ cảnh 500K token, đầu vào văn bản và hình ảnh với đầu ra văn bản, điều khiển mức độ suy luận và hỗ trợ cả Responses API lẫn Chat Completions.
Grok 4.7 là gì?
Grok 4.7 là mô hình xAI mới phát hành ngày 21 tháng 9, 2026, được định vị cho lập trình dài hơi, quy trình làm việc có tác tử và công việc tri thức chuyên nghiệp. xAI cho biết mô hình này dùng base model lớn hơn Grok 4.6 và có giai đoạn RL dài hơn, tập trung vào các tác vụ có thể kéo dài hàng giờ. Mô hình cũng được huấn luyện để hiểu Grok Bot harness một cách tự nhiên, nhấn mạnh khả năng tự kiểm tra và quản lý ngữ cảnh dài hơn.
Với nhà phát triển, thay đổi quan trọng không chỉ là điểm benchmark cao hơn. Grok 4.7 kết hợp cửa sổ ngữ cảnh 500K, điều khiển suy luận qua reasoning_effort, hỗ trợ công cụ và đầu vào đa phương thức trong một mô hình hướng tới các vòng lặp agent kéo dài.
Tính năng chính của Grok 4.7
- 500K token context: Cửa sổ ngữ cảnh lớn được thiết kế cho kho mã lớn, phiên agent kéo dài, tài liệu kỹ thuật dung lượng lớn và các tác vụ công việc tri thức nhiều bước.
- Configurable reasoning: Nhà phát triển có thể chọn mức
low,medium,highhoặcxhigh, mặc định làhigh. Điều này cho phép điều chỉnh phân bổ tài nguyên tính toán theo độ phức tạp của tác vụ. - Coding and agentic optimization: xAI định vị Grok 4.7 chuyên cho kỹ nghệ phần mềm, tác vụ agentic và quy trình làm việc chuyên nghiệp kéo dài.
- Multimodal input: API chấp nhận đầu vào văn bản và hình ảnh, xuất ra văn bản, phù hợp cho phân tích ảnh chụp màn hình, gỡ lỗi trực quan và quy trình hiểu tài liệu.
- Native tool support: Tập khả năng đã được công bố gồm function calling, web search, X search và code execution.
- Long-horizon reliability focus: xAI báo cáo cải thiện khả năng tự xác minh và quản lý ngữ cảnh dài so với Grok 4.6, phản ánh trọng tâm vào các tác vụ nhiều giờ. citeturn0search0
Hiệu năng trên các benchmark của Grok 4.7
Báo cáo đánh giá khi ra mắt của xAI đưa ra các kết quả sau. Đây là số đo benchmark do nhà cung cấp báo cáo, nên cần được diễn giải trong bối cảnh phương pháp và cấu hình của từng benchmark thay vì xem như bảng xếp hạng phổ quát.
| Benchmark | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 |
|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% |
*Báo cáo DeepSWE của Grok 4.7 sử dụng mức high. Bảng của xAI liệt kê các số đo này như một phần của so sánh khi ra mắt.
Hồ sơ benchmark phụ thuộc vào tác vụ. Grok 4.7 cho thấy mức tăng đáng kể so với Grok 4.6 trên các đánh giá về lập trình, terminal, pháp lý, lâm sàng và kỹ thuật điện được báo cáo, trong khi cùng bảng cũng cho thấy các mô hình tiên phong khác dẫn trước ở một số benchmark. Vì vậy việc chọn benchmark rất quan trọng khi đánh giá Grok 4.7 cho một khối lượng công việc cụ thể.
So sánh Grok 4.7 với Grok 4.6 và GPT-5.6 Sol
| Khía cạnh | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol |
|---|---|---|---|
| Ngữ cảnh | 500K | 500K | Xem thông số của nhà cung cấp |
| Định vị cốt lõi | Lập trình, agent, công việc tri thức | Lập trình, agent, công việc tri thức | Lý luận tổng quát tiên phong |
| Điều khiển suy luận | Low / medium / high / xhigh | Low / medium / high / xhigh | Phụ thuộc nhà cung cấp |
| Đầu vào | Văn bản + hình ảnh | Văn bản + hình ảnh | Phụ thuộc nhà cung cấp |
| Hỗ trợ công cụ | Function calling, web search, X search, code execution | Quy trình định hướng công cụ tương tự | Phụ thuộc nhà cung cấp |
| Benchmark lập trình do xAI trích dẫn | 46.3% CursorBench 4.0 | 40.4% | 41.7% |
Grok 4.7 và Grok 4.6 cùng thuộc lớp ngữ cảnh 500K và có các tùy chọn mức độ suy luận giống nhau, nhưng xAI báo cáo Grok 4.7 cải thiện kết quả trên bộ benchmark khi ra mắt. So với GPT-5.6 Sol, khác biệt thực tế phụ thuộc vào khối lượng công việc: bảng do xAI công bố cho thấy hiệu năng tương đối khác nhau giữa các tác vụ lập trình, văn phòng, terminal, pháp lý, lâm sàng và kỹ thuật điện.
Hạn chế và lưu ý triển khai
Grok 4.7 có cửa sổ ngữ cảnh lớn, nhưng ngữ cảnh lớn hơn không đảm bảo kết quả tốt hơn cho mọi tài liệu dài hay quy trình agent. Các ứng dụng chạy dài vẫn nên quản lý ngữ cảnh cẩn trọng, đặc biệt khi hội thoại tích lũy đầu ra công cụ. xAI khuyến nghị định tuyến prompt-cache và nén ngữ cảnh cho các vòng lặp agent dài.
Theo tài liệu mô hình hiện tại, không có hỗ trợ Batch API công khai. Do đó, nhà phát triển xây dựng khối lượng công việc dạng batch cần dùng các mẫu API đồng bộ được hỗ trợ hoặc con đường triển khai khác.
Kết quả benchmark do nhà cung cấp báo cáo và thay đổi theo cấu hình benchmark và mức độ suy luận. Chúng nên được xem như bằng chứng theo tác vụ thay vì một thước đo duy nhất về chất lượng mô hình.
Trường hợp sử dụng tiêu biểu
- Lập trình ở quy mô kho mã: Phân tích các codebase lớn, triển khai thay đổi trên nhiều tệp, gỡ lỗi thất bại và suy luận qua lịch sử issue dài.
- Kỹ nghệ phần mềm theo tác tử: Kết hợp suy luận với function calling, thực thi mã và công cụ bên ngoài cho quy trình kỹ thuật nhiều bước.
- Phân tích tài liệu kỹ thuật: Xử lý đặc tả dài, tài liệu kiến trúc, tư liệu nghiên cứu hoặc hồ sơ dự án trong ngữ cảnh 500K token.
- Gỡ lỗi trực quan: Phân tích ảnh chụp màn hình, sơ đồ và đầu vào hình ảnh khác cùng với ngữ cảnh kỹ thuật dạng văn bản.
- Công việc tri thức chuyên nghiệp: Soạn thảo, phân tích và chỉnh sửa tài liệu hoặc sản phẩm có cấu trúc cần suy luận nhiều bước.
- Quy trình nghiên cứu và thông tin: Dùng web search và X search khi cần thông tin bên ngoài hiện thời và ứng dụng cho phép công cụ.
Cách truy cập API Grok 4.7 qua CometAPI
CometAPI hiện có trang mô hình riêng cho Grok 4.7 với ID mô hình grok-4.7 và đã ghi tài liệu cho các route /v1/chat/completions và /v1/responses. Trang hiện tại của CometAPI xác nhận Grok 4.7 khả dụng qua lớp API của họ.
Bước 1: Lấy khóa API của CometAPI
Tạo hoặc đăng nhập tài khoản CometAPI và lấy khóa API từ bảng điều khiển API. CometAPI cung cấp lớp API hợp nhất để truy cập nhiều nhà cung cấp mô hình bằng một tài khoản.
Bước 2: Chọn grok-4.7
Sử dụng grok-4.7 làm ID mô hình và chọn route CometAPI đã ghi tài liệu phù hợp với ứng dụng. Trang mô hình hiện liệt kê cả /v1/chat/completions và /v1/responses. citeturn1search2
Bước 3: Gửi và xử lý phản hồi
Gửi prompt của người dùng qua endpoint đã chọn, rồi xử lý phản hồi trả về trong cùng quy trình ứng dụng như với các mô hình ngôn ngữ khác được CometAPI hỗ trợ. Đối với triển khai sản xuất, hãy xác minh danh mục mô hình trực tiếp và tài liệu route của CometAPI trước khi cố định chi tiết triển khai.