Tóm tắt
Grok 4.7 hiện đã có tín hiệu tiền phát hành rõ ràng nhất: đếm ngược 10 ngày từ ngày 2 tháng 9 cho thấy thời điểm phát hành dự kiến khoảng ngày 12 tháng 9 năm 2026. Các phát biểu trước đó mô tả một mô hình với khoảng 2,1 nghìn tỷ tham số và được huấn luyện bổ sung bằng lượng dữ liệu đáng kể từ công ty SpaceX. Tuy nhiên, xAI vẫn chưa công bố thẻ mô hình Grok 4.7, bộ điểm chuẩn, mã định danh API cuối, cửa sổ ngữ cảnh hoặc mức giá chính thức. Cho đến khi các chi tiết đó xuất hiện, Grok 4.6 phát hành trước đó vẫn là đường cơ sở sản xuất có thể đo lường.
Những điểm chính rút ra
- Ngày 12 tháng 9 là suy luận từ đếm ngược 10 ngày của Musk, không phải thông báo lịch riêng biệt do xAI công bố.
- Quy mô 2,1T và các phát biểu về dữ liệu SpaceX là tuyên bố tiền phát hành; số tham số kích hoạt, định tuyến, kiến trúc và phương pháp huấn luyện vẫn chưa được công bố.
- Grok 4.6 đã thể hiện kết quả tốt cho công việc tri thức và tác nhân, gồm 61,3% trên FrontierCode v1.1 (Extended), nhưng vẫn kém mô hình so sánh mạnh nhất ở một số bài đánh giá mã khó.
- Grok 4.7 nên được đánh giá bằng tỷ lệ nhiệm vụ được chấp nhận, độ tin cậy chuỗi dài, hiệu quả token, độ trễ và chi phí cho mỗi kết quả thành công — không chỉ bằng số tham số.
- CometAPI sẽ tích hợp Grok 4.7 ngay khi xAI chính thức phát hành mô hình và cung cấp endpoint sản xuất; nhà phát triển vẫn nên xác minh ID mô hình trực tiếp, giá và hành vi phản hồi thực tế trước khi di trú.
Grok 4.7 là gì?
Grok 4.7 là bản kế nhiệm đã được công bố của Grok 4.6 và được kỳ vọng tiếp tục tập trung của xAI vào lập trình, kỹ thuật, tác nhân chạy dài và công việc tri thức chuyên nghiệp. Bằng chứng công khai hiện nay bao gồm phát biểu của nhà sáng lập và đếm ngược phát hành, thay vì một gói ra mắt kỹ thuật đầy đủ.
Điểm phân biệt quan trọng nhất nằm ở ba đối tượng: mô hình Grok 4.7 đã được công bố, các tín hiệu tiền phát hành mô tả quy mô và huấn luyện có thể có, và đường cơ sở sản xuất Grok 4.6 đang hoạt động. Nhà phát triển nên xem Grok 4.7 như một ứng viên chờ đánh giá cho đến khi xAI công bố tài liệu cuối cùng và yêu cầu gọi tới endpoint phát hành thành công.
Ngày phát hành và dòng thời gian Grok 4.7
Khi nào Grok 4.7 dự kiến phát hành?
Phát biểu ngày 2 tháng 9 của Musk rằng mô hình sẽ ra mắt trong 10 ngày cho thấy khoảng thời điểm là ngày 12 tháng 9 năm 2026
Nguồn: Elon Musk trên X, 2 tháng 9, 2026
Dòng thời gian phát hành Grok 4.7
| Ngày | Tín hiệu công khai | Diễn giải |
|---|---|---|
| Cuối tháng 7 năm 2026 | Musk mô tả mô hình khoảng 2,1T, hiệu quả token được cải thiện và phục vụ chậm hơn đôi chút. | Kỳ vọng về quy mô mô hình và hiệu quả do nhà sáng lập nêu ra. |
| 12 tháng 8, 2026 | Huấn luyện ban đầu được mô tả là đã hoàn tất; huấn luyện bổ sung được cho là gồm dữ liệu công ty SpaceX đáng kể. | Cập nhật tiến độ huấn luyện, không phải xác nhận phát hành. |
| 2 tháng 9, 2026 | “Grok 4.7 sẽ ra mắt trong 10 ngày.” | Đếm ngược phát hành công khai rõ ràng nhất cho đến nay. |
| 12 tháng 9, 2026 | Ngày trên lịch suy ra từ đếm ngược. | Mục tiêu kỳ vọng; khả dụng cuối cùng vẫn cần thông báo phát hành của xAI và một endpoint hoạt động. |
Thông số kỹ thuật Grok 4.7: Thông tin đã xác nhận và chưa xác nhận
Cách hữu ích nhất để đọc thông tin hiện tại về Grok 4.7 là tách biệt phát biểu trực tiếp của nhà sáng lập với các thông số mà xAI chưa công bố. Bài đăng mới chỉ xác nhận tên mô hình và đếm ngược phát hành; không bổ sung tham số kỹ thuật hay kết quả điểm chuẩn.
| Thông số | Trạng thái hiện tại của Grok 4.7 | Mức độ bằng chứng |
|---|---|---|
| Thời điểm phát hành | Khoảng ngày 12 tháng 9, suy ra từ đếm ngược 10 ngày ngày 2 tháng 9 | Mục tiêu do nhà sáng lập nêu |
| Quy mô mô hình | Khoảng 2,1T tham số | Do nhà sáng lập nêu |
| Huấn luyện ban đầu | Được mô tả là hoàn tất vào ngày 12 tháng 8 | Do nhà sáng lập nêu |
| Huấn luyện bổ sung | Bao gồm dữ liệu công ty SpaceX đáng kể | Do nhà sáng lập nêu |
| Chất lượng tương đối | Được tuyên bố là vượt trội so với Grok 4.6 | Chưa được xác minh |
| Hiệu quả token | Được tuyên bố cải thiện so với Grok 4.6 | Chưa được xác minh |
| Tốc độ phục vụ | Dự kiến chậm hơn đôi chút | Do nhà sáng lập nêu |
| Cửa sổ ngữ cảnh | xAI chưa công bố | Chưa rõ |
| Phương thức vào/ra | xAI chưa công bố | Chưa rõ |
| ID mô hình API cuối | Chưa được xác nhận trong tài liệu xAI | Chưa rõ |
| Giá chính thức | xAI chưa công bố | Chưa rõ |
| Điểm chuẩn chính thức | Chưa có điểm chuẩn công bố cho Grok 4.7 | Chưa rõ |
Tuyên bố khoảng 2,1T tham số không tiết lộ số tham số kích hoạt, độ thưa, định tuyến chuyên gia, chi phí suy luận hoặc lượng tính toán huấn luyện hiệu dụng. Chỉ số lượng tham số không thể xác định chất lượng sản xuất.
Vì sao tín hiệu huấn luyện SpaceX có thể quan trọng hơn 2.1T
Tiết lộ có ý nghĩa hơn có thể là bổ sung dữ liệu công ty SpaceX. Một kho dữ liệu kỹ thuật chất lượng cao có thể cải thiện suy luận kỹ thuật, thiết kế, gỡ lỗi, tối ưu hóa và công việc tác nhân chuỗi dài, nơi phân bổ tác vụ và chất lượng hậu huấn luyện thường quan trọng hơn quy mô thô.
Hướng đi này phù hợp với chiến lược mô hình phát hành của xAI. Báo cáo huấn luyện Grok 4.6 mô tả một đợt huấn luyện bổ sung dài hơn với dữ liệu kỹ thuật chất lượng cao, tiếp theo là tinh chỉnh có giám sát và học tăng cường trên các lĩnh vực lập trình, STEM, phát triển web, tối ưu hóa kernel và thiết kế hỗ trợ máy tính.
Điều đó khiến tuyên bố về Grok 4.7 khả tín về mặt kỹ thuật, nhưng chưa được chứng minh. Lợi thế thực sự nên trở nên rõ ràng sau phát hành qua các kiểm thử kỹ thuật có thể tái lập, tỷ lệ hoàn thành nhiệm vụ, độ trễ và chi phí cho mỗi kết quả thành công.
Hiệu năng Grok 4.7 so với Grok 4.6: Đường cơ sở cho thấy gì
Chưa có điểm số chính thức cho Grok 4.7. Điểm so sánh có trách nhiệm là đánh giá Grok 4.6 đã phát hành của xAI. Toàn bộ tổng quan mô hình xuất hiện trong bài phân tích chuyên sâu Grok 4.6 của CometAPI; bảng dưới đây chỉ giữ các hàng điểm chuẩn quan trọng nhất cho quyết định.
| Đánh giá chính thức | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9% | 66,7% | 67,2% | 70,5% |
| DeepSWE v1.1 | 65,9% | 54,0% | 73,0% | 70,0% |
| FrontierCode v1.1 (Extended) | 61,3% | 56,6% | 60,6% | 63,6% |
| Terminal-Bench v3.0 | 26,0% | 15,7% | 34,6% | 34,1% |
Kết quả đường cơ sở: Grok 4.6 thể hiện lợi thế rõ ràng so với Grok 4.5 trên mọi hàng hiển thị. Nó ngang bằng GPT-5.6 Sol trên chỉ số trí tuệ tổng thể, dẫn đầu nhóm này trên GDPVal-AA v2 và nhỉnh hơn GPT-5.6 Sol trên FrontierCode. Các khoảng cách được công bố chính vẫn là DeepSWE và Terminal-Bench.
Những kết quả này đặt ra tiêu chuẩn cụ thể cho Grok 4.7. Nếu mô hình lớn hơn và huấn luyện bổ sung định hướng kỹ thuật chuyển hóa vào sản xuất, đột phá kỳ vọng sẽ là khả năng lập trình cấp kho mã và hoàn thành tác vụ dòng lệnh mạnh hơn mà không đánh mất sức mạnh công việc tri thức của Grok 4.6. Mục tiêu tham vọng hợp lý là trở nên cạnh tranh với Claude Fable 5.1 đã phát hành về lập trình và quy trình tác nhân chạy dài. Đó là dự báo cần được kiểm chứng, không phải tuyên bố điểm chuẩn hiện tại.
Grok 4.7 vs Grok 4.6: Đột phá kỳ vọng và hướng dẫn nâng cấp
Các tín hiệu rò rỉ và do nhà sáng lập nêu gợi ý năm lĩnh vực mà Grok 4.7 có thể cải thiện. Vì xAI chưa công bố dữ liệu đánh giá cuối cùng, mỗi kỳ vọng nên được chuyển thành một bài kiểm thử chấp nhận có thể đo lường.
Lập trình cấp kho mã
Grok 4.6 đã mạnh trên CursorBench và FrontierCode, nhưng kết quả DeepSWE và Terminal-Bench vẫn còn khoảng trống rõ rệt. Grok 4.7 nên chứng minh tỷ lệ bản vá được chấp nhận cao hơn, ít hồi quy hơn và phục hồi dòng lệnh tốt hơn trên cùng kho mã trước khi thay thế 4.6.
Độ tin cậy tác nhân chuỗi dài
Tín hiệu dữ liệu SpaceX và hướng huấn luyện tác nhân hiện có của xAI cho thấy tập trung vào công việc kỹ thuật đa giai đoạn. Hãy đo quy trình hoàn tất, lỗi lệnh gọi công cụ, số lần thử lại, can thiệp của con người và khả năng phục hồi sau lỗi — không chỉ chất lượng văn bản cuối cùng.
Công việc tri thức và suy luận kỹ thuật
Grok 4.6 đã dẫn đầu nhóm so sánh trên GDPVal-AA v2. Grok 4.7 nên giữ vững lợi thế đó đồng thời cải thiện chuyển giao vào đánh giá thiết kế, tổng hợp nghiên cứu, gỡ lỗi, tối ưu hóa và các tác vụ kỹ thuật phức tạp khác.
Hiệu quả token
Mô hình lớn hơn vẫn có thể rẻ hơn cho mỗi tác vụ thành công nếu đạt kết quả đúng trong ít bước hơn. So sánh tổng token đầu vào, đầu vào được lưu đệm, token đầu ra, số lần thử lại và chi phí cho cùng một kết quả được chấp nhận.
Đánh đổi trong phục vụ
Nếu Grok 4.7 chậm hơn, lợi ích chất lượng phải lớn hơn độ trễ. Ghi nhận thời gian đến token đầu tiên, thông lượng duy trì, thời gian hoàn tất thực tế, tỷ lệ lỗi và chi phí dưới mức đồng thời thực tế.
Điểm chuẩn Grok 4.7: 5 bài kiểm thử để xác minh nâng cấp thực sự so với Grok 4.6
- Thành công kỹ nghệ phần mềm: đo số vấn đề được giải quyết, bài kiểm thử vượt qua, tỷ lệ hồi quy và bản vá được chấp nhận trên các kho mã đại diện.
- Độ tin cậy tác nhân chuỗi dài: theo dõi quy trình hoàn tất, lỗi lệnh gọi công cụ, số lần thử lại, phục hồi và can thiệp của con người trong các lần chạy nhiều bước.
- Chuyển giao kỹ thuật thực tế: kiểm thử các tác vụ thiết kế, gỡ lỗi, tối ưu hóa, suy luận khoa học và liên quan CAD với tiêu chí chấm điểm được công bố.
- Hiệu quả token cho mỗi tác vụ thành công: so sánh tổng token và chi phí cần để đạt cùng kết quả được chấp nhận.
- Độ trễ và chi phí dưới tải sản xuất: đánh giá thời gian đến token đầu tiên, thông lượng, thời gian hoàn tất thực tế, tỷ lệ lỗi và chi phí ở mức đồng thời thực tế.
Nhà phát triển nên làm gì trước ngày 12 tháng 9 — và vai trò của CometAPI
Danh sách kiểm tra trước khi ra mắt dành cho nhà phát triển
- Xây dựng một bộ đánh giá cố định từ các quy trình lập trình, nghiên cứu, kỹ thuật và tác nhân thực tế.
- Chạy bộ này trên Grok 4.6 và ghi nhận tỷ lệ thành công, số lần thử lại, lệnh gọi công cụ, độ trễ, token và tổng chi phí.
- Giữ việc chọn mô hình có thể cấu hình và tránh hard-code mã định danh Grok 4.7 tạm thời.
- Theo dõi ghi chú phát hành của xAI và trang mô hình trên CometAPI để xác nhận khả dụng.
- Sau khi ra mắt, xác minh ngữ cảnh, phương thức, tùy chọn kiểm soát suy luận, giá, giới hạn tốc độ và phạm vi triển khai.
- Chạy lại cùng bộ đánh giá trước khi chuyển lưu lượng sản xuất.
CometAPI cung cấp một lớp API hợp nhất để truy cập nhiều nhà cung cấp mô hình AI thông qua một tài khoản và mẫu tích hợp. Một trang theo dõi Grok 4.7 đã sẵn sàng. CometAPI sẽ tích hợp Grok 4.7 ngay khi xAI chính thức phát hành và truy cập sản xuất khả dụng.
Cho đến thời điểm đó, hãy coi mọi mã định danh, giá hoặc trường năng lực tiền phát hành là tạm thời. Trước khi gửi lưu lượng sản xuất, xác nhận tuyến gọi đã hoạt động, yêu cầu thực tế thành công, mô hình trả về đúng phiên bản dự kiến và giá hiện tại hiển thị trong bảng điều khiển.
Triển vọng giá Grok 4.7 so với Grok 4.6
Mức giá chuẩn Grok 4.6 đã công bố là $2 cho 1 triệu token đầu vào và $6 cho 1 triệu token đầu ra dưới ngưỡng ngữ cảnh dài. Ghi chú phát hành của xAI liệt kê mức giá cao hơn cho yêu cầu trên 200.000 token nhắc lệnh. Giá Grok 4.7 chưa được công bố chính thức.
| Cơ sở giá đã công bố | Đầu vào / 1M | Đầu ra / 1M | Trạng thái |
|---|---|---|---|
| Grok 4.6, prompt dưới 200K | $2 | $6 | Đã công bố |
| Grok 4.6, prompt trên 200K | $4 | $12 | Bậc ngữ cảnh dài đã công bố |
| Grok 4.7 | Chưa công bố | Chưa công bố | Xác nhận sau khi ra mắt chính thức |
Ba hướng giá vẫn khả dĩ: ngang bằng Grok 4.6 để thúc đẩy tiếp nhận, bậc giá cao cấp nếu chi phí phục vụ cao hơn đáng kể, hoặc tách giá theo độ dài ngữ cảnh và tốc độ. Đây là kịch bản lập kế hoạch, không phải dự báo của xAI.
Danh sách kiểm tra trước khi ra mắt dành cho nhà phát triển
- Xây dựng một bộ đánh giá cố định từ các quy trình lập trình, nghiên cứu, kỹ thuật và tác nhân thực tế.
- Chạy bộ này trên Grok 4.6 và ghi nhận tỷ lệ thành công, số lần thử lại, lệnh gọi công cụ, độ trễ, token và tổng chi phí.
- Giữ việc chọn mô hình có thể cấu hình và tránh hard-code mã định danh Grok 4.7 tạm thời.
- Theo dõi ghi chú phát hành của xAI và trang mô hình trên CometAPI để xác nhận khả dụng.
- Sau khi ra mắt, xác minh ngữ cảnh, phương thức, tùy chọn kiểm soát suy luận, giá, giới hạn tốc độ và phạm vi triển khai.
- Chạy lại cùng bộ đánh giá trước khi chuyển lưu lượng sản xuất.
Grok 4.7: Điều cần theo dõi tiếp theo
Bốn sự kiện sẽ biến đếm ngược hiện tại thành một lần ra mắt sản phẩm có thể xác minh: bài đăng phát hành chính thức của xAI; tài liệu mô hình bao gồm ngữ cảnh, phương thức và tùy chọn kiểm soát suy luận; giá API cuối cùng và mã định danh mô hình; cùng các điểm chuẩn hoặc đánh giá sản xuất có thể tái lập.
Câu hỏi hữu ích nhất khi ra mắt không phải là liệu 2.1T có nghe “lớn” hay không. Mà là liệu Grok 4.7 hoàn thành các tác vụ kỹ thuật và tác nhân khó một cách đáng tin cậy hơn — và với chi phí tốt hơn cho mỗi kết quả thành công — so với đường cơ sở đã phát hành.
Câu hỏi thường gặp
Khi nào Grok 4.7 dự kiến phát hành?
Đếm ngược 10 ngày ngày 2 tháng 9 của Musk cho thấy khoảng ngày 12 tháng 9 năm 2026. Đây là mục tiêu suy luận, không phải ngày trên lịch do xAI công bố riêng.
Grok 4.7 đã ra mắt chưa?
Grok 4.7 đã được hé lộ/công bố công khai nhưng chưa nhận được gói tài liệu chính thức về API/mô hình đầy đủ.
Grok 4.7 có phải là mô hình 2,1 nghìn tỷ tham số?
Musk mô tả nó có khoảng 2,1T tham số. xAI chưa công bố tài liệu kiến trúc xác nhận số tham số kích hoạt hoặc chi tiết định tuyến.
Grok 4.7 có tốt hơn Grok 4.6 không?
Musk tuyên bố cải thiện đáng kể, nhưng chưa có bảng điểm chuẩn chính thức cho Grok 4.7. Hãy coi đó là chưa được xác minh cho đến khi có kết quả có thể tái lập.
Grok 4.7 có khả dụng qua CometAPI không?
Một trang theo dõi Grok 4.7 của CometAPI đã tồn tại, nhưng khả dụng cuối cùng, mã định danh, giá và định dạng hỗ trợ cần được xác nhận sau khi ra mắt chính thức.
Kết luận
Câu chuyện Grok 4.7 đã chuyển từ ước lượng đầu tháng 9 sang đếm ngược cụ thể. Phát biểu mới nhất của Musk hướng tới khoảng ngày 12 tháng 9 năm 2026, trong khi các bài đăng trước đó mô tả mô hình khoảng 2,1T và huấn luyện bổ sung bằng dữ liệu công ty SpaceX đáng kể.
Đó là các tín hiệu tiền phát hành cụ thể hiếm thấy, nhưng không phải thẻ mô hình, bộ điểm chuẩn hay hợp đồng API. Nhà phát triển nên giữ Grok 4.6 làm đường cơ sở có thể đo lường, chuẩn bị một đánh giá có kiểm soát ngay bây giờ, và chờ xAI và CometAPI xác nhận truy cập sản xuất trước khi đưa ra quyết định di trú hoặc ngân sách.
