TL;DR
Grok 5 là mô hình tiên phong thế hệ tiếp theo của SpaceXAI. xAI đã xác nhận vào tháng 1 năm 2026 rằng mô hình đang trong quá trình huấn luyện, và một hồ sơ SpaceX với U.S. Securities and Exchange Commission xác định COLOSSUS II là nền tảng huấn luyện.
Elon Musk đã công khai thảo luận về mục tiêu khoảng 6 nghìn tỷ tham số và hỗ trợ đa phương thức bao gồm văn bản, hình ảnh, video và âm thanh. Trong cuộc gọi công bố kết quả kinh doanh tháng 8 năm 2026 của SpaceX, ông nói Grok 5 dự kiến phát hành trước cuối năm 2026 và sẽ tích hợp khoảng 25 năm dữ liệu của SpaceX. Cập nhật này được CLS và ME News đưa tin.
Những gì chưa được công khai cũng quan trọng không kém: xAI chưa phát hành thẻ mô hình, kết quả benchmark, giá API, thông số cửa sổ ngữ cảnh, số lượng tham số hoạt động hoặc kế hoạch truy cập cuối cùng. Những câu hỏi bỏ ngỏ đó được tổng hợp trong Những điều chúng ta chưa biết thay vì được trình bày xuyên suốt bài viết như các thông số đã được xác nhận.
Những điểm chính
- xAI đã xác nhận rằng Grok 5 đang được huấn luyện.
- Musk đã mô tả quy mô mục tiêu khoảng 6 nghìn tỷ tham số và hỗ trợ đầu vào văn bản, hình ảnh, video và âm thanh.
- Một hồ sơ SpaceX tại SEC liên kết Grok 5 với COLOSSUS II và mô tả việc mở rộng liên tục sử dụng các hệ thống NVIDIA GB200 và GB300.
- SpaceX cho biết giai đoạn mở rộng COLOSSUS II tiếp theo được thiết kế để bổ sung ít nhất 220.000 bộ xử lý GB300 và hơn 400 megawatt năng lực tính toán.
- Musk cho biết Grok 5 sẽ được huấn luyện trên kho dữ liệu SpaceX tích lũy trong khoảng 25 năm.
- Mục tiêu công khai mới nhất là phát hành trước cuối năm 2026, sau các bản cập nhật Grok 4.6 và Grok 4.7 đã lên kế hoạch.
- Kiến trúc, độ dài ngữ cảnh, hiệu năng benchmark, giá API, các tầng sản phẩm và ngày ra mắt chính xác vẫn chưa được công bố.
Grok 5 là gì?
Grok 5 là mô hình nền tảng quan trọng tiếp theo trong họ Grok. Nó kế tiếp Grok 4.5, sản phẩm được SpaceXAI định vị cho lập trình, tác vụ tác nhân và công việc tri thức.
Mô tả chi tiết công khai đầu tiên xuất hiện trong cuộc thảo luận năm 2025 của Elon Musk tại Baron Investment Conference. Musk đã đề cập đến mô hình nhắm khoảng 6 nghìn tỷ tham số và vận hành trên văn bản, hình ảnh, video và âm thanh. Các tóm tắt thứ cấp sau đó xuất hiện trên NxCode và trang tham chiếu Grok 5 của Grokipedia.
Xác nhận chính thức hơn đến khi xAI thông báo rằng Grok 5 đang được huấn luyện. Hồ sơ chứng khoán của SpaceX sau đó kết nối mô hình với COLOSSUS II và mô tả các hệ thống Grok thế hệ tiếp theo nhắm tới độ chính xác lý luận cao hơn, tích hợp đa phương thức sâu hơn, và hiệu năng tốt hơn trong các lĩnh vực chuyên môn.
Cập nhật công khai gần nhất đến trong cuộc gọi kết quả kinh doanh ngày 4 tháng 8 năm 2026 của SpaceX. Musk nói Grok 5 dự định xuất hiện trước cuối năm và sẽ dùng toàn bộ kho dữ liệu SpaceX được tạo ra trong khoảng một phần tư thế kỷ. Điều này đặt mô hình tại giao điểm giữa công việc AI đa dụng của xAI, môi trường thông tin thời gian thực của X, và hoạt động kỹ thuật của SpaceX.
Hình 1. Tổng quan chính thức về hoạt động AI của SpaceX liên kết hạ tầng tính toán, các mô hình tiên phong và dữ liệu thời gian thực. Nguồn: Bài thuyết trình roadshow của SpaceX tại SEC
Có gì mới trong Grok 5?
Mục tiêu 6 nghìn tỷ tham số
Mục tiêu khoảng 6 nghìn tỷ tham số do Musk nêu ra sẽ đặt Grok 5 vượt xa quy mô được công khai cho các thế hệ Grok trước đó. Con số này nên được hiểu là mục tiêu phát triển: xAI chưa công bố số lượng tham số cuối cùng, số tham số hoạt động, hay cấu hình triển khai.
xAI có kinh nghiệm trước đây với các mô hình chuyên gia thưa. Bản phát hành Grok-1 mở của họ là một mô hình mixture-of-experts 314 tỷ tham số, chỉ kích hoạt một phần trọng số cho mỗi token. Lịch sử đó có liên quan đến Grok 5, nhưng không xác lập kiến trúc của mô hình chưa phát hành.
COLOSSUS II và dữ liệu kỹ thuật của SpaceX
Hồ sơ SEC của SpaceX nêu rằng COLOSSUS II đang được sử dụng cho huấn luyện mô hình tiên phong thế hệ tiếp theo, bao gồm Grok 5. Nó cũng mô tả các triển khai GB200 và GB300 quy mô lớn và một đợt mở rộng tiếp theo được thiết kế để bổ sung ít nhất 220.000 bộ xử lý GB300.
Musk cũng nói mô hình sẽ tích hợp khoảng 25 năm dữ liệu của SpaceX. Kho dữ liệu đó đáng chú ý vì nó có thể không chỉ gồm các tài liệu kỹ thuật hoàn chỉnh, mà còn có quyết định thiết kế, kết quả thử nghiệm, điều tra lỗi, phiên bản phần mềm, hồ sơ sản xuất, và công việc xác minh.
Thông tin này đưa ra lý do rõ ràng để xAI nhấn mạnh hiệu năng kỹ thuật và lĩnh vực chuyên môn. Tuy nhiên, nó không tiết lộ những bộ dữ liệu nào sẽ được đưa vào, cách chúng được lọc, hay mức độ kho dữ liệu sẽ được dùng trong tiền huấn luyện, hậu huấn luyện, hoặc truy hồi.
Định hướng đa phương thức
Musk mô tả Grok 5 bao phủ văn bản, hình ảnh, video và âm thanh. Hồ sơ của SpaceX riêng biệt nêu tích hợp đa phương thức sâu hơn là mục tiêu cho thế hệ mô hình tiên phong kế tiếp.
Định hướng này phù hợp với hệ sinh thái sản phẩm rộng hơn của xAI, vốn đã bao gồm tính năng thoại, hình ảnh và video. Các công bố công khai xác lập đa phương thức là mục tiêu, nhưng không chỉ rõ Grok 5 sẽ dùng một mô hình thống nhất cho mọi chế độ hay phối hợp một số thành phần chuyên biệt.
Học tăng cường, tìm kiếm và tác nhân
Bài công bố chính thức Grok 4.5 cho thấy định hướng công việc hậu huấn luyện của xAI. Grok 4.5 được huấn luyện trên hàng trăm nghìn tác vụ, nhấn mạnh vào kỹ thuật phần mềm nhiều bước và công việc kỹ thuật. Một số rollout tác nhân kéo dài hàng giờ và được đánh giá bằng chấm điểm tự động và dựa trên mô hình.
Sản phẩm Grok hiện tại cũng hỗ trợ tìm kiếm web, tìm kiếm trên X, gọi hàm và thực thi mã. Tài liệu dành cho nhà phát triển Grok trình bày các công cụ này là một phần của hệ sinh thái mô hình hiện hữu, trong khi tài liệu đa tác nhân mô tả các tác nhân nghiên cứu song song để tìm kiếm, phân tích, đối chiếu và tổng hợp thông tin.
Những khả năng này cung cấp cơ sở thực tế để hiểu định hướng của xAI. Grok 5 có tích hợp chúng một cách nguyên bản, mở rộng chúng, hay đóng gói chúng như các dịch vụ riêng biệt thì chưa được công bố.
Những điều chúng ta chưa biết
Grok 5 đã được xác nhận công khai, nhưng các thông số sản phẩm cuối cùng vẫn phần lớn chưa được tiết lộ. Các điểm dưới đây là dự báo có cơ sở dựa trên mô hình hiện tại của xAI, mức giá hiện tại, hạ tầng công khai, và chiến lược sản phẩm. Chúng không nên được coi là thông số Grok 5 đã công bố.
| Hạng mục | Những gì công khai | Dự báo hiện tại |
|---|---|---|
| Kiến trúc | Chưa có kiến trúc Grok 5 được công bố. | Thiết kế MoE thưa là khả dĩ, nhưng chưa được xác nhận. |
| Cửa sổ ngữ cảnh | Chưa có độ dài ngữ cảnh chính thức cho Grok 5. | 500K–1M token là khoảng lập kế hoạch hợp lý. |
| Hiệu năng | Chưa có benchmark cho Grok 5. | Mức tăng lớn nhất có thể xuất hiện ở các tác nhân dài hạn và tác vụ kỹ thuật. |
| Giá API | Chưa có bảng giá hoặc rate card. | Có khả năng cao mức giá cao hơn Grok 4.5, với các chế độ Heavy hoặc tác nhân có chi phí cao hơn. |
| Biến thể sản phẩm | Chưa công bố đội hình Grok 5. | Các tầng Standard, Heavy và multi-agent là khả dĩ. |
| Phát hành và truy cập | Mục tiêu trước cuối năm 2026. | Khả năng cao sẽ có bản xem trước theo giai đoạn, sau đó là quyền truy cập API và doanh nghiệp. |
Kiến trúc và tham số hoạt động
Kiến trúc mixture-of-experts thưa là giả thuyết hàng đầu vì nó giúp mô hình đa nghìn tỷ tham số khả thi hơn để huấn luyện và phục vụ. Grok-1 cung cấp tiền lệ, nhưng xAI có thể đã thay đổi đáng kể định tuyến, attention, bộ nhớ hoặc thiết kế đa phương thức kể từ bản phát hành đó.
Con số 6 nghìn tỷ tham số cũng không cho biết có bao nhiêu tham số sẽ hoạt động cho mỗi token. Sự khác biệt đó sẽ quyết định chi phí suy luận, độ trễ, yêu cầu phần cứng và ý nghĩa thực tế của quy mô mô hình.
Cửa sổ ngữ cảnh
Grok 4.5 hỗ trợ cửa sổ ngữ cảnh 500.000 token, trong khi hệ thống nghiên cứu đa tác nhân của xAI đã vận hành ở mức một triệu token. Vì vậy khoảng 500.000 đến 1 triệu token là dự báo hợp lý cho Grok 5, đặc biệt cho kho mã lớn, tệp đa phương thức và tác vụ chạy dài.
Con số cuối cùng có thể kém quan trọng hơn so với khả năng nhớ hiệu quả, nén ngữ cảnh, độ trễ và giá. Một cửa sổ danh nghĩa một triệu token sẽ có giá trị hạn chế nếu mô hình không thể truy hồi chi tiết đáng tin cậy từ đó hoặc nếu việc dùng ngữ cảnh dài có chi phí quá cao.
Hiệu năng
Grok 5 chưa có kết quả benchmark được công bố. Điểm chính thức của Grok 4.5 cung cấp mốc tham chiếu: 83,3% trên Terminal-Bench 2.1, 64,7% trên SWE-bench Pro, 62,0% trên DeepSWE 1.0, 53,0% trên DeepSWE 1.1, và 29,0% trên SWE Marathon.

Hình 4. Mốc chuẩn benchmark kỹ thuật của Grok 4.5, tái tạo từ kết quả chính thức do SpaceXAI công bố. Nguồn: Giới thiệu Grok 4.5 Đây là kết quả của Grok 4.5, không phải điểm số của Grok 5.
Kỳ vọng hợp lý khi ra mắt sẽ là độ tin cậy được cải thiện trong công việc trên terminal, thay đổi phần mềm nhiều tệp, và các tác vụ kỹ thuật chạy dài. Mức tăng ý nghĩa nhất có thể xuất hiện ở hoàn thành tác vụ, phục hồi sau lỗi, sử dụng công cụ lặp lại, và tổng hợp bằng chứng đa phương thức hơn là trong các benchmark đơn lượt thông thường.
Các mục tiêu điểm số cụ thể—chẳng hạn như ở mức cao 80 cho Terminal-Bench hoặc đầu 70 đến giữa 70 cho SWE-bench Pro—vẫn chỉ là suy đoán cho đến khi xAI công bố kết quả đánh giá và chi tiết thử nghiệm.
Giá API
Hiện tại Grok 4.5 có giá $2 cho mỗi triệu token đầu vào và $6 cho mỗi triệu token đầu ra, với mức giá ngữ cảnh dài cao hơn ngưỡng đã công bố.
Grok 5 nhiều khả năng sẽ có mức giá premium do quy mô và khối lượng lý luận dự kiến. Khoảng lập kế hoạch cho mô hình tiêu chuẩn khoảng $3–$5 cho mỗi triệu token đầu vào và $10–$15 cho mỗi triệu token đầu ra là có cơ sở, nhưng không phải mức giá đã công bố.
Việc sử dụng Heavy hoặc đa tác nhân có thể được định giá qua mức token cao hơn, tổng mức dùng tác nhân, nỗ lực lý luận hoặc thời gian tính toán. xAI cũng có thể định giá mô hình tiêu chuẩn cạnh tranh về giá-hiệu năng, như đã làm với Grok 4.5.
Biến thể sản phẩm và chế độ đa tác nhân
xAI hiện đã vận hành sản phẩm lý luận Heavy và nghiên cứu đa tác nhân, vì vậy một đội hình Grok 5 theo tầng là khả dĩ. Mô hình tiêu chuẩn có thể xử lý yêu cầu hằng ngày, trong khi chế độ Heavy hoặc đa tác nhân có thể phân bổ nhiều token lý luận và tác nhân song song cho công việc nghiên cứu, lập trình hoặc kỹ thuật khó.
Số lượng tác nhân có thể trở nên động thay vì cố định. Tuy nhiên, xAI chưa công bố liệu các khả năng này sẽ là một phần của mô hình Grok 5 cơ sở, các endpoint riêng, tính năng theo gói thuê bao, hay một lớp điều phối bên ngoài mô hình.
Vị thế cạnh tranh và trường hợp sử dụng khả dĩ
Grok 5 có khả năng cạnh tranh trực tiếp nhất trong kỹ thuật phần mềm, nghiên cứu kỹ thuật, phân tích thông tin thời gian thực, và các quy trình tác nhân đa phương thức. Dữ liệu SpaceX có thể tạo khác biệt trong kỹ thuật vật lý và phân tích hệ thống, trong khi truy cập gốc vào X có thể củng cố nghiên cứu thời gian thực.
Các trường hợp sử dụng khả dĩ gồm lập trình kho mã lớn, phân tích thử nghiệm và lỗi, rà soát thiết kế, tổng hợp tài liệu kỹ thuật, chẩn đoán đa phương thức, nghiên cứu thị trường và tin tức, và các quy trình kết hợp tìm kiếm, thực thi mã, tệp và tác nhân chạy dài.
Những lợi thế đó sẽ phụ thuộc vào thực thi. Dữ liệu chuyên biệt không tự động đảm bảo năng lực phán đoán kỹ thuật tốt hơn, và thông tin thời gian thực không tự động đảm bảo độ chính xác thực chứng. Độ tin cậy, xác minh nguồn, độ trễ và chi phí sẽ quyết định liệu Grok 5 trở thành lựa chọn thực tế so với các mô hình tiên phong khác hay không.
Ngày phát hành chính xác và quyền truy cập
Mục tiêu công khai là phát hành trước cuối năm 2026. Báo cáo từ CLS và ME News cho biết Grok 4.6 và Grok 4.7 dự kiến tới trước.
Trình tự đó gợi ý ra mắt vào quý IV, nhưng không xác lập tháng hay ngày cụ thể. Phát hành vào tháng 11 hoặc tháng 12 là khả dĩ chứ chưa được xác nhận.
Dựa trên các lần ra mắt Grok trước đây, quyền truy cập có thể bắt đầu qua grok.com, ứng dụng di động Grok, các gói X Premium+ hoặc SuperGrok, và đối tác được chọn trước khi mở rộng API và doanh nghiệp. CometAPI và các cổng mô hình khác có thể thêm mô hình khi có quyền truy cập API chính thức, nhưng chưa có lịch tích hợp được công bố.
Sự khác biệt trung tâm rất rõ ràng: sự tồn tại của Grok 5, nền tảng huấn luyện, mục tiêu tham số, tham vọng đa phương thức, kế hoạch dữ liệu SpaceX, và mục tiêu phát hành cuối năm là công khai. Kiến trúc cuối cùng, độ dài ngữ cảnh, hiệu năng, giá, đóng gói sản phẩm và cơ chế ra mắt thì không.
