TL;DR
Grok Build 0.1 là mô hình chuyên lập trình của xAI dành cho kỹ nghệ phần mềm theo hướng tác tử, thay vì các cuộc trò chuyện chatbot thông thường. Ra mắt bản beta công khai trên xAI API vào ngày 29/05/2026, mô hình tập trung vào phát triển web, gỡ lỗi, gọi công cụ, quy trình MCP và tác tử lập trình tự động.
Mô hình cung cấp cửa sổ ngữ cảnh 256.000 token, chấp nhận đầu vào văn bản và hình ảnh, hỗ trợ lập luận, đầu ra có cấu trúc và gọi hàm, với chi phí $1 cho mỗi triệu token đầu vào và $2 cho mỗi triệu token đầu ra ở mức giá chuẩn. Thế mạnh nhất của nó không phải là hoàn thành mã đơn lẻ, mà là quy trình nhiều bước trong đó một tác tử kiểm tra kho mã, chỉnh sửa tệp, gọi công cụ, chạy kiểm thử và lặp lại để đạt kết quả được thẩm định.
Khác biệt then chốt rất đơn giản: Grok Build là sản phẩm tác tử lập trình, còn grok-build-0.1 là mô hình có thể truy cập qua API để chạy trong các khung tác tử lập trình khác. API Grok Build 0.1 trên CometAPI cũng đã hoạt động, cung cấp cùng ID mô hình qua cổng tương thích OpenAI.
Điểm chính
- Grok Build 0.1 được tối ưu cho lập trình theo tác tử, làm việc với kho mã, gỡ lỗi và kỹ nghệ phần mềm dựa trên công cụ.
- ID mô hình API là
grok-build-0.1, có cửa sổ ngữ cảnh 256K và đầu vào văn bản & hình ảnh. - Giá xAI cho ngữ cảnh ngắn là $1/M đầu vào, $0.20/M đầu vào đã cache, và $2/M đầu ra. API Grok Build 0.1 trên CometAPI rẻ hơn 20% với $0.80/M đầu vào, $0.16/M đầu vào đã cache, và $1.60/M đầu ra; các yêu cầu từ ngưỡng 200K trở lên áp dụng mức giá ngữ cảnh dài cao hơn.
- Hỗ trợ lập luận, gọi hàm và đầu ra có cấu trúc, nhưng không hỗ trợ Batch API.
- Nên đánh giá theo chi phí và thời gian cho mỗi tác vụ kỹ thuật thành công, không chỉ theo giá token thô hoặc một phép đo đơn lẻ.
Grok Build 0.1 là gì?
Grok Build 0.1 là mô hình ngôn ngữ chuyên biệt của xAI được thiết kế xoay quanh quy trình kỹ nghệ phần mềm theo hướng tác tử. Theo xAI, mô hình được huấn luyện cho các tác vụ như phát triển web, gỡ lỗi và tác tử lập trình hỗ trợ MCP, và từng cung cấp năng lực cho môi trường Grok Build ban đầu.
Vị thế đó tách nó khỏi một trợ lý đa dụng thông thường. Một tác tử lập trình phải liên tục kiểm tra kho mã, xác định tệp liên quan, gọi công cụ, chỉnh sửa mã, chạy kiểm thử, đọc lỗi và sửa đổi triển khai mà không mất trạng thái tác vụ.
Vì vậy, đơn vị đánh giá có ý nghĩa là một tác vụ kỹ thuật đầu-cuối: điều hướng kho mã → lập kế hoạch → chỉnh sửa → thực thi công cụ → phục hồi sau lỗi → thẩm định.
Grok Build 0.1 có giống Grok Build không?
Không. Grok Build là tác tử lập trình chạy trên terminal của xAI, còn Grok Build 0.1 là mô hình nền tảng mà nhà phát triển có thể gọi qua API.
Grok Build bao gồm duyệt kế hoạch, diff mã, hỗ trợ AGENTS.md, plugin, hook, kỹ năng, máy chủ MCP, tác tử con song song, tích hợp worktree và chế độ headless cho tự động hóa. Mô hình cũng có thể được dùng ngoài sản phẩm terminal đó trong các khung tác tử và cổng tương thích khác.
Thông số kỹ thuật của Grok Build 0.1 là gì?
| Thông số | Grok Build 0.1 |
|---|---|
| Nhà phát triển | xAI / SpaceXAI |
| Model ID | grok-build-0.1 |
| Trọng tâm chính | Lập trình theo tác tử và kỹ nghệ phần mềm |
| Đầu vào / đầu ra | Đầu vào văn bản và hình ảnh; đầu ra văn bản |
| Cửa sổ ngữ cảnh | 256,000 tokens |
| Năng lực | Lập luận, gọi hàm, đầu ra có cấu trúc |
| Giá chuẩn theo token | $1.00/M đầu vào; $0.20/M đầu vào đã cache; $2.00/M đầu ra |
| Ngưỡng ngữ cảnh dài | 200K token prompt |
| Giá ngữ cảnh dài | $2.00/M đầu vào; $0.40/M đầu vào đã cache; $4.00/M đầu ra |
| Batch API | Không được hỗ trợ |
| Giới hạn đã công bố | 37 requests/s; 10,000,000 tokens/min |
| Khu vực | us-east-1, us-west-2 |
Các thông số này được ghi trên trang mô hình chính thức của xAI. Cửa sổ ngữ cảnh 256K có thể chứa nhiều ngữ cảnh kho mã, trong khi đầu vào hình ảnh cho phép tác tử diễn giải ảnh chụp màn hình, mockup, sơ đồ kiến trúc và báo lỗi trực quan song song với mã nguồn.
Khi một prompt đạt ngưỡng ngữ cảnh dài, mức giá cao hơn sẽ áp dụng cho tất cả token trong yêu cầu đó. Các tác tử xử lý kho mã nặng vì thế nên nén hoặc truy hồi ngữ cảnh có chọn lọc thay vì liên tục nối thêm tệp và đầu ra công cụ.
Điều gì khiến Grok Build 0.1 khác biệt?
Tối ưu hóa chủ yếu cho lập trình theo tác tử
Grok Build 0.1 không chỉ là mô hình có thể viết Python hay JavaScript. Sự chuyên biệt của nó nằm ở tương tác giữa lập luận, sinh mã và công cụ. Một tác tử lập trình hữu dụng phải lập kế hoạch, kiểm tra, chỉnh sửa, thực thi, phục hồi sau lỗi và tiếp tục mà không mất trạng thái tác vụ.
Quy trình công cụ định hướng MCP
Quy trình định hướng MCP có thể kết nối tác tử lập trình với cơ sở dữ liệu, hệ thống triển khai, kho tài liệu, hệ thống theo dõi vấn đề, hệ thống quan sát và công cụ phát triển nội bộ qua giao diện chuẩn hóa.
Tự động hóa có cấu trúc
Đầu ra có cấu trúc hữu ích khi tác tử cần trả về đối tượng dự đoán được thay vì văn bản tự do—ví dụ, kế hoạch thay đổi tệp, tham số công cụ, kết quả kiểm thử, phát hiện đánh giá hoặc quyết định triển khai. Điều này giảm sự mong manh khi phân tích cú pháp giữa mô hình và lớp điều phối.
Ngữ cảnh trực quan cho công việc web và giao diện
Vì mô hình chấp nhận đầu vào hình ảnh, tác tử có thể làm việc với ảnh chụp màn hình, trang đã render, tham chiếu giao diện, hộp thoại lỗi và sơ đồ kiến trúc bên cạnh mã nguồn.
Grok Build 0.1 nhanh đến mức nào?
xAI mô tả Grok Build 0.1 là mô hình lập trình nhanh nhất của họ khi ra mắt và quảng bá hơn 100 token đầu ra mỗi giây. Đây là tuyên bố dịch vụ chính thức, không phải đảm bảo cho mọi prompt hoặc endpoint.
Các phép đo độc lập nên được xem là quan sát theo thời điểm. Artificial Analysis hiện báo cáo khoảng 69.6 token đầu ra/giây và 0.54 giây đến token đầu tiên trên SpaceXAI API. Hạ tầng nhà cung cấp, độ dài prompt, hành vi lập luận, việc dùng công cụ và tải máy chủ đều có thể làm thay đổi kết quả.
Nên diễn giải các điểm chuẩn như thế nào?
| Chỉ báo độc lập | Giá trị hiện báo cáo | Diễn giải |
|---|---|---|
| Artificial Analysis Intelligence Index | 27, ước tính | Ước tính tổng hợp; đánh giá độc lập vẫn được ghi chú là sẽ công bố |
| Tốc độ đầu ra | 69.6 tokens/s | Đo trên SpaceXAI API chính hãng sau khối phản hồi đầu tiên |
| Thời gian đến token đầu tiên | 0.54 s | Đo độ trễ endpoint; không phải thời gian hoàn thành toàn bộ tác vụ |
Những con số này được đối chiếu với Artificial Analysis ngày 22/09/2026. Vì trang được cập nhật động, các bản sửa đổi trong tương lai nên được kiểm tra lại và lưu ngày xác minh.
Với hệ thống lập trình tự động, điểm chuẩn chỉ là một phần của đánh giá. Điều hướng kho mã, độ chính xác chỉnh sửa, lựa chọn công cụ, hành vi phục hồi, kỷ luật kiểm thử, độ trễ và tổng token sử dụng có thể quan trọng hơn đối với năng suất nhà phát triển.
Grok Build 0.1 có giá bao nhiêu?
Grok Build 0.1 dùng mức giá tách biệt cho ngữ cảnh ngắn và dài. Tầng ngữ cảnh ngắn áp dụng khi độ dài prompt dưới 200,000 token; khi yêu cầu đạt ngưỡng này, mức giá ngữ cảnh dài cao hơn áp dụng cho yêu cầu đó.
| Tầng giá | CometAPI | xAI chính thức |
|---|---|---|
| Đầu vào ngữ cảnh ngắn | $0.80/M | $1.00/M |
| Đầu vào đã cache ngắn | $0.16/M | $0.20/M |
| Đầu ra ngữ cảnh ngắn | $1.60/M | $2.00/M |
| Đầu vào ngữ cảnh dài | $1.60/M | $2.00/M |
| Đầu vào đã cache dài | $0.32/M | $0.40/M |
| Đầu ra ngữ cảnh dài | $3.20/M | $4.00/M |
Ở mức ngữ cảnh ngắn, một triệu token đầu vào cộng một triệu token đầu ra tốn $2.40 qua CometAPI, so với $3.00 qua xAI chính thức. Ở mức ngữ cảnh dài, cùng cơ cấu token tốn $4.80 qua CometAPI so với $6.00 qua xAI. Các con số này chỉ bao gồm token của mô hình; ngân sách sản xuất cũng nên tính cả gọi công cụ, thử lại, chạy kiểm thử và chi phí điều phối.
Grok Build 0.1 so với Grok 4.7 và Grok Code Fast 1
| Khía cạnh | Grok Build 0.1 | Grok 4.7 | Grok Code Fast 1 |
|---|---|---|---|
| Vòng đời | Mô hình chuyên lập trình hiện tại | Mô hình tiên phong hiện tại | Mô hình lập trình thế hệ trước; ngừng hoạt động ngày 15/05/2026 |
| Định vị chính | Mô hình lập trình theo tác tử chuyên biệt | Lập trình tiên phong, tác vụ tác tử và công việc tri thức | Mô hình lập trình nhanh, tiền nhiệm trong dòng mô hình lập trình của xAI |
| Cửa sổ ngữ cảnh | 256K | 500K | Thông số cũ; không dùng làm cơ sở triển khai mới |
| Lập luận và công cụ | Lập luận, gọi hàm, đầu ra có cấu trúc | Lập luận cấu hình được; gọi hàm, tìm kiếm web, tìm kiếm X, và thực thi mã | Quy trình lập trình cũ; nên di trú thay vì mở rộng dùng sản xuất mới |
| Giá chính thức ngắn đầu vào / đầu ra | $1.00 / $2.00 mỗi M token | $2.00 / $6.00 mỗi M token | Đã ngừng; không nên giả định mức giá sản xuất hiện tại |
| CometAPI ngắn đầu vào / đầu ra | $0.80 / $1.60 mỗi M token | $1.60 / $4.80 mỗi M token | Dùng danh mục hiện tại và mô hình thay thế thay vì slug đã ngừng |
| Giá chính thức dài đầu vào / đầu ra | $2.00 / $4.00 mỗi M token | $4.00 / $12.00 mỗi M token | Không áp dụng như mức chọn mô hình hiện tại |
| Phù hợp điển hình | Vòng lặp kho mã khối lượng lớn, gỡ lỗi và tác tử lập trình tiết kiệm chi phí | Công việc lập trình khó hơn, chạy lâu hơn cần lập luận tiên phong mạnh và ngữ cảnh lớn hơn | Chỉ tham chiếu cho di trú; hãy ghim grok-build-0.1 cho khối lượng lập trình hiện tại |
Grok Build 0.1 là chuyên gia kinh tế hơn khi khối lượng công việc chủ yếu là kiểm tra kho mã lặp lại, chỉnh sửa và kiểm thử. Grok 4.7 cung cấp gần gấp đôi ngữ cảnh và hồ sơ năng lực tiên phong rộng hơn, nhưng giá token đầu ra cao hơn đáng kể. Quyết định thực tế nên dựa trên chi phí cho mỗi tác vụ hoàn thành thành công, bao gồm thử lại, gọi công cụ và thời gian sửa của con người.
Cả hai mô hình đều có trên CometAPI, cho phép đội ngũ chạy cùng tác vụ lập trình qua một cổng và so sánh tỷ lệ hoàn thành, độ trễ, sử dụng ngữ cảnh và tổng chi phí dưới một bộ khung nhất quán.
Grok Build 0.1 liên quan thế nào tới Grok Code Fast 1?
Định danh grok-code-fast-1 nằm trong danh sách mô hình xAI ngừng hoạt động ngày 15/05/2026. Hướng dẫn di trú có tuyên bố rộng rằng các slug đã ngừng sẽ chuyển hướng tới grok-4.3, trong khi bảng thay thế theo mô hình và mục “Code workloads” lại khuyến nghị grok-build-0.1 và nêu rằng slug lập trình được định tuyến tới mô hình đó.
Vì cùng một hướng dẫn chính thức mô tả chuyển hướng ở hai cấp, người dùng sản xuất không nên coi slug đã ngừng là định danh mô hình ổn định. Hãy ghim grok-build-0.1 rõ ràng cho khối lượng công việc lập trình và xác minh định tuyến hiện tại trước khi triển khai.
API Grok Build 0.1 trên CometAPI cung cấp truy cập trực tiếp theo ID mô hình hiện hành, tránh phụ thuộc vào bí danh đã ngừng.
Có thể sử dụng Grok Build 0.1 ở đâu?
Điều này có nghĩa mô hình không gắn với một IDE hay endpoint nhà cung cấp duy nhất. Qua CometAPI, các nhóm có thể dùng cùng định danh grok-build-0.1 trong quy trình tương thích OpenAI và so sánh với các mô hình lập trình khác mà không phải xây lại bộ điều khiển tác tử xung quanh.
Grok Build 0.1 có thể được gọi qua xAI hoặc CometAPI. Với CometAPI, gửi yêu cầu POST đã xác thực tới api.cometapi.com/v1/chat/completions với model: "grok-build-0.1" và mảng messages chuẩn.
curl "https://api.cometapi.com/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_KEY" \
-d '{
"model": "grok-build-0.1",
"messages": [
{
"role": "user",
"content": "Find the bug in this repository and propose a minimal fix."
}
]
}'
Khi nào nên dùng Grok Build 0.1?
Tác tử lập trình trong IDE
Sự kết hợp giữa chuyên môn lập trình và giá token thấp phù hợp với quy trình tương tác nơi tác tử lặp lại việc đọc, chỉnh sửa và thẩm định mã.
Gỡ lỗi tự động
Tác tử có thể kiểm tra lỗi, tìm kiếm tệp liên quan, tạo bản vá, chạy kiểm thử và tinh chỉnh bản sửa.
Phát triển web và UI
Đầu vào hình ảnh mở ra quy trình dựa trên ảnh chụp màn hình và tham chiếu thiết kế song song với mã nguồn.
Tác tử phần mềm dựa trên MCP
Gọi hàm và quy trình định hướng MCP phù hợp với trợ lý cần quyền truy cập có kiểm soát tới hệ thống phát triển bên ngoài.
CI và tự động hóa kỹ thuật
Quy trình headless có thể hỗ trợ phân loại lỗi, sửa chữa tự động, tạo kiểm thử, tái cấu trúc, di trú và chuẩn bị pull request.
Grok Build 0.1 còn phù hợp vào năm 2026 không?
Có, nhưng vai trò của nó là chuyên biệt thay vì “mô hình mới nhất của xAI”. Giá trị của nó nằm ở sự kết hợp giữa chuyên môn lập trình, cửa sổ ngữ cảnh 256K, lập luận, gọi công cụ, đầu ra có cấu trúc, đầu vào hình ảnh và mức giá token chuẩn tương đối thấp.
Nó đặc biệt hấp dẫn khi các nhóm cần mô hình phản hồi nhanh cho vòng lặp tác tử lặp đi lặp lại và có thể đánh giá nó trên chính kho mã, kiểm thử, mục tiêu độ trễ và chi phí lỗi của họ.
Kết luận
Grok Build 0.1 là mô hình tập trung cho tác tử lập trình thay vì mô hình tiên phong đa năng. Thông số và giá chính thức khiến nó hấp dẫn cho công việc kho mã khối lượng lớn, nhưng thiết kế tác tử xung quanh mới quyết định lợi thế đó có tồn tại trong sản xuất hay không.
Trước khi áp dụng, hãy chạy đánh giá đại diện đo lường tỷ lệ hoàn thành tác vụ, thời gian sửa của con người, số lần gọi công cụ, lượng token, tỷ lệ vượt kiểm thử và mức độ tiếp xúc ngữ cảnh dài. Hãy chọn nó khi toàn bộ quy trình—không chỉ điểm chuẩn hay giá token—vượt trội so với các lựa chọn khác.
