GPT-5.6 Series is now live on CometAPI →

Cách sử dụng API Grok 4.3

CometAPI
AnnaMay 6, 2026
Cách sử dụng API Grok 4.3

Phát hành vào ngày 30 tháng 4 năm 2026, Grok 4.3 là mô hình chủ lực mới nhất của xAI, hiện đã được cung cấp rộng rãi qua xAI API. Nó mang lại hiệu suất dẫn đầu ngành về tỷ lệ ảo giác thấp, gọi công cụ mang tính tác nhân, khả năng tuân thủ hướng dẫn và các miền doanh nghiệp như án lệ và tài chính doanh nghiệp, với chi phí chỉ bằng một phần so với đối thủ.

Với mức giá $1.25 per million input tokens$2.50 per million output tokens (Giá của CometAPI là Input: $1/M, Output: $2/M), Grok 4.3 rẻ hơn nhiều mô hình tiên phong khác từ 40–60% trong khi vẫn đạt kết quả benchmark mạnh mẽ (ví dụ: 53 trên Artificial Analysis Intelligence Index). Nó hỗ trợ một cửa sổ ngữ cảnh 1 million token, đầu vào đa phương thức (văn bản + hình ảnh), gọi hàm, đầu ra có cấu trúc và lập luận.

Đối với nhà phát triển xây dựng ứng dụng AI — từ tác nhân thông minh và hệ thống RAG đến trợ lý lập trình và công cụ doanh nghiệp — Grok 4.3 mang lại sự kết hợp không thể đánh bại giữa năng lực, tốc độ và hiệu quả kinh tế.

Grok 4.3 là gì? Các tính năng chính

Grok 4.3 là mô hình chủ lực mới nhất đã được tiền huấn luyện của xAI, xây dựng dựa trên Grok 4.20 với các cải tiến kiến trúc và mốc kiến thức tháng 12 năm 2025. Nó nhấn mạnh thiết kế ưu tiên lập luận, mức độ ảo giác thấp và hiệu năng tác nhân thực tiễn.

Có gì mới trong Grok 4.3?

Thay đổi lớn nhất không chỉ là “một bước tăng mô hình” khác. Hướng dẫn chuyển đổi của xAI cho biết một số mô hình cũ sẽ bị ngừng hỗ trợ vào May 15, 2026, và khuyến nghị Grok 4.3 làm mô hình thay thế cho các mô hình lập luận và lập trình cũ như grok-4-fast-reasoning, grok-4-0709, grok-code-fast-1grok-3. Điều đó khiến Grok 4.3 trở thành trung tâm của chiến lược API hiện tại của xAI.

Grok 4.3 so với các thế hệ trước như Grok 4.20):

  • Cải thiện hiệu năng tác nhân và giảm tỷ lệ ảo giác.
  • Hiệu quả chi phí tốt hơn trên các benchmark (ví dụ: chi phí thấp hơn ~20% để chạy đầy đủ bộ Intelligence Index).
  • Nâng cao khả năng gọi công cụ và phản hồi chính xác.
  • Khả dụng trên nhiều khu vực (us-east-1, eu-west-1) với hạn mức cao (1,800 RPM, 10M TPM).

Nó xếp hạng cạnh tranh trên các bảng xếp hạng, thường đứng đầu ở các đánh giá về tác nhân và doanh nghiệp trong khi vẫn duy trì mức trí tuệ thuộc nhóm tiên phong.

Các tính năng chính của Grok 4.3

1) Lập luận tác nhân và sử dụng công cụ

Grok 4.3 xoay quanh lập luận mang tính tác nhân và việc sử dụng công cụ. Gọi hàm thể hiện vòng lặp tác nhân tiêu chuẩn: định nghĩa một công cụ, đưa nó vào yêu cầu, để mô hình trả về tool_call, thực thi hàm cục bộ, sau đó gửi kết quả lại để mô hình tiếp tục. Gọi hàm song song được bật theo mặc định, vì vậy mô hình có thể yêu cầu nhiều lời gọi công cụ trong một phản hồi.

2) Cửa sổ ngữ cảnh lớn

Grok 4.3 có một cửa sổ ngữ cảnh 1 million token, là quy mô quan trọng cho tài liệu dài, lịch sử trò chuyện dài, codebase và quy trình đa tệp. xAI cũng lưu ý hành vi định giá đặc biệt trên 200K ngữ cảnh, điều đáng đề cập trong phần chi phí sản xuất.

) 3Tìm kiếm web tích hợp và quy trình dữ liệu trực tiếp

Công cụ tìm kiếm web của xAI cho phép Grok tìm kiếm web theo thời gian thực, duyệt trang và trích xuất thông tin liên quan để phản hồi cập nhật. Tài liệu cũng cho biết web search có sẵn trên Responses API và khả năng live-search trên Chat Completions đã ngừng hỗ trợ, vì vậy Responses API là lựa chọn an toàn hơn về lâu dài cho công việc mới.

4) Vết lập luận và khả năng quan sát mức sử dụng

Đối với Grok 4.3, xAI cung cấp nội dung lập luận được tóm tắt và dữ liệu sử dụng như số token lập luận. Điều đó quan trọng cho gỡ lỗi, khả năng quan sát và kiểm soát chi phí. Trong tài liệu, xAI cho thấy cách stream tóm tắt lập luận và cách kiểm tra response.usage.output_tokens_details.reasoning_tokens.

Bắt đầu với Grok 4.3 API: Thiết lập từng bước

  1. Tạo tài khoản xAI: Đăng ký tại console.x.ai.
  2. Tạo API Key: Vào mục API Keys và tạo một khóa. Lưu trữ an toàn (dùng biến môi trường).
  3. Chọn phương thức truy cập:
  • Direct xAI API (base URL: https://api.x.ai/v1).
  • Được khuyến nghị: CometAPI để truy cập hợp nhất, có thể giảm giá (tối đa 20%), tín dụng miễn phí khi đăng ký và quản lý đa mô hình dễ dàng hơn.

Tại sao dùng CometAPI cho Grok 4.3?

  • Một API key cho hơn 500+ mô hình (bao gồm tất cả biến thể Grok).
  • Giao diện tương thích OpenAI hợp nhất.
  • Tiết kiệm chi phí, phân tích sử dụng và tính năng độ tin cậy.
  • Tín dụng khởi đầu miễn phí cho người dùng mới — hoàn hảo để thử Grok 4.3 mà không cần cam kết trước.

Truy cập CometAPI.com để bắt đầu với các mô hình Grok ngay hôm nay.

Cách sử dụng Grok 4.3 API

xAI cho biết API của họ tương thích với OpenAI và Anthropic SDKs, vì vậy việc chuyển đổi chủ yếu là tạo API key và đổi base URL. Trên thực tế, con đường tích hợp rẻ nhất là dùng CometAPI API, sau đó thêm công cụ, đầu ra có cấu trúc hoặc streaming tùy nhu cầu.

Bước 1: Tạo API key

Bắt đầu bằng cách tạo tài khoản CometAPI và tạo API key trong bảng điều khiển.

Bước 2: Chọn mô hình

Đối với hầu hết tác vụ văn bản và lập luận, hãy dùng grok-4.3. Grok 4.3 mạnh mẽ khuyến nghị mô hình này cho các bên gọi API, và trang tổng quan liệt kê Grok 4.3 là mô hình vượt trội về lập luận tác nhân, công việc tri thức và sử dụng công cụ.

Bước 3: Gửi yêu cầu đầu tiên

API tương thích OpenAI, vì vậy bạn có thể dùng SDK quen thuộc.

Python Example (OpenAI SDK)

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.getenv("XAI_API_KEY"),  # hoặc COMETAPI_KEY
    base_url="https://api.x.ai/v1"     # hoặc https://api.cometapi.com/v1 cho CometAPI
)

response = client.chat.completions.create(
    model="grok-4.3",  # hoặc grok-4.3-latest
    messages=[
        {"role": "system", "content": "Bạn là Grok, một AI hữu ích và trung thực tối đa."},
        {"role": "user", "content": "Hãy giải thích điện toán lượng tử bằng ngôn ngữ đơn giản với một phép so sánh."}
    ],
    temperature=0.7,
    max_tokens=1000
)

print(response.choices[0].message.content)

Sử dụng xAI SDK (Native)

from xai_sdk import Client
from xai_sdk.chat import user, system

client = Client(api_key=os.getenv("XAI_API_KEY"))
chat = client.chat.create(model="grok-4.3")
chat.append(system("Bạn là Grok..."))
chat.append(user("Nhập lời nhắc của bạn tại đây"))
response = chat.sample()
print(response.content)

Ví dụ Hiểu hình ảnh (Vision): Thêm URL hình ảnh vào tin nhắn cho các tác vụ đa phương thức như phân tích tài liệu hoặc hỏi đáp trực quan.

Đầu ra có cấu trúc & Gọi hàm

Định nghĩa công cụ hoặc JSON schema để có phản hồi đáng tin cậy, có thể phân tích cú pháp — quan trọng cho tác nhân và tích hợp.

Streaming Responses để có trải nghiệm người dùng tốt hơn trong ứng dụng chat. Nếu ứng dụng của bạn hiển thị quá trình tạo theo thời gian thực, hãy bật streaming. Grok 4.3 đặt "stream": true trong yêu cầu, và các mô hình lập luận có thể cần timeout dài hơn để tránh đóng kết nối quá sớm.

Prompt Caching: Tái sử dụng ngữ cảnh dài (ví dụ: system prompt hoặc tài liệu) để cắt giảm chi phí đáng kể (input được cache ở mức $0.20/M).

Mẹo tích hợp CometAPI: Hoán đổi base URL và dùng CometAPI key của bạn để chuyển đổi liền mạch giữa Grok 4.3, các mô hình xAI khác hoặc đối thủ mà không cần đổi code.

Tiếp tục hội thoại với previous_response_id

Tài liệu của xAI hỗ trợ tiếp tục phiên bằng cách truyền previous_response_id. Điều này hữu ích khi bạn muốn hành vi giống bộ nhớ mà không phải dựng lại toàn bộ trạng thái hội thoại mỗi lần.

first = client.responses.create(    model="grok-4.3",    input=[{"role": "user", "content": "Liệt kê ba trường hợp sử dụng cho Grok 4.3."}],)followup = client.responses.create(    model="grok-4.3",    previous_response_id=first.id,    input=[{"role": "user", "content": "Chuyển điều đó thành một checklist."}],)print(followup)

Grok 4.3 so với GPT-5.5: bạn nên chọn cái nào?

So sánh này nên được đặt trong bối cảnh quyết định sản phẩm, không phải cuộc đua benchmark “được ăn cả ngã về không”. Grok 4.3 là mô hình nhanh nhất và thông minh nhất của xAI cho các khối lượng công việc văn bản nói chung, trong khi GPT-5.5 là mô hình tiên phong mới nhất của OpenAI cho công việc chuyên nghiệp phức tạp nhất và hỗ trợ kiểm soát lập luận cấp cao hơn.

Bảng so sánh:

Tính năngGrok 4.3GPT-5.5Bên thắng/Ghi chú
Ngày phát hànhApril 30, 2026~April 2026Grok (mới hơn)
Cửa sổ ngữ cảnh1M tokens~1M tokensHòa
Giá Input$1.25 /M~$5 /MGrok (rẻ hơn 4x)
Giá Output$2.50 /M~$15-30 /MGrok (rẻ hơn tới 12x)
Intelligence Index53~60GPT-5.5
Tác nhân/Gọi công cụXuất sắc (đứng đầu BXH)Mạnh (Terminal-Bench cao)Grok về hiệu năng-chi phí
Tỷ lệ ảo giácThấp nhất trong nhómThấpGrok
Đa phương thứcVăn bản + Hình ảnh (Vision)Văn bản + Hình ảnhTương tự
Tốc độ/Độ trễDẫn đầu ngànhCạnh tranhGrok
Phù hợp nhất choSản xuất nhạy chi phí, tác nhânĐộ sâu benchmark tối đaTùy ngân sách

Kết luận chính: Grok 4.3 mang lại 80–90% hiệu năng hàng đầu với 10–20% chi phí, lý tưởng cho ứng dụng khối lượng lớn, tác nhân và doanh nghiệp. GPT-5.5 có thể nhỉnh hơn ở một số benchmark lập luận phức tạp nhưng với mức giá cao ảnh hưởng đến khả năng mở rộng.

Tính năng nâng cao và thực tiễn tốt nhất

1) Dùng prompt nhỏ nhất vẫn giữ đúng “hợp đồng” sản phẩm

Hướng dẫn GPT-5.5 của OpenAI hữu ích ngay cả khi bạn xây trên Grok: bắt đầu với prompt nhỏ nhất vẫn giữ đúng hợp đồng sản phẩm, sau đó tinh chỉnh system prompt, mô tả công cụ và định dạng đầu ra dựa trên ví dụ thực tế. Lời khuyên đó áp dụng trọn vẹn cho Grok 4.3.

2) Đặt mức độ lập luận phù hợp

Vì Grok 4.3 hỗ trợ nỗ lực lập luận thấp, trung bình và cao, đừng mặc định yêu cầu nào cũng ở mức tối đa. Dùng mức thấp cho câu hỏi nhanh hướng người dùng, và dành mức cao hơn cho lập kế hoạch, phân tích hoặc quy trình công cụ nhiều bước. xAI khuyến nghị rõ dùng mức thấp cho tác vụ ít nhạy về độ trễ.

3) Stream cho sản phẩm tương tác

Đối với giao diện chat, trợ lý trực tiếp và công cụ hỗ trợ khách hàng, streaming cải thiện độ trễ cảm nhận và làm sản phẩm phản hồi hơn. Streaming đặc biệt hữu ích cho phản hồi thời gian thực.

4) Dùng token được cache khi prompt lặp lại

xAI cache input tokens ở mức $0.20 per 1M tokens, rẻ hơn nhiều so với input thông thường. Điều đó tạo khác biệt thực sự cho system prompt lặp lại, template, khối policy và hướng dẫn dài không thay đổi giữa các yêu cầu.

5) Thêm timeout và logic retry

Các mô hình lập luận có thể tốn thời gian hơn các mô hình chat nhanh. Ví dụ của xAI đặt timeout dài hơn cho Grok 4.3, và timeout 3,600 giây trong các ví dụ kỳ vọng lập luận sâu. Hệ thống sản xuất nên dùng logic retry, circuit breaker và khả năng quan sát quanh các lời gọi công cụ.

6) Kiểm thử với tác vụ thực, không phải prompt đồ chơi

Một mô hình có thể trông tuyệt vời trên demo nhưng vẫn thất bại trên quy trình thực tế. Đánh giá Grok 4.3 với đầu vào của riêng bạn: ticket khách hàng, tài liệu kinh doanh, transcript hỗ trợ, tác vụ review mã và workflow tác nhân. Điều này đặc biệt quan trọng nếu bạn định so sánh trực tiếp với GPT-5.5.

Kết luận: Bắt đầu xây dựng với Grok 4.3 ngay hôm nay

Grok 4.3 dân chủ hóa AI tiên phong với tỷ lệ hiệu năng/giá thành, cửa sổ ngữ cảnh khổng lồ và API thân thiện với nhà phát triển. Dù bạn đang thử nghiệm hay mở rộng hệ thống sản xuất, nó mang lại giá trị to lớn.

Bước tiếp theo được khuyến nghị: Đăng ký tại CometAPI.com để truy cập ngay Grok 4.3 (và hàng trăm mô hình khác) với khả năng tiết kiệm và tín dụng miễn phí. Tạo khóa, thử các ví dụ trên và mở khóa năng lực AI mạnh mẽ mà không bị khóa nhà cung cấp.

Sẵn sàng giảm 20% chi phí phát triển AI?

Bắt đầu miễn phí trong vài phút. Bao gồm tín dụng dùng thử miễn phí. Không cần thẻ tín dụng.

Đọc thêm