Thông số kỹ thuật của GPT-5.4 Mini
| Mục | GPT-5.4 Mini (ước tính từ nguồn chính thức + đối chứng chéo) |
|---|---|
| Họ mô hình | Dòng GPT-5.4 (biến thể “mini” tiết kiệm chi phí) |
| Nhà cung cấp | OpenAI |
| Kiểu đầu vào | Văn bản, Hình ảnh |
| Kiểu đầu ra | Văn bản |
| Cửa sổ ngữ cảnh | 400.000 token |
| Số token đầu ra tối đa | 128.000 token |
| Mốc kiến thức | ~31 tháng 5, 2024 (kế thừa dòng mini) |
| Hỗ trợ suy luận | Có (nhẹ so với GPT-5.4 đầy đủ) |
| Hỗ trợ công cụ | Gọi hàm, tìm kiếm web, tìm kiếm tệp, tác tử (suy ra từ họ GPT-5) |
| Định vị | Mô hình gần mức tiên tiến nhất, tốc độ cao, chi phí hiệu quả |
GPT-5.4 Mini là gì?
GPT-5.4 Mini là biến thể tốc độ cao, tiết kiệm chi phí của GPT-5.4 được thiết kế cho khối lượng công việc nhạy cảm với độ trễ và lưu lượng lớn. Nó mang phần đáng kể các khả năng suy luận, lập trình và đa phương thức của GPT-5.4 vào một mô hình nhỏ hơn, nhanh hơn, được tối ưu cho các hệ thống ở quy mô sản xuất.
So với các mô hình “mini” trước đây, GPT-5.4 Mini được định vị là một mô hình nhỏ gần mức tiên tiến nhất, nghĩa là nó tiệm cận hiệu năng cấp flagship trong khi giảm mạnh chi phí và thời gian phản hồi.
Các tính năng chính của GPT-5.4 Mini
- Suy luận tốc độ cao: Được tối ưu cho các ứng dụng độ trễ thấp như chatbot, copilot và hệ thống thời gian thực
- Cửa sổ ngữ cảnh lớn (400K): Hỗ trợ tài liệu dài, quy trình nhiều bước và bộ nhớ tác tử
- Hỗ trợ lập trình và tác tử mạnh: Được thiết kế cho việc sử dụng công cụ, suy luận nhiều bước và các nhiệm vụ tác tử phụ được ủy quyền
- Đầu vào đa phương thức: Chấp nhận cả văn bản và hình ảnh để có quy trình phong phú hơn
- Mở rộng hiệu quả chi phí: Rẻ hơn đáng kể so với GPT-5.4 trong khi vẫn giữ khả năng suy luận mạnh
- Tối ưu pipeline tác tử: Lý tưởng cho kiến trúc đa mô hình, nơi mô hình lớn lập kế hoạch và mô hình mini thực thi
Hiệu năng benchmark của GPT-5.4 Mini
- Tiệm cận hiệu năng GPT-5.4 trên các tác vụ lập trình kiểu SWE-Bench (~94–95% hiệu năng của flagship) (ước tính được đối chứng chéo từ thảo luận phát hành)
- Cải thiện đáng kể so với GPT-5 Mini ở:
- độ chính xác suy luận
- độ tin cậy khi sử dụng công cụ
- khả năng hiểu đa phương thức
- Được thiết kế để vượt trội so với các thế hệ “mini” trước trong quy trình tác tử và các benchmark lập trình
- đo tốc độ: những người thử nghiệm API sớm báo cáo ~180–190 token/giây trên GPT-5.4 Mini (so với ~55–120 t/s cho các biến thể GPT-5 mini cũ tùy chế độ ưu tiên).
👉 Kết luận chính: GPT-5.4 Mini mang lại hiệu năng gần mức tiên tiến nhất với chi phí và độ trễ chỉ bằng một phần, lý tưởng cho các hệ thống có thể mở rộng.

Trường hợp sử dụng tiêu biểu
- Trợ lý và trình biên tập mã (plugin IDE, Copilot): phân tích ngữ cảnh nhanh, khám phá cơ sở mã và gợi ý/hoàn thành nhanh khiến GPT-5.4 Mini lý tưởng cho gợi ý ngay trong trình soạn thảo, nơi thời gian tới token đầu tiên rất quan trọng. GitHub Copilot là một tích hợp sớm.
- Tác tử phụ / tác tử được ủy quyền: nơi một tác tử chủ giao các tác vụ ngắn, nhanh (định dạng, bước suy luận nhỏ, tìm kiếm kiểu grep) cho một tác tử rẻ và nhanh. OpenAI định vị mini/nano cho các vai trò này.
- Tự động hóa API lưu lượng lớn: sinh mã hàng loạt, phân loại ticket tự động, tóm tắt log ở quy mô lớn, nơi chi phí mỗi lần gọi và độ trễ là ràng buộc chính. Các con số thông lượng từ cộng đồng cho thấy lợi thế vận hành đáng kể cho mini.
- Bao bọc công cụ và chuỗi công cụ: các lần gọi công cụ nhanh, nơi mô hình điều phối các lời gọi tới công cụ bên ngoài (search, grep, chạy kiểm thử) và trả về đầu ra gọn, có thể hành động. Dòng GPT-5.4 bao gồm các khả năng “computer use” được cải thiện.
Cách truy cập API GPT-5.4 Mini
Bước 1: Đăng ký lấy khóa API
Đăng nhập vào cometapi.com. Nếu bạn chưa là người dùng của chúng tôi, vui lòng đăng ký trước. Đăng nhập vào CometAPI console. Lấy khóa API thông tin xác thực của giao diện. Nhấp “Add Token” tại API token trong trung tâm cá nhân, nhận khóa token: sk-xxxxx và gửi.

Bước 2: Gửi yêu cầu tới API GPT-5.4 Mini
Chọn endpoint “gpt-5.4-mini” để gửi yêu cầu API và thiết lập phần thân yêu cầu. Phương thức yêu cầu và phần thân yêu cầu được lấy từ tài liệu API trên trang web của chúng tôi. Trang web cũng cung cấp kiểm thử Apifox để bạn tiện sử dụng. Thay thế <YOUR_API_KEY> bằng khóa CometAPI thực tế từ tài khoản của bạn. base url là Chat Completions và Responses.
Chèn câu hỏi hoặc yêu cầu của bạn vào trường content — đây là nội dung mà mô hình sẽ phản hồi. Xử lý phản hồi API để lấy câu trả lời được tạo.
Bước 3: Truy xuất và xác minh kết quả
Xử lý phản hồi API để lấy câu trả lời được tạo. Sau khi xử lý, API phản hồi trạng thái tác vụ và dữ liệu đầu ra.