Thông số kỹ thuật của GPT-5.4 Mini
| Hạng mục | GPT-5.4 Mini (ước tính từ nguồn chính thức + đối chiếu chéo) |
|---|---|
| Dòng mô hình | Dòng GPT-5.4 (biến thể “mini” tối ưu chi phí) |
| Nhà cung cấp | OpenAI |
| Loại đầu vào | Văn bản, Hình ảnh |
| Loại đầu ra | Văn bản |
| Cửa sổ ngữ cảnh | 400,000 token |
| Số token đầu ra tối đa | 128,000 token |
| Mốc kiến thức | ~31 tháng 5, 2024 (kế thừa dòng mini) |
| Hỗ trợ suy luận | Có (nhẹ so với GPT-5.4 đầy đủ) |
| Hỗ trợ công cụ | Function calling, web search, file search, agents (suy luận từ họ GPT-5) |
| Định vị | Mô hình tốc độ cao, chi phí hiệu quả gần mức tiên phong |
GPT-5.4 Mini là gì?
GPT-5.4 Mini là biến thể tốc độ cao, tối ưu chi phí của GPT-5.4 được thiết kế cho khối lượng công việc nhạy cảm độ trễ và lưu lượng lớn. Nó mang một phần đáng kể năng lực suy luận, lập trình và đa phương thức của GPT-5.4 vào một mô hình nhỏ hơn, nhanh hơn, được tối ưu cho hệ thống vận hành ở quy mô sản xuất.
So với các mô hình “mini” trước đây, GPT-5.4 Mini được định vị là một mô hình nhỏ gần mức tiên phong, nghĩa là tiệm cận hiệu năng cấp flagship đồng thời giảm mạnh chi phí và thời gian phản hồi.
Tính năng chính của GPT-5.4 Mini
- Suy luận tốc độ cao: Tối ưu cho ứng dụng độ trễ thấp như chatbot, copilot và hệ thống thời gian thực
- Cửa sổ ngữ cảnh lớn (400K): Hỗ trợ tài liệu dài, quy trình nhiều bước và bộ nhớ tác nhân
- Khả năng lập trình mạnh và hỗ trợ tác nhân: Thiết kế cho việc sử dụng công cụ, suy luận nhiều bước và nhiệm vụ được ủy nhiệm cho tác nhân con
- Đầu vào đa phương thức: Nhận cả văn bản và hình ảnh cho quy trình phong phú hơn
- Mở rộng hiệu quả chi phí: Rẻ hơn đáng kể so với GPT-5.4 nhưng vẫn giữ khả năng suy luận mạnh
- Tối ưu hóa chuỗi tác nhân: Lý tưởng cho kiến trúc đa mô hình nơi mô hình lớn lập kế hoạch và mô hình mini thực thi
Hiệu năng benchmark của GPT-5.4 Mini
- Tiệm cận hiệu năng GPT-5.4 trên các bài tập lập trình kiểu SWE-Bench (~94–95% hiệu năng của flagship) (ước tính được đối chiếu chéo từ các thảo luận phát hành)
- Cải thiện đáng kể so với GPT-5 Mini về:
- độ chính xác suy luận
- độ tin cậy khi dùng công cụ
- hiểu biết đa phương thức
- Thiết kế để vượt các thế hệ “mini” trước đó trong quy trình tác nhân và benchmark lập trình
- • • • • •
- • • • • •
- • • • • •
- • • • • •
- đo tốc độ: những người thử nghiệm API sớm báo cáo ~180–190 token/giây trên GPT-5.4 Mini (so với ~55–120 t/s cho các biến thể GPT-5 mini cũ hơn tùy chế độ ưu tiên).
👉 Điểm mấu chốt: GPT-5.4 Mini mang lại hiệu năng gần mức tiên phong với chi phí và độ trễ chỉ bằng một phần, rất phù hợp cho hệ thống có thể mở rộng.

Các trường hợp sử dụng tiêu biểu
- Trợ lý và trình soạn thảo mã (plugin IDE, Copilot): phân tích ngữ cảnh nhanh, khám phá codebase và hoàn thành nhanh khiến GPT-5.4 Mini lý tưởng cho gợi ý trong trình soạn thảo nơi time-to-first-token rất quan trọng. GitHub Copilot là một tích hợp sớm.
- Tác nhân phụ / worker được ủy quyền: nơi một tác nhân chính ủy thác các tác vụ ngắn, nhanh (định dạng, bước suy luận nhỏ, tìm kiếm kiểu grep) cho một worker rẻ và nhanh. OpenAI định vị mini/nano cho các vai trò này.
- Tự động hóa API lưu lượng lớn: sinh mã hàng loạt, phân loại ticket tự động, tóm tắt log ở quy mô lớn, nơi chi phí mỗi lần gọi và độ trễ là ràng buộc chính. Số liệu thông lượng từ cộng đồng cho thấy lợi thế vận hành đáng kể cho mini.
- Bao bọc công cụ và chuỗi công cụ: các lần gọi công cụ nhanh, nơi mô hình điều phối việc gọi công cụ bên ngoài (search, grep, chạy kiểm thử) và trả về đầu ra gọn, có thể hành động. Dòng GPT-5.4 bao gồm khả năng “computer use” được cải thiện.
Cách truy cập API GPT-5.4 Mini
Bước 1: Đăng ký API Key
Đăng nhập vào cometapi.com. Nếu bạn chưa là người dùng của chúng tôi, vui lòng đăng ký trước. Đăng nhập vào CometAPI console. Lấy khóa API thông tin xác thực truy cập của giao diện. Nhấp “Add Token” tại API token trong trung tâm cá nhân, lấy khóa token: sk-xxxxx và gửi.

Bước 2: Gửi yêu cầu đến API GPT-5.4 Mini
Chọn điểm cuối “gpt-5.4-mini” để gửi yêu cầu API và thiết lập thân yêu cầu. Phương thức yêu cầu và thân yêu cầu được lấy từ tài liệu API trên trang web của chúng tôi. Trang web cũng cung cấp Apifox test để bạn tiện thử nghiệm. Thay thế <YOUR_API_KEY> bằng CometAPI key thực tế từ tài khoản của bạn. Base URL là Chat Completions và Responses.
Chèn câu hỏi hoặc yêu cầu của bạn vào trường content — đây là nội dung mà mô hình sẽ phản hồi. Xử lý phản hồi API để lấy câu trả lời được tạo ra.
Bước 3: Truy xuất và xác minh kết quả
Xử lý phản hồi API để lấy câu trả lời được tạo ra. Sau khi xử lý, API phản hồi trạng thái tác vụ và dữ liệu đầu ra.