
Vào tháng 2 năm 2026, OpenAI giới thiệu GPT-5.3-Codex-Spark, một biến thể bản xem trước phục vụ nghiên cứu thuộc dòng Codex, được tối ưu hóa đặc biệt cho lập trình thời gian thực. Codex-Spark đánh đổi kích thước mô hình để lấy độ trễ cực thấp và thông lượng token rất cao — OpenAI cho biết tốc độ sinh >1,000 tokens/sec và cửa sổ ngữ cảnh 128k token cho mô hình này khi chạy trên hạ tầng phần cứng độ trễ thấp được cung cấp trong quan hệ hợp tác với Cerebras. Bản phát hành nhắm tới các quy trình làm việc tương tác của nhà phát triển: lập trình trực tiếp, chỉnh sửa tức thì, các vòng lặp chỉnh sửa–biên dịch–chạy chặt chẽ bên trong các IDE, và các quy trình lập trình dựa trên tác tử, nơi khả năng phản hồi là tối quan trọng.

Bản cập nhật mới nhất của OpenAI cho ChatGPT — được tiếp thị dưới tên GPT-5.3 Chat (thường được gọi trong giao diện sản phẩm là GPT-5.3 Instant) — là một sự tiến hóa có mục tiêu của mô hình hội thoại được sử dụng rộng rãi nhất của công ty. Thay vì hứa hẹn một bước nhảy vọt về khả năng suy luận thuần túy, bản phát hành tập trung vào việc trau chuốt trải nghiệm hằng ngày: ít các lần từ chối không cần thiết hơn, ít “ảo giác” hơn (các dữ kiện bịa đặt hoặc không chính xác), tông giọng trò chuyện mượt mà hơn, khả năng tích hợp ngữ cảnh web tốt hơn và giảm ma sát trong các cuộc đối thoại kéo dài. Việc triển khai bắt đầu dưới dạng một bản cập nhật cho mô hình mặc định/Instant của ChatGPT và đang được định vị như một cải tiến đối với phần lớn các tương tác hằng ngày mà người dùng thực hiện với trợ lý.

Vào tháng 2 năm 2026, OpenAI ra mắt hai thành viên thuộc họ “Codex” có quan hệ mật thiết — nhưng khác biệt về chiến lược —: GPT-5.3-Codex (một mô hình lập trình theo hướng tác nhân với năng lực cao) và GPT-5.3-Codex-Spark (một biến thể nhỏ hơn, độ trễ siêu thấp, tối ưu cho lập trình tương tác). Cùng nhau, chúng thể hiện cách tiếp cận kép của OpenAI nhằm phục vụ cả “tư duy sâu” và “hành động nhanh” trong quy trình kỹ nghệ phần mềm: một mô hình đẩy cao trần trí tuệ lập trình và hành vi tác nhân được dẫn dắt bởi công cụ, và một mô hình ưu tiên tính tương tác theo thời gian thực cho giao diện dành cho nhà phát triển.

Cả hai đợt ra mắt (Anthropic’s Claude Opus 4.6 và OpenAI’s GPT-5.3-Codex) đều thúc đẩy lập trình theo hướng tác tử và suy luận ngữ cảnh dài, nhưng lại đi theo những hướng hơi khác nhau. Opus 4.6 nghiêng về các cửa sổ ngữ cảnh rất lớn, các quy trình an toàn/phân tích và một chế độ "nhanh" mới; GPT-5.3-Codex đẩy mạnh các điểm chuẩn kỹ thuật phần mềm theo hướng tác tử và tích hợp IDE/CLI chặt chẽ hơn. Mẫu "tốt hơn" phụ thuộc vào nhu cầu của bạn: ngữ cảnh cực lớn, soát xét mã ưu tiên an toàn và các tác tử chạy lâu (Opus 4.6) — hoặc hiệu năng trên các điểm chuẩn viết mã thuần nhỉnh hơn đôi chút, tốc độ và tích hợp Codex tức thì (GPT-5.3-Codex). Xem phân tích chuyên sâu bên dưới.

Vào ngày 5 tháng 2 năm 2026, OpenAI công bố GPT-5.3 Codex, một bản nâng cấp tập trung cho dòng Codex của mình, kết hợp khả năng viết mã nâng cao với khả năng lập luận chuyên môn rộng hơn, suy luận nhanh hơn và các quy trình làm việc “agentic” sâu hơn. Bản phát hành này mang đến một ứng dụng Codex trên máy tính để bàn mới và mở rộng khả năng truy cập trên toàn hệ sinh thái Codex (CLI, tiện ích mở rộng IDE, web), kèm quyền truy cập API (được hứa hẹn “soon").