Tổng quan nhanh về GPT-6 Astra
| Thông số | GPT-6 Astra |
|---|---|
| Nhà phát triển | OpenAI |
| ID model API | gpt-6-astra |
| Ngày phát hành | September 3, 2026 |
| Cửa sổ ngữ cảnh | 1,050,000 tokens |
| Đầu ra tối đa | 128,000 tokens |
| Mốc kiến thức | April 30, 2026 |
| Các phương thức đầu vào | Text, image |
| Phương thức đầu ra | Text |
| Mức độ suy luận | low, medium, high, xhigh, max |
| Giá đầu vào chuẩn | $10 / 1M tokens |
| Đầu vào đã lưu cache | $1 / 1M tokens |
| Ghi cache | $12.50 / 1M tokens |
| Giá đầu ra chuẩn | $50 / 1M tokens |
| Ngưỡng ngữ cảnh dài | More than 272K input tokens |
| Tinh chỉnh | Not supported |
| API khuyến nghị | Responses API for tool-rich workflows |
| Công cụ | Web search, file search, image generation, code interpreter, hosted shell, apply patch, computer use, MCP, tool search |
GPT-6 Astra là gì?
GPT-6 Astra là model chủ lực của OpenAI dành cho suy luận phức tạp, lập trình, sử dụng máy tính, nghiên cứu và các quy trình làm việc chuyên nghiệp. Nó được thiết kế không chỉ để tạo văn bản, mà còn để thực thi các tác vụ dài, nhiều bước trên phần mềm, trình duyệt, mã, tài liệu và các công cụ bên ngoài.
OpenAI định vị Astra như một bước tiến lớn trong AI có tính tác tử, kết hợp khả năng suy luận mạnh hơn với khả năng sử dụng máy tính và tuân thủ hướng dẫn được cải thiện. Cửa sổ ngữ cảnh 1.05 triệu token cũng khiến nó phù hợp với các ứng dụng cần kho lưu trữ lớn, tài liệu dài hoặc lịch sử tác vụ kéo dài luôn sẵn có trong một quy trình làm việc duy nhất.
Một điểm khác biệt đặc biệt quan trọng là Astra được tối ưu cho hoàn thành tác vụ đầu-cuối. Thay vì coi lập trình, duyệt web, nghiên cứu và tạo tài liệu là các khả năng tách rời, model này được thiết kế để phối hợp chúng như các phần của một quy trình lớn hơn.
Tính năng chính của GPT-6 Astra
- Ngữ cảnh dài 1.05M token: Cửa sổ ngữ cảnh hơn một triệu token cho phép ứng dụng cung cấp các codebase rất lớn, bộ sưu tập tài liệu, tư liệu nghiên cứu và lịch sử tác vụ chạy lâu.
- Suy luận nâng cao: GPT-6 Astra hỗ trợ
low,medium,high,xhighvàmaxmức độ suy luận, cho phép nhà phát triển cân đối chi phí và độ trễ với chiều sâu suy luận. - Khả năng sử dụng máy tính: Astra có thể vận hành môi trường máy tính thông qua các công cụ được hỗ trợ, phù hợp cho tự động hóa trình duyệt, quy trình phần mềm, tương tác UI và các tác vụ tác tử khác.
- Điều phối công cụ mang tính tác tử: Model hỗ trợ web search, file search, code interpreter, hosted shell, Apply Patch, MCP, tool search và các khả năng của Responses API.
- Gọi công cụ bất đồng bộ và điều hướng giữa lượt: Astra có thể tiếp tục suy luận trong khi một thao tác công cụ bất đồng bộ đang chạy, và nhà phát triển có thể cung cấp chỉ dẫn bổ sung trong khi một tác vụ đang diễn ra.
- Căn chỉnh ranh giới tác vụ mạnh hơn: OpenAI cho biết Astra được thiết kế để hiểu ý định người dùng tốt hơn, tôn trọng ranh giới tác vụ, truyền đạt mức độ không chắc chắn và tránh các hành động ngoài phạm vi được ủy quyền.
Hiệu năng benchmark của GPT-6 Astra
Điểm khác biệt mạnh nhất của GPT-6 Astra xuất hiện ở các benchmark về tác tử, sử dụng máy tính, khoa học, lập trình và công việc chuyên nghiệp, thay vì chỉ các đánh giá tạo văn bản thông thường.
| Benchmark | GPT-6 Astra | GPT-5.6 Sol | Claude Opus 5 / Fable 5.1 |
|---|---|---|---|
| Agents' Last Exam | 59.3% | 53.6% | Opus 5: 55.5% |
| OSWorld 2.0 | 72.6% | 65.7% | Opus 5: 70.2% |
| ScreenSpot-Pro | 92.7% | 76.9% | Fable 5: 87.3% |
| AutomationBench | 41.4% | 18.1% | Fable 5.1: 31.4% |
| BenchCAD | 95.9% | 83.3% | Fable 5.1: 84.3% |
| BrowseComp | 91.5% | 90.4% | Opus 5: 90.8% |
| Terminal-Bench 4.0 | 57.9% | 37.3% | Fable 5.1: 55.8% |
| GPQA Diamond | 96.0% | — | — |
| Artificial Analysis Intelligence Index | 61.2 | 60.9 | Fable 5.1: 65.7 |
OpenAI báo cáo 98% trên FrontierMath Tier 4, 99.9% trên ARC-AGI-3, và 100% trên ExploitBench. Những con số nổi bật này nên được hiểu như kết quả cụ thể theo benchmark hơn là bằng chứng cho thấy Astra vượt trội ở mọi khối lượng công việc.
Kết quả sử dụng máy tính đặc biệt đáng chú ý: Astra đạt 72.6% trên OSWorld 2.0 và 92.7% trên ScreenSpot-Pro trong so sánh do OpenAI báo cáo, cho thấy cải thiện đáng kể so với GPT-5.6 Sol trên các tác vụ tương tác máy tính trực quan.
Trên Terminal-Bench 4.0, Astra đạt 57.9%, so với 37.3% của GPT-5.6 Sol và 55.8% của Claude Fable 5.1 trong so sánh của OpenAI.
GPT-6 Astra so với GPT-5.6 Sol và Claude Opus 5
| Mô hình | Phù hợp nhất cho | Ngữ cảnh | Lợi thế chính |
|---|---|---|---|
| GPT-6 Astra | Tác tử phức tạp, lập trình, sử dụng máy tính, nghiên cứu | 1.05M | Định vị tác tử đầu-cuối mạnh nhất |
| GPT-5.6 Sol | Khối lượng công việc chuyên nghiệp với hiệu quả chi phí tốt hơn | 1.05M | Chi phí token thấp hơn |
| Claude Opus 5 | Lập trình, công việc tri thức, suy luận phức tạp | Not established here | Hiệu năng chuyên nghiệp và suy luận mạnh |
Khác biệt thực tiễn lớn nhất giữa GPT-6 Astra và GPT-5.6 Sol là năng lực so với chi phí. Cả hai đều có cửa sổ ngữ cảnh 1.05M token và đầu ra tối đa 128K, nhưng Astra có chi phí $10/$50 mỗi triệu token đầu vào/đầu ra, so với $4/$20 của Sol.
Vì vậy, Astra phù hợp nhất khi khả năng suy luận được cải thiện, sử dụng máy tính, điều phối công cụ hoặc hoàn thành tác vụ có thể bù đắp mức giá theo token cao hơn đáng kể. Đối với việc tạo nội dung thường xuyên khối lượng lớn, GPT-5.6 Sol hoặc Terra có thể mang lại cân bằng chi phí/hiệu năng tốt hơn.
Trường hợp sử dụng GPT-6 Astra
Kỹ thuật phần mềm tự động
Astra có thể kết hợp suy luận, tạo mã, thực thi shell, kiểm tra kho lưu trữ và Apply Patch vào các quy trình kỹ thuật phần mềm dài hơn. Điều này khiến nó đặc biệt phù hợp cho gỡ lỗi ở quy mô kho mã, tái cấu trúc, triển khai, kiểm thử và bảo trì.
Tác tử sử dụng máy tính
Sử dụng máy tính là một trong những yếu tố khác biệt rõ ràng nhất của Astra. Ứng dụng có thể dùng nó cho tương tác trình duyệt, vận hành phần mềm, kiểm thử UI, điền biểu mẫu và các tác vụ nơi một tác tử cần tương tác với giao diện đồ họa thay vì chỉ trả về văn bản.
Nghiên cứu chuyên sâu
Sự kết hợp giữa cửa sổ ngữ cảnh 1.05M token, web search, file search, suy luận và điều phối công cụ khiến Astra phù hợp cho các hệ thống nghiên cứu cần thu thập, so sánh, phân tích và tổng hợp lượng lớn thông tin.
Quy trình khoa học
OpenAI báo cáo kết quả mạnh trên các benchmark suy luận khoa học và trình diễn Astra làm việc với phần mềm khoa học và quy trình phân tích dữ liệu. Điều này khiến nó phù hợp cho các trợ lý nghiên cứu kết hợp suy luận khoa học với công cụ phần mềm bên ngoài.
Tự động hóa chuyên nghiệp
Astra có thể tự động hóa các quy trình liên quan đến tài liệu, bảng tính, duyệt web, môi trường phần mềm và đầu ra có cấu trúc. Kết quả trên AutomationBench và công việc chuyên nghiệp của OpenAI gợi ý giá trị đặc biệt cho tự động hóa công việc tri thức nhiều bước.
Điều phối tác tử phức tạp
Astra hỗ trợ MCP, tool search, gọi công cụ bất đồng bộ, quy trình nhiều tác tử và hạ tầng tác tử khác, khiến nó là ứng viên cho các hệ thống nơi model phải quyết định công cụ nào cần dùng và phối hợp nhiều giai đoạn công việc.
Hạn chế của GPT-6 Astra
GPT-6 Astra không đơn giản là bản thay thế thả vào cho mọi model của OpenAI.
Mức giá chuẩn $10/M đầu vào và $50/M đầu ra cao hơn đáng kể so với GPT-5.6 Sol và Terra, nên dùng Astra cho phân loại, trích xuất, tóm tắt đơn giản hoặc tạo nội dung khối lượng lớn có thể tốn kém không cần thiết.
Các nhà phát triển chuyển từ các model suy luận trước đó của OpenAI cũng cần tính đến thay đổi tham số. OpenAI khuyến nghị bỏ các tham số không được hỗ trợ như temperature, top_p và top_logprobs, và lưu ý rằng Astra không hỗ trợ mức suy luận none. Việc gọi công cụ nên sử dụng Responses API.
Astra cũng không hỗ trợ tinh chỉnh, và audio cũng như video không được hỗ trợ như các phương thức model theo đặc tả hiện tại.