Siêu dữ liệu SEO
TL;DR
- Đặc tả API chính thức hiện tại liệt kê cửa sổ ngữ cảnh 400K, đầu ra tối đa 128K, mốc kiến thức ngày 16 tháng 2 năm 2026, đầu vào hình ảnh, token suy luận, streaming, gọi hàm, đầu ra có cấu trúc và bề mặt công cụ Responses API rộng.
GPT-5.6-Cyber là gì?
OpenAI mô tả GPT-5.6-Cyber là một bí danh cho các mô hình an ninh mạng mục đích chuyên dụng tiên tiến nhất dành cho những người bảo vệ đã được phê duyệt. Công việc dự kiến bao gồm nghiên cứu lỗ hổng được ủy quyền nâng cao, xác thực khai thác và kiểm thử bảo mật. Mô hình không được định vị như một “chế độ hacking” cho người dùng; quyền truy cập được quản trị bởi chương trình Daybreak và các kiểm soát ủy quyền.
Thông số kỹ thuật chính của GPT-5.6-Cyber
| Thông số | GPT-5.6-Cyber |
|---|---|
| Nhà cung cấp | OpenAI |
| Model ID | gpt-5.6-cyber |
| Lớp mô hình | Mô hình suy luận an ninh mạng mục đích chuyên dụng |
| Mô hình nền | GPT-5.6 Sol |
| Đường truy cập chính | Daybreak Red / phê duyệt và cung cấp riêng |
| Cửa sổ ngữ cảnh | 400,000 token |
| Đầu ra tối đa | 128,000 token |
| Mốc kiến thức | February 16, 2026 |
| Văn bản | Đầu vào và đầu ra |
| Hình ảnh | Chỉ đầu vào |
| Âm thanh / video | Không hỗ trợ |
| Token suy luận | Hỗ trợ |
| Streaming | Hỗ trợ |
| Gọi hàm | Hỗ trợ |
| Đầu ra có cấu trúc | Hỗ trợ |
| Tinh chỉnh | Không hỗ trợ |
| Responses API | Hỗ trợ |
| Chat Completions | Hỗ trợ |
Vì sao OpenAI xây dựng GPT-5.6-Cyber?
Thông báo Daybreak của OpenAI giải thích trực tiếp vấn đề triển khai: các biện pháp bảo vệ an ninh mạng ở cấp hệ thống có thể ngăn chặn lạm dụng, nhưng cũng có thể chặn công việc phòng thủ hợp pháp. Daybreak Blue giảm ma sát đó cho sử dụng phòng thủ rộng rãi. Tuy ngay cả khi các rào chắn ở cấp hệ thống được gỡ bỏ, Sol vẫn có thể từ chối các yêu cầu có tính lưỡng dụng cao ở cấp mô hình.
Daybreak Blue vs Daybreak Red
| Khía cạnh | Daybreak Blue | Daybreak Red |
|---|---|---|
| Mô hình lõi | Các mô hình tổng quát Frontier như GPT-5.6 Sol | Các mô hình an ninh mạng mục đích chuyên dụng như GPT-5.6-Cyber |
| Điểm khởi đầu tốt nhất | Khuyến nghị cho hầu hết người phòng thủ | Dành cho các đội cần quy trình làm việc chuyên gia nâng cao |
| Công việc điển hình | Phát hiện lỗ hổng, rà soát mã an toàn, phân tích malware, ứng phó sự cố, xác thực bản vá | Nghiên cứu lỗ hổng nâng cao, xác thực khai thác, kiểm thử xâm nhập, red teaming |
| Tỷ lệ hoàn thành nâng cao trong đánh giá của OpenAI | 2,0% đối với Sol trong Blue | 95,0% đối với GPT-5.6-Cyber |
| Truy cập | Người phòng thủ được phê duyệt | Người phòng thủ được phê duyệt với trường hợp sử dụng rủi ro cao hơn |
| Kiểm soát vận hành | Xác minh danh tính, bảo mật tài khoản, giám sát, hạn chế sử dụng được phê duyệt, cam kết pháp lý | Cùng các kiểm soát lõi, với nhu cầu cô lập, kiểm soát phạm vi và rà soát mạnh hơn |
Hiệu năng benchmark của GPT-5.6-Cyber
Tỷ lệ hoàn thành An ninh mạng nâng cao
| Cấu hình mô hình / truy cập | Tỷ lệ hoàn thành |
|---|---|
| GPT-5.6-Cyber — Daybreak Red | 95,0% |
| GPT-5.5-Cyber — Daybreak Red | 57,3% |
| GPT-5.6 Sol — Daybreak Blue | 2,0% |
| GPT-5.6 Sol — bật rào chắn | 1,5% |
ExploitGym
System card GPT-5.6 là bối cảnh hữu ích cho thấy gia đình Sol nền tảng vốn đã mạnh trong phát triển khai thác có kiểm soát. Thông báo Cyber cho biết mô hình chuyên gia tiến xa hơn baseline Sol đó trên ExploitGym.
Đánh giá phát hiện zero-day
Đánh giá zero-day nội bộ của OpenAI cung cấp cho mỗi mô hình bản phát hành hiện tại của một kho mã nguồn mở và yêu cầu tạo các exploit PoC tác động tối đa cùng bài viết kỹ thuật. Chấm điểm bao phủ mức độ nghiêm trọng, tác động, hiệu chuẩn và chất lượng báo cáo. GPT-5.6-Cyber với Daybreak Red vượt trội so với GPT-5.6 Sol với Daybreak Blue trong đánh giá này.
Phát hiện lỗ hổng và viết báo cáo
Trong đánh giá Phát hiện Lỗ hổng và Viết Báo cáo của OpenAI, cả hai biến thể GPT-5.6 đều cải thiện so với GPT-5.5-Cyber, nhưng GPT-5.6-Cyber thấp hơn GPT-5.6 Sol. OpenAI cho rằng chênh lệch một phần do Cyber tạo báo cáo ngắn hơn, ít chi tiết hơn.
ExploitBench
ExploitBench đánh giá liệu một agent có thể biến một lỗ hổng V8 thành một exploit hoàn chỉnh trong khi các biện pháp bảo vệ vẫn được bật. GPT-5.6 Sol thể hiện tốt nhất và sử dụng token hiệu quả hơn trong thiết lập 300 lượt chuẩn; ở 600 lượt, khoảng cách giữa Sol và Cyber thu hẹp.
| Đánh giá | Kết quả GPT-5.6-Cyber | Ý nghĩa kết quả |
|---|---|---|
| Tỷ lệ hoàn thành An ninh mạng nâng cao | 95,0%; +37,7 điểm phần trăm so với GPT-5.5-Cyber | Ma sát từ chối thấp hơn nhiều trên tập yêu cầu nâng cao cụ thể |
| ExploitGym | Vượt GPT-5.6 Sol và GPT-5.5-Cyber | Chuyên môn phát triển khai thác có kiểm soát mạnh hơn |
| Đánh giá zero-day nội bộ | Vượt Sol Blue | Nghiên cứu lỗ hổng mới chuyên sâu tốt hơn trên đánh giá nội bộ của OpenAI |
| Phát hiện lỗ hổng + viết báo cáo | Thấp hơn GPT-5.6 Sol; cao hơn baseline Cyber cũ | Sol vẫn mạnh hơn cho một số khối lượng công việc báo cáo end-to-end |
| ExploitBench — 300 lượt | Thấp hơn Sol | Sol mạnh hơn và tiết kiệm token hơn trong thiết lập khai thác khó chuẩn |
| ExploitBench — 600 lượt | Khoảng cách thu hẹp | Ngân sách agent lớn hơn giúp Cyber thu hẹp một phần khác biệt |
95% thực sự có nghĩa là gì?
Con số 95,0% là tỷ lệ hoàn thành, không phải là điểm chính xác, thành công khai thác hay phát hiện lỗ hổng. Nó đo tần suất GPT-5.6-Cyber phản hồi một tập các yêu cầu an ninh mạng nâng cao liên quan đến chuỗi exploit, bỏ qua xác thực, leo thang đặc quyền và các kịch bản liên quan. Hãy đọc cùng với ExploitGym, đánh giá zero-day, chất lượng viết báo cáo và ExploitBench.
GPT-5.6-Cyber vs GPT-5.6 Sol vs GPT-5.5-Cyber
| Khía cạnh | GPT-5.6-Cyber | GPT-5.6 Sol | GPT-5.5-Cyber |
|---|---|---|---|
| Định vị | Chuyên gia an ninh mạng | Đầu bảng tổng quát | Thế hệ chuyên gia trước |
| Nền tảng | Xây dựng trên GPT-5.6 Sol | Đầu bảng gia đình GPT-5.6 | Thế hệ GPT-5.5 |
| Truy cập chính | Daybreak Red / truy cập được phê duyệt | API chuẩn và Daybreak Blue | Daybreak Red / truy cập tin cậy |
| Cửa sổ ngữ cảnh | 400K | 1,05M | Không so sánh ở đây |
| Đầu ra tối đa | 128K | 128K | Không so sánh ở đây |
| Hoàn thành An ninh nâng cao | 95,0% | 2,0% Blue / 1,5% chuẩn | 57,3% |
| ExploitGym | Tốt nhất trong ba theo thông báo Cyber của OpenAI | Dưới Cyber | Dưới Cyber |
| Đánh giá zero-day nội bộ | Vượt Sol Blue | Dưới Cyber | Baseline trước đó |
| Chất lượng báo cáo lỗ hổng | Có thể ngắn / ít chi tiết hơn | Tốt nhất trong hai biến thể 5.6 trên đánh giá viết báo cáo | Dưới cả hai biến thể 5.6 |
| ExploitBench — 300 lượt | Dưới Sol | Tốt nhất / tiết kiệm token hơn | Baseline thấp hơn |
| Suy luận mục đích chung | Chuyên biệt | Phù hợp nhất | Chuyên biệt |
Chọn GPT-5.6-Cyber khi nút thắt là chuyên môn an ninh nâng cao hoặc ma sát từ chối trong môi trường được phê duyệt. Chọn GPT-5.6 Sol khi bạn cần suy luận chuyên nghiệp rộng, ngữ cảnh lớn hơn nhiều, báo cáo dài mạnh hơn hoặc một mô hình phải bao phủ cả công việc bảo mật và phi bảo mật.
Hướng dẫn quyết định: GPT-5.6-Cyber không phải lúc nào cũng tốt hơn GPT-5.6 Sol. Chọn Cyber khi công việc được phê duyệt phụ thuộc vào chuyên môn định hướng khai thác, nghiên cứu zero-day hoặc ma sát từ chối thấp hơn. Chọn Sol cho suy luận chuyên nghiệp rộng, ngữ cảnh lớn hơn, viết báo cáo mạnh hơn và khối lượng công việc pha trộn bảo mật với kỹ thuật chung. Một ngăn xếp trưởng thành có thể định tuyến xác thực khai thác sâu sang Cyber trong khi giữ rà soát mã, điều tra ngữ cảnh dài, báo cáo và kỹ thuật chung trên Sol.
Các lỗ hổng thực tế được tìm thấy với GPT-5.6-Cyber
OpenAI báo cáo sử dụng GPT-5.6-Cyber để điều tra V8, động cơ JavaScript dùng bởi Chrome. Nghiên cứu phát hiện hai lỗ hổng chưa được biết trước đó có thể được xâu chuỗi để làm hỏng bộ nhớ và thoát khỏi sandbox heap của V8; các phát hiện đã được xác thực và báo cáo cho Google thông qua công bố phối hợp.
Google đã sửa CVE-2026-15903, mà OpenAI mô tả là một lỗi nghiêm trọng trong trình biên dịch tối ưu hóa của V8. Một kiểm tra an toàn bị bỏ qua trong quá trình chuyển đổi số nguyên có thể tạo ra giá trị lớn bất ngờ, cho phép bỏ kiểm tra giới hạn và cho phép truy cập bộ nhớ ngoài đối tượng dự định. Cần một lỗ hổng thứ hai để thoát khỏi sandbox heap.
Tổng quan chuỗi exploit CVE-2026-15903. Nguồn: OpenAI.
OpenAI cũng báo cáo sử dụng mô hình để xác định:
- Ít nhất năm lỗ hổng trong một hệ điều hành di động phổ biến, bao gồm một chuỗi từ ứng dụng không tin cậy đến leo thang đặc quyền cục bộ.
- Ba lỗ hổng nghiêm trọng trong một cơ sở dữ liệu phổ biến, bao gồm đường dẫn từ xa đến thực thi mã.
- Hơn 400 lỗ hổng có thể dẫn đến leo thang đặc quyền trong một nhân hệ điều hành phổ biến.
Các số liệu bổ sung này vẫn là các phát hiện do OpenAI báo cáo trong công việc công bố và khắc phục đang diễn ra, vì vậy không nên trình bày như một danh mục CVE công khai trừ khi có các tư vấn tương ứng.
Tính năng và hỗ trợ công cụ của GPT-5.6-Cyber
| Năng lực | Hỗ trợ |
|---|---|
| Đầu vào/đầu ra văn bản | Hỗ trợ |
| Đầu vào hình ảnh | Hỗ trợ |
| Token suy luận | Hỗ trợ |
| Streaming | Hỗ trợ |
| Gọi hàm | Hỗ trợ |
| Đầu ra có cấu trúc | Hỗ trợ |
| Tìm kiếm web | Hỗ trợ |
| Tìm kiếm tệp | Hỗ trợ |
| Image generation tool | Hỗ trợ |
| Code Interpreter | Hỗ trợ |
| Hosted shell | Hỗ trợ |
| Apply Patch | Hỗ trợ |
| Skills | Hỗ trợ |
| Sử dụng máy tính | Hỗ trợ |
| MCP | Hỗ trợ |
| Tìm kiếm công cụ | Hỗ trợ |
| Tinh chỉnh | Không hỗ trợ |
Vì sao điều này quan trọng: nghiên cứu lỗ hổng hiện đại là một vòng lặp agent. Mô hình có thể cần kiểm tra một kho, suy luận trên mã nguồn, chạy mã trong môi trường cách ly, xác thực giả thuyết, chỉnh sửa bản vá và thử nghiệm lại. Do đó hỗ trợ công cụ quan trọng gần như mức điểm benchmark tĩnh.
Giá của GPT-5.6-Cyber
Bảng giá chính thức hiện tại của OpenAI là $12,50 cho mỗi triệu token đầu vào, $1,25 cho mỗi triệu token đầu vào được cache và $75 cho mỗi triệu token đầu ra. Yêu cầu có hơn 272K token đầu vào được tính giá 2× cho đầu vào và 1,5× cho đầu ra cho toàn bộ yêu cầu, và ghi cache được tính 1,25× so với mức đầu vào chưa cache.
| Chỉ số giá | Chính thức OpenAI |
|---|---|
| Đầu vào | $12,50 / 1M token |
| Đầu vào cache | $1,25 / 1M token |
| Đầu ra | $75,00 / 1M token |
| Quy tắc ngữ cảnh dài | >272K đầu vào: 2× đầu vào và 1,5× đầu ra cho toàn yêu cầu |
CometAPI hiện liệt kê $10/M đầu vào và $60/M đầu ra, mức giảm 20% so với giá niêm yết hiện tại của OpenAI được hiển thị trên cùng trang mô hình. Trang mô hình trực tiếp nên được kiểm tra trước khi đưa vào sản xuất vì tình trạng khả dụng và định tuyến có thể thay đổi trong quá trình rollout.
| Giá | CometAPI | Chính thức OpenAI | Chênh lệch |
|---|---|---|---|
| Đầu vào | $10 / 1M | $12,50 / 1M | Thấp hơn 20% |
| Đầu ra | $60 / 1M | $75 / 1M | Thấp hơn 20% |
Cách truy cập GPT-5.6-Cyber
Trên thực tế, các đội nên lên kế hoạch cho:
- Yêu cầu xác minh danh tính và bảo mật tài khoản.
- Phạm vi ủy quyền rõ ràng cho các hệ thống và hành động được kiểm thử.
- Giám sát, hạn chế sử dụng được phê duyệt và cam kết pháp lý.
- Sandboxing hoặc môi trường cách ly cho quy trình bảo mật rủi ro cao hơn.
- Rà soát thủ công hoặc tự động cho các lần gọi công cụ yêu cầu quyền nâng cao.
- Khóa bảo mật phần cứng cho tài khoản Daybreak cá nhân từ ngày 1 tháng 9 năm 2026.
Cách sử dụng GPT-5.6-Cyber qua CometAPI
Trang GPT-5.6 Cyber của CometAPI liệt kê model ID và các endpoint tương thích với OpenAI. Quyền truy cập vẫn phụ thuộc vào quyền lợi an ninh mạng đã được phê duyệt của tài khoản. Các ví dụ dưới đây sử dụng các prompt đánh giá có phạm vi hẹp, được ủy quyền.
Python
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.responses.create(
model="gpt-5.6-cyber",
input=(
"Within the explicitly authorized scope, review this security "
"assessment and prioritize remediation. Do not test any system."
),
)
print(response.output_text)
Bash (cURL)
curl https://api.cometapi.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_KEY" \
-d '{
"model": "gpt-5.6-cyber",
"input": "Within the authorized scope, review this assessment and prioritize remediation."
}'
Trường hợp sử dụng tốt nhất cho GPT-5.6-Cyber
Nghiên cứu lỗ hổng nâng cao
Phù hợp nhất là phân tích bền bỉ các codebase không quen thuộc, nơi mục tiêu là xác định, tái hiện và xác thực các lỗ hổng nghiêm trọng trong phạm vi nghiên cứu được phê duyệt. Đánh giá zero-day nội bộ và công việc V8 của OpenAI đều chỉ ra trường hợp sử dụng này.
Xác thực khai thác trong môi trường kiểm soát
ExploitGym được thiết kế xoay quanh việc biến các lỗ hổng đã biết thành thực thi mã hoạt động trong môi trường có kiểm soát. Điều này khiến Cyber phù hợp khi đội phòng thủ phải xác định liệu phát hiện có thực sự khai thác được trước khi ưu tiên khắc phục.
Kiểm thử xâm nhập và nghiên cứu red-team
Kiểm thử xâm nhập và red teaming được ủy quyền tạo ra sự mơ hồ về ý định đối với các mô hình chung. Daybreak Red giải quyết mơ hồ đó với quyền truy cập đã xác minh và kiểm soát vận hành, cho phép mô hình chuyên gia hoàn thành nhiều công việc kỹ thuật cần thiết hơn mà không làm hành vi đó khả dụng phổ quát.
Xác thực bản vá
Một mô hình chuyên biệt định hướng khai thác có thể giúp kiểm tra liệu bản vá đã đóng đường dẫn dễ tổn thương, liệu các đường thực thi thay thế có còn và liệu kiểm thử hồi quy có bao phủ ranh giới bảo mật. Đây là bổ trợ phòng thủ cho phát hiện lỗ hổng.
Tự động hóa an ninh tác tử
Hạn chế của GPT-5.6-Cyber
- Kết quả tiêu đề 95% là chỉ số hoàn thành, không phải điểm chính xác.
- Cửa sổ ngữ cảnh 400K của Cyber nhỏ hơn rất nhiều so với 1,05M của Sol.
- Mô hình được thiết kế với cổng phê duyệt và dành cho công việc được ủy quyền, do đó không nên giả định khả dụng chung chỉ từ một model ID.
- Số lượng lỗ hổng thực tế ngoài các CVE đã công bố công khai nên được mô tả là phát hiện do OpenAI báo cáo cho đến khi có tư vấn độc lập hoặc hồ sơ nhà cung cấp.
An toàn và sẵn sàng
Hệ quả vận hành đơn giản: năng lực mô hình mạnh hơn phải đi kèm kiểm soát hệ thống mạnh hơn. Hướng dẫn của chính OpenAI nhấn mạnh sandboxing, giám sát, phạm vi rõ ràng và rà soát các hành động nâng cao. Đối với các đội an ninh sản xuất, các kiểm soát đó nên được triển khai trong hạ tầng và chính sách thay vì chỉ dựa vào prompt.
Kết luận
GPT-5.6-Cyber là mô hình mục đích chuyên dụng cho những người bảo vệ đã được phê duyệt thực hiện nghiên cứu lỗ hổng nâng cao, xác thực khai thác và kiểm thử bảo mật được ủy quyền. Tỷ lệ Hoàn thành An ninh mạng Nâng cao 95,0% cho thấy ma sát từ chối giảm đáng kể, trong khi bộ đánh giá rộng hơn cho thấy các đánh đổi thực tế: Cyber dẫn đầu các bài kiểm tra chuyên gia chọn lọc, nhưng GPT-5.6 Sol vẫn mạnh hơn cho một số khối lượng công việc viết báo cáo và cấu hình ExploitBench chuẩn.
Hầu hết các đội nên bắt đầu với Daybreak Blue và GPT-5.6 Sol. Yêu cầu Daybreak Red và GPT-5.6-Cyber chỉ khi quy trình công việc được ủy quyền đòi hỏi chuyên môn định hướng khai thác sâu hơn, và ghép quyền truy cập đó với phạm vi rõ ràng, cô lập, giám sát và rà soát các hành động nâng cao.
Câu hỏi thường gặp
GPT-5.6-Cyber là gì?
GPT-5.6-Cyber là bí danh mô hình an ninh mạng mục đích chuyên dụng của OpenAI dành cho những người bảo vệ được phê duyệt thực hiện nghiên cứu lỗ hổng nâng cao, xác thực khai thác và kiểm thử bảo mật thông qua Daybreak Red.
GPT-5.6-Cyber được phát hành khi nào?
OpenAI công bố GPT-5.6-Cyber và chương trình Daybreak mở rộng vào ngày 10 tháng 8 năm 2026.
Cửa sổ ngữ cảnh của GPT-5.6-Cyber là gì?
Tài liệu mô hình chính thức hiện tại liệt kê cửa sổ ngữ cảnh 400,000 token và đầu ra tối đa 128,000 token.
GPT-5.6-Cyber có giá bao nhiêu?
OpenAI hiện liệt kê $12,50/M đầu vào, $1,25/M đầu vào cache và $75/M đầu ra. CometAPI hiện liệt kê $10/M đầu vào và $60/M đầu ra trên trang mô hình của họ.
GPT-5.6-Cyber có tốt hơn GPT-5.6 Sol không?
Không phải luôn luôn. Cyber dẫn đầu các đánh giá chuyên biệt như ExploitGym và một bài kiểm tra zero-day nội bộ, trong khi Sol thể hiện tốt hơn trong bài đánh giá viết báo cáo lỗ hổng được trích dẫn và thiết lập ExploitBench 300 lượt chuẩn.
Chỉ số 95% nghĩa là gì?
Nó đo liệu mô hình hoàn thành các yêu cầu an ninh mạng nâng cao hay không. Đây không phải điểm chính xác 95% về thành công khai thác hay phát hiện lỗ hổng.
Đây là Tỷ lệ Hoàn thành An ninh mạng Nâng cao đo lường liệu mô hình hoàn thành các yêu cầu nâng cao. Đây không phải tỷ lệ thành công khai thác 95% hay độ chính xác phát hiện lỗ hổng.
Bất kỳ ai cũng có thể sử dụng GPT-5.6-Cyber?
Không. OpenAI nêu rằng mô hình yêu cầu phê duyệt và cung cấp riêng thông qua Daybreak cho công việc an ninh được ủy quyền.
Model ID của GPT-5.6-Cyber là gì?
Model ID chính thức là gpt-5.6-cyber. Quyền truy cập yêu cầu phê duyệt và cung cấp Daybreak riêng.
GPT-5.6-Cyber có hỗ trợ công cụ không?
Có. Tài liệu Responses API hiện liệt kê web search, file search, image generation, Code Interpreter, hosted shell, Apply Patch, Skills, computer use, MCP và tool search.
- GPT-5.6-Cyber là mô hình chuyên gia thay vì thay thế phổ quát cho GPT-5.6 Sol. Nó được tinh chỉnh cho nghiên cứu lỗ hổng nâng cao được ủy quyền, xác thực khai thác, kiểm thử xâm nhập và các quy trình bảo mật liên quan.
- Chỉ số tiêu đề Tỷ lệ Hoàn thành An ninh mạng Nâng cao là 95,0%, so với 57,3% cho GPT-5.5-Cyber, 2,0% cho GPT-5.6 Sol qua Daybreak Blue và 1,5% cho GPT-5.6 Sol chuẩn có rào chắn.
- OpenAI báo cáo rằng GPT-5.6-Cyber vượt GPT-5.6 Sol và GPT-5.5-Cyber trên ExploitGym và vượt Sol trong một đánh giá zero-day nội bộ, nhưng Sol tốt hơn trong thiết lập ExploitBench 300 lượt chuẩn và ở phát hiện lỗ hổng cộng viết báo cáo.
- Giá chính thức là $12,50 cho mỗi triệu token đầu vào, $1,25 cho mỗi triệu token đầu vào được cache và $75 cho mỗi triệu token đầu ra. CometAPI hiện liệt kê $10/M đầu vào và $60/M đầu ra trên trang mô hình GPT-5.6 Cyber.
- GPT-5.6 Sol vẫn thắng các đánh giá quan trọng, bao gồm đánh giá viết báo cáo lỗ hổng được trích dẫn và cấu hình ExploitBench 300 lượt chuẩn.
- OpenAI lưu ý rằng GPT-5.6-Cyber có xu hướng sử dụng ngân sách suy luận rộng hơn so với Sol, điều này có thể làm tăng mức dùng token.
