TL;DR
GPT-6.1 Sol là bản nâng cấp Tháng 9 năm 2026 cho GPT-6 Sol, được xây dựng cho nhà phát triển vận hành các quy trình lập trình nâng cao, sử dụng máy tính, xử lý tài liệu và tác tử nhiều bước. Mức giá API ngữ cảnh ngắn tiêu chuẩn vẫn là $2 trên mỗi 1 triệu token đầu vào và $10 trên mỗi 1 triệu token đầu ra, đồng thời cải thiện năng lực và hiệu quả tác vụ theo các đánh giá do OpenAI báo cáo. Cửa sổ ngữ cảnh vẫn là 1.05 triệu token, với tối đa 128,000 token đầu ra.
Key Takeaways
- OpenAI phát hành GPT-6.1 Sol vào ngày 29 Tháng 9, 2026 cho lập trình phức tạp, sử dụng máy tính và quy trình làm việc chuyên nghiệp.
- Giữ cửa sổ ngữ cảnh 1,050,000 token và giới hạn đầu ra 128,000 token, hỗ trợ đầu vào văn bản và hình ảnh, đầu ra văn bản.
- Mức giá API ngữ cảnh ngắn tiêu chuẩn là $2 đầu vào, $0.10 đầu vào đã cache, $2.50 ghi cache, và $10 đầu ra trên mỗi 1 triệu token; prompt lớn và chế độ xử lý có thể thay đổi chi phí.
- Đánh giá chính thức cho thấy cải thiện so với GPT-6 Sol và tiệm cận Astra trên một số tải công việc được thử; tỉ lệ chi phí trên tác vụ trong benchmark khác với tỉ lệ giá token.
- Sử dụng Responses API cho gọi công cụ. Khi ra mắt, mô hình khả dụng qua API, Codex, và ChatGPT Work cho các gói trả phí đủ điều kiện, nhưng chưa có trên Chat thông thường.
What Is GPT-6.1 Sol?
GPT-6.1 Sol là mô hình tập trung hiệu suất nâng cấp trong họ GPT-6. OpenAI mô tả đây là nâng cấp cho GPT-6 Sol, gần đạt GPT-6 Astra về lập trình tác tử, sử dụng máy tính và công việc chuyên nghiệp trong khi chi phí chỉ bằng một phần năm Astra ở mức giá token đầu vào và đầu ra tiêu chuẩn.
Bản cập nhật ít tập trung vào tăng giới hạn ngữ cảnh thô hơn là cải thiện lượng công việc hữu ích hoàn thành trên mỗi đô la. Với các nhóm đã dùng GPT-6 Sol API trong CometAPI, GPT-6.1 Sol nên được hiểu là nâng cấp năng lực giữ nguyên mức giá tiêu chuẩn $2/$10 cho đầu vào/đầu ra, đồng thời giảm một nửa giá cho đầu vào đã cache.
Vị thế này quan trọng cho tác tử trong môi trường sản xuất. Hệ thống lập trình khối lượng lớn, xử lý tài liệu, tự động hóa quy trình và sử dụng máy tính có thể thực thi hàng trăm hoặc hàng nghìn yêu cầu nặng suy luận. Một mô hình tiệm cận năng lực tiên phong trong khi duy trì chi phí trên tác vụ thấp hơn có thể thực tế hơn so với việc định tuyến mọi yêu cầu khó sang Astra.
Một chi tiết khi di chuyển quan trọng: GPT-6.1 Sol không hỗ trợ mức nỗ lực suy luận none hoặc minimal. Thiết lập thấp nhất là low, do đó nhà phát triển chuyển từ GPT-6 Sol nên rà soát logic định tuyến và tham số yêu cầu.
How Does GPT-6.1 Sol Perform on Benchmarks?
Các kết quả dưới đây đến từ các đánh giá khi ra mắt của OpenAI. Chúng đo lường các tác vụ và cấu hình cụ thể, không phải xếp hạng mô hình phổ quát. OpenAI đánh giá mô hình trong môi trường nghiên cứu của họ hoặc qua API; prompt hệ thống, công cụ và thiết lập suy luận có thể khác với ChatGPT sản xuất. Kết quả đối thủ lấy từ báo cáo công khai. Chi phí trên tác vụ và giá token tiêu chuẩn là thước đo khác nhau: chi phí tác vụ phụ thuộc token, suy luận, công cụ và giao thức đánh giá. Khi thông báo không nêu đầy đủ bộ kịch bản hoặc cấu hình, các con số nên được xem là so sánh do họ báo cáo thay vì kết quả tái lập độc lập.
Agentic Coding Performance on DeepSWE v1.1
DeepSWE v1.1 đánh giá các tác vụ kỹ nghệ phần mềm tầm dài trong codebase thực. OpenAI báo cáo GPT-6.1 Sol ngang GPT-6 Astra với chi phí khoảng một phần năm và vượt điểm cao nhất của GPT-6 Sol thêm 6.4 điểm phần trăm ở mức nỗ lực và chi phí thấp hơn.
Điều này khiến nâng cấp đặc biệt phù hợp cho tác tử lập trình liên tục khảo sát kho mã, chỉnh sửa tệp, chạy công cụ, thực thi kiểm thử và gỡ lỗi thất bại, thay vì chỉ tạo các đoạn mã rời rạc.
Business Workflow Performance on AutomationBench
AutomationBench đo lường khả năng tác tử hoàn thành quy trình nhiều bước trong các ứng dụng kinh doanh. Ở mức nỗ lực trung bình, OpenAI báo cáo GPT-6.1 Sol cao hơn Opus 5.5 2.2 điểm phần trăm với chi phí khoảng một phần ba và cải thiện 4.8 điểm so với GPT-6 Sol ở cùng thiết lập.
Benchmark sử dụng 47 công cụ trên bán hàng, marketing, vận hành, hỗ trợ, tài chính và nhân sự, đại diện hơn cho tự động hóa doanh nghiệp so với bài kiểm tra hỏi-đáp đơn giản.
Báo cáo ra mắt xác định AutomationBench 1.0.6. So sánh với Opus ở mức nỗ lực trung bình; đây là kết quả do OpenAI báo cáo, không phải tuyên bố rằng GPT-6.1 Sol thắng mọi quy trình doanh nghiệp. Nhà phát triển cũng có thể truy cập Claude Opus 5.5 API trong CometAPI để so sánh theo khối lượng công việc cụ thể.
Computer-Use Performance on OSWorld 2.0
Trên tập offline OSWorld 2.0, GPT-6.1 Sol ở mức nỗ lực tối đa vượt GPT-6 Sol bảy điểm phần trăm với chi phí chưa đến một nửa. Mô hình kém GPT-6 Astra 2.1 điểm phần trăm với chi phí trên tác vụ khoảng một phần bảy so với Astra.
Kết quả OSWorld dùng phần thưởng một phần trên tập offline bản v2026.08.08. Hãy gắn kèm chỉ số, phiên bản và thiết lập tối đa này với so sánh; kết quả từ bản phát hành khác hoặc định nghĩa phần thưởng khác không hoán đổi trực tiếp.
Cải thiện này quan trọng cho tác tử trình duyệt, tự động hóa desktop, vận hành phần mềm và các quy trình đòi hỏi mô hình tương tác với giao diện đồ họa thay vì chỉ tạo văn bản.
Scientific Workflow Performance on Terminal-Bench Science
Terminal-Bench Science 0.1 đánh giá quy trình khoa học như phân tích dữ liệu, mô phỏng, khớp mô hình và chứng minh định lý thông qua công cụ mã và terminal. OpenAI báo cáo GPT-6.1 Sol hơn gấp đôi điểm GPT-6 Sol ở mức nỗ lực tối đa trong khi chi phí trên tác vụ chưa đến một nửa.
| Model | Chi phí tác vụ trung bình ở mức nỗ lực tối đa |
|---|---|
| GPT-6.1 Sol | $5.47 |
| Opus 5.5 | $23.21 |
| GPT-6 Astra | $23.80 |
GPT-6 Astra vẫn là mô hình điểm cao nhất trong đánh giá này ở mức 68.1%, do đó không nên hiểu GPT-6.1 Sol là thay thế Astra cho mọi khối lượng nghiên cứu tiên phong. Lợi thế của nó là chi phí tác vụ thấp hơn nhiều để tiệm cận năng lực đó.
Factuality on Difficult Prompts
OpenAI báo cáo cải thiện lớn nhất về tính xác thực so với GPT-6 Sol ở mức nỗ lực thấp, nơi tỷ lệ câu trả lời chứa lỗi thực tế giảm từ 11.4% xuống 7.7%, giảm khoảng 32%. Trên các thiết lập suy luận đã thử, GPT-6.1 Sol luôn trong phạm vi 1.9 điểm phần trăm so với GPT-6 Astra trong khi chi phí chưa đến một phần năm trên mỗi tác vụ.
OpenAI lưu ý rằng đánh giá này dùng các hội thoại cố ý khó và đã khử định danh, do người dùng trước đó gắn cờ lỗi thực tế. Vì vậy, các tỷ lệ này không nên coi là tỉ lệ ảo giác thông thường.
Đồ thị tính xác thực chính thức của OpenAI vẽ tỷ lệ lỗi theo độ trễ mô phỏng trung bình. Nó được tái tạo trực tiếp từ phụ lục system-card; các hội thoại khó được chọn này không thiết lập tỉ lệ lỗi cho sử dụng thông thường.
Đánh giá tính xác thực chính thức của OpenAI: tỷ lệ lỗi trên các cuộc hội thoại do người dùng gắn cờ
GPT-6.1 API Pricing
GPT-6.1 Sol dùng cùng mức giá tiêu đề đầu vào và đầu ra Tiêu chuẩn như GPT-6 Sol, nhưng giảm giá đầu vào đã cache từ $0.20 xuống $0.10 trên mỗi 1 triệu token. OpenAI định giá mô hình khác nhau tùy theo độ dài ngữ cảnh và chế độ xử lý, vì vậy chi phí sản xuất nên ước tính từ mẫu yêu cầu đầy đủ thay vì chỉ mức giá token tiêu đề.
Standard Pricing
Theo xử lý Tiêu chuẩn của OpenAI, GPT-6.1 Sol có giá $2 trên mỗi 1 triệu token đầu vào và $10 trên mỗi 1 triệu token đầu ra. Đầu vào đã cache có giá $0.10 trên mỗi 1 triệu token, trong khi ghi cache có giá $2.50 trên mỗi 1 triệu token.
| Định giá tiêu chuẩn | OpenAI GPT-6.1 Sol | CometAPI GPT-6.1 Sol |
|---|---|---|
| Đầu vào | $2.00 / 1M token | $1.60 / 1M token |
| Đầu vào đã cache | $0.10 / 1M token | $0.08 / 1M token |
| Ghi cache | $2.50 / 1M token | $2.00 / 1M token |
| Đầu ra | $10.00 / 1M token | $8.00 / 1M token |
Cached Input and Cache Writes
Caching quan trọng hơn so với mức giá đầu vào tiêu đề gợi ý.
Giá $0.10 cho đầu vào đã cache chỉ bằng 5% so với $2 đầu vào chưa cache, khiến ngữ cảnh lặp lại rẻ đáng kể khi ứng dụng tái sử dụng cùng prompt hệ thống, định nghĩa công cụ, hướng dẫn kho mã hoặc tài liệu tham chiếu dài. Ghi cache được tính $2.50 trên mỗi 1 triệu token, tức 1.25× so với giá đầu vào chưa cache tiêu chuẩn.
Với tác tử chạy lâu, điều này nghĩa là chi phí phụ thuộc nặng vào lượng ngữ cảnh có thể tái sử dụng. Một quy trình thường xuyên gửi một prompt lớn ổn định có chi phí hiệu dụng rất khác so với quy trình xây lại toàn bộ ngữ cảnh cho mỗi yêu cầu.
Long-Context Pricing
GPT-6.1 Sol hỗ trợ cửa sổ ngữ cảnh 1.05 triệu token, nhưng yêu cầu vượt 272,000 token đầu vào sẽ chuyển sang bậc định giá ngữ cảnh dài của OpenAI.
Với toàn bộ yêu cầu, mức giá trở thành:
| Định giá ngữ cảnh dài | OpenAI GPT-6.1 Sol | CometAPI GPT-6.1 Sol |
|---|---|---|
| Đầu vào | $4.00 / 1M token | $3.20 / 1M token |
| Đầu vào đã cache | $0.20 / 1M token | $0.16 / 1M token |
| Ghi cache | $5.00 / 1M token | $4.00 / 1M token |
| Đầu ra | $15.00 / 1M token | $12.00 / 1M token |
Nói cách khác, khi prompt vượt 272K token đầu vào, OpenAI áp dụng mức giá 2× cho đầu vào và cache, 1.5× cho đầu ra với toàn bộ yêu cầu, không chỉ phần vượt ngưỡng.
Điều này khiến quản lý ngữ cảnh trở nên quan trọng với codebase lớn, hệ thống phân tích tài liệu và tác tử thường trực. Một yêu cầu chỉ hơi vượt ngưỡng có thể tốn kém đáng kể hơn so với yêu cầu được giữ dưới ngưỡng thông qua truy xuất, tóm tắt hoặc phân đoạn prompt.
Batch, Flex, and Fast Modes
OpenAI cũng thay đổi giá GPT-6.1 Sol theo chế độ xử lý.
Batch và Flex được định giá thấp hơn 50% so với Tiêu chuẩn, hữu ích khi độ trễ ít quan trọng hơn chi phí. Ở định giá ngữ cảnh ngắn, điều đó giảm GPT-6.1 Sol xuống khoảng $1/M đầu vào, $0.05/M đầu vào đã cache, $1.25/M ghi cache, và $5/M đầu ra.
Fast đi theo hướng ngược lại. Chi phí gấp 2× Tiêu chuẩn, cho mức ngữ cảnh ngắn khoảng $4/M đầu vào, $0.20/M đầu vào đã cache, $5/M ghi cache, và $20/M đầu ra. Chế độ này dành cho khối lượng công việc mà độ trễ thấp có giá trị kinh doanh đủ lớn để biện minh cho chi phí token cao hơn.
Xử lý theo khu vực có thể cộng thêm phụ phí 10% ở nơi được hỗ trợ.
Lựa chọn thực tế vì vậy khá rõ ràng: dùng Tiêu chuẩn cho khối lượng tương tác thông thường, Batch hoặc Flex khi chi phí quan trọng hơn thời gian phản hồi, và Fast chỉ khi độ trễ thấp mang lại giá trị kinh doanh đủ để chấp nhận chi phí gần gấp đôi Tiêu chuẩn.
What Makes GPT-6.1 Sol Different?
GPT-6.1 Sol làm rõ hơn sự phân tách giữa hai lựa chọn triển khai cao cấp. GPT-6 Astra là phương án ưu tiên năng lực, trong khi GPT-6.1 Sol trở thành phương án ưu tiên hiệu suất cho công việc nâng cao.
Sự khác biệt đó hỗ trợ định tuyến lai: thử GPT-6.1 Sol trước cho công việc sản xuất đòi hỏi, rồi chỉ nâng cấp sang Astra cho các ca bất thường hoặc thất bại. Điều này giữ quyền truy cập năng lực tối đa mà không phải trả giá mức Astra cho mọi yêu cầu.
Near-Astra Performance Without Astra-Level Cost
Trung tâm là tỷ lệ năng lực so với chi phí. OpenAI cho biết GPT-6.1 Sol mang lại hiệu năng gần Astra trên một số khối lượng công việc chuyên nghiệp khó trong khi tính phí bằng một phần năm giá token đầu vào và đầu ra tiêu chuẩn của Astra.
Với hệ thống sản xuất, điều này có thể quan trọng hơn khoảng cách benchmark nhỏ. Chi phí trên tác vụ thấp hơn có thể dành chỗ cho thử lại, bước xác minh, ngữ cảnh lớn hơn và lưu lượng yêu cầu cao hơn trong cùng ngân sách.
Better Agentic Coding
Kết quả DeepSWE gợi ý nâng cấp nhắm vào vòng lặp lập trình dài hơn: gỡ lỗi cấp kho, chỉnh sửa đa tệp, thực thi kiểm thử và sửa lỗi, quy trình phát triển dựa trên shell, và bảo trì phần mềm theo tác tử.
Stronger Computer Use
Cải thiện OSWorld cho thấy hiệu năng mạnh hơn khi suy luận cần kết hợp với tương tác GUI, khiến GPT-6.1 Sol phù hợp hơn cho tự động hóa trình duyệt và desktop.
Better Professional Document Work
Trên GDP.pdf, GPT-6.1 Sol đạt điểm cao hơn Opus 5.5 với fallbacks ở các thiết lập suy luận đã thử với chi phí tác vụ chưa đến một nửa, đồng thời tiệm cận Astra với chi phí khoảng một phần năm.
Điều đó hứa hẹn cho quy trình liên quan đến báo cáo tài chính, tài liệu pháp lý, tài liệu y tế, bài báo nghiên cứu và các PDF chuyên nghiệp phức tạp khác.
Deep Tool Integration
Thông qua Responses API, GPT-6.1 Sol hỗ trợ web search, file search, image generation, Code Interpreter, hosted shell, Apply Patch, Skills, computer use, MCP và tool search.
GPT-6.1 Sol vs GPT-6 Sol vs GPT-6 Astra
| Hạng mục và thông số chính thức | GPT-6 Sol | GPT-6.1 Sol | GPT-6 Astra |
|---|---|---|---|
| Định vị | Lập trình phức tạp và quy trình tác tử | Hiệu năng gần Astra với chi phí thấp hơn | Năng lực cao nhất cho công việc đòi hỏi nhất |
| Cửa sổ ngữ cảnh | 1.05M | 1.05M | 1.05M |
| Đầu ra tối đa | 128K | 128K | 128K |
| Đầu vào tiêu chuẩn / 1M | $2 | $2 | $10 |
| Đầu vào đã cache / 1M | $0.20 | $0.10 | $1.00 |
| Ghi cache / 1M | $2.50 | $2.50 | $12.50 |
| Đầu ra / 1M | $10 | $10 | $50 |
| Mức nỗ lực suy luận thấp nhất | None | Low | Low |
| Lập trình tác tử | Điểm chuẩn cho cải thiện DeepSWE được báo cáo | Cao hơn điểm tốt nhất của Sol 6.4 điểm; ngang Astra trong so sánh được báo cáo | Ngang Sol 6.1 trong so sánh DeepSWE được báo cáo |
| Sử dụng máy tính | Điểm chuẩn cho so sánh OSWorld được báo cáo | Tăng 7 điểm so với Sol; kém Astra 2.1 điểm ở nỗ lực tối đa trên tập offline chỉ định | Dẫn Sol 6.1 2.1 điểm trong so sánh được báo cáo |
| Phù hợp nhất | Khối lượng công việc Sol hiện có | Tác tử nâng cao khối lượng lớn | Khối lượng công việc tiên phong khó nhất |
Sự khác biệt giá đặc biệt rõ khi so sánh với GPT-6 Astra API trong CometAPI. Giá chính thức của OpenAI là $10 đầu vào và $50 đầu ra trên mỗi 1 triệu token cho Astra so với $2 và $10 cho GPT-6.1 Sol.
Which GPT-6 Model Should You Choose?
GPT-6.1 Sol là lựa chọn mặc định mạnh mẽ nhất cho đa số khối lượng sản xuất nâng cao. Mô hình giữ mức giá $2 đầu vào và $10 đầu ra như GPT-6 Sol, nhưng cải thiện lập trình tác tử, sử dụng máy tính và quy trình chuyên nghiệp đồng thời tiến gần GPT-6 Astra hơn nhiều.
Chọn GPT-6 Sol nếu quy trình hiện có của bạn đã hoạt động tốt và không cần các cải tiến tác tử mới.
Chọn GPT-6.1 Sol nếu bạn muốn cân bằng tốt nhất giữa hiệu năng và chi phí, đặc biệt cho tác tử lập trình, tự động hóa, sử dụng máy tính và khối lượng suy luận lớn.
Chọn GPT-6 Astra khi năng lực tối đa quan trọng hơn chi phí. Giá chính thức của OpenAI là $10 đầu vào và $50 đầu ra trên mỗi 1 triệu token, so với $2 và $10 cho GPT-6.1 Sol. Do đó GPT-6 Astra API trong CometAPI phù hợp hơn với các tác vụ khó hoặc giá trị cao nhất thay vì triển khai quy mô lớn thường nhật.
When Should You Still Use GPT-6 Astra?
GPT-6.1 Sol không thay thế Astra. OpenAI tiếp tục định vị GPT-6 Astra là mô hình có năng lực cao nhất, và Astra vẫn dẫn đầu các đánh giá khó như Terminal-Bench Science.
- Mức độ thành công tác vụ quan trọng hơn nhiều so với chi phí token.
- Công việc bất thường phức tạp hoặc thiên về nghiên cứu.
- Bạn cần trần suy luận cao nhất sẵn có.
- Thử thất bại có chi phí đủ lớn khiến chi phí mô hình cao hơn trở nên thứ yếu.
- Chênh lệch chất lượng nhỏ mang lại giá trị kinh doanh vượt trội.
Một chiến lược định tuyến thực tế là dùng GPT-6.1 Sol cho phần lớn công việc sản xuất đòi hỏi và dành Astra cho đường nâng cấp khi năng lực tối đa biện minh cho chi phí bổ sung.
Is GPT-6.1 Sol Cheaper Than GPT-6 Astra in Real Workloads?
Ở mức giá token tiêu chuẩn, có: GPT-6.1 Sol rẻ bằng một phần năm Astra cho cả đầu vào và đầu ra. Nhưng kinh tế sản xuất nên được đánh giá theo chi phí trên tác vụ thành công, không chỉ chi phí trên token.
Nếu một tác tử cần suy luận lặp lại, gọi công cụ và thử lại nhiều lần, một mô hình rẻ hơn vẫn có thể kém hiệu quả nếu cần nhiều lần thử hơn đáng kể. Ngược lại, nếu GPT-6.1 Sol đạt tỉ lệ hoàn thành gần như Astra trên khối lượng công việc của bạn, chênh lệch giá token gấp năm lần có thể chuyển thành tiết kiệm đáng kể.
Where Can You Use GPT-6.1 Sol?
Khi ra mắt vào ngày 29 Tháng 9, 2026, GPT-6.1 Sol khả dụng cho người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex, cũng như qua OpenAI API. Chưa khả dụng trong Chat thông thường. Quyền truy cập thực tế phụ thuộc gói, khách hàng, khu vực và cài đặt workspace. Kiểm tra ngày 30 Tháng 9, 2026, danh mục mô hình trực tiếp của CometAPI liệt kê gpt-6.1-sol với cả hai route /v1/responses và /v1/chat/completions. Dùng Responses cho quy trình công cụ và xác minh quyền truy cập mô hình cùng tính cước cho khóa API của bạn trước khi triển khai.
How Do You Use the GPT-6.1 Sol API?
Sử dụng Responses API để gọi công cụ. GPT-6.1 Sol hỗ trợ yêu cầu Chat Completions không có công cụ; tác tử phụ thuộc công cụ không nên giả định hành vi công cụ giống nhau giữa hai endpoint. Ví dụ Python tối thiểu dưới đây dùng endpoint và thông tin xác thực của OpenAI.
Cài đặt OpenAI Python SDK chính thức, đặt OPENAI_API_KEY trong môi trường của bạn và sử dụng một dự án API có quyền truy cập mô hình. Ví dụ chỉ-văn-bản sau gửi một yêu cầu Responses API và in đầu ra văn bản; bản thân nó không bật công cụ tác tử.
from openai import OpenAI
client = OpenAI() # Reads OPENAI_API_KEY from the environment
response = client.responses.create(
model="gpt-6.1-sol",
input="Review this software architecture and identify the three highest-risk design decisions.",
reasoning={"effort": "medium"},
)
print(response.output_text)
Với lập trình, nghiên cứu hoặc tác vụ tác tử khó hơn, có thể tăng mức nỗ lực suy luận lên high, xhigh hoặc max. Với công việc chi phí thấp hơn, có low, nhưng không hỗ trợ none và minimal.
Use GPT-6.1 Sol Through CometAPI
Làm theo Hướng dẫn nhanh CometAPI để tạo tài khoản và khóa API. Lưu khóa vào COMETAPI_KEY, cài đặt OpenAI Python SDK bằng pip install openai, và cấu hình gateway như dưới đây.
Danh mục hiện liệt kê gpt-6.1-sol. Ví dụ chỉ-văn-bản này dùng endpoint Responses được ghi chép; công cụ cần cấu hình yêu cầu bổ sung. Liệt kê mô hình xác nhận sự hiện diện trong danh mục, trong khi một yêu cầu thành công với khóa của bạn xác nhận quyền truy cập cho tài khoản.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.responses.create(
model="gpt-6.1-sol",
input="Review this architecture and list three design risks.",
reasoning={"effort": "medium"},
)
print(response.output_text)
Chọn mức nỗ lực suy luận low, medium, high, xhigh hoặc max. Không gửi none hoặc minimal. Với lỗi xác thực, kiểm tra khóa và số dư tài khoản; với lỗi mô hình hoặc route, kiểm tra lại danh mục và endpoint hiện tại. Chạy một kiểm thử khói nhỏ trước khi chuyển lưu lượng sản xuất.
What Do OpenAI's GPT-6.1 Sol Safety Evaluations Show?
Phụ lục system-card GPT-6.1 Sol của OpenAI báo cáo cải thiện căn chỉnh so với GPT-6 Sol, gồm tỉ lệ thất bại thấp hơn trong các đánh giá khó liên quan minh bạch khi công cụ hỏng, hạn chế rõ ràng, kết quả trái phép và an toàn sử dụng máy tính.
OpenAI xếp GPT-6.1 Sol là Critical về năng lực an ninh mạng và High về năng lực sinh học và hóa học theo Preparedness Framework, và áp dụng cùng ngăn xếp biện pháp bảo vệ như GPT-6 Astra.
Các đánh giá này cố tình dùng tình huống khó nhằm khơi gợi thất bại, vì vậy tỉ lệ của chúng không nên đọc như đại diện cho sử dụng điển hình.
FAQ
Is GPT-6.1 Sol a replacement for GPT-6 Sol?
GPT-6.1 Sol là bản nâng cấp mới hơn thay vì hướng sản phẩm hoàn toàn khác. Nó nhắm vào cùng khối lượng lập trình nâng cao và quy trình tác tử như GPT-6 Sol, nhưng cải thiện hiệu năng ở các lĩnh vực như kỹ nghệ phần mềm, sử dụng máy tính và tự động hóa nhiều bước.
Is GPT-6.1 Sol as powerful as GPT-6 Astra?
Không ở mọi khối lượng. GPT-6 Astra vẫn là lựa chọn có năng lực cao hơn của OpenAI cho các tác vụ đòi hỏi nhất, trong khi GPT-6.1 Sol được thiết kế để thu hẹp phần lớn khoảng cách hiệu năng với hiệu suất tốt hơn cho sử dụng sản xuất quy mô lớn.
Who should use GPT-6.1 Sol?
GPT-6.1 Sol phù hợp nhất với nhà phát triển và nhóm vận hành tác tử lập trình, hệ thống tự động hóa, quy trình tài liệu, tác tử sử dụng máy tính và các khối lượng công việc khác nơi suy luận mạnh cần lặp lại ở quy mô.
What is the biggest improvement in GPT-6.1 Sol?
Cải thiện lớn nhất không phải là cửa sổ ngữ cảnh lớn hơn hay phương thức đầu vào mới. Đó là hiệu năng tác tử đời thực mạnh hơn, đặc biệt trong lập trình, sử dụng máy tính và quy trình chuyên nghiệp, đồng thời vẫn ở cùng bậc chi phí chung như GPT-6 Sol.
Conclusion
GPT-6.1 Sol ít tập trung vào mở rộng giới hạn thông số thô của GPT-6 và nhiều hơn vào đưa suy luận nâng cao xuống đường cong chi phí. Mô hình giữ cửa sổ ngữ cảnh 1.05M và trần đầu ra 128K trong khi cải thiện tác tử lập trình, quy trình doanh nghiệp, sử dụng máy tính, quy trình khoa học và độ chính xác thực tế so với GPT-6 Sol.
Đồng thời, mức giá tiêu chuẩn đầu vào và đầu ra vẫn là $2/$10 trên mỗi 1 triệu token, so với $10/$50 của Astra.
Với nhà phát triển, điều đó tạo ra một tầng triển khai hữu ích: Astra vẫn sẵn cho khi năng lực tối đa quan trọng, trong khi GPT-6.1 Sol có thể xử lý phần lớn hơn các khối lượng sản xuất nâng cao mà không buộc mọi yêu cầu phải chịu chi phí mức flagship. Tuy nhiên, benchmark ý nghĩa nhất vẫn là khối lượng công việc của chính bạn.
