GPT-6.1 Sol are now live on CometAPI →
new/Nghiên cứu CometAPI

Gemini 4 Argon: Điểm chuẩn, tính năng, giá và truy cập API

Khám phá các điểm chuẩn của Gemini 4 Argon, đầu ra 1M token, bảo mật, giá, tính sẵn có và so sánh với GPT-6 Astra và Claude Opus 5.

CometAPI
AnnaĐội ngũ nghiên cứu mô hình AI và API
Đã cập nhật Oct 1, 2026 17 phút đọc
Gemini 4 Argon: Điểm chuẩn, tính năng, giá và truy cập API
Sử dụng mẫu này

Thực hiện API call đầu tiên.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Tóm tắt: Ngày 30 tháng 9, 2026, Google DeepMind công bố Gemini 4 Argon, mô hình frontier mới và là khởi đầu cho dòng Gemini 4. Mô hình đạt hiệu năng dẫn đầu trong kỹ nghệ phần mềm dài hạn (77.9% trên DeepSWE v1.1), công việc tri thức doanh nghiệp (đứng đầu Vals Index với 68.9%) và an ninh mạng phòng thủ. Nâng cấp chủ chốt gồm giới hạn đầu ra 1 triệu token dẫn đầu ngành (tăng từ 64K).

Điểm chính

  • Gemini 4 Argon là mô hình mạnh nhất của Google đến nay, được tối ưu cho quy trình phức tạp, nhiều bước trong lập trình, công việc tri thức pháp lý/tài chính và phòng thủ an ninh mạng.
  • Argon được thiết kế cho suy luận bền bỉ qua các quy trình dài, nhiều bước thay vì trò chuyện ngắn thông thường. Google nhấn mạnh kỹ nghệ phần mềm thực tế, công việc pháp lý và tài chính, hiểu đa phương thức và phòng thủ an ninh mạng.
  • Google tăng mức tối đa đầu ra từ 64K token lên 1 triệu token. Google chưa công bố đầy đủ đặc tả API Gemini công khai cho ngữ cảnh đầu vào, các phương thức, hành vi endpoint, hoặc giới hạn tần suất của Argon.
  • Trên bảng so sánh của Google, Argon đạt 68.9% ở Vals Index, 77.9% ở DeepSWE v1.1, 91.7% ở LVBench và 68% ở CWE-bench v1. Không phải bài nào cũng dẫn đầu: GPT-6 Astra thắng FrontierSWE v2 và Terminal-Bench Science, trong khi Claude Opus 5.5 dẫn Terminal-Bench 4.0 và PostTrainBench.
  • Giá API mở đầu của Google là $2 mỗi triệu token đầu vào và $10 mỗi triệu token đầu ra. Sau giai đoạn mở đầu, giá lần lượt là $4 và $20. Đầu vào được cache được quảng bá giảm 95% so với giá token đầu vào tương ứng.
  • Danh mục công khai của CometAPI liệt kê gemini-4-argon là khả dụng, không phải sắp ra mắt, vào ngày 1 tháng 10, 2026.

Google đã giành lại vị thế dẫn đầu trong cuộc đua AI frontier với việc ra mắt Gemini 4 Argon. Được công bố ngày 30 tháng 9, 2026, mô hình này đánh dấu kỷ nguyên Gemini 4 và được định vị rõ ràng là “kỷ nguyên tiếp theo của trí tuệ frontier” của Google. Nó nhắm đến các tác vụ thực tế khó nhất: lập trình tác tử bền bỉ, công việc tri thức doanh nghiệp rủi ro cao (pháp lý, tài chính, thuế) và an ninh mạng phòng thủ.

Khác với các cập nhật gia tăng trước đây, Argon giới thiệu một bước nhảy về chiều sâu năng lực thông qua độ dài đầu ra tăng mạnh và huấn luyện chuyên biệt cho tác vụ dài hạn. Hàng nghìn nhân viên Google đã dùng nội bộ cho công việc kỹ thuật sản xuất, trong khi truy cập bên ngoài khởi đầu hẹp với các đối tác an ninh mạng đã thẩm định.

Gemini 4 Argon là gì?

Gemini 4 Argon là mô hình ngôn ngữ lớn frontier mới nhất của Google DeepMind và là bản phát hành đầu tiên trong gia đình Gemini 4. Nó được thiết kế để duy trì suy luận sâu qua các quy trình phức tạp, nhiều bước, dài hạn mà các mô hình trước đây khó hoàn tất tin cậy trong một quỹ đạo duy nhất.

Theo Google, Argon “đạt hiệu năng frontier trong các quy trình phức tạp trên kỹ nghệ phần mềm thực tế, công việc tri thức doanh nghiệp như pháp lý và tài chính, và phòng thủ an ninh mạng.” Nó kế thừa bài học từ nỗ lực Gemini 3.5 Pro bị hoãn hoặc hủy hồi đầu 2026 và trọng tâm tiếp theo vào dòng Gemini 3.8 Flash.

Mô hình nhấn mạnh năng lực mang tính tác tử — lập kế hoạch tự động, dùng công cụ, sinh và chỉnh sửa mã, phát hiện và khắc phục lỗ hổng, phân tích đa tài liệu, và hiểu video dài — đồng thời tích hợp hệ thống an toàn mạnh hơn cho sức mạnh cấp độ frontier.

Nội bộ, Argon đã mang lại tác động đo lường được ở quy mô Google:

  • Các nhóm tính toán lượng tử dùng nó để tối ưu tài nguyên không-thời gian (qubits × gates), vượt các baseline công bố 40% chỉ trong vài phút.
  • Các nhóm tác tử phân tích telemetry toàn đội hình và tự động áp dụng tối ưu hóa bộ nhớ, giải phóng hơn 300 TiB bộ nhớ trên các trung tâm dữ liệu (ước tính tổng tiết kiệm 500 TiB đến 1 PiB).
  • Các đợt di chuyển mã quy mô lớn từ C/C++ sang Rust đang diễn ra, gồm hàng chục nghìn dòng trong thư viện lõi (re2, libgav1) và hơn 800,000 dòng trong nhân Fuchsia Zircon. Một kết quả đáng chú ý: bộ giải mã video an toàn bộ nhớ (libgav1) chạy nhanh hơn 2.7× so với bản port Rust trước đó sau tối ưu hóa theo hồ sơ.

Những triển khai thực tế này cho thấy Argon không chỉ là quán quân benchmark mà còn là bộ nhân năng suất thiết thực cho các tổ chức kỹ thuật phức tạp.

Khả dụng của Gemini 4 Argon tính đến ngày 1 tháng 10

Google áp dụng cách phát hành theo giai đoạn có chủ đích do năng lực nâng cao của mô hình. Hiện đang triển khai cho nhóm các nhà phòng thủ mạng tin cậy thông qua Chương trình Fairwind (đã ghi danh hơn 650 tổ chức, gồm các hãng an ninh lớn). Google cũng tham gia quy trình truy cập mô hình trước phát hành tự nguyện của chính phủ Hoa Kỳ. Khả dụng rộng hơn cho nhà phát triển, doanh nghiệp và người dùng — bắt đầu với khách hàng API trả phí và thuê bao Google AI Ultra — được kỳ vọng “càng sớm càng tốt” sau khi lặp lại hàng rào bảo vệ dựa trên phản hồi sớm.

Tính năng chính của Gemini 4 Argon

1. Suy luận dài hạn với tối đa 1M token đầu ra

Google cho biết đầu ra tối đa của Argon là 1 triệu token, tăng từ 64,000 token ở thế hệ trước. Đây là giới hạn sinh tối đa, không có nghĩa mọi phản hồi nên khổng lồ. Nó cho mô hình không gian cho quỹ đạo suy luận dài, sinh mã đa tệp, nghiên cứu chi tiết, hoặc tác vụ tác tử kéo dài mà không buộc phải tạo yêu cầu mới sau vài bước.

Gemini 4 Argon: Điểm chuẩn, tính năng, giá và truy cập API

2. Kỹ nghệ phần mềm thực tế

Điểm 77.9% của Argon trên DeepSWE v1.1 là giá trị cao nhất trong bảng so sánh của Google. DeepSWE tập trung vào công việc kỹ nghệ phần mềm dài hạn, phù hợp hơn với tác tử lập trình tự động so với các bài kiểm tra hoàn tất mã ngắn. Mô hình cũng đạt 91.9% trên Vibe Code Bench.

Bức tranh không một chiều. GPT-6 Astra đạt 65.5% trên FrontierSWE v2 so với 55.0% của Argon, và Claude Opus 5.5 đạt 66.4% trên Terminal-Bench 4.0 so với 57.4% của Argon. Do đó, người mua nên thử nghiệm riêng việc chỉnh sửa repository, dùng shell, gỡ lỗi và công việc di chuyển thay vì dựa vào một điểm “lập trình” duy nhất.

Gemini 4 Argon: Điểm chuẩn, tính năng, giá và truy cập API

3. Công việc tri thức doanh nghiệp

Google báo cáo Argon đạt 68.9% trên Vals Index, vốn phân trọng tài chính, lập trình, pháp lý và thuế theo đóng góp vào GDP Hoa Kỳ. Nó cũng dẫn đầu các mô hình được so sánh trên Vals Finance Agent v2, Harvey's Legal Agent Benchmark và AutomationBench.

Các đánh giá này khiến Argon đặc biệt phù hợp với quy trình nặng nghiên cứu: thẩm định, rà soát hợp đồng, phân tích tài chính, nghiên cứu thuế và tổng hợp xuyên tài liệu. Chúng không loại bỏ nhu cầu xác minh nguồn và rà soát chuyên môn. Dẫn đầu benchmark đo hiệu năng dưới một khung đánh giá cụ thể; nó không khẳng định sự phù hợp cho quyết định pháp lý hay tài chính không giám sát.

4. Hiểu đa phương thức và video dài

Argon đạt 71.6% trên Chartography và 91.7% trên LVBench, nhỉnh hơn GPT-6 Astra ở hiểu biểu đồ và vượt rõ hơn ở hiểu video dài. Google cũng mô tả các quy trình trong đó Argon diễn giải một chuỗi tài liệu và hành động dựa trên kết quả.

Kết hợp này hữu ích khi văn bản là chưa đủ: phân tích biểu đồ lợi nhuận cùng báo cáo, trích xuất chứng cứ từ hàng giờ video, rà soát ảnh chụp sản phẩm với yêu cầu viết, hoặc đối soát dữ liệu xuyên các PDF và báo cáo trực quan.

5. An ninh mạng phòng thủ

Google huấn luyện Argon để phát hiện, xác minh và vá các lỗ hổng nghiêm trọng. Trên CWE-bench v1, Argon và GPT-6 Astra cùng đạt 68%, trong khi Claude Opus 5.5 đạt 67%. Google cho biết Argon cũng vượt Gemini 3.8 Flash Cyber trong các đánh giá nội bộ về phát hiện lỗ hổng và kiểm thử xâm nhập hộp đen.

Quyền truy cập ban đầu phản ánh rủi ro. Các nhà phòng thủ mạng tin cậy có thể dùng mô hình thông qua Chương trình Fairwind, và Google cho biết Wiz đã dùng Argon trong sáng kiến Scan for Good để xác định một lỗ hổng nghiêm trọng ảnh hưởng đến phần mềm y tế. Phân phối hạn chế cho phép Google thu thập bằng chứng trước khi phổ biến rộng năng lực an ninh nâng cao.

6. Tỷ lệ ảo giác giảm xuống 10%.

Gemini 4 Argon có tỷ lệ ảo giác cực thấp trên Artificial Analysis. 15%. Arena báo cáo 0.10% +/- 0.48% ước tính ảo giác công cụ cho Gemini 4 Argon High, so với 0.16% +/- 0.09% cho Gemini 3.8 Flash High. Ước lượng điểm thấp hơn, gợi ý tiến bộ. Tuy nhiên, khoảng bất định chồng lấn đáng kể, và khoảng của Argon rộng hơn nhiều.

Gemini 4 Argon: Điểm chuẩn, tính năng, giá và truy cập API

Hiệu năng benchmark của Gemini 4 Argon

Các con số sau đây đến từ bảng so sánh của Google DeepMind. Google liên kết tài liệu phương pháp riêng và nêu rằng điểm là pass@1 trừ khi có ghi chú. Hãy coi đây là kết quả do nhà cung cấp công bố và xác thực đối chiếu với khối lượng công việc riêng.

BenchmarkKhối công việcGemini 4 ArgonGPT-6 AstraClaude Opus 5.5Dẫn đầu
Vals IndexCông việc tri thức trọng số theo GDP68.9%63.1%67.0%Argon
AutomationBenchTự động hóa doanh nghiệp đầu-cuối51.3%41.4%42.5%Argon
Vals Finance Agent v2Nghiên cứu tài chính nhiều bước65.4%53.5%58.6%Argon
Harvey Legal AgentNghiên cứu pháp lý và soạn thảo19.6%5.4%3.8%Argon
DeepSWE v1.1Kỹ nghệ phần mềm dài hạn77.9%74.1%74.2%Argon
FrontierSWE v2Lập trình mang tính tác tử55.0%65.5%62.3%Astra
Terminal-Bench 4.0Công việc tác tử dựa trên terminal57.4%58.2%66.4%Opus
Terminal-Bench Science 0.1Tác tử khoa học và toán57.6%68.1%63.3%Astra
GraphWalks, 256K-1MDuyệt đồ thị ngữ cảnh dài, F184.2%71.8%66.8%Argon
Agent's Last ExamSử dụng máy tính39.5%34.2%38.2%Argon
OSWorld 2.0 offline subsetSử dụng máy tính, điểm một phần69.2%72.6%Không công bốAstra
ChartographyHiểu biểu đồ71.6%71.0%66.3%Argon
LVBenchHiểu video dài91.7%87.5%83.7%Argon
CWE-bench v1Khắc phục lỗ hổng68.0%68.0%67.0%Hòa

Cách đọc kết quả

Lợi thế rõ nhất của Argon là bề rộng qua công việc tri thức chuyên nghiệp, ngữ cảnh dài, phân tích biểu đồ và video dài. Kết quả 19.6% ở tác tử pháp lý của nó cao hơn hơn ba lần so với 5.4% của Astra, dù cả ba điểm tuyệt đối cho thấy benchmark vẫn khó. Argon cũng dẫn AutomationBench với chênh 8.8 điểm phần trăm so với Opus 5.5.

Lập trình cần kết luận tinh tế hơn. Argon dẫn DeepSWE và Vibe Code Bench, nhưng Astra dẫn FrontierSWE, và Opus dẫn Terminal-Bench 4.0. Với công việc terminal thiên về khoa học, Astra dẫn Argon 10.5 điểm. Tựa đề đúng không phải “Argon thắng mọi benchmark.” Mà là Argon cực mạnh trên các quy trình doanh nghiệp dài hạn, trong khi đối thủ vẫn giữ lợi thế quan trọng theo tác vụ.

Gemini 4 Argon: Điểm chuẩn, tính năng, giá và truy cập API

Bằng chứng benchmark vững nhưng không phổ quát. GPT-6 Astra vẫn dẫn trước ở một số thước đo khoa học, lập trình và sử dụng máy tính, trong khi Claude Opus 5.5 dẫn các bài kiểm tra terminal và ML-engineering quan trọng. Bằng chứng độc lập cũng tinh tế tương tự: Artificial Analysis xếp Argon #8 trong 223 mô hình cùng nhóm so sánh, và Arena xếp Gemini 4 Argon High #8 trong 46 mô hình tác tử đồng thời đặt nó hạng nhất về khả năng điều khiển. Lợi thế lớn nhất của Argon là kết hợp suy luận dài hạn, hiệu năng miền doanh nghiệp và chiều sâu đa phương thức với mức giá công bố mang tính cạnh tranh.

Gemini 4 Argon đã khả dụng chưa?

Tính đến thời điểm công bố (ngày 30 tháng 9, 2026) và các bài đưa tin sau đó, chưa — chưa dành cho công chúng hoặc nhà phát triển thông thường. Truy cập bị giới hạn cho:

  • Thành viên tin cậy của Chương trình Fairwind (nhà phòng thủ mạng, chính phủ, đối tác hạ tầng trọng yếu).
  • Các nhóm nội bộ Google.
  • Người tham gia quy trình truy cập mô hình trước phát hành tự nguyện của chính phủ Hoa Kỳ.

Google cho biết sẽ mở rộng “càng sớm càng tốt” sau khi thu thập phản hồi và lặp lại hàng rào bảo vệ, bắt đầu với khách hàng API trả phí và thuê bao Google AI Ultra, rồi mở rộng cho nhà phát triển, doanh nghiệp và người tiêu dùng. Chưa có ngày công khai cố định

Giá API Gemini 4 Argon

Giá mở đầu của Google là $2 mỗi triệu token đầu vào và $10 mỗi triệu token đầu ra. Sau giai đoạn mở đầu, mức tương ứng là $4 đầu vào và $20 đầu ra. Đầu vào được cache được tính giá giảm 95% so với mức đầu vào áp dụng, ngụ ý $0.10 mỗi triệu trong giai đoạn mở đầu và $0.20 sau đó nếu chính sách được áp dụng đúng như công bố.

Mức giá hấp dẫn so với các mô hình frontier cao cấp khác, nhưng chi phí mỗi token không phải chi phí mỗi tác vụ hoàn thành. Một mô hình sinh hàng trăm nghìn token đầu ra hoặc thực hiện nhiều lần gọi công cụ vẫn có thể tạo hóa đơn lớn. Hãy đặt trần đầu ra, giám sát vòng lặp công cụ và đo chi phí mỗi kết quả được chấp nhận.

Cách truy cập API Gemini 4 Argon qua CometAPI

Khi Google mở truy cập API rộng hơn, các nền tảng tổng hợp mô hình frontier sẽ trở thành cách nhanh nhất và thường hiệu quả chi phí nhất cho nhà phát triển để thử nghiệm và đưa vào sản xuất.

CometAPI cung cấp endpoint thống nhất tương thích OpenAI cho 500+ mô hình từ OpenAI, Anthropic, Google và các bên khác. Điều này nghĩa là bạn có thể chuyển giữa các mô hình Gemini, biến thể GPT-6 và mô hình Claude chỉ bằng cách đổi tham số model — không cần quản lý nhiều tài khoản, hệ thống thanh toán hay SDK.

Các bước khuyến nghị để chuẩn bị và truy cập qua CometAPI:

  1. Đăng ký tại cometapi.com và tạo khóa API từ bảng điều khiển (bắt đầu với sk-).
  2. Sử dụng base URL https://api.cometapi.com/v1.
  3. Gọi mô hình bằng OpenAI SDK tiêu chuẩn hoặc định dạng Gemini gốc.

CometAPI đã hỗ trợ họ Gemini (bao gồm các mô hình Pro và Flash trước đó) với giá cạnh tranh, tín dụng dùng thử miễn phí và chuyển đổi liền mạch. Hãy kiểm tra trang Models của CometAPI thường xuyên để biết tình trạng khả dụng của Gemini 4 Argon. Cách tiếp cận này tránh ma sát khi onboard Google Cloud và cho phép thử nghiệm A/B dễ dàng với Claude Opus 5.5 hoặc GPT-6 Astra trong cùng codebase.

Gemini 4 Argon vs GPT-6 Astra vs Claude Opus 5.5

Danh mụcGemini 4 ArgonGPT-6 AstraClaude Opus 5.5
Nhà cung cấpGoogleOpenAIAnthropic
Tình trạng phát hành vào ngày 1 tháng 10, 2026Triển khai giới hạn cho người thử nghiệm tin cậy; sẽ mở rộngMô hình API đang hoạt độngMô hình mới nhất đang hoạt động; phát hành 22 tháng 9, 2026
Phù hợp nhấtCông việc tri thức dài hạn, phân tích đa phương thức, an ninh phòng thủ, đầu ra lớnSuy luận phức tạp, khoa học, sử dụng máy tính, hệ sinh thái công cụ rộngLập trình tác tử chạy dài và công việc tri thức
Ngữ cảnh đầu vàoChưa công bố như đặc tả API công khai cuối cùng1,050,000 tokens1,000,000 tokens
Đầu ra tối đa1,000,000 tokens128,000 tokens128,000 đồng bộ; 300,000 Batch beta
Đầu vào và đầu raNêu có năng lực đa phương thức; ma trận API công khai chi tiết đang chờVăn bản và ảnh vào; văn bản raVăn bản và ảnh vào; văn bản ra
Điều khiển suy luậnSuy luận dài hạn; điều khiển API công khai đang chờMức nỗ lực suy luận từ thấp đến tối đaTư duy thích ứng luôn bật; nỗ lực mặc định trung bình
Giá chuẩn mỗi 1M tokenMở đầu: $2 đầu vào / $10 đầu ra; sau đó $4 / $20$10 đầu vào / $50 đầu ra$4 đầu vào / $20 đầu ra
Thành tích nổi bật trong bảng của GoogleVals, AutomationBench, DeepSWE, ngữ cảnh dài, LVBenchFrontierSWE, công việc terminal khoa học, OSWorld subsetTerminal-Bench 4.0, PostTrainBench
Lưu ý chínhKhả dụng API rộng và đặc tả đầy đủ đang dần được triển khaiGiá niêm yết cao nhất trong ba mô hìnhKhông dẫn đầu bảng công việc tri thức của Google; tư duy thích ứng không thể tắt

Mô hình nào phù hợp nhất?

Chọn Gemini 4 Argon khi công việc tri thức ngữ cảnh dài, bằng chứng đa phương thức, an ninh mạng phòng thủ, hoặc tạo tác sinh rất lớn chiếm ưu thế trong khối lượng công việc. Chọn GPT-6 Astra khi bạn cần bề mặt công cụ OpenAI trưởng thành, hiệu năng tác tử khoa học mạnh, hoặc các điểm mạnh cụ thể về sử dụng máy tính của nó. Chọn Claude Opus 5.5 cho lập trình và quy trình terminal bản địa của Claude, đặc biệt khi hành vi của nó đã hiệu quả trong khung đánh giá của bạn.

Với hầu hết doanh nghiệp, chiến lược tốt hơn không phải quyết định một mô hình duy nhất vĩnh viễn. Chuyển tuyến yêu cầu thường lệ sang mô hình chi phí thấp hơn, đánh giá Argon, Astra và Opus trên phần đuôi khó, và duy trì phương án dự phòng. CometAPI hữu ích ở đây vì một lớp tích hợp có thể giúp thử nghiệm đa mô hình và định tuyến có kiểm soát dễ dàng hơn.

Kết luận

Gemini 4 Argon đánh dấu cú tái nhập mạnh mẽ nhất của Google vào frontier tuyệt đối, giành lại vị thế dẫn đầu trên nhiều benchmark then chốt cho doanh nghiệp và dài hạn, đồng thời giới thiệu các tiến bộ thiết thực như đầu ra 1M token và mức giá mở đầu cạnh tranh. Lộ trình phát hành theo giai đoạn, ưu tiên an toàn đặt trọng tâm vào triển khai có trách nhiệm các năng lực phòng thủ mạng mạnh mẽ.

Tiếp tục học

Kết nối bài viết này với quyết định tiếp theo.

Xem tất cả chủ đề
Được xuất bản Oct 1, 2026
Cập nhật lần cuối Oct 1, 2026
26 lượt xem
Đã được xem xét về độ rõ ràng, ghi nguồn và thuật ngữ API hiện tại.

Đọc thêm