Thông số kỹ thuật — Gemini 3.1 Pro
| Mục | gemini-3-pro (tóm tắt công khai) |
|---|---|
| Nhà cung cấp | |
| ID mô hình chuẩn | gemini-3-pro (bản xem trước công khai) |
| Loại đầu vào | Văn bản, Hình ảnh, Video, Âm thanh, PDF |
| Loại đầu ra | Văn bản (ngôn ngữ tự nhiên, đầu ra có cấu trúc, payloads gọi hàm) |
| Giới hạn token đầu vào (ngữ cảnh) | 1,048,576 token |
| Giới hạn token đầu ra | 65,536 token |
| Gọi hàm / sử dụng công cụ | Được hỗ trợ (gọi hàm, đầu ra có cấu trúc, tích hợp công cụ) |
| Đa phương thức | Hỗ trợ đa phương thức đầy đủ (hình ảnh, video, âm thanh, tài liệu) |
| Thực thi mã & luồng tác tử | Được hỗ trợ (chế độ tác tử, hỗ trợ mã, điều phối công cụ) |
| Thời điểm ngắt kiến thức | Tháng 1 năm 2025 |
Gemini 3.1 Pro là gì?
Gemini 3.1 Pro là sản phẩm hàng đầu được công bố công khai trong gia đình Gemini 3 của Google, định vị là mô hình suy luận đa phương thức tiên tiến với công cụ tác tử và bộ công cụ dành cho nhà phát triển hiện đại. Mô hình nhấn mạnh khả năng xử lý ngữ cảnh dung lượng cao (đầu vào hơn 1M token), hỗ trợ đa phương tiện rộng (hình ảnh, video, âm thanh, PDF), và tích hợp sâu cho việc sử dụng công cụ, gọi hàm, cùng các quy trình tập trung vào mã (ví dụ: Gemini Code Assist và các chế độ tác tử).
Gemini 3 Pro được Google giới thiệu là tối ưu cho cả trải nghiệm tương tác của nhà phát triển (lập trình độ trễ thấp và quy trình tác tử) và khả năng hiểu đa phương thức độ trung thực cao (diễn giải và suy luận trên các đầu vào đa phương tiện hỗn hợp).
Các tính năng chính của Gemini 3.1 Pro
Gemini-3.1 Pro (thông qua bản xem trước) giới thiệu các tính năng sau:
Tích hợp đa phương thức
Xử lý đầu vào qua:
- Ngôn ngữ tự nhiên
- Hình ảnh
- Lời nói/âm thanh
- Video
với biểu diễn token thống nhất cho suy luận xuyên phương thức.
Cửa sổ ngữ cảnh mở rộng
Dung lượng ngữ cảnh cực lớn lên tới ~1 triệu token cho phép xử lý:
- Tài liệu dài
- Tổng hợp đa tài liệu
- Mã nguồn và bản ghi.
Điều này vượt qua nhiều mô hình cạnh tranh thường chỉ hỗ trợ khoảng ~32 K–262 K token.
Mở rộng Sparse Mixture-of-Experts (MoE)
Định tuyến MoE thưa cho phép mở rộng dung lượng nội bộ của mô hình mà không tăng chi phí tính toán tương ứng, cải thiện khả năng suy luận ở quy mô lớn.
Lập luận / Lập kế hoạch nâng cao
Các đổi mới như huấn luyện chuỗi suy nghĩ, học tăng cường từ phản hồi của con người, và các bộ điểm chuẩn chuyên biệt giúp mô hình mạnh mẽ trong các tác vụ logic và toán học.
Điểm chuẩn được cho là:
AIME 2025: 100% (với thực thi mã)
SWE-Bench Verified: 83.9%
ARC-AGI-2: 71.8%
LiveCodeBench Pro: 2844 Elo
Terminal-Bench 2.0: 63.5%
MMMLU: 93.6%
Trường hợp sử dụng tiêu biểu cho doanh nghiệp
- Chuỗi xử lý phương tiện đầu-cuối: Nạp video, bản ghi và hình ảnh để tạo bản tóm tắt đồng bộ, siêu dữ liệu và thông tin có cấu trúc ở quy mô lớn.
- Tạo và rà soát mã quy mô lớn: Sử dụng trong IDE và pipeline CI để tự động tạo mã, tái cấu trúc dự án nhiều tệp, và đưa ra đề xuất kiểm thử trên các codebase lớn.
- Tự động hóa tác tử: Phối hợp các tác tử đa công cụ tương tác với dịch vụ đám mây, hệ thống điều phối và API nội bộ bằng các lệnh gọi hàm có cấu trúc.
- Nghiên cứu & sản xuất nội dung: Soạn thảo nội dung dài (báo cáo, sách) kết hợp văn bản và đa phương tiện nhúng với các tham chiếu chéo nội bộ được giữ nguyên.
Cách truy cập Gemini 3.1 Pro API
Bước 1: Đăng ký khóa API
Đăng nhập vào cometapi.com. Nếu bạn chưa là người dùng của chúng tôi, vui lòng đăng ký trước. Đăng nhập vào CometAPI console. Nhận khóa API thông tin xác thực truy cập của giao diện. Nhấp “Add Token” tại mục API token trong trung tâm cá nhân, nhận token key: sk-xxxxx và gửi.
Bước 2: Gửi yêu cầu đến Gemini 3.1 Pro API
Chọn endpoint “gemini-3.1-pro” để gửi yêu cầu API và thiết lập phần thân yêu cầu. Phương thức yêu cầu và phần thân yêu cầu được lấy từ tài liệu API trên website của chúng tôi. Website của chúng tôi cũng cung cấp Apifox test để bạn thuận tiện. Thay thế <YOUR_API_KEY> bằng khóa CometAPI thực tế từ tài khoản của bạn. base url là Gemini Generating Content và Chat.
Chèn câu hỏi hoặc yêu cầu của bạn vào trường content—đây là nội dung mà mô hình sẽ phản hồi. Xử lý phản hồi API để nhận câu trả lời đã tạo.
Bước 3: Truy xuất và xác minh kết quả
Xử lý phản hồi API để nhận câu trả lời đã tạo. Sau khi xử lý, API sẽ phản hồi trạng thái tác vụ và dữ liệu đầu ra.
Xem thêm Gemini 3 Pro API