Thông số kỹ thuật của GLM-5.2
| Hạng mục | GLM-5.2 |
|---|---|
| Nhà cung cấp | Zhipu AI |
| Ngày phát hành | 13 tháng 6, 2026 |
| Loại mô hình | LLM Mixture-of-Experts (MoE) với trọng số mở |
| Tổng số tham số | ~744B |
| Tham số hoạt động | ~40B mỗi token |
| Cửa sổ ngữ cảnh | 1,000,000 tokens |
| Đầu ra tối đa | 131,072 tokens |
| Chế độ suy luận | High, Max |
| Giấy phép | MIT |
| Trọng tâm chính | Lập trình theo hướng agent, kỹ nghệ phần mềm, suy luận dài hạn |
| Khả dụng API | Nền tảng Z.ai và các nhà cung cấp tương thích |
| Trọng số mở | Có |
GLM-5.2 là mẫu chủ lực mới nhất thuộc dòng GLM của Zhipu AI. Khác với các mô hình tiên tiến đa dụng, GLM-5.2 được định vị chủ yếu là một mô hình ưu tiên lập trình và định hướng agent, được thiết kế cho kỹ nghệ phần mềm ở quy mô kho mã, quy trình làm việc tự động và suy luận với ngữ cảnh cực dài. Năng lực nổi bật của nó là cửa sổ ngữ cảnh gốc 1 triệu token, khiến nó trở thành một trong những cửa sổ ngữ cảnh lớn nhất được công khai trong số các mô hình có trọng số mở.
Tính năng chính của GLM-5.2
- Cửa sổ ngữ cảnh 1M-token cho toàn bộ kho mã, bộ tài liệu dài và quy trình làm việc đa phiên của agent.
- Tối ưu hóa theo hướng lập trình tập trung vào tái cấu trúc, gỡ lỗi, sinh mã và các tác vụ kỹ nghệ phần mềm.
- Hỗ trợ quy trình dựa trên agent cho các công cụ như Claude Code, Cline, Roo Code, OpenCode và các agent lập trình tương tự.
- Phát hành trọng số mở theo giấy phép MIT, cho phép tự lưu trữ và fine-tuning.
- Hai chế độ suy luận (High và Max) cho phép cân bằng giữa độ trễ và độ sâu suy luận.
- Kiến trúc MoE lớn với khoảng 744B tổng tham số nhưng chỉ kích hoạt ~40B mỗi token để đạt hiệu quả.
Hiệu năng benchmark của GLM-5.2
Zhipu không công bố bộ kết quả benchmark chính thức toàn diện khi ra mắt, khiến việc đối sánh trực tiếp kém chắc chắn hơn so với các mô hình như GPT-5 hoặc Claude. Nhiều báo cáo trong ngành ghi nhận việc thiếu các công bố benchmark được thẩm định độc lập.
| Benchmark | Điểm được báo cáo |
|---|---|
| Terminal-Bench 2.1 | 81.0 |
| SWE-Bench Pro | 62.1 |
| NL2Repo | 48.9 |
| AIME 2026 | 99.2 |

GLM-5.2 so với GLM-5.1 và Claude Opus 4.8
| Thông số | GLM-5.2 | GLM-5.1 | Claude Opus 4.8 |
|---|---|---|---|
| Ngày phát hành | 2026-06-13 | 2026 | 2026 |
| Cửa sổ ngữ cảnh | 1,000,000 | ~200,000 | 1,000,000 |
| Trọng số mở | Có (MIT) | Có | Không |
| Chế độ suy luận | High, Max | Standard | Extended Thinking |
| Tổng số tham số | 744B | 744B | Không công bố |
| Tham số hoạt động | 40B | 40B | Không công bố |
| Dữ liệu benchmark chính thức | Chưa công bố | Được công bố khi ra mắt | Được công bố |
Nâng cấp được ghi nhận chính của GLM-5.2 so với GLM-5.1 là mở rộng lên cửa sổ ngữ cảnh 1M-token và giới thiệu các chế độ suy luận có thể chọn High và Max. Khi ra mắt, Z.ai không công bố các kết quả benchmark chính thức như SWE-Bench, LiveCodeBench, HumanEval hay tương tự, vì vậy so sánh hiệu năng với Claude Opus 4.8, GPT-5, DeepSeek hoặc Qwen vẫn chưa được xác thực.
So với các mô hình mở khác, điểm khác biệt chính của GLM-5.2 là sự kết hợp giữa cửa sổ ngữ cảnh rất lớn, chuyên môn hóa cho lập trình và giấy phép MIT. Sức hấp dẫn mạnh nhất của nó hướng đến kỹ nghệ phần mềm ở quy mô kho mã hơn là các ứng dụng trò chuyện chung.
Vì sao nên dùng GLM-5.2 qua CometAPI?
CometAPI cho phép nhà phát triển tích hợp GLM-5.2 bằng cùng một giao diện được dùng cho hàng chục mô hình AI hàng đầu.
Lợi ích bao gồm:
- Xác thực thống nhất trên nhiều nhà cung cấp
- Tích hợp API tương thích với OpenAI
- Đơn giản hóa quản lý thanh toán và sử dụng
- Thử nghiệm nhanh với các mô hình thay thế
- Dễ dàng chuyển đổi giữa các mô hình lập trình, suy luận, hình ảnh, âm thanh và video
- Giảm phụ thuộc nhà cung cấp cho hệ thống sản xuất
Dù bạn đang xây dựng một AI IDE, trợ lý kỹ thuật nội bộ hay nền tảng tự động hóa doanh nghiệp, CometAPI giúp tối thiểu hóa nỗ lực tích hợp đồng thời vẫn giữ được tính linh hoạt.
Cách truy cập API GLM-5.2 trên CometAPI
Bắt đầu với sản phẩm của chúng tôi chỉ với vài bước đơn giản...
Bước 1: Đăng ký khóa API GLM-5.2 của bạn
Tạo tài khoản trên CometAPI và điều hướng đến bảng điều khiển API để tạo khóa API GLM-5.2. Khóa này xác thực mọi yêu cầu của bạn và cấp quyền truy cập ngay lập tức vào đầy đủ khả năng của GLM-5.2 API, bao gồm cửa sổ ngữ cảnh 1M token và 128k token đầu ra.
Bước 2: Gửi yêu cầu đến API GLM-5.2
Sử dụng khóa API GLM-5.2 của bạn để gửi yêu cầu POST đến endpoint của CometAPI. Truyền prompt, đặt các tham số mô hình như effort level và max tokens, và GLM-5.2 API sẽ xử lý yêu cầu của bạn — từ sinh mã đến phân tích tài liệu đến sử dụng công cụ dựa trên agent.
Bước 3: Nhận kết quả và tích hợp API GLM-5.2
GLM-5.2 API trả về phản hồi có cấu trúc, bao gồm văn bản completion, hướng dẫn gọi công cụ và metadata về mức sử dụng token. Hỗ trợ cả phản hồi đồng bộ tiêu chuẩn và streaming thời gian thực qua Server-Sent Events (SSE) khi cấu hình stream: true. Endpoint có thể được tích hợp dễ dàng vào quy trình hiện có của bạn bằng các HTTP client tiêu chuẩn hoặc openAI compatible SDKs bằng cách định tuyến yêu cầu qua url(//api.cometapi.com/v1) với Bearer Token của bạn.