Thông số kỹ thuật của GLM-5.2
| Mục | GLM-5.2 |
|---|---|
| Nhà cung cấp | Zhipu AI |
| Ngày phát hành | 13 tháng 6, 2026 |
| Loại mô hình | LLM Mixture-of-Experts (MoE) trọng số mở |
| Tổng tham số | ~744B |
| Tham số kích hoạt | ~40B mỗi token |
| Cửa sổ ngữ cảnh | 1,000,000 token |
| Đầu ra tối đa | 131,072 token |
| Chế độ suy luận | High, Max |
| Giấy phép | MIT |
| Trọng tâm chính | Lập trình hướng tác tử, kỹ nghệ phần mềm, suy luận tầm xa |
| Khả dụng API | Nền tảng Z.ai và các nhà cung cấp tương thích |
| Trọng số mở | Có |
GLM-5.2 là mô hình flagship mới nhất từ dòng GLM của Zhipu AI. Không giống các mô hình tiên tiến đa năng, GLM-5.2 được định vị chủ yếu là một mô hình ưu tiên lập trình và định hướng tác tử, được thiết kế cho kỹ nghệ phần mềm ở quy mô kho mã, quy trình tự động và suy luận ngữ cảnh cực dài. Năng lực nổi bật của nó là cửa sổ ngữ cảnh gốc 1 triệu token, khiến nó trở thành một trong những cửa sổ ngữ cảnh lớn nhất công khai trong số các mô hình mở trọng số.
Các tính năng chính của GLM-5.2
- Cửa sổ ngữ cảnh 1M token cho toàn bộ kho mã, bộ tài liệu dài và quy trình tác tử đa phiên.
- Tối ưu hóa ưu tiên cho lập trình, tập trung vào tái cấu trúc, gỡ lỗi, sinh mã và các tác vụ kỹ nghệ phần mềm.
- Hỗ trợ quy trình làm việc dựa trên tác tử cho các công cụ như Claude Code, Cline, Roo Code, OpenCode và các tác tử lập trình tương tự.
- Phát hành trọng số mở theo giấy phép MIT, cho phép tự lưu trữ và tinh chỉnh.
- Hai chế độ suy luận (High và Max) cho phép đánh đổi giữa độ trễ và độ sâu suy luận.
- Kiến trúc MoE lớn với khoảng 744B tổng tham số, chỉ kích hoạt ~40B mỗi token để đạt hiệu quả.
Hiệu năng benchmark của GLM-5.2
Zhipu không công bố kết quả benchmark chính thức toàn diện khi ra mắt, điều này khiến việc benchmark trực tiếp kém chắc chắn hơn so với các mô hình như GPT-5 hoặc Claude. Nhiều báo cáo trong ngành ghi nhận sự thiếu vắng các công bố benchmark được thẩm định độc lập.
| Benchmark | Điểm được báo cáo |
|---|---|
| Terminal-Bench 2.1 | 81.0 |
| SWE-Bench Pro | 62.1 |
| NL2Repo | 48.9 |
| AIME 2026 | 99.2 |

GLM-5.2 so với GLM-5.1 và Claude Opus 4.8
| Thông số | GLM-5.2 | GLM-5.1 | Claude Opus 4.8 |
|---|---|---|---|
| Ngày phát hành | 2026-06-13 | 2026 | 2026 |
| Cửa sổ ngữ cảnh | 1,000,000 | ~200,000 | 1,000,000 |
| Trọng số mở | Có (MIT) | Có | Không |
| Chế độ suy luận | High, Max | Tiêu chuẩn | Tư duy mở rộng |
| Tổng tham số | 744B | 744B | Không tiết lộ |
| Tham số kích hoạt | 40B | 40B | Không tiết lộ |
| Dữ liệu benchmark chính thức | Chưa công bố | Công bố khi ra mắt | Đã công bố |
Nâng cấp được ghi nhận chính của GLM-5.2 so với GLM-5.1 là mở rộng lên cửa sổ ngữ cảnh 1M token và giới thiệu các chế độ suy luận có thể chọn High và Max. Khi ra mắt, Z.ai không công bố kết quả benchmark chính thức cho SWE-Bench, LiveCodeBench, HumanEval hay tương tự, vì vậy các so sánh hiệu năng với Claude Opus 4.8, GPT-5, DeepSeek hoặc Qwen vẫn chưa được kiểm chứng.
So với các mô hình mở khác, điểm khác biệt chính của GLM-5.2 là sự kết hợp giữa cửa sổ ngữ cảnh rất lớn, chuyên môn hóa cho lập trình và giấy phép MIT. Sức hấp dẫn lớn nhất của nó là cho kỹ nghệ phần mềm ở quy mô kho mã hơn là các ứng dụng trò chuyện chung.
Tại sao sử dụng GLM-5.2 qua CometAPI?
CometAPI cho phép nhà phát triển tích hợp GLM-5.2 bằng cùng một giao diện được dùng cho hàng chục mô hình AI hàng đầu.
Lợi ích bao gồm:
- Xác thực thống nhất trên nhiều nhà cung cấp
- Tích hợp API tương thích với OpenAI
- Đơn giản hóa quản lý thanh toán và sử dụng
- Thử nghiệm nhanh với các mô hình thay thế
- Dễ dàng chuyển đổi giữa các mô hình về lập trình, suy luận, hình ảnh, âm thanh và video
- Giảm phụ thuộc nhà cung cấp cho hệ thống sản xuất
Dù bạn đang xây dựng một IDE AI, trợ lý kỹ thuật nội bộ hay nền tảng tự động hóa doanh nghiệp, CometAPI giúp giảm công sức tích hợp đồng thời duy trì tính linh hoạt.
Cách truy cập API GLM-5.2 trên CometAPI
Bắt đầu với sản phẩm của chúng tôi chỉ với vài bước đơn giản...
Bước 1: Đăng ký để lấy khóa API GLM-5.2 của bạn
Tạo tài khoản trên CometAPI và đi tới bảng điều khiển API để tạo khóa API GLM-5.2 của bạn. Khóa này xác thực mọi yêu cầu của bạn và cho phép truy cập ngay tới toàn bộ khả năng của API GLM-5.2, bao gồm cửa sổ ngữ cảnh 1M token và 128k token đầu ra.
Bước 2: Gửi yêu cầu tới API GLM-5.2
Sử dụng khóa API GLM-5.2 của bạn để gửi yêu cầu POST tới endpoint của CometAPI. Truyền prompt của bạn, thiết lập các tham số mô hình như mức độ nỗ lực và số token tối đa, và API GLM-5.2 sẽ xử lý yêu cầu của bạn — xử lý mọi thứ từ sinh mã đến phân tích tài liệu và sử dụng công cụ tác tử.
Bước 3: Nhận kết quả và tích hợp API GLM-5.2
API GLM-5.2 trả về phản hồi có cấu trúc, bao gồm văn bản hoàn thành, hướng dẫn gọi công cụ và siêu dữ liệu về mức sử dụng token. Hỗ trợ cả phản hồi đồng bộ tiêu chuẩn và truyền trực tuyến thời gian thực qua Server-Sent Events (SSE) khi cấu hình stream: true. Endpoint có thể dễ dàng tích hợp vào quy trình hiện có của bạn bằng các client HTTP tiêu chuẩn hoặc SDK tương thích OpenAI bằng cách định tuyến yêu cầu qua url(//api.cometapi.com/v1) với Bearer Token của bạn.