Thông số kỹ thuật của GLM-5.3
| Thông số | GLM-5.3 |
|---|---|
| Nhà phát triển | Z.ai / Zhipu AI |
| Phát hành | 14 tháng 8, 2026 |
| Loại mô hình | Mô hình nền tảng chủ lực |
| Đầu vào | Văn bản |
| Đầu ra | Văn bản |
| Cửa sổ ngữ cảnh | 1,000,000 token |
| Đầu ra tối đa | 128,000 token |
| Tư duy | Nhiều chế độ |
| Streaming | Có |
| Gọi hàm | Có |
| Đầu ra có cấu trúc | Có |
| Bộ nhớ đệm ngữ cảnh | Có |
| MCP | Có |
| Ứng dụng chính | Lập trình, tác tử, kỹ thuật, an ninh mạng |
Kho lưu trữ mô hình công khai của Z.ai vẫn nổi bật hiển thị GLM-5.2, thay vì một GLM-5.3 có thể tải xuống, vì vậy các thông số chưa được công bố nên được đánh dấu rõ ràng là chưa xác nhận.
GLM-5.3 là gì?
GLM-5.3 là thế hệ mới nhất của dòng GLM từ Z.ai và thể hiện sự chuyển dịch hướng tới các hệ thống AI có khả năng tự động thực hiện các nhiệm vụ an ninh và kỹ thuật phức tạp.
Thông báo này đặc biệt đáng chú ý vì an ninh mạng không chỉ được trình bày như một hạng mục đánh giá khác. Z.ai đang sử dụng GLM-5.3 để chứng minh một hệ thống AI có khả năng phát hiện lỗ hổng phần mềm và tham gia vào các quy trình phát triển tấn công.
Reuters đưa tin rằng Z.ai dự định phát hành mô hình công khai sau khi hoàn tất đánh giá bảo mật, trong khi các khả năng nâng cao hơn ban đầu sẽ bị hạn chế thông qua một cơ chế truy cập tin cậy.
Đây là sự thay đổi đáng kể về trọng tâm so với GLM-5.2.
GLM-5.2 chủ yếu được định vị quanh kỹ thuật phần mềm tầm dài và lập trình tác tử. Trang nghiên cứu tháng 6 của Z.ai mô tả GLM-5.2 là "Built for Long-Horizon Tasks."
GLM-5.3 đưa triết lý tác tử đó vào một lĩnh vực nhạy cảm hơn nhiều:
kỹ thuật phần mềm → phát hiện lỗ hổng → phòng thủ mạng → an ninh tấn công có kiểm soát
Các tính năng chính của GLM-5.3 là gì?
Lập luận tập trung vào an ninh mạng
Khả năng tiêu biểu là an ninh mạng.
GLM-5.3 đạt:
84,5% trên CyberGym
CyberGym đánh giá khả năng của hệ thống AI trong việc xác định lỗ hổng phần mềm. Kết quả này nhỉnh hơn một chút so với 83,8% của Mythos 5.
Điều đó quan trọng vì an ninh mạng đòi hỏi nhiều hơn việc tạo mã đúng cú pháp.
Một tác tử bảo mật có năng lực cần:
- Hiểu mã lạ.
- Xác định bề mặt tấn công.
- Hình thành giả thuyết về lỗ hổng.
- Lần theo luồng dữ liệu và điều khiển.
- Xác minh giả thuyết.
- Phát triển bằng chứng khái niệm phù hợp.
- Xác định liệu lỗ hổng có thực sự khai thác được hay không.
Điểm CyberGym của GLM-5.3 cho thấy tiến bộ có ý nghĩa ở phần đầu của chuỗi này.
Khả năng phát hiện lỗ hổng mạnh
Điểm 84,5% trên CyberGym có lẽ là kết quả ấn tượng nhất ban đầu.
Nó đưa GLM-5.3 nhỉnh hơn Mythos 5 một chút về nhận diện lỗ hổng:
| Mô hình | CyberGym |
|---|---|
| GLM-5.3 | 84,5% |
| Mythos 5 | 83,8% |
Biên độ chỉ 0,7 điểm phần trăm, nên sẽ gây hiểu lầm nếu mô tả GLM-5.3 là vượt trội một cách dứt khoát.
Điểm thú vị hơn là một mô hình có trọng số mở từ Z.ai đang bước vào cùng vùng hiệu năng với một hệ thống an ninh mạng bị hạn chế cao.
Phát triển khai thác vẫn là điểm yếu
GLM-5.3 không vượt trội ở mọi tác vụ an ninh mạng.
Trên ExploitBench:
| Mô hình | ExploitBench |
|---|---|
| GLM-5.3 | 54,4% |
| Mythos 5 | 78,0% |
Đó là một khoảng cách 23,6 điểm.
Điều này cho thấy một khác biệt quan trọng:
Tìm thấy một lỗ hổng không giống với việc khai thác nó một cách đáng tin cậy.
GLM-5.3 có vẻ rất mạnh ở khâu xác định điểm yếu, nhưng các kết quả ban đầu cho thấy việc chuyển các phát hiện đó thành phát triển khai thác đáng tin cậy vẫn khó hơn đáng kể.
Đối với các đội an ninh doanh nghiệp, điều này thực sự khiến mô hình trở nên thú vị như một trợ lý phân tích lỗ hổng mang tính phòng thủ, hơn là một công cụ tự động hóa tấn công đơn thuần.
GLM-5.3 so với GLM-5.2
GLM-5.2 cung cấp đường chuẩn hữu ích nhất đã được xác nhận.
| Tính năng | GLM-5.2 | GLM-5.3 |
|---|---|---|
| Trạng thái | Đã phát hành | Đã công bố |
| Định vị chính | Tác tử tầm dài | An ninh mạng + tác tử |
| Lập trình | Xuất sắc | Được kỳ vọng vẫn mạnh |
| An ninh mạng | Tiềm năng mạnh | Trọng tâm chủ lực rõ ràng |
| CyberGym | — | 84,5% |
| ExploitBench | — | 54,4% |
| Cửa sổ ngữ cảnh | 1M | Chưa xác nhận |
| Tham số | ~753B | Chưa xác nhận |
| Giấy phép | MIT | Trọng số mở đã công bố |
| Giá API | Đã công bố | Chưa công bố |
| Trọng số công khai | Có sẵn | Đã lên kế hoạch |
Kiến trúc đã xác nhận của GLM-5.2 vào khoảng 753B tham số, và danh mục mô hình công khai của nó vẫn liệt kê mô hình 753B và phiên bản FP8.
GLM-5.2 cũng đạt 81,0 trên Terminal-Bench 2.1 và 62,1 trên SWE-bench Pro theo các báo cáo của bên thứ ba dựa trên tài liệu đánh giá mô hình của Z.ai.
Nhưng những con số đó nên vẫn là điểm chuẩn của GLM-5.2, không nên gán cho GLM-5.3.
GLM-5.3 so với Mythos 5
Đây hiện là so sánh điểm chuẩn có ý nghĩa nhất.
| Điểm chuẩn | GLM-5.3 | Mythos 5 | Chênh lệch |
|---|---|---|---|
| CyberGym | 84,5% | 83,8% | +0,7 điểm phần trăm |
| ExploitBench | 54,4% | 78,0% | −23,6 điểm |
Kết quả đưa đến một kết luận có sắc thái.
GLM-5.3 thắng ở nhận diện lỗ hổng.
Nhưng:
Mythos 5 vẫn mạnh hơn đáng kể ở phát triển khai thác.
Vì vậy, nói "GLM-5.3 vượt Mythos 5" sẽ là diễn giải không chính xác dựa trên dữ liệu hiện có.
Mô tả phù hợp hơn là:
GLM-5.3 đạt mức hiệu năng tương đương Mythos 5 ở phát hiện lỗ hổng trong khi vẫn tụt lại ở phát triển khai thác.
Điều đó dễ bảo vệ hơn và hữu ích hơn cho các nhà phát triển.