Thông số kỹ thuật của GLM-5.3
| Thông số | GLM-5.3 |
|---|---|
| Nhà phát triển | Z.ai |
| Dòng mô hình | GLM-5 |
| Phiên bản | 5.3 |
| Công bố | 14 tháng 8, 2026 |
| Loại mô hình | LLM tiên tiến định hướng tác nhân |
| Trọng tâm chính | An ninh mạng, viết mã, tác nhân tự động |
| Trọng số mở | Có / đã công bố |
| Tham số | Chưa được tiết lộ |
| Tham số hoạt động | Chưa được tiết lộ |
| Kiến trúc | Chưa được tiết lộ |
| Cửa sổ ngữ cảnh | Chưa được tiết lộ |
| Đầu ra tối đa | Chưa được tiết lộ |
| Thị giác gốc | Chưa được xác nhận |
| CyberGym | 84.5% |
| ExploitBench | 54.4% |
| Trọng số công khai | Đã lên kế hoạch |
| Phát hành công khai | Khoảng hai tuần sau khi công bố |
| ID mô hình API | Chưa được xác nhận công khai |
| Giá API | Chưa được công bố |
| Truy cập nâng cao | Người dùng đáng tin cậy/đã xác minh |
| Trường hợp sử dụng tốt nhất | An ninh mạng, tác nhân lập trình, nghiên cứu lỗ hổng |
Kho lưu trữ mô hình công khai của Z.ai vẫn nổi bật hiển thị GLM-5.2, thay vì một bản phân phối có thể tải xuống của GLM-5.3, vì vậy các thông số kỹ thuật chưa được công bố cần tiếp tục được đánh dấu rõ ràng là chưa được xác nhận.
GLM-5.3 là gì?
GLM-5.3 là thế hệ mới nhất của dòng GLM từ Z.ai và thể hiện sự chuyển dịch hướng tới các hệ thống AI có khả năng tự chủ thực hiện các tác vụ bảo mật và kỹ thuật phức tạp.
Thông báo này đặc biệt đáng chú ý vì an ninh mạng không chỉ được trình bày như một danh mục điểm chuẩn khác. Z.ai đang sử dụng GLM-5.3 để trình diễn một hệ thống AI có khả năng phát hiện lỗ hổng phần mềm và tham gia vào các quy trình phát triển tấn công.
Reuters đưa tin rằng Z.ai dự định phát hành công khai mô hình sau khi hoàn tất các đánh giá bảo mật, trong khi các khả năng nâng cao hơn ban đầu sẽ bị hạn chế thông qua cơ chế truy cập tin cậy.
Đây là một thay đổi trọng tâm đáng kể so với GLM-5.2.
GLM-5.2 chủ yếu được định vị xung quanh kỹ thuật phần mềm tầm nhìn dài và lập trình theo tác nhân. Trang nghiên cứu tháng 6 của Z.ai mô tả GLM-5.2 là "Được xây dựng cho các nhiệm vụ dài hạn."
GLM-5.3 đưa triết lý tác nhân đó vào một lĩnh vực nhạy cảm hơn nhiều:
kỹ nghệ phần mềm → phát hiện lỗ hổng → phòng thủ mạng → tấn công có kiểm soát
Các tính năng chính của GLM-5.3 là gì?
Lập luận lấy an ninh mạng làm trung tâm
Khả năng tiêu biểu là an ninh mạng.
GLM-5.3 đạt:
84.5% trên CyberGym
CyberGym đánh giá khả năng của một hệ thống AI trong việc xác định lỗ hổng phần mềm. Kết quả này nhỉnh hơn một chút so với 83.8% được báo cáo của Mythos 5.
Điều đó quan trọng vì an ninh mạng đòi hỏi nhiều hơn việc tạo ra mã cú pháp đúng.
Một tác nhân bảo mật đủ năng lực cần phải:
- Hiểu mã lạ.
- Xác định bề mặt tấn công.
- Hình thành giả thuyết về lỗ hổng.
- Truy vết luồng dữ liệu và điều khiển.
- Xác minh giả thuyết.
- Phát triển bằng chứng khái niệm phù hợp.
- Xác định liệu lỗ hổng thực sự có thể khai thác được hay không.
Điểm số CyberGym của GLM-5.3 gợi ý tiến bộ đáng kể ở phần đầu của chuỗi này.
Khả năng phát hiện lỗ hổng mạnh
Điểm 84.5% trên CyberGym có lẽ là kết quả ban đầu ấn tượng nhất.
Nó đặt GLM-5.3 nhỉnh hơn một chút so với Mythos 5 về xác định lỗ hổng:
| Mô hình | CyberGym |
|---|---|
| GLM-5.3 | 84.5% |
| Mythos 5 | 83.8% |
Biên độ chỉ 0.7 điểm phần trăm, vì vậy mô tả GLM-5.3 vượt trội dứt khoát sẽ là sai lệch.
Điểm thú vị hơn là một mô hình trọng số mở từ Z.ai đang bước vào vùng hiệu năng tương đương với một hệ thống an ninh mạng bị hạn chế cao.
Phát triển khai thác vẫn còn là điểm yếu
GLM-5.3 không vượt trội ở mọi tác vụ an ninh mạng.
Trên ExploitBench:
| Mô hình | ExploitBench |
|---|---|
| GLM-5.3 | 54.4% |
| Mythos 5 | 78.0% |
Đó là một khoảng cách 23.6 điểm.
Điều này cho thấy một khác biệt quan trọng:
Tìm ra một lỗ hổng không giống với việc khai thác nó một cách đáng tin cậy.
GLM-5.3 có vẻ rất mạnh trong việc xác định điểm yếu, nhưng các kết quả ban đầu cho thấy việc chuyển những phát hiện đó thành phát triển khai thác đáng tin cậy vẫn khó hơn đáng kể.
Đối với các đội an ninh doanh nghiệp, điều này thực sự khiến mô hình trở nên thú vị như một trợ lý phân tích lỗ hổng phục vụ phòng thủ, thay vì chỉ là một động cơ tự động hóa tấn công.
GLM-5.3 so với GLM-5.2
GLM-5.2 cung cấp đường cơ sở được xác nhận hữu ích nhất.
| Tính năng | GLM-5.2 | GLM-5.3 |
|---|---|---|
| Trạng thái | Đã phát hành | Đã công bố |
| Định vị chính | Tác nhân dài hạn | An ninh mạng + tác nhân |
| Viết mã | Xuất sắc | Kỳ vọng vẫn mạnh |
| An ninh mạng | Tiềm năng mạnh | Trọng tâm chủ lực rõ ràng |
| CyberGym | — | 84.5% |
| ExploitBench | — | 54.4% |
| Ngữ cảnh | 1M | Chưa xác nhận |
| Tham số | ~753B | Chưa xác nhận |
| Giấy phép | MIT | Trọng số mở đã công bố |
| Giá API | Đã công bố | Chưa được công bố |
| Trọng số công khai | Có sẵn | Đã lên kế hoạch |
Kiến trúc đã được xác nhận của GLM-5.2 xấp xỉ 753B tham số, và danh mục mô hình công khai của nó vẫn liệt kê mô hình 753B và phiên bản FP8.
GLM-5.2 cũng đạt 81.0 trên Terminal-Bench 2.1 và 62.1 trên SWE-bench Pro theo báo cáo của bên thứ ba dựa trên tài liệu đánh giá mô hình của Z.ai.
Nhưng những con số đó nên vẫn là điểm chuẩn của GLM-5.2, không nên gán cho GLM-5.3.
GLM-5.3 so với Mythos 5
Đây hiện là so sánh điểm chuẩn có ý nghĩa nhất.
| Điểm chuẩn | GLM-5.3 | Mythos 5 | Chênh lệch |
|---|---|---|---|
| CyberGym | 84.5% | 83.8% | +0.7 điểm phần trăm |
| ExploitBench | 54.4% | 78.0% | −23.6 điểm |
Kết quả đưa đến một kết luận tinh tế.
GLM-5.3 thắng ở việc xác định lỗ hổng.
Nhưng:
Mythos 5 vẫn mạnh hơn đáng kể ở phát triển khai thác.
Vì vậy, nói "GLM-5.3 đánh bại Mythos 5" sẽ là diễn giải không chính xác từ dữ liệu hiện có.
Mô tả tốt hơn là:
GLM-5.3 đạt mức hiệu năng ngang tầm Mythos 5 ở phát hiện lỗ hổng trong khi vẫn tụt sau ở phát triển khai thác.
Điều đó phòng thủ hơn nhiều và hữu ích hơn cho nhà phát triển.