Mô hình và nền tảng AI
GLM-5.3 Đạt 60 Điểm trên Chỉ số Trí tuệ của Artificial Analysis, Bằng Kimi K3

GLM-5.3 của Z.ai đã được đánh giá bởi Artificial Analysis ở mức 60 trên Chỉ số Trí tuệ của họ, nhà đánh giá độc lập báo cáo vào ngày 18 tháng 8 năm 2026, đặt mô hình suy luận mới nhất của phòng thí nghiệm Trung Quốc ở mức tương đương với Kimi K3 của Moonshot AI và cách Claude Opus 5 của Anthropic ba điểm, người dẫn đầu hiện tại với 63.
Điểm số này phản ánh GLM-5.3 hoạt động với mức nỗ lực suy luận tối đa, cài đặt mà Z.ai khuyến nghị cho công việc lập trình. Với 60 điểm, nó vượt xa mức trung vị 35 của 181 mô hình trong cùng lớp so sánh, và đứng thứ tám trong toàn bộ lớp.
Kết quả này là lần đọc độc lập đầu tiên về một mô hình mà Z.ai đã phát hành vào ngày 14 tháng 8 năm 2026 với cấu trúc khác thường: GLM-5.3 sử dụng cùng mô hình cơ sở với GLM-5.2, và mọi cải tiến khả năng đều đến từ quá trình huấn luyện sau, thay vì một vòng tiền huấn luyện mới.
Cách GLM-5.3 Đạt Đến Đây
Bài đăng phát hành của Z.ai mô tả một tháng mở rộng học tăng cường trên các môi trường nhiệm vụ dài hạn: nhiều môi trường hơn, nhiều nhiệm vụ đa dạng hơn, nhiều tính toán hơn, tất cả trên nền tảng huấn luyện mà phòng thí nghiệm đã xây dựng cho GLM-5.2. Công ty báo cáo rằng phương pháp này đã nâng Terminal-Bench 3.0 từ 4.6 lên 28.3 và DeepSWE v1.1 từ 46.2 lên 66.9, và bài đăng của họ ghi lại một loạt kết quả trong lập trình, an ninh mạng và các tiêu chuẩn đại lý so sánh với Kimi K3, Claude Opus 4.8, Claude Fable 5 và GPT-5.6 Sol. Unite.AI đã đưa tin chi tiết về việc ra mắt và các kết quả an ninh mạng mới nổi khi mô hình được giao tuần trước.
Số liệu của Artificial Analysis có trọng lượng khác so với các bảng do nhà cung cấp báo cáo, vì nhà đánh giá tự thực hiện bộ công cụ của mình. Chỉ số Trí tuệ v4.1.1 của họ tổng hợp chín đánh giá bao gồm các nhiệm vụ công việc thực tế của đại lý, việc sử dụng công cụ đại lý, lập trình terminal, suy luận khoa học và kiến thức, các câu hỏi khoa học trình độ sau đại học, suy luận vật lý, độ tin cậy kiến thức và ảo giác, và suy luận ngữ cảnh dài. Điểm 60 của GLM-5.3 là tổng hợp kết quả chạy qua toàn bộ bộ đánh giá này, với tổng chi phí đánh giá là 1.238,50 USD trên API của Z.ai.
Vị Trí Của GLM-5.3 Trên Bảng Xếp Hạng
Sự tương đương với Kimi K3 là điểm nổi bật trong so sánh. Kimi K3, phát hành ngày 16 tháng 7 năm 2026, đạt cùng 60 điểm trên chỉ số và vẫn là mô hình mở trọng số có điểm cao nhất trong bảng xếp hạng của Artificial Analysis, một vị trí mà GLM-5.3 hiện cũng đạt về điểm số dù không về giấy phép. Moonshot đã mở trọng số của Kimi K3 dưới giấy phép dựa trên doanh thu vào tháng 7 năm 2026; GLM-5.3 hiện được liệt kê là sở hữu độc quyền, với Artificial Analysis ghi nhận 753 tỷ tham số cho mô hình này.
Claude Opus 5, phát hành ngày 24 tháng 7 năm 2026, vẫn dẫn đầu chỉ số với 63 điểm. Khoảng cách ba điểm giữa GLM-5.3 và người dẫn đầu là khoảng cách mà một vòng huấn luyện sau nhanh chưa thu hẹp được, đối mặt với một ranh giới đã tự di chuyển kể từ mùa xuân.
Giá cả là nơi hai mô hình đạt 60 điểm khác biệt rõ rệt. GLM-5.3 có giá 1,40 USD cho mỗi triệu token đầu vào và 4,40 USD cho mỗi triệu token đầu ra trên API của Z.ai, so với 3,00 USD và 15,00 USD cho Kimi K3 trên nền tảng của Moonshot. Theo mỗi nhiệm vụ trong Chỉ số Trí tuệ, chi phí này tương đương 0,68 USD cho GLM-5.3, 0,84 USD cho Kimi K3 và 2,34 USD cho Claude Opus 5. GLM-5.3 đạt điểm số với chi phí mỗi nhiệm vụ thấp nhất trong ba mô hình, mặc dù nó cũng là mô hình sinh ra token nhiều nhất, tạo ra 170 triệu token đầu ra trong bộ đánh giá, so với mức trung vị 72 triệu trong cùng lớp.
Những Gì Sẽ Được Phát Hành Tiếp Theo
GLM-5.3 hiện có sẵn qua API của Z.ai và đã được triển khai cho tất cả người đăng ký GLM Coding Plan. Mô hình yêu cầu bật tính năng suy nghĩ, với ba mức nỗ lực, và Z.ai cảnh báo rằng các ứng dụng vẫn gọi mô hình mà không bật tính năng suy nghĩ sẽ gặp lỗi cho đến khi được chuyển đổi.
Trọng số là phần còn lại. Z.ai đã cam kết phát hành chúng hai tuần sau ngày ra mắt 14 tháng 8 năm 2026, sau khi hoàn thành đánh giá an toàn và củng cố, điều này sẽ đưa GLM-5.3 cùng với Kimi K3 trở thành lựa chọn mở trọng số ở mức 60 trên chỉ số, với giá mỗi token khoảng một nửa.












