← Về trang chính1 tin
Thứ Ba, 1 thg 9, 2026
1
Cập nhật: GLM-5.3 vươn lên vị trí thứ 2 trong bảng xếp hạng open-weight trên Vals Index, đứng thứ 13 toàn cầu
Models3 ngày trước1/14Mô hình AI GLM-5.3 vừa đạt 64,3 điểm coding, trở thành hệ thống open-weight dẫn đầu trong các tác vụ lập trình. Trên Vals Index, mô hình này hiện đứng thứ 13 trong tổng số 50 mô hình, tăng mạnh so với vị trí thứ 18 của phiên bản GLM-5.2 (vốn đạt 57,0 điểm). GLM-5.3 cũng chiếm ngôi đầu ở mảng nghiên cứu pháp lý và chuyển đổi mã nguồn, đồng thời đứng thứ hai trong benchmark Finance Agent v2.
Số liệu hiệu suất cho thấy mô hình đạt 95,4% trên SWE-bench và 71,5% trên Terminal-Bench 2.1. Kết quả Vibe Code Bench cũng tăng thêm 14 điểm lên mức 78,1%. Tuy nhiên, GLM-5.3 vẫn kém Kimi K3 ở các tác vụ khó trên Terminal-Bench khi chỉ đạt 53,3% so với 74,4% của đối thủ.
Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@valsai20:48 31 thg 8— #1 on our proprietary Legal Research, #1 on Code Migration, and #2 on Finance Agent v2
SOURCE@arena15:01 31 thg 8— At a $0.12 median cost per task and a +4.6% net improvement, it has reshaped the Pareto frontier!