Thứ Ba, 1 thg 9, 2026

Mô hình AI GLM-5.3 vừa đạt 64,3 điểm coding, trở thành hệ thống open-weight dẫn đầu trong các tác vụ lập trình. Trên Vals Index, mô hình này hiện đứng thứ 13 trong tổng số 50 mô hình, tăng mạnh so với vị trí thứ 18 của phiên bản GLM-5.2 (vốn đạt 57,0 điểm). GLM-5.3 cũng chiếm ngôi đầu ở mảng nghiên cứu pháp lý và chuyển đổi mã nguồn, đồng thời đứng thứ hai trong benchmark Finance Agent v2.

Số liệu hiệu suất cho thấy mô hình đạt 95,4% trên SWE-bench và 71,5% trên Terminal-Bench 2.1. Kết quả Vibe Code Bench cũng tăng thêm 14 điểm lên mức 78,1%. Tuy nhiên, GLM-5.3 vẫn kém Kimi K3 ở các tác vụ khó trên Terminal-Bench khi chỉ đạt 53,3% so với 74,4% của đối thủ.

Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@valsai20:48 31 thg 8#1 on our proprietary Legal Research, #1 on Code Migration, and #2 on Finance Agent v2
SUPPORT@wesroth4:30 1 thg 978.1% Vibe Code Bench, up 14 points
SUPPORT@zixuanli_3:07 1 thg 9strong capabilities in legal and financial reasoning
SOURCE@arena15:01 31 thg 8At a $0.12 median cost per task and a +4.6% net improvement, it has reshaped the Pareto frontier!
SUPPORT@dabit314:29 31 thg 8rolled out support for GLM 5.3 Flash along with an improved model picker UX in Devin CLI
SUPPORT@factoryai16:42 31 thg 8GLM-5.3 and GLM-5.3 Flash have arrived in Droid
SUPPORT@factoryai16:42 31 thg 8stronger results on complex programming and long-horizon tasks
SUPPORT@deeplearningai13:44 31 thg 8This unexpected jump in exploit generation prompted a temporary safety hold on the model weights’ release