Thứ Năm, 20 thg 8, 2026

Mô hình ngôn ngữ mới nhất từ Z AI cho thấy khả năng lập trình tự động mạnh mẽ trong các đợt thử nghiệm gần đây. Kết quả trên Terminal-Bench 3.0 cho thấy phiên bản GLM-5.3 đã đạt trình độ gần tương đương Fable 5 khi xử lý các tác vụ terminal agent, sau khi hãng ra mắt bản tối ưu riêng cho coding và bảo mật phòng thủ.

Trên bảng xếp hạng chính thức của DeepSWE — nơi đo lường khả năng giải quyết các sự cố phần mềm thực tế — GLM-5.3 ghi nhận mức điểm 69. Z AI đã mở API cho mô hình này từ ngày 18/8 thông qua các cổng đối tác, mức giá giữ nguyên so với phiên bản GLM-5.2 tiền nhiệm.

Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@zixuanli_10:55 20 thg 8GLM-5.3 scores 69 on the official DeepSWE leaderboard
SUPPORT@zai_org12:56 20 thg 8GLM-5.3 scores 69 on the official DeepSWE leaderboard
SUPPORT@scaling0113:50 20 thg 8GLM-5.3 is crushing Terminal-Bench 3.0
SOURCE@liamfedus9:01 20 thg 8The 1.6T model achieved better C4 perplexities than the T5 models using far less compute, set a new SOTA on TriviaQA, but was dumb as bricks on reasoning tasks like SuperGLUE.
SUPPORT@nandodf7:03 20 thg 8This is the wisest and most accurate take on scaling laws — their promise and their costly failures — that you could read today.