← Về trang chính1 tin
Thứ Bảy, 29 thg 8, 2026
1
Mô hình mã nguồn mở GLM-5.3 vượt qua GPT-5.6 để đứng thứ 3 trên Terminal-Bench 4.0, đánh bại sản phẩm tốt nhất của OpenAI
Nghiên cứu6 ngày trước1/11Một bài kiểm tra hiệu năng AI độc lập vừa làm thay đổi cục diện cạnh tranh giữa các mô hình đóng và mô hình chạy cục bộ. GLM-5.3 Max đã vượt qua GPT-5.6 Max và Sol để giành vị trí thứ ba trên bảng xếp hạng Terminal-Bench 4.0, vượt mặt cả những dòng flagship của OpenAI.
Benchmark này sử dụng các tác vụ được thiết kế để ngăn chặn tình trạng "benchmaxxing" — hành vi các nhà phát triển tối ưu hóa mô hình chỉ để lấy điểm cao trong các bài kiểm tra. Sau kết quả này, một số người dùng cho rằng GPT-5.6 Sol là mô hình bị thổi phồng quá mức nhất thị trường, trong khi kết quả lại cho thấy khả năng ngày càng mạnh mẽ của các mô hình mã nguồn mở khi chạy cục bộ.
Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@kimmonismus11:10 29 thg 8— GLM-5.3 (max) outperforming GPT-5.6 (max) on the new Terminal-Bench 4.0 was not on my bingo card
SUPPORT@spac891:30 29 thg 8— an open source model that you can actually run locally competing with, and in this benchmark beating, OpenAI’s best model
SUPPORT@himanshustwts1:24 29 thg 8— GLM 5.3 is best open source model out there sharing very close boundary with Fable 5
SUPPORT@zixuanli_4:30 29 thg 8— pushed a version update to the Terminal-Bench dataset and leaderboard