---
format: "aidr-story-markdown/v1"
id: "4988fdcb45510e88ccfa1ea727a2fa304f31529db3a4ee7d0c8c095ee11fb50e"
canonical_url: "https://aidr.today/4988fdcb?lang=vi"
title: "GLM-5.3 nhảy 19 bậc, đứng thứ 2 trong nhóm mô hình open-weight trên Terminal Bench"
lang: "vi"
requested_lang: "vi"
available_langs: ["en","vi"]
translation_fallback: null
fallback_fields: []
published_at: "2026-08-20T05:48:40.000Z"
category: "Models"
topics: ["llm","benchmark","open-source"]
source_urls: ["https://huggingnews.com/ai/update-glm-53-ranks-2nd-open-weight-model-on-terminal-bench-after-19-spo-33d00b52","https://x.com/ValsAI/status/2090192848780136668","https://x.com/ValsAI/status/2090192851057696924","https://x.com/ValsAI/status/2090192853033275460","https://x.com/ValsAI/status/2090192857902841931"]
summary: "Mô hình GLM-5.3 từ Z AI đạt 71,5% trên Terminal-Bench 2.1, vươn lên vị trí thứ hai trong nhóm các mô hình open-weight, chỉ sau Kimi K3. Trên LegalBench, mô hình này cũng đạt 84,8%, mức điểm cao thứ ba trong nhóm mô hình open-weight sau Kimi K3 và MiniMax M3, với hiệu quả cao nhất ở các tác vụ đưa ra kết luận và phát hiện vấn đề. Thứ hạng trên Terminal Bench cho thấy GLM-5.3 đã tăng mạnh 19 bậc so với phiên bản GLM 5.2, trong khi chi phí mỗi lần kiểm thử giảm từ 0,12 USD xuống còn 0,31 USD. ValsAI lưu ý rằng các hạn chế về kiểm soát xuất khẩu hiện tại khiến việc đánh giá chỉ giới hạn ở các benchmark công khai và học thuật; hãng có kế hoạch chạy thêm các benchmark Vals Index và Finance Agent ngay khi trọng số mô hình được phát hành."
---

# GLM\-5\.3 nhảy 19 bậc, đứng thứ 2 trong nhóm mô hình open\-weight trên Terminal Bench

> [Open the canonical story](<https://aidr.today/4988fdcb?lang=vi>)

**Published:** 2026-08-20T05:48:40.000Z
**Category:** Models
**Topics:** llm, benchmark, open\-source

## Summary

Mô hình GLM\-5\.3 từ Z AI đạt 71,5% trên Terminal\-Bench 2\.1, vươn lên vị trí thứ hai trong nhóm các mô hình open\-weight, chỉ sau Kimi K3\. Trên LegalBench, mô hình này cũng đạt 84,8%, mức điểm cao thứ ba trong nhóm mô hình open\-weight sau Kimi K3 và MiniMax M3, với hiệu quả cao nhất ở các tác vụ đưa ra kết luận và phát hiện vấn đề\. Thứ hạng trên Terminal Bench cho thấy GLM\-5\.3 đã tăng mạnh 19 bậc so với phiên bản GLM 5\.2, trong khi chi phí mỗi lần kiểm thử giảm từ 0,12 USD xuống còn 0,31 USD\. ValsAI lưu ý rằng các hạn chế về kiểm soát xuất khẩu hiện tại khiến việc đánh giá chỉ giới hạn ở các benchmark công khai và học thuật; hãng có kế hoạch chạy thêm các benchmark Vals Index và Finance Agent ngay khi trọng số mô hình được phát hành\.

## Sources

- [Story source](<https://huggingnews.com/ai/update-glm-53-ranks-2nd-open-weight-model-on-terminal-bench-after-19-spo-33d00b52>)
- [Story source](<https://x.com/ValsAI/status/2090192848780136668>)
- [Supporting source](<https://x.com/ValsAI/status/2090192851057696924>)
- [Supporting source](<https://x.com/ValsAI/status/2090192853033275460>)
- [Supporting source](<https://x.com/ValsAI/status/2090192857902841931>)

