Vercel vừa tích hợp mô hình GLM 5.3 từ Z.ai vào AI Gateway nhằm hỗ trợ lập trình viên xử lý các tác vụ coding và an ninh mạng. Điểm nhấn của lần triển khai này là hiệu suất vượt trội trên benchmark DeepsecBench cùng chi phí vận hành thấp, giúp các nhà phát triển dễ dàng thực hiện đánh giá bảo mật thường xuyên hơn mà không tốn kém như khi dùng các công cụ độc quyền cùng chất lượng.

GLM 5.3 dùng chung base model 743B với phiên bản 5.2 nhưng được cải thiện nhờ quá trình post-training trong môi trường kỹ thuật mô phỏng. Nhờ đó, điểm Terminal-Bench tăng vọt từ 4,6 lên 28,3 và DeepSWE tăng từ 46,2 lên 66,9. Đặc biệt, trên benchmark CyberGym, GLM 5.3 đạt 84,5%, vượt qua cả Mythos 5 của Anthropic.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@vercel_dev“1/3 of the cost of some proprietary models with similar scores”x.com
  2. SOURCE@rauchg“means you can run https://t.co/KwrlahlCiK at least 3× more often!”x.com
  3. SUPPORT@wesroth“Terminal-Bench jumped from 4.6 → 28.3 and DeepSWE from 46.2 → 66.9”x.com
  4. SUPPORT@maxforai“GLM 5.3 已经站到了开源模型的第一梯队”x.com
Bản Markdown