← Về trang chính1 tin
Thứ Sáu, 4 thg 9, 2026
1
Cập nhật: Unsloth giúp tăng tốc GLM-5.3-Flash lên 3,3 lần khi chạy local với context dài
Nghiên cứu2 giờ trước1/12Nhờ các kỹ thuật tối ưu hóa decoding và multi-token prediction mới từ Unsloth, tốc độ inference định dạng GGUF tại chỗ hiện nhanh hơn từ 1,6 đến 3,4 lần. Bản cập nhật này tập trung cải thiện hiệu suất cho các tác vụ xử lý ngữ cảnh dài.
Đăng nhập để góp ý, chỉnh sửa