← Về trang chính1 tin
1
Unsloth giúp tăng tốc GLM-5.3-Flash lên 3,3 lần khi chạy local với context dài
Research27 ngày trướcNhờ các kỹ thuật tối ưu hóa decoding và multi-token prediction mới từ Unsloth, tốc độ inference định dạng GGUF tại chỗ hiện nhanh hơn từ 1,6 đến 3,4 lần. Bản cập nhật này tập trung cải thiện hiệu suất cho các tác vụ xử lý ngữ cảnh dài.
Đăng nhập để góp ý, chỉnh sửa
Bản Markdown