Tôi kiểm thử các bản GGUF của Qwen3.8 27B từ Unsloth (Q4_K_M, UD-Q2_K_XL, UD-IQ1_S) bằng llama.cpp trên GPQA Diamond, IFBench và Terminal-Bench 2.1. Q4_K_M đạt kết quả tương đương BF16 và vừa vặn trên RTX 4090.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. THẢO LUẬNmpweiherlobste.rs
Bản Markdown