Mô hình AI 27B mới nhất của Alibaba vượt qua Claude Opus trong các benchmark lập trình, trong khi vẫn đủ nhẹ để chạy trên máy tính cá nhân. Với điểm số 61,7 trên SWE-Pro (so với 53,4 của Opus) và hỗ trợ context window lên tới 262.144 token, mô hình này đã trở thành cái tên được yêu thích thứ ba mọi thời đại trên Hugging Face. Người dùng có thể chạy mô hình trên các phần cứng phổ thông như RTX 5090 hay Apple Silicon.

Một phiên bản MLX không kiểm duyệt dành cho Apple Silicon hiện cho phép người dùng vượt qua các bộ lọc an toàn. Người tạo ra phiên bản này cảnh báo mô hình có thể cung cấp hướng dẫn về mã độc, gian lận và vũ khí theo yêu cầu. Các thử nghiệm trên các phiên bản 4, 6 và 8-bit cho thấy mô hình không hề từ chối yêu cầu mà vẫn giữ nguyên khả năng suy luận và tool-calling.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@kimmonismus“can provide malware, fraud and weapons instructions on demand”x.com
  2. SUPPORT@rohanpaul_ai“SWE-Pro 61.7 vs Opus 53.4; GPQA 89.2 vs 91.3”x.com
  3. SUPPORT@kimmonismus“matches the closed-source state-of-the-art from just a few months ago”x.com
  4. SUPPORT@ttunguz“Your laptop can now run a model as capable as nearly anything in the cloud”x.com
  5. SUPPORT@multimodalart“surpassed Kimi-K3 and is now the #3 most liked model on hugging face of all times”x.com
  6. SOURCE@alibaba_qwen“A local 27B model scoring frontier performance!”x.com
  7. SUPPORT@alibaba_qwen“Strong enough to keep up with the frontier, light enough to run on your own laptop.”x.com
  8. SUPPORT@danielhanchen“the previous most-liked Unsloth GGUFs were Qwen3.6-35B-A3B with 1.54K likes and DeepSeek-R1 with 1.12K”x.com
Bản Markdown