← Về trang chính1 tin
Hệ thống multimodal Mixture-of-Experts (MoE) này sẽ chính thức cho phép tải về dưới dạng open-weight từ ngày mai, 26/8. Với tổng cộng 120 tỷ tham số nhưng chỉ có 6 tỷ tham số hoạt động, Alibaba thiết kế mô hình này nhằm trình diễn một khung kiến trúc thế hệ mới. Bản phát hành này giúp các nhà phát triển tiếp cận sớm những cải tiến về cấu trúc sẽ làm nền tảng cho dòng Qwen4 sắp tới, đánh dấu lần đầu tiên thế hệ mô hình mới được công khai. UnslothAI cũng đang chuẩn bị hỗ trợ ngay từ ngày đầu để người dùng có thể tích hợp mô hình nhanh chóng. Việc chuyển sang quy mô 120B tham số, thay vì bản Qwen-3.8 27b trước đó, cho thấy xu hướng tăng cường năng lực cho các mô hình multimodal mã nguồn mở.
Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
- SOURCE@bdsqlsz“The countdown starts now!”x.com
- SUPPORT@kimmonismus“Alibaba is giving developers early access to the architectural improvements that will underpin the upcoming model family.”x.com
- SUPPORT@jun_song“Qwen3.8-120B/51B/A6B MoE is coming out in 24 hours.”x.com
- SUPPORT@danielhanchen“working on @UnslothAI day zero support.”x.com
- SUPPORT@thezachmueller“Welcome to the era of ~120B models.”x.com
- SOURCE@alibaba_qwen“Priced at $0.40/$3 per M input/output tokens, it has shifted the Pareto frontier”x.com
- SUPPORT@kimmonismus“roughly 176B parameters of stored capacity with just 6B activated per token”x.com
- SUPPORT@wesroth“the ONLY model in its size class in the top 10”x.com