Thứ Ba, 1 thg 9, 2026

Khi được phát hành qua QwenCloud API, phiên bản thương mại của mô hình đa phương thức mới từ Alibaba sẽ có giá 0,16 USD cho mỗi 1 triệu input token và 0,47 USD cho mỗi 1 triệu output token. Thiết kế Mixture-of-Experts (MoE) của mô hình sử dụng 125 tỷ tham số với 6 tỷ tham số được kích hoạt cho mỗi token. Nhờ kết hợp cơ chế attention GDN và QSA, chi phí huấn luyện đã giảm xuống chỉ còn 1/9 so với Qwen3.7-Plus. Mô hình hỗ trợ context window gốc 262K và có thể mở rộng lên 1 triệu token nhờ YaRN.

Qwen3.8-Flash-Next, phiên bản open-weight của kiến trúc mới, hiện đứng thứ 7 trong số các mô hình mở và thứ 24 trên bảng xếp hạng Agent Arena dựa trên 8.700 phiên làm việc thực tế. Mô hình này ghi nhận mức cải thiện ròng 2,4%, vượt qua mức 1,5% của Qwen3.8-27B. Đặc biệt, mô hình dẫn đầu về khả năng hoàn thành tác vụ với tỷ lệ thành công xác nhận đạt 12,3%.

Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@arena23:21 31 thg 8scoring 58.7 on DeepSWE 1.1, 62.5 on SWE-bench Pro, 73.9 on CoWorkBench, 84.5 on AndroidWorld, and 95.7 on MathVision
SUPPORT@thenewstack16:00 31 thg 8An early preview of the architecture in Qwen4