---
format: "aidr-story-markdown/v1"
id: "abec50fa368223e1f49183ed15c646bf14fd5e7700956ee4a6c261050c8760f7"
canonical_url: "https://aidr.today/abec50fa?lang=vi"
title: "Alibaba Qwen3.8 27B đạt hiệu suất ngang ngửa GPT 5.6 Luna, lập kỷ lục mới cho mô hình mã nguồn mở"
lang: "vi"
requested_lang: "vi"
available_langs: ["en","vi"]
translation_fallback: null
fallback_fields: []
published_at: "2026-08-17T20:53:05.000Z"
category: "Models"
topics: ["alibaba","qwen","benchmark","open-source","multimodal","nvidia"]
source_urls: ["https://huggingnews.com/ai/update-alibaba-qwen38-27b-matches-gpt-56-luna-performance-in-first-local-ea7210d7","https://x.com/cline/status/2089425906569977896","https://x.com/xenovacom/status/2089435071384076306","https://x.com/sgl_project/status/2089337991181598989","https://x.com/rohanpaul_ai/status/2089363481124593942"]
summary: "Theo chỉ số Artificial Analysis Intelligence Index mới nhất, mô hình mã nguồn mở mới của Alibaba đạt 52 điểm, đứng ngang hàng với các mô hình hàng đầu như DeepSeek V4-Pro. Kết quả benchmark này đưa mô hình 27B tham số vào nhóm hiệu suất vốn trước đây chỉ dành cho các hệ thống đóng độc quyền. Đây là mô hình đa phương thức (multimodal) gốc và được cấp phép theo chuẩn Apache 2.0 để các nhà phát triển dễ dàng tiếp cận. Khi chạy trên một card Nvidia RTX 5090 với 32 GB VRAM, người dùng ghi nhận tốc độ đạt 115 token/giây, trong khi các phương pháp tối ưu từ SGLang có thể đẩy tốc độ lên tới 206,1 token/giây."
---

# Alibaba Qwen3\.8 27B đạt hiệu suất ngang ngửa GPT 5\.6 Luna, lập kỷ lục mới cho mô hình mã nguồn mở

> [Open the canonical story](<https://aidr.today/abec50fa?lang=vi>)

**Published:** 2026-08-17T20:53:05.000Z
**Category:** Models
**Topics:** alibaba, qwen, benchmark, open\-source, multimodal, nvidia

## Summary

Theo chỉ số Artificial Analysis Intelligence Index mới nhất, mô hình mã nguồn mở mới của Alibaba đạt 52 điểm, đứng ngang hàng với các mô hình hàng đầu như DeepSeek V4\-Pro\. Kết quả benchmark này đưa mô hình 27B tham số vào nhóm hiệu suất vốn trước đây chỉ dành cho các hệ thống đóng độc quyền\. Đây là mô hình đa phương thức \(multimodal\) gốc và được cấp phép theo chuẩn Apache 2\.0 để các nhà phát triển dễ dàng tiếp cận\. Khi chạy trên một card Nvidia RTX 5090 với 32 GB VRAM, người dùng ghi nhận tốc độ đạt 115 token/giây, trong khi các phương pháp tối ưu từ SGLang có thể đẩy tốc độ lên tới 206,1 token/giây\.

## Sources

- [Story source](<https://huggingnews.com/ai/update-alibaba-qwen38-27b-matches-gpt-56-luna-performance-in-first-local-ea7210d7>)
- [Story source](<https://x.com/cline/status/2089425906569977896>)
- [Supporting source](<https://x.com/xenovacom/status/2089435071384076306>)
- [Supporting source](<https://x.com/sgl_project/status/2089337991181598989>)
- [Supporting source](<https://x.com/rohanpaul_ai/status/2089363481124593942>)

