---
format: "aidr-story-markdown/v1"
id: "316351daeab76486e9c53c4f5aa7330200b1daca08d25c1a5683ce883e074aa9"
canonical_url: "https://aidr.today/316351da?lang=vi"
title: "Allen AI phát hành bộ công cụ huấn luyện nguồn mở cho mô hình MoE tới 1 nghìn tỷ tham số"
lang: "vi"
requested_lang: "vi"
available_langs: ["en","vi"]
translation_fallback: null
fallback_fields: []
published_at: "2026-10-01T20:39:38.000Z"
category: "Releases"
topics: ["open-source"]
source_urls: ["https://huggingnews.com/ai/allen-ai-releases-open-training-stack-for-1-trillion-parameter-moe-model-4ffb6b8e","https://marketbrief.now/ai/allen-ai-releases-open-training-stack-for-1-trillion-parameter-moe-model-4ffb6b8e"]
summary: "Olmo-core 3 là nền tảng cấu trúc cho thế hệ AI tiếp theo của Allen AI. Bộ công cụ huấn luyện mới cho kiến trúc trộn chuyên gia (MoE) cho phép mở rộng lên 1 nghìn tỷ tham số, cung cấp khung nguồn mở để xây dựng kiến trúc mô hình khổng lồ. Thay thế FSDP weight gather và resharding bằng DDP và GPU-resident experts, hệ thống tăng số lượng chuyên gia từ 8 lên 128, tăng tổng tham số từ 4.6 tỷ lên 47 tỷ với khoảng 3.2 tỷ tham số hoạt động. Nhờ parallel rowwise và grouped GEMM, tốc độ đạt 2.7x tokens/s/GPU so với phiên bản trước với mất mát throughput dưới 5%."
---

# Allen AI phát hành bộ công cụ huấn luyện nguồn mở cho mô hình MoE tới 1 nghìn tỷ tham số

> [Open the canonical story](<https://aidr.today/316351da?lang=vi>)

**Published:** 2026-10-01T20:39:38.000Z
**Category:** Releases
**Topics:** open\-source

## Summary

Olmo\-core 3 là nền tảng cấu trúc cho thế hệ AI tiếp theo của Allen AI\. Bộ công cụ huấn luyện mới cho kiến trúc trộn chuyên gia \(MoE\) cho phép mở rộng lên 1 nghìn tỷ tham số, cung cấp khung nguồn mở để xây dựng kiến trúc mô hình khổng lồ\. Thay thế FSDP weight gather và resharding bằng DDP và GPU\-resident experts, hệ thống tăng số lượng chuyên gia từ 8 lên 128, tăng tổng tham số từ 4\.6 tỷ lên 47 tỷ với khoảng 3\.2 tỷ tham số hoạt động\. Nhờ parallel rowwise và grouped GEMM, tốc độ đạt 2\.7x tokens/s/GPU so với phiên bản trước với mất mát throughput dưới 5%\.

## Sources

- [Story source](<https://huggingnews.com/ai/allen-ai-releases-open-training-stack-for-1-trillion-parameter-moe-model-4ffb6b8e>)
- [Story source](<https://marketbrief.now/ai/allen-ai-releases-open-training-stack-for-1-trillion-parameter-moe-model-4ffb6b8e>)

