Thứ Tư, 19 thg 8, 2026

Dòng server này sử dụng ba chip WSE-3 Turbo cùng kiến trúc Nexus mới nhằm đẩy nhanh việc triển khai các mô hình AI tiên tiến. Những lô hàng đầu tiên sẽ bắt đầu được giao trong quý này. Cerebras khẳng định thiết bị này sẽ tạo lợi thế cạnh tranh lớn hơn so với các phần cứng dựa trên chip Nvidia. Hệ thống có khả năng chạy các mô hình 10 nghìn tỷ tham số với tốc độ 1.000 token mỗi giây, đồng thời giảm được 50% số lượng linh kiện nhờ các cụm nguồn và I/O dạng mô-đun.

Hệ thống đạt hiệu suất cao gấp 10 lần trên mỗi megawatt và gấp đôi hiệu năng tổng thể so với thế hệ CS-3 trước đó. Cerebras cho biết phần cứng này giúp bộ tăng tốc AI của họ trở thành lựa chọn thay thế khả thi cho các hệ thống dựa trên GPU truyền thống trong các tác vụ inference hiệu suất cao.

Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@cerebras0:21 19 thg 850% fewer components with modular compute, power, and I/O assemblies
SUPPORT@techmeme0:30 19 thg 8first shipments starting this quarter
SUPPORT@scaling010:40 19 thg 8up to 10x higher throughput per MW
SUPPORT@scaling010:34 19 thg 810T models running at 1000 tokens/s
SUPPORT@business1:05 19 thg 8give it a wider advantage over Nvidia-based equipment
SOURCE@andrewdfeldman19:18 19 thg 8CS-4 solutions deliver both, in the same power budget.
SUPPORT@dnystedt0:50 20 thg 8Cerebras chips do not use HBM memory, instead relying on SRAM.
SUPPORT@arjunkshah2113:47 19 thg 8129.6 PB/s of memory bandwidth.