Thứ Tư, 19 thg 8, 2026
Cập nhật: Server AI Cerebras CS-4 đạt tốc độ inference nhanh gấp 30 lần GPU, gấp đôi thế hệ CS-3
Hạ tầng16 ngày trước1/23Dòng server này sử dụng ba chip WSE-3 Turbo cùng kiến trúc Nexus mới nhằm đẩy nhanh việc triển khai các mô hình AI tiên tiến. Những lô hàng đầu tiên sẽ bắt đầu được giao trong quý này. Cerebras khẳng định thiết bị này sẽ tạo lợi thế cạnh tranh lớn hơn so với các phần cứng dựa trên chip Nvidia. Hệ thống có khả năng chạy các mô hình 10 nghìn tỷ tham số với tốc độ 1.000 token mỗi giây, đồng thời giảm được 50% số lượng linh kiện nhờ các cụm nguồn và I/O dạng mô-đun.
Hệ thống đạt hiệu suất cao gấp 10 lần trên mỗi megawatt và gấp đôi hiệu năng tổng thể so với thế hệ CS-3 trước đó. Cerebras cho biết phần cứng này giúp bộ tăng tốc AI của họ trở thành lựa chọn thay thế khả thi cho các hệ thống dựa trên GPU truyền thống trong các tác vụ inference hiệu suất cao.