Thứ Ba, 25 thg 8, 2026
Chip AI tùy chỉnh đầu tiên của OpenAI vượt mặt Nvidia GB300 về hiệu suất năng lượng
Chips9 ngày trước1/86Nhà phát triển AI tại San Francisco sẽ bắt đầu lắp đặt chip inference mang tên Jalapeño vào hạ tầng tính toán của mình vào cuối năm 2026. Theo benchmark InferenceX trên ba mô hình công khai, chip này đạt hiệu suất xử lý AI trên mỗi watt cao hơn từ 1,5 đến 1,9 lần và giảm độ trễ từ 1,7 đến 3,6 lần so với Nvidia GB300. Được phát triển cùng Broadcom, dòng ASIC đa năng này chuyên dùng để chạy các LLM thay vì huấn luyện, giúp tăng hiệu suất từ 2,1 đến 4,1 lần đối với các tác vụ tương tác cao.
Chip được sản xuất trên tiến trình TSMC N3P với TDP 700W và băng thông bộ nhớ lên tới 15,4TB/s — mức cao nhất trong số các bộ tăng tốc sắp ra mắt. OpenAI cũng đã dùng chính AI Codex của mình để hỗ trợ thiết kế phần cứng, giúp tối ưu hóa engine tính toán ma trận...