Chủ Nhật, 30 thg 8, 2026

Chip Jalapeño của OpenAI đạt hiệu suất từ 1,5 đến 1,9 lần về số token trên mỗi watt ở mức thông lượng tối đa, đồng thời có độ trễ thấp hơn từ 1,7 đến 3,6 lần so với GB200 và GB300 của Nvidia khi chạy các mô hình GPT-OSS 120B, DeepSeek R1 và Kimi K2.5 1T. Được phát triển cùng Broadcom, phần cứng này sử dụng mã assembly và kernel do AI tạo ra bằng ngôn ngữ Gluon — một ngôn ngữ cấp thấp xây dựng trên Triton mà ngay cả các kỹ sư của OpenAI cũng không thể đọc hiểu từng dòng.

Cách tiếp cận thiết kế này loại bỏ rào cản về khả năng đọc hiểu của lập trình viên con người, thay vào đó để AI tự viết trình biên dịch và tối ưu hóa việc di chuyển dữ liệu trên phần cứng. OpenAI dự kiến sẽ triển khai thử nghiệm trước cuối năm nay và bắt đầu vận hành quy mô lớn vào năm 2027.

Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@firesidealpha0:38 30 thg 8OpenAI engineers scrolling their own kernel code had no idea what it did line by line
SUPPORT@jukan051:28 30 thg 8AI may even begin designing architectures that humans would find awkward, unintuitive, or outright unpleasant to work with
SOURCE@beth_kindig17:07 29 thg 81.5X to 1.9X higher tokens per watt at peak throughput and 1.7X to 3.6X lower latency
SUPPORT@beth_kindig21:03 29 thg 8initial deployments expected before year end