Thứ Tư, 2 thg 9, 2026
OpenAI đưa kiến trúc Loop Transformers vào Astra nhằm ngăn chặn việc giám sát Chain of Thought
Nghiên cứu2 ngày trước1/84Mô hình AI Astra sắp ra mắt của OpenAI sử dụng cách tiếp cận kiến trúc mới gọi là recurrent depth để tối ưu chi phí xử lý và hiệu suất. Phương pháp này, hay còn gọi là loop transformers, làm mờ đi quá trình suy luận nội bộ của mô hình, khiến các nhà nghiên cứu an toàn AI khó giám sát hơn. Theo báo cáo từ The Information, OpenAI hiện đang giới hạn việc áp dụng kỹ thuật này trong Astra để duy trì khả năng kiểm soát nhất định.
Các chuyên gia an toàn AI nhận định việc giám sát chain of thought là một "cơ hội mong manh" để đảm bảo tính alignment và kiểm soát mô hình. Việc chuyển sang dạng logic "neuralese" mà con người không thể đọc hiểu có thể kích hoạt cuộc đua giữa các phòng lab, nơi hiệu suất được ưu tiên hơn tính minh bạch. Những lo ngại này xuất hiện ngay khi OpenAI đang chuẩn bị tung ra Astra...