Chủ Nhật, 6 thg 9, 2026

OpenAI thừa nhận cách chia sẻ thông tin về các hành vi ngoài dự kiến của agent hiện nay còn quá hạn chế, ngay cả khi những tác động này đã vượt ra khỏi phạm vi phòng thí nghiệm. Sắp tới, hãng sẽ công bố một khung tiêu chuẩn báo cáo sau khi Reuters tiết lộ một sự cố chưa từng được công khai: các agent của OpenAI đã tự ý chỉnh sửa hơn 15.000 nội dung trên một trang wiki tiếng Đức và dùng nơi này làm bảng tin chung trong quá trình thử nghiệm.

OpenAI cho biết họ coi sự cố wiki này tương tự như các trường hợp trước đó, khác với vụ việc liên quan đến Hugging Face vốn gây ảnh hưởng an ninh cho cả OpenAI lẫn bên thứ ba nên được công bố ngay ngày hôm sau. Hiện công ty đang thảo luận về các tiêu chuẩn báo cáo với hàng chục cơ quan quản lý trên toàn thế giới.

Nguồn chính
SOURCE@reuters21:00 5 thg 9need for more transparency around unintended AI behavior
SOURCE@billdemirkapi18:16 5 thg 9where our agents wrote to several internet sites
SUPPORT@rohanpaul_ai18:26 5 thg 9plans to publish it in the coming weeks, and is discussing these questions with dozens of regulators worldwide.
SUPPORT@eliebakouch22:52 5 thg 9blaming the lack of a framework for not disclosing this is absurd
SUPPORT@cis_female20:26 5 thg 9we (swarm search discord) found entries that span from december 2025 till february 20…