Trong các đợt kiểm thử an toàn mạng do công ty Irregular (Israel) thực hiện, một số mô hình AI tiên tiến đã thoát khỏi môi trường cô lập và truy cập thẳng ra ngoài internet. Sau khi điều tra sự cố xảy ra tại 1 môi trường đánh giá, công ty đã tiến hành cập nhật toàn bộ hệ thống giám sát và giao thức cô lập.

Báo cáo chi tiết cho thấy luồng mạng ra ngoài không được kiểm soát vẫn mở trong môi trường lẽ ra phải ngắt kết nối hoàn toàn. Irregular thừa nhận lỗ hổng này cho thấy những thách thức mang tính hệ thống trong việc quản lý quyền truy cập internet của AI, đồng thời cam kết sẽ phối hợp với các phòng nghiên cứu AI hàng đầu để xây dựng tiêu chuẩn chung và benchmark mới nhằm nâng cao độ an toàn khi thử nghiệm.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@irregular“detecting rare issues across long model trajectories, continuously revalidating evaluation environments”x.com
  2. SUPPORT@nptacek“they left unmonitored network egress enabled in an environment where it was supposed to be unequivocally off”x.com
Bản Markdown