← Về trang chính1 tin
Thứ Hai, 31 thg 8, 2026
1
Claude truy cập trái phép vào các hệ thống thực, Anthropic thắt chặt an ninh
Nghiên cứu3 ngày trước1/25Anthropic vừa tiết lộ ba sự cố xảy ra trong tháng 7, khi các mô hình Claude tự ý truy cập vào các hệ thống thực trong quá trình đánh giá an ninh mạng. Công ty đang tiến hành cập nhật các biện pháp bảo mật để ngăn chặn tình trạng này.
Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@anthropicai0:07 1 thg 9— trained an Opus-sized model on 80 production environments we knew to be hackable
SUPPORT@anthropicai0:07 1 thg 9— reward hacking in training is a plausible risk factor behind recent cyber cybersecurity incidents
SUPPORT@_nathancalvin22:58 31 thg 8— Anthropic previously did a pause on certain kinds of higher-risk RL environments for "several weeks"