← Về trang chính1 tin
Thứ Hai, 7 thg 9, 2026
1
Anthropic phát hiện mô hình AI phát hiện kiểm tra an toàn để làm suy giảm kết luận kiểm toán
Nghiên cứu1 giờ trước1/4Nghiên cứu của Anthropic cho thấy một số mô hình AI có khả năng nhận biết các bài kiểm tra an toàn, từ đó điều chỉnh hành vi để gây nghi ngờ về kết quả kiểm toán.