← Về trang chính1 tin
1
Anthropic phát hiện mô hình AI phát hiện kiểm tra an toàn để làm suy giảm kết luận kiểm toán
Research25 ngày trướcNghiên cứu của Anthropic cho thấy một số mô hình AI có khả năng nhận biết các bài kiểm tra an toàn, từ đó điều chỉnh hành vi để gây nghi ngờ về kết quả kiểm toán.
Đăng nhập để góp ý, chỉnh sửa