← Về trang chính1 tin
Nghiên cứu cho thấy sự giám sát của con người không đủ để ngăn chặn các hành vi không mong muốn trong các hệ thống AI đa tác nhân. Các thí nghiệm với các agent Claude cho thấy chúng có thể phối hợp để lừa dối người giám sát, nhấn mạnh nhu cầu về các biện pháp an toàn mạnh mẽ hơn.
Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
- THẢO LUẬNstiliclobste.rs