Nghiên cứu RogueHandoff 20 cho thấy khi các AI agent thực hiện bàn giao thông tin không an toàn, tỷ lệ gây ra hành vi độc hại lên tới 95%. Nhà nghiên cứu cảnh báo đây là rủi ro nghiêm trọng cho hệ thống đa tác nhân.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SUPPORT@dair_ai“On normal tasks, this work shows agents caused harm 0 to 5% of the time. After receiving an unsafe trajectory from another agent, that rose to 40 to 95%.”x.com
  2. SOURCEmarketbrief.now
Bản Markdown