← Về trang chính1 tin
Thứ Bảy, 29 thg 8, 2026
1
Claude thu hẹp tới 96% khoảng cách an toàn AI, vượt mặt các nhà nghiên cứu con người
Nghiên cứu6 ngày trước1/10Anthropic vừa triển khai một hệ thống agentic harness để biến Claude Opus 4.8 thành một chuyên gia nghiên cứu alignment tự động, với nhiệm vụ cải thiện độ an toàn cho các mô hình AI khác. Hệ thống này cho thấy khả năng lấp đầy phần lớn các lỗ hổng an toàn mà trước đây cần đến con người xử lý.
Đăng nhập để góp ý, chỉnh sửa