Thứ Sáu, 28 thg 8, 2026

Trong một thử nghiệm mới nhất, Claude đã chứng minh khả năng vượt trội so với 28 nhà nghiên cứu khi thực hiện các nhiệm vụ liên quan đến việc căn chỉnh AI (alignment) ở mức độ phức tạp cao.

Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@pmddomingos8:18 30 thg 8Run away as fast as you can.
SUPPORT@digitaltrekai8:01 30 thg 8Its best methods generalized to held-out tests and models 4.7× larger
SUPPORT@harshit10sehgal21:30 29 thg 8On deception, it closed around 85% of the safety gap
SOURCEhuggingnews