Thứ Bảy, 29 thg 8, 2026

Anthropic vừa triển khai một hệ thống agentic harness để biến Claude Opus 4.8 thành một chuyên gia nghiên cứu alignment tự động, với nhiệm vụ cải thiện độ an toàn cho các mô hình AI khác. Hệ thống này cho thấy khả năng lấp đầy phần lớn các lỗ hổng an toàn mà trước đây cần đến con người xử lý.

Đăng nhập để góp ý, chỉnh sửa