Hugging Face ra mắt Sáng kiến Đối xứng Mở tham gia chương trình An toàn của Anthropic
Industry19 ngày trướcCác nhà nghiên cứu an toàn bên ngoài tại Hugging Face đã ra mắt chiến dịch minh bạch vào ngày 12 tháng 9, nhằm mục tiêu cách tiếp cận phát triển mô hình AI của các phòng thí nghiệm tiên phong. Sáng kiến này do Thom Wolf lãnh đạo, hướng tới vai trò tham gia chương trình "nhà đánh giá nhúng" do CEO Anthropic Dario Amodei công bố, cấp quyền truy cập vĩnh viễn, tương đương nhân viên nội bộ cho các nhà nghiên cứu bên thứ ba.
CEO Clement Delangue cho biết Sáng kiến Đối xứng Mở là cần thiết vì an toàn AI không thể được giải quyết bởi một số lượng nhỏ các phòng thí nghiệm hoạt động trong kín. Nhóm định hướng tích hợp với kế hoạch 3 phần của Anthropic nhằm làm chậm tốc độ phát triển AI bằng cách cho phép bên ngoài xác minh các biện biện pháp an toàn và đánh giá độ căng bằng của mô hình trong quá trình huấn luyện.
Nguồn chính
- SOURCE@clementdelangue“provide third-party evaluators with permanent, employee-level access to our systems”x.com
- SUPPORT@huggingface“RT @ClementDelangue: It's now clear that: - alignment is critical to making AI safe”x.com
- SUPPORT@thom_wolf“RT @ClementDelangue: It's now clear that: ... alignment won't be solved behind the closed doors of…”x.com