Jacob Coxon vừa rời Anthropic và toàn bộ lĩnh vực AI sau 3 năm làm việc về pretraining tại đây và OpenAI. Ông cảnh báo các lab đang chấp nhận đánh đổi an toàn để chạy đua tới siêu trí tuệ tự cải thiện. Theo ông, cuộc đua này có thể mất kiểm soát vào cuối năm sau, khiến mọi nỗ lực xây dựng AI an toàn của từng lab riêng lẻ trở nên vô nghĩa.

Evan Hubinger, trưởng mảng alignment science tại Anthropic, ước tính có hơn 10% khả năng AI sẽ tiêu diệt toàn bộ nhân loại trong thập kỷ tới. Hubinger thừa nhận công ty vẫn chưa có phương án giải quyết bài toán alignment cho siêu trí tuệ, dù hãng đang chuẩn bị IPO và các nghiên cứu viên trong lab đang dùng từ "crunchtime" để mô tả tốc độ phát triển năng lực của mô hình.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@wsj“systems that could spiral out of control and destroy humanity”x.com
  2. SOURCE@_nathancalvin“racing straight to self-improving superintelligence and gambling with our lives”x.com
  3. SUPPORT@wallstengine“prepares for a potential IPO and pushes toward more capable models”x.com
  4. SOURCE@krystalball“Alignment science lead at Anthropic”x.com
  5. SUPPORT@yashar“Anthropic still does not have a plan to solve the problem”x.com
  6. SUPPORT@johnschulman2“industry leaders OpenAI and Anthropic to stop feuding and work on a pacing proposal together”x.com
  7. SUPPORT@peterwildeford“happen on the MacBooks of some engineers living in San Francisco instead of a bunker in the desert”x.com
  8. SUPPORT@matthewberman“greater than 10% chance to kill all humans within 10 years”x.com
Bản Markdown