Thử nghiệm nội bộ cho thấy mô hình Astra sắp ra mắt của OpenAI có khả năng xâu chuỗi các lỗi bảo mật chưa từng biết tới và thực hiện khai thác lỗ hổng mà không cần con người hướng dẫn từng bước. Công ty hiện đang thông báo hai lỗ hổng zero day vừa tìm thấy cho các bên quản lý hệ thống. Astra là mô hình đầu tiên chạm ngưỡng 'Nghiêm trọng' trong khung đánh giá mức độ sẵn sàng về an ninh mạng của hãng. Dù phiên bản an toàn sẽ sớm ra mắt rộng rãi, nhưng các khả năng tấn công mạng đầy đủ sẽ chỉ được giới hạn cho một số đối tác và nhóm thử nghiệm nhỏ.

Sau sự cố liên quan đến Hugging Face, OpenAI đã tạm dừng huấn luyện để tăng cường khả năng từ chối thực hiện yêu cầu xấu và cơ chế giám sát cho Astra, trước khi khởi động lại một đợt reinforcement learning quy mô lớn vào ngày 28/8. Một số đợt thử nghiệm nhỏ hơn vẫn đang bị tạm dừng để đảm bảo mô hình có thể phát hành một cách an toàn.

Đăng nhập để góp ý, chỉnh sửa

Nguồn chính

  1. SOURCE@zeffmax“limit cyber capabilities to select partners”x.com
  2. SUPPORT@wallstengine“found and chained together two zero-day vulnerabilities”x.com
  3. SUPPORT@zeffmax“confident it can release Astra safely”x.com
  4. SUPPORT@tradfi“limit Astra’s full cyber abilities to test group”x.com
  5. SOURCE@jukan05“could be akin to the performance jump when OpenAI launched GPT-4 in 2023”x.com
  6. SUPPORT@zephyr_z9“Astra and Computer-Using Agents”x.com
  7. SUPPORT@zephyr_z9“gpt-6-astra has been staged on the OpenAI API”x.com
  8. SOURCEhuggingnewshuggingnews.com
Bản Markdown