Thứ Ba, 1 thg 9, 2026

Thử nghiệm nội bộ cho thấy mô hình Astra sắp ra mắt của OpenAI có khả năng xâu chuỗi các lỗi bảo mật chưa từng biết tới và thực hiện khai thác lỗ hổng mà không cần con người hướng dẫn từng bước. Công ty hiện đang thông báo hai lỗ hổng zero day vừa tìm thấy cho các bên quản lý hệ thống. Astra là mô hình đầu tiên chạm ngưỡng 'Nghiêm trọng' trong khung đánh giá mức độ sẵn sàng về an ninh mạng của hãng. Dù phiên bản an toàn sẽ sớm ra mắt rộng rãi, nhưng các khả năng tấn công mạng đầy đủ sẽ chỉ được giới hạn cho một số đối tác và nhóm thử nghiệm nhỏ.

Sau sự cố liên quan đến Hugging Face, OpenAI đã tạm dừng huấn luyện để tăng cường khả năng từ chối thực hiện yêu cầu xấu và cơ chế giám sát cho Astra, trước khi khởi động lại một đợt reinforcement learning quy mô lớn vào ngày 28/8. Một số đợt thử nghiệm nhỏ hơn vẫn đang bị tạm dừng để đảm bảo mô hình có thể phát hành một cách an toàn.

Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@zeffmax20:07 1 thg 9limit cyber capabilities to select partners
SUPPORT@wallstengine20:05 1 thg 9found and chained together two zero-day vulnerabilities
SUPPORT@zeffmax20:07 1 thg 9confident it can release Astra safely
SUPPORT@tradfi20:00 1 thg 9limit Astra’s full cyber abilities to test group
SOURCE@jukan0514:25 2 thg 9could be akin to the performance jump when OpenAI launched GPT-4 in 2023
SUPPORT@zephyr_z915:25 2 thg 9Astra and Computer-Using Agents
SUPPORT@zephyr_z916:30 2 thg 9gpt-6-astra has been staged on the OpenAI API
SOURCEhuggingnews