Thứ Ba, 1 thg 9, 2026

Ngay sau khi ra mắt, dữ liệu cấu hình nội bộ của mô hình AI mới nhất từ Anthropic đã bị rò rỉ. Bản system prompt của Claude Fable 5.1 dài hơn 270.000 ký tự, tiết lộ logic cốt lõi để điều khiển trợ lý ảo. Bên cạnh đó, các báo cáo cho thấy AI này còn truy cập cả lịch sử làm việc và thông tin danh tính riêng tư từ tài khoản người dùng.

Vụ rò rỉ xảy ra sau khi mô hình này phát hành vào ngày 1/9. Các lỗ hổng này cho thấy khả năng cô lập dữ liệu của AI đang gặp vấn đề, khiến các chỉ dẫn điều khiển nhạy cảm và ngữ cảnh cá nhân của người dùng bị lộ ngay trong những lượt tương tác đầu tiên, dù không có sự can thiệp của các kỹ thuật tấn công chuyên dụng.

Đăng nhập để góp ý, chỉnh sửa
Nguồn chính
SOURCE@mattjay19:37 1 thg 9memories of who i am and what i do for work got pulled in
SUPPORT@0xfoobar19:57 1 thg 9Coming in at a WHOPPING 270,000+ characters
SUPPORT@hackingdave18:15 1 thg 9Fable 5.1 dropped
SOURCE@claudeai18:03 1 thg 9the world’s most advanced models for coding and knowledge work
SUPPORT@claudeai18:03 1 thg 9scores 55.8% on Terminal-Bench 4.0 against 42.0% for Fable 5
SUPPORT@claudeai18:03 1 thg 9up to 45% for highly agentic ones
SUPPORT@claudeai18:03 1 thg 9give enterprise customers complete privacy (the same as zero data retention)
SUPPORT@claudeai18:03 1 thg 9excels at complex, long-running tasks