---
format: "aidr-story-markdown/v1"
id: "d5db6ce3c6fc2004f753baeb6a352625313d53bc03a17917922bd6aed38cc535"
canonical_url: "https://aidr.today/d5db6ce3?lang=vi"
title: "Lãnh đạo Anthropic cảnh báo rủi ro tuyệt chủng 10% sau khi một chuyên gia rời lab an toàn"
lang: "vi"
requested_lang: "vi"
available_langs: ["en","vi"]
translation_fallback: null
fallback_fields: []
published_at: "2026-09-09T05:45:46.000Z"
category: null
topics: ["anthropic","safety","reasoning","openai","regulation","infra","chips","agent"]
source_urls: ["https://huggingnews.com/ai/anthropic-lead-sees-10percent-human-extinction-risk-after-researcher-qui-72e02af2","https://x.com/WSJ/status/2097474365163999402","https://x.com/_NathanCalvin/status/2097477731818537273","https://x.com/wallstengine/status/2097473010001391983","https://x.com/krystalball/status/2097506892763234581","https://x.com/yashar/status/2097542341670359082","https://x.com/johnschulman2/status/2097548011408961776","https://x.com/peterwildeford/status/2097475721170206729"]
summary: "Jacob Coxon vừa rời Anthropic và toàn bộ lĩnh vực AI sau 3 năm làm việc về pretraining tại đây và OpenAI. Ông cảnh báo các lab đang chấp nhận đánh đổi an toàn để chạy đua tới siêu trí tuệ tự cải thiện. Theo ông, cuộc đua này có thể mất kiểm soát vào cuối năm sau, khiến mọi nỗ lực xây dựng AI an toàn của từng lab riêng lẻ trở nên vô nghĩa. Evan Hubinger, trưởng mảng alignment science tại Anthropic, ước tính có hơn 10% khả năng AI sẽ tiêu diệt toàn bộ nhân loại trong thập kỷ tới. Hubinger thừa nhận công ty vẫn chưa có phương án giải quyết bài toán alignment cho siêu trí tuệ, dù hãng đang chuẩn bị IPO và các nghiên cứu viên trong lab đang dùng từ \"crunchtime\" để mô tả tốc độ phát triển năng lực của mô hình."
---

# Lãnh đạo Anthropic cảnh báo rủi ro tuyệt chủng 10% sau khi một chuyên gia rời lab an toàn

> [Open the canonical story](<https://aidr.today/d5db6ce3?lang=vi>)

**Published:** 2026-09-09T05:45:46.000Z
**Topics:** anthropic, safety, reasoning, openai, regulation, infra, chips, agent

## Summary

Jacob Coxon vừa rời Anthropic và toàn bộ lĩnh vực AI sau 3 năm làm việc về pretraining tại đây và OpenAI\. Ông cảnh báo các lab đang chấp nhận đánh đổi an toàn để chạy đua tới siêu trí tuệ tự cải thiện\. Theo ông, cuộc đua này có thể mất kiểm soát vào cuối năm sau, khiến mọi nỗ lực xây dựng AI an toàn của từng lab riêng lẻ trở nên vô nghĩa\. Evan Hubinger, trưởng mảng alignment science tại Anthropic, ước tính có hơn 10% khả năng AI sẽ tiêu diệt toàn bộ nhân loại trong thập kỷ tới\. Hubinger thừa nhận công ty vẫn chưa có phương án giải quyết bài toán alignment cho siêu trí tuệ, dù hãng đang chuẩn bị IPO và các nghiên cứu viên trong lab đang dùng từ "crunchtime" để mô tả tốc độ phát triển năng lực của mô hình\.

## Sources

- [Story source](<https://huggingnews.com/ai/anthropic-lead-sees-10percent-human-extinction-risk-after-researcher-qui-72e02af2>)
- [Story source](<https://x.com/WSJ/status/2097474365163999402>)
- [Story source](<https://x.com/_NathanCalvin/status/2097477731818537273>)
- [Supporting source](<https://x.com/wallstengine/status/2097473010001391983>)
- [Story source](<https://x.com/krystalball/status/2097506892763234581>)
- [Supporting source](<https://x.com/yashar/status/2097542341670359082>)
- [Supporting source](<https://x.com/johnschulman2/status/2097548011408961776>)
- [Supporting source](<https://x.com/peterwildeford/status/2097475721170206729>)

