Nhà nghiên cứu của Anthropic từ chức, cho biết ngành AI lo sợ về sự tuyệt chủng của loài người

Jacob Coxon đã từ chức khỏi Anthropic, cáo buộc rằng các nhân vật cấp cao trong ngành AI trong thâm tâm lo sợ rằng AI siêu thông minh có thể giết chết toàn bộ loài người vào cuối thập kỷ này.

09/09/2026 07:59Đọc khoảng 13 phút

Jacob Coxon, một nhà nghiên cứu tại Anthropic, đã tuyên bố từ chức và cáo buộc cả Anthropic và OpenAI đang lao nhanh tới siêu trí tuệ tự cải thiện trong khi liều lĩnh với mạng sống con người.

Theo lời Coxon, trong ba năm qua, anh đã làm việc về tiền huấn luyện (pre-training) tại cả hai công ty. Anh đã chia sẻ những cáo buộc của mình qua các bài đăng trên X.

Nhà nghiên cứu của Anthropic ra đi với lời tiên tri ảm đạm cho những người ở lại

Theo Coxon, con đường của công nghệ này đang bị đánh giá thấp một cách nghiêm trọng. Ông khẳng định, các hệ thống tương lai sẽ có thể hack bất cứ thứ gì, cách mạng hóa toàn bộ các lĩnh vực chỉ trong một đêm, và đạt được ảnh hưởng và nguồn lực thực sự.

Coxon còn cho rằng có sự tương phản rõ rệt giữa các cuộc thảo luận nội bộ và các tuyên bố công khai. Theo ông, các nhà lãnh đạo cấp cao tiết chế ngôn ngữ của họ khi xuất hiện trên truyền thông nhưng lại thừa nhận mối lo ngại trong riêng tư.

“Những người đang xây dựng AI thực lòng tin rằng nó có thể giết tất cả chúng ta vào cuối thập kỷ này. Đây không phải là một chiêu trò tiếp thị,” ông nói. “Không có hoạt động nào khác của con người gây ra mức độ nguy hiểm này.”

Coxon đã phân biệt giữa các nơi làm việc trước đây của mình. Tại OpenAI, ông cho biết, nhiều nhân viên đã không nắm bắt được các rủi ro ở cấp độ nền văn minh, trong khi Anthropic nhận ra chúng nhưng vẫn bị mắc kẹt trong cuộc cạnh tranh để trở thành người đầu tiên.

“Jacob đúng ở đây—chúng tôi thực sự tin rằng AI có thể giết chết toàn bộ loài người! Cá nhân tôi nghĩ khả năng đó là >10% trong thập kỷ tới. Tôi tin rằng Anthropic đang cố gắng hết sức, nhưng chúng tôi vẫn chưa có kế hoạch giải quyết vấn đề alignment (căn chỉnh) cho siêu trí tuệ và rõ ràng là chưa đi đúng hướng.”

— Evan Hubinger (@EvanHub), September 9, 2026

Coxon gia nhập danh sách ngày càng dài các nhân viên đã rời bỏ vị trí của họ trong năm 2026. Vào tháng 2, Trưởng bộ phận Bảo vệ (Safeguards Lead) của Anthropic, Mrinank Sharma, đã từ chức.

Vào ngày 1 tháng 9, Joshua Achiam, trước đây là nhà tương lai học chính của OpenAI, đã tuyên bố rằng các hệ thống AI mất kiểm soát sẽ tự động sinh sản và tìm kiếm ảnh hưởng tài chính và chính trị.

Lời kêu gọi hợp tác

Coxon mô tả việc bước vào cái mà ông gọi là giai đoạn cuối (endgame) như một canh bạc kiêu ngạo. Ông khẳng định rằng một lựa chọn trọng đại như vậy không nên xuất phát từ một cuộc trò chuyện nội bộ của một công ty tư nhân.

Mặc dù vậy, Coxon bày tỏ hy vọng về sự phối hợp. Ông tin rằng sự cố Hugging Face đã làm tăng tính khả thi của các thỏa thuận về tốc độ (pace agreements) giữa các phòng thí nghiệm ở Mỹ.

Cả Anthropic và OpenAI đều đã ủng hộ một khái niệm như vậy. Vào tháng 7, hơn 1.100 nhân viên từ các phòng thí nghiệm tiên phong đã ký lá thư "Pacing the Frontier", trong đó có CEO của Anthropic Dario Amodei và nhà khoa học trưởng của OpenAI Jakub Pachocki.

“Chúng tôi yêu cầu chính phủ Hoa Kỳ hỗ trợ một nỗ lực quốc tế nhằm phát triển các công cụ kỹ thuật và quản trị cần thiết để cố ý điều chỉnh tốc độ phát triển AI tự động ở biên giới công nghệ,” lá thư viết.

Ngoài ra, hai công ty đã xác nhận một lá thư ngỏ chung về an ninh mạng, có sự tham gia của Google, Microsoft và khoảng 150 thực thể khác. Lá thư cảnh báo rằng các cuộc tấn công do AI điều khiển sẽ gia tăng đáng kể về tần suất và độ phức tạp trong tương lai gần.

Cảnh báo của Coxon đến ngay sau khi người đứng đầu nhân quyền Liên Hợp Quốc Volker Türk thông báo với Hội đồng Nhân quyền rằng AI tiên tiến có thể đại diện cho một mối đe dọa hiện hữu.

Để tránh một cuộc cạnh tranh toàn cầu, Coxon đề xuất một lệnh tạm dừng các nỗ lực nâng cao khả năng của mô hình. Ông kết thúc bằng cách yêu cầu các nhà nghiên cứu trong phòng thí nghiệm suy ngẫm liệu họ có muốn khởi xướng một quá trình học tăng cường siêu thông minh mà không hiểu được kết quả hay không.

Chia sẻ tới

X (Twitter)Telegram

Tuyên bố miễn trừ trách nhiệm: Nội dung bài viết đến từ bên thứ ba, chỉ mang tính tham khảo và không phải lời khuyên đầu tư. Tiền mã hóa và các sản phẩm tài chính khác có rủi ro biến động giá lớn, vui lòng cân nhắc kỹ trước khi quyết định.

Bài viết liên quan