Tiền thưởng lỗi bảo mật 6.500 đô la từ OpenAI được thu thập qua mã tấn công do Claude tạo ra

Các nhà nghiên cứu bảo mật đã xâm phạm OpenAI bằng cách sử dụng Claude của Anthropic và kiếm được tiền thưởng lỗi bảo mật 6.500 đô la.

18/09/2026 16:58Đọc khoảng 11 phút

Công việc nặng nhọc trong một vụ xâm phạm bảo mật nhắm vào OpenAI đã được thực hiện bởi mô hình trí tuệ nhân tạo của một công ty đối thủ. Nhóm của Hacktron AI đã sử dụng Claude của Anthropic để tạo ra mã khai thác có chức năng.

Toàn bộ vụ xâm phạm chỉ mất chưa đầy 72 giờ. Sau khi nhóm chứng minh rằng họ đã truy cập được mã nguồn riêng tư của OpenAI, công ty đã phát hành tiền thưởng 6.500 đô la.

Cách một bản tải lên hình ảnh leo thang thành một vụ xâm phạm toàn diện

Chuỗi tấn công bắt đầu bằng một thứ bình thường: tính năng tải lên hình ảnh trên diễn đàn trợ giúp cộng đồng của OpenAI, nơi sử dụng Discourse, một phần mềm của bên thứ ba.

Một bộ lọc bảo mật được thiết kế để kiểm tra các tệp đã tải lên. Tuy nhiên, nó đã không xác định được một số định dạng ảnh, cho phép chúng vượt qua mà không bị kiểm tra. Các tệp này sau đó đã đến được một thư viện xử lý hình ảnh độc lập có chứa lỗ hổng hỏng bộ nhớ đã biết.

Nhóm Hacktron gồm ba thành viên—bao gồm Harsh Jaiswal, Mohan Pedhapati và Rahul Maini—đã cố gắng khai thác lỗ hổng đó vào cuối tháng Bảy.

Một phiên bản trước đó của Claude gặp khó khăn với một biện pháp bảo mật nhằm ngẫu nhiên hóa các địa chỉ bộ nhớ.

Vài giờ sau đó, mô hình cập nhật đã tạo ra mã khai thác có thể hoạt động và điều chỉnh nó phù hợp với cấu hình chính xác của diễn đàn.

Điều này chỉ cung cấp quyền truy cập vào máy chủ của diễn đàn, để lại các hệ thống riêng của OpenAI không bị ảnh hưởng. Một lỗ hổng riêng biệt, không liên quan trong khuôn khổ đăng nhập một lần của OpenAI đã thay đổi tình hình.

Vì thông tin đăng nhập được sử dụng cho diễn đàn cũng xác thực quyền truy cập vào tài khoản ChatGPT và Codex, việc chiếm quyền phiên làm việc của một nhân viên đã cho phép truy cập trực tiếp vào kho mã độc quyền của OpenAI.

Discourse đã phát hành bản vá cho lỗ hổng hình ảnh vài ngày sau đó, gán điểm mức độ nghiêm trọng là 8,8 trên 10. OpenAI đã giải quyết vấn đề xác thực trong khoảng 14 giờ kể từ thời điểm báo cáo được gửi đến chương trình tiền thưởng lỗi của họ.

Lý do các phòng thí nghiệm AI liên tục đối mặt với công nghệ của chính mình

Sự cố này không phải là một trường hợp cá biệt. Trước đó, OpenAI đã báo cáo một sự kiện khác vào tháng Bảy, trong đó các mô hình của chính họ đã phá vỡ hộp cát thử nghiệm và truy cập vào các hệ thống bên ngoài.

Trong khi đó, Anthropic thừa nhận rằng Claude đã xâm phạm các tổ chức thực tế trong khi thực hiện các bài kiểm tra an ninh mạng vô tình bao gồm kết nối internet thực tế.

Mustafa Suleyman, người đứng đầu mảng AI của Microsoft, đã chỉ ra cùng một hiện tượng về các tác nhân trái phép này trong tuần này. Ông công khai cảnh báo rằng các mô hình có quyền tự chủ ngày càng tăng ngày càng khó kiểm soát.

“Đó là một phát súng cảnh báo… Rõ ràng bây giờ là lúc phải phối hợp giữa các phòng thí nghiệm để chúng ta có thể đảm bảo rằng chúng ta kiểm soát được công nghệ này,” Suleyman nói với Reuters.

Sự cố Hacktron nổi bật không phải vì sự đổi mới của nó. Trong nhiều thập kỷ, các nhà nghiên cứu bảo mật đã kết hợp các lỗ hổng phần mềm.

Sự thay đổi thực sự nằm ở tốc độ: một công việc trước đây yêu cầu kỹ năng chuyên môn cao của con người trong một thời gian dài đã được giảm xuống chỉ còn một đêm khi một mô hình đủ tiên tiến trở thành một phần của quy trình.

Chia sẻ tới

X (Twitter)Telegram

Tuyên bố miễn trừ trách nhiệm: Nội dung bài viết đến từ bên thứ ba, chỉ mang tính tham khảo và không phải lời khuyên đầu tư. Tiền mã hóa và các sản phẩm tài chính khác có rủi ro biến động giá lớn, vui lòng cân nhắc kỹ trước khi quyết định.

Bài viết liên quan