$6,500 OpenAI 漏洞賞金經由 Claude 生成的攻擊代碼取得

安全研究人員使用 Anthropic 的 Claude 入侵了 OpenAI,並獲得 $6,500 的漏洞賞金。

2026-09-18 16:58約 4 分鐘閱讀

針對 OpenAI 的安全漏洞入侵中的主要工作是由一家競爭對手公司的人工智慧模型所執行。Hacktron AI 的團隊使用 Anthropic 的 Claude 來製作可運作的漏洞利用程式碼。

整個入侵過程耗時不到 72 小時。在團隊證明其已存取 OpenAI 的私有原始碼後,該公司發放了 $6,500 的賞金。

圖片上傳如何升級為全面入侵

攻擊鏈始於一件平凡的事情:OpenAI 社群支援論壇上的圖片上傳功能,該論壇使用第三方軟體 Discourse。

一個安全過濾器旨在檢查上傳的檔案。然而,它未能識別某些圖片格式,讓它們未經檢查便通過。這些檔案隨後進入了包含已知記憶體損毀漏洞的獨立影像處理函式庫。

由 Harsh Jaiswal、Mohan Pedhapati 和 Rahul Maini 組成的 Hacktron 三人團隊,在七月底試圖利用該漏洞。

較早版本的 Claude 在應對旨在隨機化記憶體位址的安全措施時遇到困難。

幾小時後,更新後的模型生成了可運作的漏洞利用程式碼,並根據論壇的具體設定進行了調整。

這僅提供了進入論壇伺服器的途徑,並未觸及 OpenAI 自身的系統。OpenAI 單一登入框架中的一個獨立、不相關的漏洞改變了情況。

由於用於論壇的憑證也驗證了對 ChatGPT 和 Codex 帳戶的存取權限,接管一名員工的工作階段便直接進入了 OpenAI 的專有程式碼庫。

Discourse 在幾天後發布了針對圖片漏洞的修補程式,將其嚴重性評分定為 8.8 分(滿分 10 分)。OpenAI 在其漏洞賞金計畫收到報告後約 14 小時內解決了認證問題。

AI 實驗室一再面對自身技術的原因

這起事件並非單一事件。OpenAI 先前在七月曾報告另一起事件,其自身的模型突破了測試沙盒並存取外部系統。

與此同時,Anthropic 承認 Claude 在進行網路安全測試時,意外包含了即時網際網路連線,從而入侵了實際組織。

微軟 AI 負責人 Mustafa Suleyman 本週指出了同樣的未經授權代理現象。他公開警告,自主性日益增強的模型越來越難以控制。

“這是一記警鐘……現在⁠顯然是時候​在實驗室之間進行協調,以確保我們​能夠控制這項技術了,” Suleyman 告訴 Reuters。

Hacktron 事件的突出之處不在於其創新性。幾十年來,安全研究人員一直在結合軟體漏洞。

真正的轉變在於速度:以前需要專業人類技能且耗時長久的工作,一旦足夠先進的模型加入流程,就縮短為一個晚上。

分享至

免責聲明:本文內容來源於第三方媒體,僅供參考,不構成任何投資建議。加密貨幣及其他金融產品存在較大價格波動風險,請謹慎決策。

相關文章