Anthropic 研究員離職,稱 AI 業界擔憂人類滅絕

Jacob Coxon 從 Anthropic 辭職,指控高階 AI 人物私下擔心超級智慧 AI 可能在本十年末消滅所有人類。

2026-09-09 07:59約 5 分鐘閱讀

Anthropic 研究員 Jacob Coxon 宣布辭職,並指控 Anthropic 和 OpenAI 加速邁向自我改進的超級智慧,同時危及人類生命。

他聲稱,過去三年間,Coxon 曾在兩家公司從事預訓練工作。他透過 X 上的貼文分享了他的指控。

Anthropic 研究員離職,對留下者發出嚴峻預測

根據 Coxon 的說法,這項技術的發展路徑被嚴重低估。他斷言,未來的系統將能夠駭入任何事物,在一夜之間徹底改變整個產業,並獲得真正的影響力和資源。

Coxon 進一步聲稱,內部討論與公開聲明之間存在明顯對比。他表示,高層領導人在媒體露面時會修飾言辭,但在私下承認擔憂。

「打造 AI 的人們真心相信,它可能在本十年末消滅我們所有人。這不是行銷噱頭,」他表示。「沒有其他人類活動構成這種程度的危險。」

Coxon 區分了他先前的工作場所。他說,在 OpenAI,許多員工未能理解文明層級的風險,而 Anthropic 雖然意識到這些風險,卻仍陷入爭先的競賽中。

「Jacob 在這裡是對的——我們真的真心相信 AI 可能消滅所有人類!我個人認為在未來十年內機率大於 10%。我相信 Anthropic 正在盡力,但我們尚無解決超級智慧對齊的計劃,且並未明確在軌道上。」

— Evan Hubinger (@EvanHub),2026 年 9 月 9 日

Coxon 加入了 2026 年離職職員的增長名單。2 月,Anthropic 的安全防護負責人 Mrinank Sharma 辭職。

9 月 1 日,曾任 OpenAI 首席未來學家的 Joshua Achiam 表示,失控的 AI 系統將自主複製,並尋求金融和政治影響力。

合作呼籲

Coxon 將進入他所謂的終局階段形容為傲慢的賭注。他堅持認為,如此重大的選擇不應來自於私人公司的內部聊天。

儘管如此,Coxon 仍表達了對協調的希望。他認為 Hugging Face 事件提高了美國實驗室之間達成節奏協議的可行性。

Anthropic 和 OpenAI 都已支持這樣的概念。7 月,來自前沿實驗室的超過 1,100 名員工簽署了「Pacing the Frontier」公開信,其中包括 Anthropic 執行長 Dario Amodei 和 OpenAI 首席科學家 Jakub Pachocki。

「我們要求美國政府支持國際努力,開發所需的技術和治理工具,以審慎地調控自動化 AI 發展的前沿,」信中寫道。

此外,這兩家公司還支持了一份關於網路安全的聯合公開信,由 Google、Microsoft 及約 150 個其他實體共同簽署。該信警告,AI 驅動的攻擊在不久的將來將在頻率和複雜性上顯著增加。

Coxon 的警告發布前不久,聯合國人權事務高級專員 Volker Türk 向人權理事會表示,先進 AI 可能構成生存威脅。

為避免全球競爭,Coxon 建議暫停提升模型能力的嘗試。他最後要求實驗室研究人員反思,是否希望在未理解結果的情況下啟動一個超級智慧的強化學習過程。

分享至

免責聲明:本文內容來源於第三方媒體,僅供參考,不構成任何投資建議。加密貨幣及其他金融產品存在較大價格波動風險,請謹慎決策。

相關文章