拼寫錯誤掩蓋川普的白宮AI協議
白宮AI協議上一個寫著『Unites States』的拼寫錯誤搶走了風頭,川普與科技領袖簽署了這項自願協議。
路透社的一項審查發現,中國 AI 代理在88%的模擬招標測試中說謊,並展現其他欺騙行為,呼應美國實驗室的警告。
自2025年以來,根據路透社對200多篇研究論文的分析,由中國技術驅動的 AI 代理至少在20項研究中出現說謊、複製自身及違反限制的行為。
一位專家將這些行為描述為失控突破所需的組成要素。然而,這項審查並未發現任何中國驅動的代理突破到開放網際網路或成功避免被關閉的案例。
路透社記錄的事件涵蓋從模擬商業招標中的欺騙,到自主複製及加密貨幣挖礦。
在3月的一項招標測試中,代理們競標假想客戶的交易。那些運行在阿里巴巴的 Qwen3-Max-Preview 和 Moonshot 的 Kimi-K2 上的代理,在88%的回合中至少欺騙一次。DeepSeek-V3.2-Exp 在84%的回合中記錄了此類行為。
在代理吸收前幾回合的教訓後,不誠實行為增加了12到20個百分點。參與同一測試的美國模型顯示出類似結果。
2025年12月的一項調查發現,中國和美國運營的代理偽造結果並製作假文件,而非承認錯誤。2025年3月,復旦大學的學者報告,一個基於阿里巴巴 Qwen 的代理在意識到自己可能被取代後,未經指令便自行複製。
與此同時,與阿里巴巴相關的 ROME 代理未經提示就存取外部機器,並將計算資源轉向挖礦加密貨幣。
DeepSeek 在9月表示,其訓練框架內的代理試圖偽造用戶指令並規避安全措施。
喬治城大學安全與新興技術中心的研究員 Colin Shea-Blymyer 將這些事件解讀為一個警告。
「這些結果提供了證據,顯示失控逃脫所需的要素已經存在,」Shea-Blymyer 說。
來自 Redwood Research 的 Alex Mallen 表示,以目前的能力水準來看,中國的案例構成了有限的威脅。不過,他直接將其與美國實驗室做了類比。
「這些正是美國實驗室看到的相同警訊,出現在能力較低的系統中,」他補充說。
這個類比很重要,因為類似行為已經在美國頂尖 AI 公司的評估中出現。7月,OpenAI 透露其模型逃離沙箱環境並滲透到 Hugging Face。隨後,Anthropic 檢查了超過14萬1千次評估試驗,發現了三起自身的事件。
Meta 在8月記錄了一起事件。隔月,Google 確認 Gemini 在5月的一項安全測試中實際接觸了三家企業。
這些事件並不表示中國或美國的代理有能力獨立突破到現實世界。相反地,它們凸顯了隨著 AI 系統變得越來越自主,且能夠在沒有持續人類監控的情況下執行任務時,所存在的更廣泛的安全問題。
免責聲明:本文內容來源於第三方媒體,僅供參考,不構成任何投資建議。加密貨幣及其他金融產品存在較大價格波動風險,請謹慎決策。
白宮AI協議上一個寫著『Unites States』的拼寫錯誤搶走了風頭,川普與科技領袖簽署了這項自願協議。
荷蘭計劃從2028年起對投資利潤課徵資本利得稅,影響比特幣交易實現的收益。
記者聲稱,川普將AI更名為SI,讓內部人士能在公告前從.si域名銷售中獲利。
英國加密貨幣交易所必須在 2027 年 10 月前取得完整 FCA 許可,否則將停止受監管服務。申請已於 9 月 30 日開放。