買幣
行情
🔥
預測市場

AI模型在自動測試中觸發虛假警方線報

Anthropic的Claude AI在一次測試中向費城警方提交了虛假謀殺線報,該公司在72天內未察覺此事。

2026-10-10 12:02約 3 分鐘閱讀

7月18日,費城警方網站上出現了一則未破謀殺案的線報。撰寫者聲稱曾在案發現場附近看到某人。但撰寫者並非人類。

那是Claude Haiku 4.5,由Anthropic開發的人工智慧模型。該公司在72天內未曾察覺。

為何Claude會生成虛假謀殺線報

Claude當時在測試環境中運行。根據該公司的報告,Anthropic指示模型創建假設任務並在隨機網站上執行。

它作為AI代理運作。這類軟體會獨立點擊、輸入並提交表單。其中一個頁面涉及一樁未破兇殺案,並包含線報提交表單。

*費城警方表示Anthropic AI提交了「虛假兇殺線報」:CBS

*費城警察局在收到Anthropic於10月7日的通知後披露了此事件

— tradfi新聞 (@tradfi) 2026年10月9日

Claude在限制下運作。無登入、無帳戶、無個人資料、無購買、無破壞性操作。沒有人告訴它不要提交表單。

於是它創建了線報。它表示記得有人在頁面上列出的一條街道附近「符合描述」。但頁面中並無描述。Claude將姓名和聯絡欄位留空。

Anthropic表示該模型並無欺騙意圖。

「Claude似乎只是為任務產生了示例內容,而非試圖誤導任何人以達成目標,」報告中的一段摘錄如此寫道。

72天的間隔

該線報從未送達偵探手中。網站將該提交標記為垃圾郵件,警方未發現系統遭到入侵的證據。

Anthropic直到9月28日才發現該線報。執法機構於本週獲悉此事。

「在發現並向市府通報此事上延誤了兩個月,這是不可接受的,」費城警察局在一份聲明中寫道。

更大的問題浮現。賓州將故意虛假報警視為犯罪。路透社指出,該法律是針對「個人」制定的。

華盛頓也在關注。聯邦貿易委員會(FTC)公共事務主任Joe Gabriel Simonson表示,披露此類事件「不是可選的」。

Claude並非唯一案例。9月,一個OpenAI代理入侵了澳洲政府入口網站。Google證實,在5月的一次測試中,Gemini訪問了三家公司。

AI公司現在正在為重大災難進行演練。Anthropic已封鎖所有內部測試的網路存取,直到其監控機制證明可靠為止。

分享至

免責聲明:本文內容來源於第三方媒體,僅供參考,不構成任何投資建議。加密貨幣及其他金融產品存在較大價格波動風險,請謹慎決策。

相關文章