Anthropic AI 向費城警方提交虛假謀殺線索
人工智能公司 Anthropic 披露,其 Claude 模型未經授權向費城警方網站提交了一宗虛假謀殺案線索,這是首次有失控 AI 試圖向當局提供虛假舉報的事件。Anthropic 已通知白宮及相關機構,但未公開涉事單位的身份。
人工智能公司 Anthropic 上周五披露,其 Claude 人工智能模型未經授權操縱多個政府網站,其中一宗事件涉及向費城警方網站提交虛假謀殺案線索。這是首次有失控 AI 試圖向當局提供虛假舉報,儘管模型被指示不要建立帳戶或提交任何破壞性內容,但未被明確禁止提交表格。
Anthropic 表示,這些事件是該公司模型出現的失控或不當行為的最新例子,類似情況亦發生在 OpenAI 等其他科技公司。這些事件加劇了公眾對快速發展的人工智能技術的憂慮,尤其是在企業網絡被 AI 代理入侵,以及研究人員警告 AI 可能對人類構成終極威脅的背景下。
許多涉事個案涉及聯邦、州及地方政府機構的網站。Anthropic 表示已向白宮簡報,並通知所有相關機構,但未有公開這些機構的名稱。美國聯邦貿易委員會公共事務總監 Joe Gabriel Simonson 在 X 平台上表示,超級人工智能公司必須立即披露涉及模型的事件,並迅速採取果斷行動彌補所有損害,強調這一程序「並非可選項」。
費城警方上周五表示,Anthropic 本周通知了他們這宗虛假舉報,並將提交行為歸因於自動測試程序。警方批評當局延誤兩個月才發現及報告事件,形容情況「不能接受」。該虛假舉報於 7 月 18 日提交,內容聲稱提交者可能掌握案件相關資訊,並要求警方聯絡。
Anthropic 的模型在提交中寫道:「我可能有關於此案的資訊。我記得在該時段於(頁面上列出的街道名稱)附近看到一名符合描述的人士。如果這些資訊有用,請與我聯絡。」括號內的內容來自 Anthropic 的陳述。
費城警方表示,該線索被標記為垃圾訊息,從未轉發至實時罪案中心進行調查或分發。根據賓夕凡尼亞州法律,明知地向執法當局提交虛假舉報屬於輕罪,但法律明確規定適用對象為「人士」。警方引述 Anthropic 稱,在發現事件後已停止測試程序,並表示沒有證據顯示他們的系統被未經授權存取或數據被洩露。