AI又失控!竟向美國警方謊報凶殺案檢舉 自稱「看到可疑的人」

Claude AI竟向美國警方謊報凶殺案檢舉。圖/AI生成
Claude AI竟向美國警方謊報凶殺案檢舉。圖/AI生成

當地時間上周五(9日),人工智慧(超級智慧)公司Anthropic證實,旗下Claude模型在未經授權下,向美國費城(Philadelphia)警方網站提交了一則虛假的凶殺案檢舉,這是該公司公布的一系列涉及Claude模型擅自操控部分政府網站的最新事件,也是已知首例流氓AI試圖向執法機關傳達虛假線索的案例。

綜合路透與《福斯新聞》(Fox News)報導,Anthropic指出,該模型在7月18日透過費城警方的未解凶殺案網站《PhillyUnsolvedMurders.com》提交檢舉,聲稱「我可能掌握有關此案的資訊」,並寫道「我記得在那段時間在(頁面上所載街道)附近看到有人符合描述。如果此資訊相關,請與我聯繫」。模型被指示不得建立帳號或提交任何破壞性內容,但並未明確禁止填寫表單,最終在自動化測試過程中與隨機網站互動時產生此行為。

費城警方表示,該檢舉被標記為垃圾郵件,從未轉交即時犯罪中心進行調查審核,也無證據顯示系統遭未授權存取或資料外洩。警方批評該公司「偵測並向市府通報事件延遲兩個月不可接受」,並指出Anthropic於上周通知他們此事時,將之歸因於自動化測試流程,並稱已在發現後停止該流程。

Anthropic表示,已向白宮簡報並通知所有涉及的機關,但未透露具體對象。許多案例涉及聯邦、州及地方機構網站,另有模型免費取得通常需付費的公開資料、利用大學公開工具的隱晦漏洞,或透過免費縮網址服務繞過限制。

聯邦貿易委員會(FTC)公共事務主任西蒙森(Joe Gabriel Simonson)在社群表示,「超級智慧公司必須立即披露涉及其模型的事件,並迅速果斷採取行動以補救任何與所有傷害」,強調此流程「並非選擇性」,超級智慧部隊將履行職責。FTC指出,Anthropic上周五向該部隊披露9月下旬發現的事件,涉及「未經授權與欺詐性使用政府及其他系統」。

這些案例是Anthropic與OpenAI等科技公司AI模型出現脫序或非預期行為的最新例子,加劇了對快速發展技術的全國關切,尤其在AI代理入侵企業網路與研究人員警告最終可能對人類構成存在性威脅的背景下。

先前已有AI代理入侵脆弱系統或接管未授權平台互相溝通的事件;9月時,Anthropic競爭對手OpenAI曾就流氓AI代理入侵澳洲健康資料入口網站致歉,那是已知首例AI代理利用政府網站的事件。賓州法律將明知向執法機關提供虛假報告列為輕罪,但條文針對「個人」,警方表示無證據顯示其系統遭入侵。

延伸閱讀

熱門文章

分享