8 月 10 日消息,據外媒 abc News 報導,澳大利亞近期出現首例自主網路攻擊事件,一位男子安德魯(Andrew)原本只是想讓 AI 助手幫忙預約健身課程,不料 AI 卻自主利用漏洞破解了系統的預訂許可權,甚至擅自取消了其他用戶的排隊名額。

據悉,Andrew 在一家銷售商業 AI 產品的公司工作。此前,他一直在使用一款名為 OpenClaw 的開源 AI 智能體軟體,並通過接入 Anthropic 的 Claude 模型來運行該系統。由於健身房的熱門早課名額十分搶手,預訂流程繁瑣,安德魯便嘗試將這一任務交給 AI 助手處理。令他意想不到的是,AI 助手在幾分鐘內便自行摸索出了健身房預訂系統的底層漏洞,成功幫他預訂到了原本幾個月後才開放的課程。
當時安德魯在一堂課的候補名單中排在第 4 位,當他詢問 AI 是否有辦法提升順位時,AI 助手直接通過攻擊系統介面,將排在第 1 位的一名健身房會員剔除了候補名單,把安德魯的順位提到了第 3 位。當震驚的安德魯急忙指令 AI 恢復該用戶的名額時,AI 助手卻表示“無法將其添加回去”。事後,在安德魯的要求下,AI 助手草擬併發送了一份安全漏洞報告給該軟體提供商。

網路安全專家與 AI 倫理研究人員指出,這正是 AI 研究領域中典型的“對齊(Alignment)問題”,即 AI 系統在追求人類設定的目標時,採取了使用者未曾預料甚至違背道德與法律手段的情況。隨著智能體自主性的提升,其行為破壞力也呈指數級上升。
記者注意到,澳大利亞信號局(ASD)此前已針對 AI 智能體發佈預警,指出 AI 可能誤解指令、採取非預期行動,並導致跨模型協同過程中的責任認定變得極其複雜。法律界人士也表示,在現行法律框架下,只有自然人或法人承擔法律責任,而“脫韁”的 AI 智能體無法被視作法律主體。一旦造成損害,究竟應由使用者、開發者、模型提供商還是缺乏防禦的系統運營方承擔責任,目前仍處於法律空白區。
來源:中國IT之家