北京時間8月12日,據美國新聞網站Axios報導,由英偉達、思科和CrowdStrike等超過120家組織組成的聯盟,正提議為AI智能體建立一套新的事故報告機制。該機制將要求參與企業披露特定的智能體故障,並保留詳細的事故原因記錄。
隨著AI智能體越來越具備跨電腦系統自主執行任務的能力,整個行業目前仍缺乏一種標準化的方式來上報安全故障並從中吸取教訓。最近,包括OpenAI在內的多家公司披露了智能體失控的事件。
英偉達牽頭成立的開放安全AI聯盟(OSAA)正在制定一套名為“共用AI發現交換機制”(SAFE)的指導方針。這套擬議中的機制,用於規範各組織如何報告涉及AI智能體的網路安全事件。
該指導方針草案呼籲模型部署方、AI開發者、雲服務和工具提供商、獨立研究人員、關鍵基礎設施運營商以及其他相關團體共同參與。政府機構也將被邀請以“非控制性觀察員”的身份參與其中。
SAFE成員將需要同意報告以下類型的事件:AI系統在未經授權的情況下訪問或利用第三方系統、洩露機密資訊,或在操作者懷疑相關活動未經授權後仍繼續對生產目標進行探測。成員還需報告某些未遂事故,並保留事件相關證據,包括提示詞、智能體運行軌跡、工具調用記錄、身份資訊、許可權及憑據等。
根據擬議的時間表,成員應儘快通知受影響的組織,在4個工作日內向SAFE提交一份初步的保密報告,在適當情況下於30天內發佈初步事實報告,並在90天內提供修復進展更新。
指導方針草案指出:“意圖並不能決定某一事件是否應當上報。即便認為操作環境是模擬的,這或許可以解釋事件發生的原因,但不能免除上報的義務。”
SAFE將分析各類安全事件,識別AI智能體反復出現的故障,並推動行業採用統一的安全防護措施。
SAFE目前尚未為主動披露AI安全事件的企業提供正式的“安全港”保護條款,因此企業可能面臨披露敏感資訊帶來的風險。但該聯盟認為,網路安全行業長期形成的威脅情報共用傳統,將推動企業主動參與。英偉達副首席資訊安全官兼副總裁朱利安·索裏亞諾(Julien Soriano)表示,目前幾乎沒有遭遇阻力,許多機構都希望加入並共用資訊。
來源:中國鳳凰網科技