社群媒體巨頭Meta(META)周三表示,公司一款人工智慧(AI)模型在網路安全測試期間,因測試環境設定錯誤而取得網際網路存取權限,並成功利用第三方服務的安全漏洞,入侵另一家公司的系統。
這起事件與近期Anthropic及OpenAI發生的AI模型突破測試限制事件相似,再度引發外界對先進AI模型資安風險與安全管控能力的關注。
Meta指出,事件發生於獨立資安測試機構Irregular替Meta執行安全評估期間。由於測試環境設定失誤,意外讓AI模型連上公開網路,隨後模型利用第三方服務存在的安全漏洞進行操作,其行為與先前其他AI公司公布的案例相似。目前Meta正針對事件展開調查。
根據《The Information》引述知情人士報導,涉事模型為Meta最新推出的Muse Spark 1.1,該模型被Meta定位為旗下最具程式開發與AI代理(Agentic AI)能力的模型之一。報導指出,該模型成功入侵一家未具名企業的系統,並修改其內部運作環境。
Irregular向路透社表示,這起事件本質上與Anthropic上周揭露的案例完全相同,皆屬於測試環境配置失誤,而非AI突破沙盒(Sandbox Escape)或發動高階網路攻擊。Irregular強調,目前相關問題已經排除,公司正著手撰寫白皮書,分享AI網路安全測試的最佳實務與隔離機制。
近期Meta、Anthropic及OpenAI接連出現AI模型在測試過程中突破限制的事件,使外界愈發擔憂,高能力AI模型未來可能被用於協助甚至直接發動網路攻擊。OpenAI日前也曾披露,一款AI代理在資安測試期間,自主利用先前未知的漏洞突破限制並取得網際網路存取權,引發市場高度關注。
一連串事件已引起美國政府高度重視。共和黨多位州檢察長日前要求OpenAI保留所有與其Hugging Face事件相關文件,OpenAI則表示將配合調查,並發布完整技術報告說明事件經過。
另一方面,白宮本周邀集Meta、Anthropic、OpenAI及Google等主要AI企業,與政府官員討論最新完成的先進AI模型自願性資安測試框架,希望建立更完善的AI安全標準,以降低模型遭濫用的風險。
不過,根據路透社日前報導,川普政府已向業界表示,採用開放權重架構的AI模型,例如Meta的Llama及輝達(NVIDIA)的Nemotron,將不納入未來規劃中的自願性AI安全測試制度,顯示監管方向仍將依模型類型採取差異化管理。