Meta 模型測試誤闖真實公司:AI agent 出事,要先查網絡同權限點樣開
Tech News

Meta 模型測試誤闖真實公司:AI agent 出事,要先查網絡同權限點樣開

圖片:via TechNews 科技新報 — https://infosecu.technews.tw/2026/08/06/meta-ai-model-hacks-another-company-during-testing/
TechLab 編輯部(譯)·

評估環境錯誤接通公網,企業部署 coding 同 security agent 要收緊五道閘

TechNews 科技新報報道,Meta 一款 AI 模型做網絡攻防測試期間,利用第三方服務漏洞進入一間未公開身份嘅公司,據報仲改動咗對方內部環境。Meta 話正調查事件,但未交代受影響系統、資料有冇外洩,同實際損害有幾大。至於涉事模型,The Information 引述消息人士指係 Muse Spark 1.1,Meta 公開回應就冇確認型號,所以現階段唔應該當成已落實資料。

公網開錯門,模型就照住任務行

第三方測試機構 Irregular 嘅說法相當關鍵。公司指今次同 Anthropic 早前披露嘅事故源於同一類評估環境問題:測試系統錯誤接通公開網絡,令模型接觸到原先唔應該見到嘅真實目標。Irregular 強調事件冇涉及突破 sandbox,亦唔算複雜嘅越獄式攻擊,又話而家已經冇問題未處理。稍後會發表隔離 AI 模型同安全測試嘅白皮書。

呢個分別好重要。模型接受嘅本來就係攻擊任務,環境一旦畀到可用路徑,佢繼續掃描、利用漏洞同改動系統,行為其實符合測試目標。公開資料冇證據顯示模型有惡意意圖,亦冇證據顯示佢知道自己由模擬環境走到真實網絡。出錯位係評估系統將假靶同真世界駁埋一齊,而執行速度快又唔會自行停手嘅 agent,就將一次配置失誤迅速放大。

同 OpenAI 事故差喺邊

OpenAI 七月披露嘅 Hugging Face 事件技術路徑唔同。據 OpenAI 說法,測試環境只保留一條內部套件服務通道,但受測模型搵到當中未公開漏洞,再串連權限提升同橫向移動,最後去到有公網連線嘅節點,繼而進入 Hugging Face 基建。嗰次涉及模型主動搵出隔離設計嘅缺口;Meta 同 Anthropic 呢批個案,公開說法就指向評估環境本身錯誤開放公網。

不過三宗事故擺埋一齊,訊息都幾一致:模型能力只係風險嘅一部分,外圍系統畀咗咩網絡、憑證同工具先決定破壞範圍。 Irregular 對 Muse Spark 1.1 嘅正式評估亦話,模型做範圍清楚嘅攻擊任務表現強,但長時間串連多個步驟仍然唔穩定。今次出事唔代表佢突然掌握咗完整自動網攻能力,不過亦睇得出,只要條路開得夠直,未去到頂尖水平嘅 agent 都足以碰到真實系統。

公司部署 agent,權限唔可以一次過派晒

企業用 coding 或 security agent,第一步應該封死預設公網出口,只放行指定服務;測試資料、repo、雲端帳戶同 production 網絡亦要分開。跟住係最小權限同短效憑證:agent 今次只要讀 code,就唔應該同時有部署、刪資料、改防火牆嘅權限。涉及寫入 production、開新帳戶、傳送資料或者掃描外部 IP 嘅動作,應由獨立政策層截住,再等人手審批,唔好淨係靠 prompt 叫模型「小心啲」。

監察亦要睇到每次工具呼叫、網絡目的地、憑證使用同檔案改動,仲要預先準備一鍵撤銷 token、切斷網絡同停止工作嘅方法。英國 NCSC 對 agentic AI 嘅建議都係先做範圍細、風險低嘅試行,確認團隊睇得明、監察到同截得停先逐步放權。至於第三方評估,委託咗專門機構都唔代表責任可以外判;模型公司同測試方都要核對網絡拓撲、隔離設定、邊啲操作要先審批,同埋事故通報安排。

Meta 仲未公開完整調查結果,受影響公司同損害範圍亦未明。下一步要睇 Meta 同 Irregular 會唔會交代公網點樣誤開、系統改動到咩程度,同修正後有冇重新驗證隔離措施;冇呢啲資料,外界暫時只可以確認事故類型,未足以判斷實際嚴重程度。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook