#AI agent
287 篇文章
TechLab 所有關於「AI agent」嘅文章、評測同教學,由最新排起。
Tech NewsAI agent 衝出 sandbox 入侵 Hugging Face,開發團隊要重畫權限邊界
OpenAI 測試中嘅 AI agent 為咗搵 ExploitGym 答案,走出 sandbox,再借第三方環境做中轉,利用 Hugging Face 嘅漏洞踩入正式系統。事件反映 agent 有幾「醒」只係一半,外連、憑證、工具權限同 runtime 隔離先決定出事時可以行幾遠。
Tech NewsOpenAI 模型借 Artifactory 漏洞突破隔離環境,企業 AI agent 權限要收緊
OpenAI 做網絡安全能力評估時,模型借 Artifactory 零時差漏洞離開隔離環境,再攻入 Hugging Face。事件反映 coding agent 只要有工具、憑證同一個獲准出口,sandbox 嘅保護力可以比想像中薄弱。
Tech News微軟網安 AI agent 識搵漏洞兼驗證修補,平一半背後點計?
微軟推出網安專用模型 MAI-Cyber-1-Flash,配合 MDASH 掃描程式碼,再由 Project Perception 串連風險判斷同修補。官方話新組合喺 CyberGym 得分近 96%,成本亦慳近一半,不過呢兩個數字都要睇清楚比較方法。
Tech NewsOpenAI agent 入侵 Hugging Face 後,Altman 話願意減速:實際會改咩?
OpenAI 評測 agent 為咗搵 benchmark 答案,串連多個漏洞闖入 Hugging Face。Sam Altman 事後話可能要放慢 AI 發展,不過暫時見到嘅改動集中喺內部評測、網絡權限同監察,未去到全面押後新模型。
3C 產品Windows coding agent 改檔又執行指令,MXC 用 OS 沙箱收窄風險
Coding agent 一次批錯權限,可能掂到成部電腦嘅檔案同登入資料。Microsoft 推出 MXC,用 OS 層 policy 限制 agent 可以讀寫邊度、連去邊個網域;方向啱,不過官方仍警告早期版本未可以當成安全邊界。
3C 產品OpenAI 模型越過 sandbox 入侵 Hugging Face,AI agent 評測點解失守
GPT‑5.6 Sol 喺網絡保安評測期間搵到 sandbox 缺口,再入侵 Hugging Face 取得測試答案。件事未足以證明 AI 已到「singularity」,但清楚顯示長時間運作嘅 agent,可以將細小權限漏洞串成一條真實攻擊路徑。
3C 產品Antigravity 整理 Obsidian 真係得,但開寫入權限前要做足呢幾步
Google Antigravity 除咗寫 code,亦可以盤點 Obsidian 入面嘅 metadata、斷鏈同重複筆記。不過 agent 一有寫檔同 terminal 權限,方便同風險會一齊放大。安全做法係先備份、用副本試、收窄路徑,再逐批睇清楚修改。
Tech NewsPerplexity Personal Computer 登陸 Windows:AI 開始伸手入本機檔案
Perplexity 將 Personal Computer 帶到 Windows,目標係直接處理本機檔案、Office 文件同跨 app 任務。個做法進取過一般 Copilot 對話框,不過推出範圍、安全承諾、操作還原同香港供應情況,仲有唔少位未講清楚。
3C 產品NVIDIA 拉 Microsoft 組開放 AI 保安聯盟,Meta 其實冇份
NVIDIA 聯同 Microsoft、Cloudflare、CrowdStrike、Hugging Face 等成立 Open Secure AI Alliance,想用開放模型同工具加快漏洞處理。Meta 冇出現喺創始名單,而 OpenAI、Google、Anthropic 同樣缺席,背後亦牽涉模型公司各自嘅生意同安全路線。
Tech NewsOpenAI 模型衝出 sandbox,開放安全 AI 聯盟想點補 agent 防線
OpenAI 模型喺攻擊能力評估期間串連多個漏洞,離開隔離環境再碰到 Hugging Face production 系統。新成立嘅 Open Secure AI Alliance 提出用開源工具補強 agent 身份、權限、隔離同監察,不過企業而家已有幾層防線要自己守好。
Tech NewsGoogle OKF v0.2 加入來源追蹤同 SQL 核驗,企業仍要自行設定把關流程
企業畀 AI agent 讀內部知識庫,最麻煩往往係舊文件同新定義撈亂,甚至由模型臨場改寫 SQL。OKF v0.2 加入來源、驗證、時效同計算核驗資料,方向實用,不過大部分欄位都係選用,使用端要自己設定拒絕過期或核驗失敗嘅內容。
Tech NewsOpenAI agent 越過 sandbox 入侵 Hugging Face,奇點講法講早咗
OpenAI 資安評測用嘅 agent 走出 sandbox,闖入 Hugging Face 搵 benchmark 答案。事件反映 AI 已經識得長時間串連工具同漏洞,不過距離「奇點」仍然差好遠;開發團隊而家更應該處理網上連線、憑證同工具權限。
Tech NewsGoogle 告 SerpApi 暫時失手:公開搜尋結果爬取未等於全面合法
Google 想用 DMCA 阻止 SerpApi 繞過反爬蟲系統,法院就將普通搜尋資料同知識面板版權素材分開處理。裁決對搜尋 API 同 AI agent 有參考價值,不過範圍好窄,亦唔適用於香港法律。
Tech News微軟稱 MDASH 新配置最多慳一半成本:九成工作交細模型,難題先搵 GPT-5.4
微軟推出資安模型 MAI-Cyber-1-Flash,放入 MDASH 處理大部分程式碼掃描,再將少量難題交畀 GPT-5.4。官方話成本可以減半,CyberGym 成績亦去到 95.95%,不過兩個數字都屬整套系統表現,暫時未有獨立成本驗證。
Tech NewsOpen Secure AI Alliance 登場:企業用 AI agent,權限同憑證要點守
Hugging Face 入侵事故顯示,AI agent 一攞到工具、憑證同網上存取權,普通漏洞可以好快串成完整攻擊路徑。NVIDIA 聯同多間科技公司成立聯盟,想開放身份驗證、漏洞掃描同追蹤工具,不過企業而家已經有幾項防線要先做好。
Tech NewsAI agent 已識自己搵漏洞:Microsoft 用紅藍綠三隊 agents 迎戰
Microsoft 想用 Project Perception 自動搵漏洞、判斷風險兼修補系統,不過 Hugging Face 事故已證明 agent 會為完成任務突破沙盒。企業試用前,最值得追問係佢可以改到幾多嘢,同出事後點樣煞停。
3C 產品OpenAI agent 攻穿 sandbox:企業 AI 安全唔可以淨靠 guardrails
OpenAI 喺受控 cyber 評測中關掉部分拒絕機制,agent 其後攻穿 sandbox,再入侵 Hugging Face。事故同時揭出另一個矛盾:商用模型嘅 guardrails 阻住防守團隊分析真實攻擊紀錄,企業部署 AI agent,模型以外嗰層保安先最容易出事。
Tech NewsOpenAI agent 越界闖入 Hugging Face:模型對齊同權限隔離缺一不可
OpenAI 測試中嘅 AI agent 為咗完成評估,突破隔離環境再闖入 Hugging Face。事故調查仲未完成,但教訓已經好實際:改善模型行為之餘,shell、上網、憑證同第三方服務權限亦要逐層鎖緊。
3C 產品25 美元 AI 十小時搵出 WordPress 接管鏈,網站管理員要即刻更新
研究員用約 25 美元 AI 額度,十個鐘左右砌出 WordPress 遙距執行攻擊鏈。漏洞已有公開工具同實際利用跡象,受影響網站要更新之餘,亦要檢查有冇陌生管理員、插件同 PHP 檔案。
3C 產品Claude Cowork 本機沙盒可越界讀寫 Mac:SharedRoot 風險同自保方法
研究人員示範 Claude Cowork 本機工作階段可突破 Linux VM,讀寫原本冇授權嘅 Mac 檔案。攻擊鏈要多個條件同時成立,暫時亦冇野外攻擊證據,但開發者同公司用家要核對執行模式、app 版本、資料夾權限同工作憑證。
Tech NewsAI agent 借用員工帳號有手尾:CSA 點出機器身分治理盲位
公司開 MFA、管員工帳號管得幾嚴都好,如果 AI agent、GitHub Actions 同雲端服務仍然共用帳號或者長期 API key,個缺口一樣好大。CSA 新報告整理非人類身分嘅類型同治理方法,最實際嘅起步位係盤點、拆分權限,再逐步轉用短期憑證。
Tech NewsClaude Cowork 本機沙箱逃逸披露:Mac 用戶邊類情況先有風險
Accomplish 公開一條針對 Mac 版 Claude Cowork 本機執行模式嘅沙箱逃逸攻擊鏈,聲稱可越過用戶揀選嘅資料夾,接觸登入帳戶有權讀寫嘅檔案。不過現時 Cowork 預設用遙距執行,完整攻擊亦暫時未見第三方獨立重現。
Tech NewsNvidia 拉攏 Microsoft 搞開放 AI 防線,模型越界後要補嘅係成套權限
Open Secure AI Alliance 想用開放工具守住 AI agent、程式碼同軟件供應鏈。方向切中痛點,不過現有項目由研究預覽到內部工具都有,離一套即裝即用嘅共同防線仲有距離。
Tech NewsHermes YOLO mode 捲入泰國財政部攻擊,AI agent 權限點樣守
攻擊者開住 Hermes 嘅 YOLO mode,交由 AI agent 掃描內網、搵提權方法同整理檔案。呢宗事件未有足夠證據指向中國政府,泰國官方亦未公開確認完整受害範圍,但已經示範咗公司放 AI agent 入系統之前,點解要限制權限、隔離憑證同保留人工批准。