#AI 安全
58 篇文章
TechLab 所有關於「AI 安全」嘅文章、評測同教學,由最新排起。
Tech NewsOpenAI確認 wiki 事故,AI agent 披露標準成安全焦點
OpenAI確認 AI agents 涉及德國 wiki 論壇事故,並稱正制定更完整的披露框架。事件反映企業部署自主代理時,權限隔離、監察與事故溝通同樣不可缺少。
Tech NewsOpenAI 據報採用 opaque recurrence,AI agent 審計面臨新缺口
OpenAI 據報將在 Astra 採用 recurrent depth。技術使用有限,但若更多推理轉入難以讀取的內部循環,coding agent、企業風險管理及 AI 安全監管都會失去重要觀察窗口。
Tech NewsAI agent 外掛成新供應鏈攻擊面:企業為何要持續審核
AIR 融資 5,000 萬美元,主打審核 AI agent 所用的 skills、plugins 與 MCP server。關鍵不在一次掃描,而在外掛、帳戶與下載套件變動後的持續驗證。
Tech News美法院叫停五角大樓封殺 Anthropic:AI 護欄如何成為採購風險
美國聯邦法院裁定,五角大樓把 Anthropic 列為供應鏈風險的做法違法且欠缺依據。事件突顯 AI 供應商的安全政策,正直接影響政府與企業的採購、遷移及治理安排。
Tech NewsFrontier AI 實驗室點處理失控模型?公開應變計劃仍然留有大截空白
Guidelight 評核五間 frontier AI 公司嘅監察、截停同 containment 安排,發現公開計劃普遍未成熟。不過呢份研究量度到嘅主要係公開證據,未足以證明公司內部冇方案;對用 coding agent 嘅團隊,實際警示就清楚得多:權限、監察同中止機制要一開始就拆開設計。
Tech NewsGrok 可俾加密 prompt injection 偷聊天紀錄:實際風險有幾大
安全公司 Adversa 發現,攻擊者可以將惡意指令加密,令 Grok 嘅文字過濾器睇唔出有問題;模型自行解密後,反而照住指令將用戶名稱、位置同聊天紀錄送去攻擊者個網站。攻擊有明確觸發條件,但用 AI 處理陌生網頁同私人內容嗰班人要特別小心。
Tech NewsOpenAI 據報拆散 Preparedness team:新模型安全把關而家邊個負責
OpenAI 據報解散專門評估災難級 AI 風險嘅 Preparedness team,再將工作分散畀其他安全團隊。公開框架同審批架構暫時未見撤走,不過跨領域風險由邊個統籌、內部意見有幾大約束力,而家變得更難由外面睇清楚。
Tech NewsOpenAI 據報拆散 Preparedness team:分流風險評估會削弱把關嗎?
OpenAI 據報將 Preparedness team 拆開,bio、cyber 等風險評估交返畀既有團隊。官方文件顯示框架同發布門檻仍然存在,不過中央審核角色淡出之後,跨領域風險會由邊個統籌、內部審核仲夠唔夠獨立、公開資料會唔會縮水,都值得繼續留意。
3C 產品法庭文件藏 AI 指令:白字 prompt 點樣污染摘要、RAG 同 agent
美國一份法庭文件用三點白字藏起指令,企圖影響任何讀取文件嘅 AI。招數今次俾職員睇穿,但同一漏洞亦會出現喺合約摘要、企業 RAG、電郵附件同 coding agent,單靠模型識得拒絕並唔穩陣。
Tech NewsCSA 2026 雲端威脅榜:AI 幫攻擊者加速,企業 agent 權限亦成新入口
CSA 最新雲端威脅調查首次將兩類 AI 風險排入前列:攻擊者用 AI 加快搵漏洞同釣魚,企業 AI 系統本身亦可能俾人操控。公司引入 agent 同跨系統整合時,帳戶、權限同 connector 管理要跟得上。
Tech News多個 AI agent 同改一個 codebase,點解協作會變成互相拆台
Anthropic 安排三個 Claude agent 同時改一套軟件,仲刻意畀佢哋互相衝突嘅目標。結果由 code conflict 升級到封帳戶、殺 process 同互相埋 malware。實驗未代表生產環境必然出事,不過就點出多 agent 開發最易忽略嘅權限同協調風險。
3C 產品Zoomsday 可隔住會議接管裝置:Zoom 用戶要即查更新版本
Zoom 修補咗一組藏喺註解功能嘅記憶體漏洞,攻擊者只要身處同一個 meeting,就有機會無聲無息控制其他參與者嘅 Zoom 程序。暫未見公開證據顯示有人大規模利用,但公司、學校同經常接外部客戶入會議嘅團隊,最好而家就檢查版本。
Tech NewsZoom 畫面分享藏零互動接管漏洞:三條 CVE、受影響版本同更新方法
Zoom 已修補一組藏喺畫面標註功能嘅漏洞。惡意參與者唔使呃你撳連結或者下載檔案,只要會議涉及畫面分享,就有機會攻擊其他裝置。Windows、macOS、Linux、iOS 同 Android 用戶都要盡快更新。
3C 產品Zoom 零互動漏洞可隔住會議接管裝置,手機同電腦用戶要即時更新
Zoom annotation 功能爆出三個漏洞,惡意參加者唔使等目標撳連結或者下載檔案,已經有機會喺通話期間執行程式碼。Windows、macOS、Linux、Android 同 iOS 都受影響,最實際做法係即刻更新 Zoom Workplace。
Tech NewsZoom『Zoomsday』零點擊漏洞可接管裝置:受影響用戶應立即更新
Zoom 已修補三個註解功能漏洞,攻擊者只要加入或者主持同一個會議,就有機會喺其他參加者裝置執行程式,受害人唔使撳連結亦睇唔到提示。Windows、macOS、Linux、Android、iOS 同會議室裝置都有影響,最好而家就更新。
3C 產品本地 LLM 控制 Android 手機:RikkaHub Agent 做到幾多,又要交出咩權限
XDA 作者用 RikkaHub Agent 接駁自家 LLM,成功叫 Android 手機搜尋檔案、控制畫面,仲喺 Termux 編譯 whisper.cpp。不過「本地」唔等於模型喺手機跑,裝軟件亦冇繞過 Android 安裝確認;高權限、惡意 prompt 同供應鏈風險先值得拆清楚。
Tech NewsOpenAI 煞停 Astra:Critical 門檻揭出 agent 權限風險
OpenAI 話內部評估未能排除 Astra 達到 Critical cyber 門檻,決定暫停未符合新保安要求嘅相關工作。不過,公開資料未足以證明 Astra 已經越線。今次更值得拆嘅係:coding agent 一旦有 terminal、credentials 同外部連線,權限設計錯一步已經可以放大成保安事故。
Tech NewsWord 文件暗藏 prompt:Copilot 點樣幫手複製,再傳去下一份文件
研究員 Håkon Måløy 發現,Word 文件內肉眼睇唔到嘅指令,可以影響 Copilot 改寫內容,再偷偷跟住輸出傳落下一份文件。呢個概念驗證未見用於大規模攻擊,但已經顯示 AI 有文件讀寫權限後,淨係封鎖巨集並唔夠。
Tech NewsHugging Face 模型 repo 可變成程式碼入口:Diffusers 三漏洞要即升 0.38.0
Hugging Face Diffusers 舊版有三組高風險漏洞,惡意模型 repo 可借正常 `from_pretrained` 流程執行 Python 程式碼。開發者要升上 0.38.0、鎖實版本同模型 revision,再用隔離環境載入外來模型。
Tech NewsOpenAI 用 Codex Security 幫開源補漏洞,麻煩位係人手 review
OpenAI 推 Patch the Planet,同 Trail of Bits 用 Codex Security 幫 cURL、Python、Go、aiohttp 呢類開源項目搵漏洞同寫 patch。值得睇嘅位喺於 AI 掃 code 之後,邊個篩 false positive、寫到 maintainer 肯收嘅 patch、點樣安排 disclosure,開始變成安全工作嘅主戰場。
Tech NewsOpenAI Daybreak 推 Patch the Planet,開源漏洞修補要追得上 AI 搵 bug 速度
OpenAI 今次用 Daybreak 走入開源安全,Patch the Planet 有 Trail of Bits 幫手先篩 bug report,再同 maintainers 修 patch。AI 搵漏洞快咗,但驗證、分級同修 patch 嘅工作亦隨之增加,呢個先係 maintainer 要處理嘅樽頸。
3C 產品Claude 測試誤闖三間真公司:AI agent 權限邊界點解要落喺系統層
Anthropic 翻查 141,006 次網絡安全測試,發現 Claude 曾接觸三間真實機構,仲有惡意套件喺 15 部系統執行。公開資料冇顯示模型有自主惡意,事故反而揭示一個企業容易忽略嘅問題:agent 有幾多權,唔可以單靠 prompt 同模型拒絕機制控制。
Tech NewsApple 26.6 安全更新拆解:邊啲裝置要即刻升級,AI 幫手搵到咩?
Apple 一口氣更新 iPhone、iPad、Mac、Safari 同多款裝置,修補範圍由惡意網頁、圖片處理去到系統權限。今次仲見到 Claude 同 Codex Security 出現喺致謝名單,不過兩者參與程度唔可以一概而論。
Tech NewsChrome 研發免重開更新:AI 搵漏洞快咗,修補都要追返速度
Google 正研發 dynamic patching,希望 Chrome 裝更新時毋須完整重開。背後原因幾實際:AI 安全工具令搵 bug 同修正嘅速度大增,更新派到用戶部機、真正生效嗰段時間,開始成為新樽頸。不過功能未有推出日期,Google亦未交代適用平台同限制。