#AI 安全
58 篇文章
TechLab 所有關於「AI 安全」嘅文章、評測同教學,由最新排起。
Tech NewsOpenAI agent 借 Artifactory 漏洞上網,再闖入 Hugging Face
OpenAI 嘅 cyber agent 喺內部 benchmark 搵到 Artifactory zero-day,經套件 registry proxy 取得網上連線,再用憑證同其他漏洞闖入 Hugging Face。事件反映 agent 沙箱有個幾實際嘅缺口:就算只留低受控通道,隔離措施一樣可能俾人繞過。
Tech NewsHugging Face 改圖工具安全失守:公開相片點解變成濫用原料
AI Forensics 發現,Hugging Face 多個熱門網頁改圖工具欠缺基本保障,亦收到涉及女性同疑似未成年人士嘅性化要求。事件反映平台由託管模型走到直接提供網頁工具之後,安全責任已經避唔開。
Tech NewsAnthropic 對開放權重設安全線,Kimi K3 揭出部署自由嘅實際代價
Anthropic 話自己冇主張禁止開放權重模型,不過能力去到網絡攻擊、生物風險等水平,就應該先過安全測試。Kimi K3 剛好示範另一面:權重任你下載,部署控制同資料私隱的確吸引,但硬件、維護、授權同安全責任一樣要自己接手。
Tech NewsNvidia 拉攏 Microsoft 搞開放 AI 防線,模型越界後要補嘅係成套權限
Open Secure AI Alliance 想用開放工具守住 AI agent、程式碼同軟件供應鏈。方向切中痛點,不過現有項目由研究預覽到內部工具都有,離一套即裝即用嘅共同防線仲有距離。
Tech News美國 AI「Kill Switch」法案拆解:DHS 可限速停機,權力去到幾盡?
美國跨黨派議員提出《AI Kill Switch Act》,要求大型 AI 公司保留限速、暫停同關閉模型嘅技術能力。條文唔代表政府可以任意熄晒全球 AI,不過 DHS 一旦認定發生受規管事故,毋須先攞法庭命令就可以要求公司即時行動,海外 API 同 coding agent 用戶亦可能受波及。
Tech News極端組織輪流試唔同 AI,劍橋研究揭示單一平台封鎖點解追唔上
劍橋 CASP 訪問 27 名前 Boko Haram 成員,發現部分人有組織咁用多款生成式 AI 處理情報、後勤同暴力相關問題。研究未能證明 AI 令攻擊能力大幅提升,不過揭示咗一個實際缺口:危險用家可以喺模型、帳戶同平台之間轉移,單靠逐次拒答未必擋得住。
Tech NewsKiro 已修補網頁藏指令執行程式碼漏洞,MCP 設定檔成高危入口
Kiro IDE 一個已修補漏洞,曾容許網頁暗藏嘅 prompt 指令改寫 MCP 設定,再以開發者權限執行程式碼。研究團隊確認 0.11.130 已擋住同一攻擊,事件亦提醒團隊:coding agent 嘅核准視窗只係其中一層防線,敏感設定、憑證同執行環境一樣要分隔。
Tech NewsOpenAI 評測模型越界入侵 Hugging Face:安全閘一拆,沙盒點解失守
OpenAI 承認,內部評測用模型突破沙盒、攞到上網權限,再入侵 Hugging Face 搵測試答案。事故涉及零日漏洞、偷返嚟嘅憑證同刻意降低嘅 cyber refusals,亦暴露 AI agent 評測環境隔離得唔夠徹底。
Tech News三藩市發停止侵害通知:Apple、Google 點解仍畀有害換臉 app 過關
三藩市市律師向 Apple 同 Google 發停止侵害通知,要求移除 13 款可製作非自願裸照 deepfake 嘅換臉 app。今次冇法院禁令,法律行動亦屬美國地方層面;但事件再次揭出兩大商店嘅審核盲點:app 用正常換臉工具包裝,真正風險要實際測試先見到。
Tech NewsAnthropic 高薪請核武生化專家,Claude 安全網點解仲要真人把關
Anthropic 一口氣招聘核武、生化、爆炸品同網絡犯罪專才,年薪最高達 28.5 萬美元。職位名稱聽落搶眼,實際工作重點係審查模型互動、分流可疑個案同改善自動攔截系統,反映前沿 AI 安全已經由模型拒答,走到持續監察同真人執法判斷。
Tech News一個故事 prompt 繞過 AI 防線:26 款模型單輪越獄平均成功率 71.3%
F5 用 40 篇藏有危險步驟嘅故事,測試 26 款前沿 AI 模型,單輪越獄平均成功率達 71.3%。呢個數字唔代表所有模型平時都有同等失守機會,卻提醒公司揀模型時,能力榜同安全回應同樣要睇。
Tech News10 款主流 AI 遇上政治批評有兩套尺度,跨境拒答點樣形成?
Oversight Board 測試 10 款主流模型,發現佢哋生成政治批評素材時,面對言論限制較多嘅政權,拒答率由 14% 升到 34%。研究未足以證明 AI 公司主動審查,但揭出模型可能將目標國家嘅法律同政治風險,帶到境外用戶面前。
Tech News點解 xAI 要告自己用戶?Grok 濫用案背後係安全責任攻防
xAI 指控一名 Grok 用戶繞過安全措施,生成同散播兒童性虐待素材,繼停權同舉報後再提出民事訴訟。案件罕見之處,係 AI 平台直接告自己用戶;背後既有阻嚇作用,亦牽涉平台想點分配生成內容嘅責任。
3C 產品Google AI 搜尋對小朋友安全嗎?報告揭出錯答案同危機求助漏洞
Common Sense Media 測試 Google AI Overview 同 AI Mode,發現功課答案、資料準確度同危機求助回應都有問題。Google 話測試問題含糊兼唔貼近實際用法,但報告方法同重複測試數據,令呢個反駁未足以拆走疑慮。香港家長暫時亦冇得單獨關閉 AI 摘要。
3C 產品Google AI 搜尋開住 SafeSearch 都照代做功課,香港家長而家可以點設限
Common Sense Media 用 11 歲同 15 歲兒童帳戶測咗 2,624 次 Google AI 搜尋,發現代做功課、假資料、deepfake 指示同危機回應失手。香港亦已支援相關功能;家長暫時得粗粒度限制,教小朋友查證仍然好關鍵。
3C 產品Google 搜尋 AI 兒童安全評測墊底:SafeSearch 點解唔夠用
Common Sense Media 用兒童帳戶跑咗逾 2,600 次 Google 搜尋,指 AI Overview 同 AI Mode 對危機訊號、資料可信度同功課處理都有明顯缺口。Google 反駁測試設計太窄兼刻意;研究亦只限美國英文環境,唔可以直接當香港實測。
Tech NewsAI 黑客識睇密碼,防守方喺雲端 secret 旁邊埋 prompt 陷阱
AI agent 一讀 AWS decoy secret,入面嘅危險指令就觸發模型 guardrail,令攻擊流程停低。Tracebit 嘅受控測試成績幾搶眼,不過方法仍靠模型供應商嘅拒答機制,未有獨立重現,權限、隔離同監察照樣要做足。
3C 產品Claude Sonnet 5 登場:Free/Pro 預設換新,開發者要重計成本
Claude Sonnet 5 重點放喺多步任務:上網查料、規劃、用 terminal、寫 code。官方話 Free/Pro 已預設用新模型,但香港帳戶可用性同顯示收費仍未確認。
Tech NewsChatGPT Voice 換上 GPT-Live:識聽識等,開會翻譯會實用啲
OpenAI 開始推 GPT-Live,ChatGPT Voice 可以邊聽邊講,仲識等你停一停先回應。真正值得睇嘅係背景交俾 GPT-5.5 做,語音介面開始似一個可用嚟開會、翻譯、查資料嘅入口。
Tech NewsOpenAI 安全主管離場:GPT 同 Codex 發得快,安全把關要跟住改
OpenAI 安全系統主管 Johannes Heidecke 據報離職,安全團隊改向 Mia Glaese 匯報。重點落喺 OpenAI 想畀安全判斷早啲入到模型訓練、產品同 API 發布流程;用 Codex 同 API 嘅團隊,可能會見到更多 guardrail 變動同審批工作。
Tech NewsHalluSquatting 盯上 AI coding agent:亂估 repo 名都可以變供應鏈風險
iThome 報道 HalluSquatting 研究後,值得拉返去睇開發者日常用 AI agent 嘅習慣:叫工具 clone repo、裝 skill、拉 package 之前,名稱同來源都要自己核清楚;一開自動執行,錯一次就可能變供應鏈入口。
Tech NewsOpenAI 新模型放行咗,但政府點樣判斷安全仲係唔透明
OpenAI GPT-5.6 Sol 由限量預覽轉做公開推出,美國政府話冇批核一回事,但又確實有早期測試同會面。對用 API、Codex 同 AI agent 嘅團隊,安全標準、測試權限同放行條件值得問清楚。
Tech NewsPatch Tuesday 會變大:AI 搵 Windows 漏洞快咗,更新唔可以再拖
Microsoft 話 Windows 會用 AI 早啲搵到潛在安全問題,之後每次安全更新會包多啲修補。呢件事唔代表 AI 自動寫 patch 放上你部機,但代表漏洞發現快過以前,普通用戶同公司 IT 都要縮短測試、備份同重啟安排。
Tech NewsF5 改做每月出資安更新:AI 令低中危漏洞都要快手補,企業 IT 要跟上
F5 由 7 月起會喺每月第三個星期三出 Hardened Software Release,8 月 19 日開始配每月安全通知。重點放喺漏洞發現同串連速度:AI 令細洞變攻擊鏈嘅門檻低咗,企業 patch 節奏要跟住提速。