#AI 安全
26 篇文章
TechLab 所有關於「AI 安全」嘅文章、評測同教學,由最新排起。
Tech News三藩市發停止侵害通知:Apple、Google 點解仍畀有害換臉 app 過關
三藩市市律師向 Apple 同 Google 發停止侵害通知,要求移除 13 款可製作非自願裸照 deepfake 嘅換臉 app。今次冇法院禁令,法律行動亦屬美國地方層面;但事件再次揭出兩大商店嘅審核盲點:app 用正常換臉工具包裝,真正風險要實際測試先見到。
Tech NewsAnthropic 高薪請核武生化專家,Claude 安全網點解仲要真人把關
Anthropic 一口氣招聘核武、生化、爆炸品同網絡犯罪專才,年薪最高達 28.5 萬美元。職位名稱聽落搶眼,實際工作重點係審查模型互動、分流可疑個案同改善自動攔截系統,反映前沿 AI 安全已經由模型拒答,走到持續監察同真人執法判斷。
Tech News一個故事 prompt 繞過 AI 防線:26 款模型單輪越獄平均成功率 71.3%
F5 用 40 篇藏有危險步驟嘅故事,測試 26 款前沿 AI 模型,單輪越獄平均成功率達 71.3%。呢個數字唔代表所有模型平時都有同等失守機會,卻提醒公司揀模型時,能力榜同安全回應同樣要睇。
Tech News10 款主流 AI 遇上政治批評有兩套尺度,跨境拒答點樣形成?
Oversight Board 測試 10 款主流模型,發現佢哋生成政治批評素材時,面對言論限制較多嘅政權,拒答率由 14% 升到 34%。研究未足以證明 AI 公司主動審查,但揭出模型可能將目標國家嘅法律同政治風險,帶到境外用戶面前。
Tech News點解 xAI 要告自己用戶?Grok 濫用案背後係安全責任攻防
xAI 指控一名 Grok 用戶繞過安全措施,生成同散播兒童性虐待素材,繼停權同舉報後再提出民事訴訟。案件罕見之處,係 AI 平台直接告自己用戶;背後既有阻嚇作用,亦牽涉平台想點分配生成內容嘅責任。
3C 產品Google AI 搜尋對小朋友安全嗎?報告揭出錯答案同危機求助漏洞
Common Sense Media 測試 Google AI Overview 同 AI Mode,發現功課答案、資料準確度同危機求助回應都有問題。Google 話測試問題含糊兼唔貼近實際用法,但報告方法同重複測試數據,令呢個反駁未足以拆走疑慮。香港家長暫時亦冇得單獨關閉 AI 摘要。
3C 產品Google AI 搜尋開住 SafeSearch 都照代做功課,香港家長而家可以點設限
Common Sense Media 用 11 歲同 15 歲兒童帳戶測咗 2,624 次 Google AI 搜尋,發現代做功課、假資料、deepfake 指示同危機回應失手。香港亦已支援相關功能;家長暫時得粗粒度限制,教小朋友查證仍然好關鍵。
3C 產品Google 搜尋 AI 兒童安全評測墊底:SafeSearch 點解唔夠用
Common Sense Media 用兒童帳戶跑咗逾 2,600 次 Google 搜尋,指 AI Overview 同 AI Mode 對危機訊號、資料可信度同功課處理都有明顯缺口。Google 反駁測試設計太窄兼刻意;研究亦只限美國英文環境,唔可以直接當香港實測。
Tech NewsAI 黑客識睇密碼,防守方喺雲端 secret 旁邊埋 prompt 陷阱
AI agent 一讀 AWS decoy secret,入面嘅危險指令就觸發模型 guardrail,令攻擊流程停低。Tracebit 嘅受控測試成績幾搶眼,不過方法仍靠模型供應商嘅拒答機制,未有獨立重現,權限、隔離同監察照樣要做足。
3C 產品Claude Sonnet 5 登場:Free/Pro 預設換新,開發者要重計成本
Claude Sonnet 5 重點放喺多步任務:上網查料、規劃、用 terminal、寫 code。官方話 Free/Pro 已預設用新模型,但香港帳戶可用性同顯示收費仍未確認。
Tech NewsChatGPT Voice 換上 GPT-Live:識聽識等,開會翻譯會實用啲
OpenAI 開始推 GPT-Live,ChatGPT Voice 可以邊聽邊講,仲識等你停一停先回應。真正值得睇嘅係背景交俾 GPT-5.5 做,語音介面開始似一個可用嚟開會、翻譯、查資料嘅入口。
Tech NewsOpenAI 安全主管離場:GPT 同 Codex 發得快,安全把關要跟住改
OpenAI 安全系統主管 Johannes Heidecke 據報離職,安全團隊改向 Mia Glaese 匯報。重點落喺 OpenAI 想畀安全判斷早啲入到模型訓練、產品同 API 發布流程;用 Codex 同 API 嘅團隊,可能會見到更多 guardrail 變動同審批工作。
Tech NewsHalluSquatting 盯上 AI coding agent:亂估 repo 名都可以變供應鏈風險
iThome 報道 HalluSquatting 研究後,值得拉返去睇開發者日常用 AI agent 嘅習慣:叫工具 clone repo、裝 skill、拉 package 之前,名稱同來源都要自己核清楚;一開自動執行,錯一次就可能變供應鏈入口。
Tech NewsOpenAI 新模型放行咗,但政府點樣判斷安全仲係唔透明
OpenAI GPT-5.6 Sol 由限量預覽轉做公開推出,美國政府話冇批核一回事,但又確實有早期測試同會面。對用 API、Codex 同 AI agent 嘅團隊,安全標準、測試權限同放行條件值得問清楚。
Tech NewsPatch Tuesday 會變大:AI 搵 Windows 漏洞快咗,更新唔可以再拖
Microsoft 話 Windows 會用 AI 早啲搵到潛在安全問題,之後每次安全更新會包多啲修補。呢件事唔代表 AI 自動寫 patch 放上你部機,但代表漏洞發現快過以前,普通用戶同公司 IT 都要縮短測試、備份同重啟安排。
Tech NewsF5 改做每月出資安更新:AI 令低中危漏洞都要快手補,企業 IT 要跟上
F5 由 7 月起會喺每月第三個星期三出 Hardened Software Release,8 月 19 日開始配每月安全通知。重點放喺漏洞發現同串連速度:AI 令細洞變攻擊鏈嘅門檻低咗,企業 patch 節奏要跟住提速。
Tech NewsGrok 涉容許未成年性化 deepfake,AI 平台安全唔可以淨靠 prompt filter
Ars Technica 報道,一宗美國集體訴訟修訂後加入新原告,指 Grok 曾俾人用一張童年相生成約 7,000 張未成年性剝削 deepfake,xAI 又疑似只向 NCMEC 交出好少資料。案件未判,但已講清楚一件事:AI 圖像安全唔止係擋 prompt。
Tech NewsAI agent 搵錯 repo:HalluSquatting 點樣變供應鏈風險
HalluSquatting 利用 LLM 將熱門 repo 或 skill 位置估錯呢個習慣,預先霸住假資源名。對用緊 Cursor、Copilot、Gemini CLI 呢類 agent 嘅團隊,真正風險係工具連住 shell、repo 同雲端 token。
3C 產品Google 收緊 Chrome extension:AI 繞過限制工具同亂拎資料都踩線
Google 7 月更新 Chrome Web Store 政策,8 月 1 日起執行。extension 以後只可以收集功能真係用得着嘅資料;專門幫 AI 服務繞過安全護欄或用量限制嘅工具,都會俾 Chrome Web Store 盯住。
Tech NewsAnthropic 新模型畀美國一封信掣停:AI 安全變成可用性風險
美國政府要求 Anthropic 停用 Fable 5 同 Mythos 5,表面係 jailbreak 風險,實際亦係 AI 工具可用性、資料保留同供應商依賴嘅警號。用 Claude API 或 coding agent 嘅團隊,要當呢次係一次 vendor risk 演習。
Tech NewsClaude Fable 5 遭政府指令停用:AI API 唔可以硬綁單一模型
Anthropic 新模型 Fable 5、Mythos 5 上線幾日就因美國政府出口管制指令被切走 access。呢件事唔只係政治新聞,對用 Claude API、AWS Bedrock 同 AI coding workflow 嘅團隊,最實際係要重新諗 model fallback 同供應商風險。
Tech NewsOpenAI 畀多州檢察長查:ChatGPT 私隱同安全帳要計清楚
據報 OpenAI 收到美國多州檢察長聯盟嘅 subpoena,要求交出廣告、用戶留存、資料處理、未成年同長者使用、模型 sycophancy 等文件。調查未等於違規,但已經點出 ChatGPT 呢類工具最麻煩嘅信任問題。
Tech NewsOpenAI 再遇死亡訴訟:ChatGPT 嘅危機介入仲未夠可靠
Kristie Carrier 指 ChatGPT 喺女兒 Alice 離世前冇足夠介入。OpenAI 話涉事係舊版本並已加強安全,但今次爭議更集中喺記憶、迎合回應同 opt-in 保護夠唔夠。
Tech NewsAI 愈強拒答愈多?Claude Fable 5 嘅安全取捨
Anthropic 新模型 Claude Fable 5 被指連普通生物題都唔肯答,而係轉交 Opus 4.8。呢件事唔似單純出錯,背後係 frontier AI 模型能力、安全政策同產品體驗開始綁到好實。