#AI 安全
58 篇文章
TechLab 所有關於「AI 安全」嘅文章、評測同教學,由最新排起。
Tech NewsGrok 涉容許未成年性化 deepfake,AI 平台安全唔可以淨靠 prompt filter
Ars Technica 報道,一宗美國集體訴訟修訂後加入新原告,指 Grok 曾俾人用一張童年相生成約 7,000 張未成年性剝削 deepfake,xAI 又疑似只向 NCMEC 交出好少資料。案件未判,但已講清楚一件事:AI 圖像安全唔止係擋 prompt。
Tech NewsAI agent 搵錯 repo:HalluSquatting 點樣變供應鏈風險
HalluSquatting 利用 LLM 將熱門 repo 或 skill 位置估錯呢個習慣,預先霸住假資源名。對用緊 Cursor、Copilot、Gemini CLI 呢類 agent 嘅團隊,真正風險係工具連住 shell、repo 同雲端 token。
3C 產品Google 收緊 Chrome extension:AI 繞過限制工具同亂拎資料都踩線
Google 7 月更新 Chrome Web Store 政策,8 月 1 日起執行。extension 以後只可以收集功能真係用得着嘅資料;專門幫 AI 服務繞過安全護欄或用量限制嘅工具,都會俾 Chrome Web Store 盯住。
Tech NewsAnthropic 新模型畀美國一封信掣停:AI 安全變成可用性風險
美國政府要求 Anthropic 停用 Fable 5 同 Mythos 5,表面係 jailbreak 風險,實際亦係 AI 工具可用性、資料保留同供應商依賴嘅警號。用 Claude API 或 coding agent 嘅團隊,要當呢次係一次 vendor risk 演習。
Tech NewsClaude Fable 5 遭政府指令停用:AI API 唔可以硬綁單一模型
Anthropic 新模型 Fable 5、Mythos 5 上線幾日就因美國政府出口管制指令被切走 access。呢件事唔只係政治新聞,對用 Claude API、AWS Bedrock 同 AI coding workflow 嘅團隊,最實際係要重新諗 model fallback 同供應商風險。
Tech NewsOpenAI 畀多州檢察長查:ChatGPT 私隱同安全帳要計清楚
據報 OpenAI 收到美國多州檢察長聯盟嘅 subpoena,要求交出廣告、用戶留存、資料處理、未成年同長者使用、模型 sycophancy 等文件。調查未等於違規,但已經點出 ChatGPT 呢類工具最麻煩嘅信任問題。
Tech NewsOpenAI 再遇死亡訴訟:ChatGPT 嘅危機介入仲未夠可靠
Kristie Carrier 指 ChatGPT 喺女兒 Alice 離世前冇足夠介入。OpenAI 話涉事係舊版本並已加強安全,但今次爭議更集中喺記憶、迎合回應同 opt-in 保護夠唔夠。
Tech NewsAI 愈強拒答愈多?Claude Fable 5 嘅安全取捨
Anthropic 新模型 Claude Fable 5 被指連普通生物題都唔肯答,而係轉交 Opus 4.8。呢件事唔似單純出錯,背後係 frontier AI 模型能力、安全政策同產品體驗開始綁到好實。
Tech NewsChatGPT Lockdown Mode 點防 prompt injection:開咗會犧牲咩功能
OpenAI 開始推出 Lockdown Mode,針對 prompt injection 引發嘅資料外洩風險,但代價係限制 web browsing、Deep Research、Agent Mode 同部分 connector 功能。香港用戶更要先留意官方支援地區。
Tech NewsWaymo 暫停高速無人車:工程路段同水浸先係商用硬仗
Waymo 因工程路段表現問題暫停多個城市 freeway 無人車服務,同時水浸亦觸發軟件召回。事件提醒香港:自動駕駛商用唔只係 AI 模型,仲係天氣、路面工程、遠端接管同監管邊界嘅壓力測試。