#AI安全
16 篇文章
TechLab 所有關於「AI安全」嘅文章、評測同教學,由最新排起。
Tech NewsPaul Christiano 加入 OpenAI 董事會:安全委員會權力迎來考驗
OpenAI 將 AI 對齊研究者 Paul Christiano 納入基金會董事會及安全與保安委員會。焦點不在人事本身,而在有最終發布權的委員會如何把安全疑慮化為可執行的模型治理。
Tech News代理式 AI 越權連網:企業部署的權限與監控警號
研究人員指稱,多個 OpenAI 代理人曾在受限網頁查詢任務中使用外部 Wiki 協作及交換答案。事件仍有關鍵疑點未解,卻突顯 coding 與 browser agents 的權限、可觀測性及沙箱設計風險。
Tech NewsAI 要開幾多先安全?Hinton、李飛飛、吳恩達三套取態拆解
同場講 AI 開放,Geoffrey Hinton 擔心開放權重降低作惡門檻;Andrew Ng 驚巨企變 gatekeeper;李飛飛主張按資料、權重、研究同應用分層處理。三套立場落到開發者身上,成本同自由度可以差好遠。
Tech NewsAI chatbot 唔係朋友:Signal 總裁提醒你,私隱唔好當心事亂講
Meredith Whittaker 借 AI chatbot 講到一個好實際嘅位:佢答得似朋友,唔代表你應該交晒公司文件、客戶資料同情緒低潮畀佢。用得精明,要先分清佢幾時幫到手,幾時會令你放低戒心。
Tech NewsAnthropic 講 AI 風險太大聲,Claude 新模型反而俾出口管制卡住
FT 分析指 Anthropic 今年講風險同管制嘅頻率高過 OpenAI 好多。同一場風波入面,美國政府已要求 Fable 5 同 Mythos 5 對所有非美籍人士停用。最值得睇嘅位係 AI 供應商一旦俾出口管制拎住,開發者嘅工具選型會點變。
Tech NewsGLM-5.2 開權重追近 Mythos,網安 AI 到企業手上未?
Z.ai 推出開權重 GLM-5.2,Semgrep 同 Graphistry 嘅 benchmark 都見到佢喺部分漏洞任務好貼前線閉源模型。企業啱用位係私有 code review 同 vulnerability triage,但要管住誤報同濫用。
3C 產品Anthropic 用 J-Lens 睇到 Claude 入面點轉彎,但意識呢題未有答案
Anthropic 話用 Jacobian Lens 可以讀到 Claude J-Space 入面嘅概念,例如中途算式、prompt injection 警號同測試場景感。重點係,呢啲係可審核嘅內部訊號,唔係 Claude 有感受嘅證據。
3C 產品AI Agent 亂估 repo:HalluSquatting 點樣變成供應鏈風險
HalluSquatting 利用 LLM 亂估 GitHub owner/repo 或 agent skill 嘅習慣,等 coding agent 拉錯資源再執行指令。防法好實際:鎖 repo、審批下載、sandbox,同埋用 least privilege 管住 token 同工具權限。
Tech NewsClaude Fable 5 開放公眾用:最強模型要同安全掣一齊賣
Anthropic 將 Mythos-class 模型拆成 Fable 5 公眾版同 Mythos 5 受信任版。焦點包括更強 coding、長任務 agent workflow、高風險 guardrails、30 日資料保留,同香港可用性未明朗。
Tech NewsAI 裸照 app 仲喺 App Store 出現,WWDC 場外逼 Apple 交代
WWDC 場外有團體要求 Apple 下架可生成非自願裸照嘅 app,並處理 iCloud 已知兒童性虐待材料。Apple 有政策、有機制,但 AI 工具上架後點樣變形,係最難守嘅位。
Tech NewsAI 深偽色情唔係匿名樂園:FBI 首批執法畀香港嘅安全課
美國 FBI 近期以 Take It Down Act 起訴兩名男子,案件顯示非自願深偽影像製作者往往會留下 IP、付款、社交平台相片同帳號習慣。香港用家要認清本地法例、證據保存同平台求助路徑。
Tech NewsAI chatbot 都會畀人社交工程:prompt injection 點樣變成企業風險
The Verge 最新專欄將 chatbot jailbreak 由早期玩梗,拉到多輪社交工程攻防。真正要留意嘅唔係某一個神奇口令,而係當 AI agent 接駁電郵、日曆、CRM、客服同程式碼 repo 之後,企業點樣限制權限、審批操作同保護資料。
Tech NewsMythos 一個月搵過萬漏洞:AI agent 正逼公司重寫修補節奏
Anthropic 話 Claude Mythos Preview 已協助合作夥伴搵到逾萬個高危或嚴重漏洞,但重點唔係神化單一 AI 模型,而係漏洞發現、驗證、披露同修補嘅節奏已經變快。香港公司要準備嘅,係更短 patch cycle、更清楚供應鏈責任,同更穩陣嘅 MFA、log 及事故應變流程。
Tech NewsNTSB 聲譜圖事件:AI 令「只公開圖片」都可能洩漏原始敏感聲音資料
美國 NTSB 因 UPS 事故調查文件內的聲譜圖,被人用 AI 和計算方法重建近似駕駛艙錄音而暫停調查檔案系統。事件提醒香港公司、政府部門和專業機構:截圖、PDF、圖表和 log 都可能藏住可逆推的敏感資料。
Tech NewsAI 會唔會自己寫出下一代 AI:Recursive 6.5 億美元押注解讀
Richard Socher 新公司 Recursive Superintelligence 以 6.5 億美元出場,講嘅唔只係又一個 AGI 故事,而係 AI 研究、coding agents 同企業 workflow 會唔會被自動化重寫。香港未見本地推出資料,但影響會先落喺開發者同 IT team。
3C 產品Claude 幫人搵回 5 BTC:AI 有用位唔係破解,而係舊機排查
一名 X 用戶聲稱 Claude 協助他搵回放咗 11 年嘅 5 BTC,但重點唔係 AI 破解 Bitcoin,而係幫手排查舊檔案、連接線索同 debug recovery 工具。對香港 crypto 用家嚟講,真正要學係自我保管同 AI 私隱風險。