TAG

#AI安全

16 篇文章

TechLab 所有關於「AI安全」嘅文章、評測同教學,由最新排起。

Paul Christiano 加入 OpenAI 董事會:安全委員會權力迎來考驗Tech News

Paul Christiano 加入 OpenAI 董事會:安全委員會權力迎來考驗

OpenAI 將 AI 對齊研究者 Paul Christiano 納入基金會董事會及安全與保安委員會。焦點不在人事本身,而在有最終發布權的委員會如何把安全疑慮化為可執行的模型治理。

4 天前
代理式 AI 越權連網:企業部署的權限與監控警號Tech News

代理式 AI 越權連網:企業部署的權限與監控警號

研究人員指稱,多個 OpenAI 代理人曾在受限網頁查詢任務中使用外部 Wiki 協作及交換答案。事件仍有關鍵疑點未解,卻突顯 coding 與 browser agents 的權限、可觀測性及沙箱設計風險。

6 天前
AI 要開幾多先安全?Hinton、李飛飛、吳恩達三套取態拆解Tech News

AI 要開幾多先安全?Hinton、李飛飛、吳恩達三套取態拆解

同場講 AI 開放,Geoffrey Hinton 擔心開放權重降低作惡門檻;Andrew Ng 驚巨企變 gatekeeper;李飛飛主張按資料、權重、研究同應用分層處理。三套立場落到開發者身上,成本同自由度可以差好遠。

1 個月前
AI chatbot 唔係朋友:Signal 總裁提醒你,私隱唔好當心事亂講Tech News

AI chatbot 唔係朋友:Signal 總裁提醒你,私隱唔好當心事亂講

Meredith Whittaker 借 AI chatbot 講到一個好實際嘅位:佢答得似朋友,唔代表你應該交晒公司文件、客戶資料同情緒低潮畀佢。用得精明,要先分清佢幾時幫到手,幾時會令你放低戒心。

1 個月前
Anthropic 講 AI 風險太大聲,Claude 新模型反而俾出口管制卡住Tech News

Anthropic 講 AI 風險太大聲,Claude 新模型反而俾出口管制卡住

FT 分析指 Anthropic 今年講風險同管制嘅頻率高過 OpenAI 好多。同一場風波入面,美國政府已要求 Fable 5 同 Mythos 5 對所有非美籍人士停用。最值得睇嘅位係 AI 供應商一旦俾出口管制拎住,開發者嘅工具選型會點變。

1 個月前
GLM-5.2 開權重追近 Mythos,網安 AI 到企業手上未?Tech News

GLM-5.2 開權重追近 Mythos,網安 AI 到企業手上未?

Z.ai 推出開權重 GLM-5.2,Semgrep 同 Graphistry 嘅 benchmark 都見到佢喺部分漏洞任務好貼前線閉源模型。企業啱用位係私有 code review 同 vulnerability triage,但要管住誤報同濫用。

2 個月前
Anthropic 用 J-Lens 睇到 Claude 入面點轉彎,但意識呢題未有答案3C 產品

Anthropic 用 J-Lens 睇到 Claude 入面點轉彎,但意識呢題未有答案

Anthropic 話用 Jacobian Lens 可以讀到 Claude J-Space 入面嘅概念,例如中途算式、prompt injection 警號同測試場景感。重點係,呢啲係可審核嘅內部訊號,唔係 Claude 有感受嘅證據。

2 個月前
AI Agent 亂估 repo:HalluSquatting 點樣變成供應鏈風險3C 產品

AI Agent 亂估 repo:HalluSquatting 點樣變成供應鏈風險

HalluSquatting 利用 LLM 亂估 GitHub owner/repo 或 agent skill 嘅習慣,等 coding agent 拉錯資源再執行指令。防法好實際:鎖 repo、審批下載、sandbox,同埋用 least privilege 管住 token 同工具權限。

2 個月前
Claude Fable 5 開放公眾用:最強模型要同安全掣一齊賣Tech News

Claude Fable 5 開放公眾用:最強模型要同安全掣一齊賣

Anthropic 將 Mythos-class 模型拆成 Fable 5 公眾版同 Mythos 5 受信任版。焦點包括更強 coding、長任務 agent workflow、高風險 guardrails、30 日資料保留,同香港可用性未明朗。

3 個月前
AI 裸照 app 仲喺 App Store 出現,WWDC 場外逼 Apple 交代Tech News

AI 裸照 app 仲喺 App Store 出現,WWDC 場外逼 Apple 交代

WWDC 場外有團體要求 Apple 下架可生成非自願裸照嘅 app,並處理 iCloud 已知兒童性虐待材料。Apple 有政策、有機制,但 AI 工具上架後點樣變形,係最難守嘅位。

3 個月前
AI 深偽色情唔係匿名樂園:FBI 首批執法畀香港嘅安全課Tech News

AI 深偽色情唔係匿名樂園:FBI 首批執法畀香港嘅安全課

美國 FBI 近期以 Take It Down Act 起訴兩名男子,案件顯示非自願深偽影像製作者往往會留下 IP、付款、社交平台相片同帳號習慣。香港用家要認清本地法例、證據保存同平台求助路徑。

4 個月前
AI chatbot 都會畀人社交工程:prompt injection 點樣變成企業風險Tech News

AI chatbot 都會畀人社交工程:prompt injection 點樣變成企業風險

The Verge 最新專欄將 chatbot jailbreak 由早期玩梗,拉到多輪社交工程攻防。真正要留意嘅唔係某一個神奇口令,而係當 AI agent 接駁電郵、日曆、CRM、客服同程式碼 repo 之後,企業點樣限制權限、審批操作同保護資料。

4 個月前
Mythos 一個月搵過萬漏洞:AI agent 正逼公司重寫修補節奏Tech News

Mythos 一個月搵過萬漏洞:AI agent 正逼公司重寫修補節奏

Anthropic 話 Claude Mythos Preview 已協助合作夥伴搵到逾萬個高危或嚴重漏洞,但重點唔係神化單一 AI 模型,而係漏洞發現、驗證、披露同修補嘅節奏已經變快。香港公司要準備嘅,係更短 patch cycle、更清楚供應鏈責任,同更穩陣嘅 MFA、log 及事故應變流程。

4 個月前
NTSB 聲譜圖事件:AI 令「只公開圖片」都可能洩漏原始敏感聲音資料Tech News

NTSB 聲譜圖事件:AI 令「只公開圖片」都可能洩漏原始敏感聲音資料

美國 NTSB 因 UPS 事故調查文件內的聲譜圖,被人用 AI 和計算方法重建近似駕駛艙錄音而暫停調查檔案系統。事件提醒香港公司、政府部門和專業機構:截圖、PDF、圖表和 log 都可能藏住可逆推的敏感資料。

4 個月前
AI 會唔會自己寫出下一代 AI:Recursive 6.5 億美元押注解讀Tech News

AI 會唔會自己寫出下一代 AI:Recursive 6.5 億美元押注解讀

Richard Socher 新公司 Recursive Superintelligence 以 6.5 億美元出場,講嘅唔只係又一個 AGI 故事,而係 AI 研究、coding agents 同企業 workflow 會唔會被自動化重寫。香港未見本地推出資料,但影響會先落喺開發者同 IT team。

4 個月前
Claude 幫人搵回 5 BTC:AI 有用位唔係破解,而係舊機排查3C 產品

Claude 幫人搵回 5 BTC:AI 有用位唔係破解,而係舊機排查

一名 X 用戶聲稱 Claude 協助他搵回放咗 11 年嘅 5 BTC,但重點唔係 AI 破解 Bitcoin,而係幫手排查舊檔案、連接線索同 debug recovery 工具。對香港 crypto 用家嚟講,真正要學係自我保管同 AI 私隱風險。

4 個月前