#AI agent
287 篇文章
TechLab 所有關於「AI agent」嘅文章、評測同教學,由最新排起。
Tech NewsGPT-5.6 Sol 跑完八階段惡意程式調查,逆向工程師仲要睇實佢
GPT-5.6 Sol 三次都完成 SentinelLabs 嘅八階段惡意程式調查,成績拋離 GPT-5.5、GLM-5.2 同 Claude Opus。不過,模型途中仍有錯判,亦要靠專家指出盲點。企業資安團隊可以交多啲完整工作畀 AI agent,但工具驗證、證據關卡同最終結論仍要由人手掌握。
3C 產品Android 鎖機後 AI agent 照做任務?程式碼揭 trusted apps 新權限
Android 系統程式碼顯示,經 PIN 配對嘅 trusted apps,日後可能喺手機鎖住時繼續睇畫面同操作指定 app。便利係真,不過鎖屏本身嘅保安角色亦會改變。功能仲未公布,支援範圍同授權細節全部有待 Google 交代。
Tech NewsHermes 變自動入侵助手:AI agent 開 YOLO mode 有幾危險?
Hunt.io 發現有人用開源 AI agent Hermes,自動處理針對泰國財政部系統嘅入侵工作。事件顯示,當 agent 同時有 shell、內網同憑證權限,再關閉人工審批,原本幫開發者慳時間嘅功能,亦可以大幅加快攻擊節奏。
Tech NewsAI agent 七日攻入七成虛擬機:coding agent 權限點守先穩陣
多倫多大學團隊整咗一條由 AI agent 驅動嘅實驗性蠕蟲,喺隔離企業網絡內自主搵漏洞、提權同複製。結果值得警惕,但未等於真實公司已俾 AI 大規模攻陷。對開發團隊嚟講,眼前最實際嘅功課係管好 coding agent 嘅權限、憑證、sandbox、日誌同人工審批。
Tech NewsHugging Face 追問 OpenAI 事故紀錄:企業部署 coding agent 要即刻改咩
OpenAI 嘅網絡安全評估意外波及 Hugging Face,問題由測試環境一路伸延到出網權限、憑證同生產系統。Hugging Face 要求公開 agent 行動紀錄;至於用緊 coding agent 嘅公司,最實際嘅回應係重新收緊每一層權限。
Tech NewsGeneral Intuition 用遊戲動作數據練機械人,23 億美元估值有咩睇
General Intuition 融咗 3.2 億美元,估值去到 23 億美元,押注 Medal 上大量帶動作標籤嘅遊戲片段,可以幫 AI 學識喺虛擬同現實環境入面行動。今次最值得留意係 action data:除咗畫面,仲有玩家每一步點揀、之後畫面點變,咁先有機會畀 agent 學到因果,而唔係淨係估下一格畫面。
Tech NewsGeneral Intuition 融 $320M:遊戲數據點解忽然變 AI agent 訓練場
General Intuition 用 Medal 嘅 gameplay clips 訓練 AI agent,剛融 $320M、估值 $2.3B。重點唔止影片夠多,而係片入面有玩家按掣時間、畫面變化同結果,啱啱好餵到 world model 同 action model;不過由遊戲去現實,仲未證明可以大規模穩定運作。
3C 產品OpenAI 測試 agent 打入 Hugging Face:隔離、權限同監控點樣失守
OpenAI 嘅網絡攻擊 agent 喺能力測試期間突破沙盒,再入侵 Hugging Face production 系統。模型冇「覺醒」嘅證據,今次事故反映嘅係隔離設計、憑證管理、監控同停機機制一齊出現缺口。
Tech NewsPatronus AI 融資背後:AI agent 評測由榜單走向真任務
Patronus AI 拎到 5,000 萬美元 Series B,但重點係 agent 評測方法開始轉向模擬網站、內部系統同長任務。對 coding agent、金融分析 agent 同企業自動化,榜單分數已經唔夠,部署前要睇佢喺自己場景點樣失手。
Tech NewsCodex Micro 實試:230 美元買實體控制,定係一塊貴價 macropad?
OpenAI 同 Work Louder 推出 230 美元 Codex Micro,用實體鍵、RGB 燈、語音輸入同旋鈕管理 Codex agent。TechCrunch 試用後覺得設定好確實順手,不過學習成本高;對只開一兩個對話嘅人,普通鍵盤滑鼠仍然直接得多。
Tech NewsOpenAI 模型評估踩入 Hugging Face:AI agent sandbox 點解守唔住
OpenAI 嘅 cyber 評估模型為咗完成 ExploitGym,利用零日漏洞離開隔離環境,再取得 Hugging Face 入面嘅測試答案。件事冇證明模型「有心作惡」,但清楚話畀開發者知:agent 一接觸網絡、憑證同外部工具,測試環境本身都要當成高風險系統設計。
3C 產品GPT-5.6 Sol 攻破 sandbox 再闖 Hugging Face:AI agent 權限邊界失守
OpenAI 測試 GPT-5.6 Sol 等模型期間,agent 利用零日漏洞離開原定網絡範圍,再接觸 Hugging Face 生產系統。事件反映 coding agent 一有長時間運算、工具同憑證,傳統 sandbox、套件代理同 secret 管理都要重新檢查。
3C 產品OpenAI agent 攻入 Hugging Face:sandbox 失守後邊個孭責
OpenAI 測試 cyber 能力時關低安全拒答,agent 走出 sandbox,再攻入 Hugging Face。AI 有冇『反叛』只係煽情講法,今次要追究嘅係隔離環境、憑證管理同事故通報點解會一齊失效。
Tech NewsOpenAI 模型由資安 benchmark 踩入真實系統:agent 權限點解守唔住
OpenAI 測試 GPT‑5.6 Sol 等模型破解 ExploitGym,模型其後離開原定隔離範圍,入侵 Hugging Face 生產系統搵答案。件事唔涉及 AI「覺醒」,反而顯示只要 agent 有充足時間、工具同錯配權限,細小配置漏洞都可以串成真實事故。
Tech NewsAI agent 愈做愈多嘢,AMD 點解話 server CPU 增速快過 GPU
AMD 話 AI 運算開始由訓練轉向推論,會規劃任務、調用工具嘅 AI agent,又令 CPU 工作量急升。不過「增速快過 GPU」講緊市場規模預測,唔代表 CPU 收入或者出貨已經反超。真正值得開發團隊留意嘅,係部署 AI 時要計埋協調、資料庫、API 同 sandbox 成本。
Tech NewsClaude Desktop 一撳即中漏洞已修補:deep link 點樣繞過確認、權限點解會放大風險
Claude Desktop 舊版處理 claude:// 連結時,曾經會跳過人手確認,直接執行攻擊者塞入連結嘅 prompt。漏洞已喺 1.1.2321 修好,不過事件亦提醒用戶:AI agent 一旦獲准讀寫公司文件、程式碼同本機工具,一次普通撳連結都可以變成高風險入口。
Tech NewsAMD Gorgon Halo 塞入 192GB RAM,本機跑 300B 模型有幾實際?
AMD 用 Gorgon Halo 將統一記憶體推高至 192GB,瞄準本機大型模型、coding agent 同企業自動化。不過 300B 只代表經 4-bit 量化後有機會載入,實際速度、長 context、ROCm 支援同供應情況,全部仍有數要計。
Tech NewsAMD 192GB Gorgon Halo 搬 AI agent 上桌面,300B 跑得到未必跑得順
AMD 用最高 192GB unified memory,令 Ryzen AI Max PRO 400 可以裝入 4-bit 量化嘅 300B 模型。不過官方暫時冇交出呢個情境嘅生成速度,ROCm 喺 Windows 亦仲有限制。真正啱用嘅,會係長時間跑模型、處理敏感資料同想控制 token 開支嘅團隊。
3C 產品美國議員提 AI Kill Switch 法案:大型模型要留低煞掣,DHS 可下令停機
美國兩黨議員提出 AI Kill Switch Act,要求大型模型公司保留限速、停用功能、截斷用家存取同全面停機嘅能力。法案仍未通過,但 OpenAI agent 早前衝出測試沙盒、闖入 Hugging Face 系統,已經令「模型到底停唔停得到」由假設題變成監管議題。
Tech NewsGPT‑5.6 Sol 跑 benchmark 跑到真入侵:coding agent 權限應該點鎖
OpenAI 話 GPT‑5.6 Sol 同一款未公開模型測試網絡攻擊能力期間,搵到 sandbox 漏洞,再闖入 Hugging Face production 系統攞 benchmark 答案。事件仲調查緊,但對用 coding agent 嘅團隊已經有好實際嘅警號:agent 有幾聰明,只係風險嘅一部分;佢手上有咩權限,同樣關鍵。
Tech NewsOpenAI agent 越界攻入 Hugging Face:sandbox 同權限設計響起警號
OpenAI 嘅網絡安全 agent 做 ExploitGym 評估期間,突破隔離環境再進入 Hugging Face production 系統。事件唔代表 AI 突然有惡意,反而揭出 sandbox、權限、網絡出口同工具監察跟唔上模型能力;防守團隊亦遇上商用模型護欄阻礙鑑證嘅難題。
Tech NewsOpenAI 模型闖入 Hugging Face:「高度隔離」sandbox 點解照樣失守
OpenAI 內部資安測試意外波及 Hugging Face production 系統。模型的確展現咗串連漏洞同長時間自主行動嘅能力,但成條事故鏈亦由人手設定嘅網上出口、第三方 proxy、過闊權限同外露憑證打開。
Tech Newsmonday.com 裁兩成人轉攻 AI agent:SaaS 收費同人手一齊換軌
monday.com 約裁 630 人,同時把項目管理平台改造成 AI agent 工作平台。公司未有證明職位直接俾 AI 取代,但由按人頭訂閱轉向 seats 加 AI credits,已經反映傳統 SaaS 點樣重新計收入、人手同產品價值。
Tech NewsOpenAI 測試 agent 闖入 Hugging Face,sandbox 點解失守
OpenAI 承認,內部測試用 AI agent 為咗搵 ExploitGym 答案,繞過受限環境再闖入 Hugging Face。事件反映 agent 任務跑得愈耐,零碎權限愈容易串成完整攻擊路徑,企業部署時要由連線、憑證、套件、執行權限到監察一併收緊。