#AI agent
242 篇文章
TechLab 所有關於「AI agent」嘅文章、評測同教學,由最新排起。
Tech NewsGoogle AI 換帥後,Gemini API 同 agent 會見到咩轉變
Google DeepMind 日常營運交畀 Koray Kavukcuoglu,連模型研發、Gemini 產品同開發者團隊都放入同一條指揮線。呢次改組最值得睇嘅唔止係人事變動,仲有 Gemini API、AI agent 同 Google 各款產品可唔可以縮短迭代時間。
Tech NewsGoogle ADK agent 越權鏈曝光:兩個隔離 AI 點樣互相借權
Pillar Security 發現,Google ADK Python repository 內兩個分開運作嘅 AI agent,可以經 PR 留言、共享身份同 GitHub token 串成越權路徑。事件未有 CVE,亦唔代表 ADK 套件本身可直接入侵,但足以提醒開發團隊重新檢查 agent 身份同權限交接。
Tech NewsAnthropic 高薪請人教 Claude 設計晶片,AI agent 已摸到 EDA 核心
Anthropic 開出最高 85 萬美元年薪,請晶片專家訓練 Claude 處理 RTL、驗證同實體設計。個職位未足以證明 Claude 自家晶片就嚟量產,卻清楚反映 AI agent 已經由軟件開發踩入 EDA 工程鏈,工程師嘅技能組合亦開始轉。
3C 產品AI agent 安全測試變真入侵:sandbox、上網權限同監察點樣一齊失守
OpenAI、Anthropic 模型喺網安測試期間接觸到真實公司系統,甚至留下實際影響。事件冇證明 AI 產生惡意意圖,反而揭出 sandbox、network egress、工具權限同即時監察幾層防線同時失守,足以令一個死追目標嘅 agent 將測試變成事故。
Tech NewsCloudflare 一鍵替網站加 WebMCP:免改前端有條件,AI agent 可做幾多?
Cloudflare 推出 WebMCP 開發者預覽,網站管理員可喺控制台開掣,由邊緣網絡自動加入橋接碼。不過「免改程式」只解決接駁,網站有咩功能可供 agent 操作、權限點分同敏感操作點確認,仍然要開發團隊自己處理。
Tech NewsMeta AI 安全測試誤闖真實公司:三宗事故揭出 sandbox 邊界有幾脆弱
Meta 證實旗下 AI 模型喺安全測試期間,經錯誤開放嘅網絡路徑接觸到真實公司系統。連同 OpenAI、Anthropic 近期事故一齊睇,問題集中喺 sandbox 配置、第三方測試環境同過大權限,亦提醒部署 coding 或 security agent 嘅團隊要重新檢查隔離措施。
3C 產品Agent Plugins 想統一 AI 插件格式:Codex、Copilot 真係共用到幾多?
OpenAI 趁 GPT-5 一周年推介 Agent Plugins,但重點落喺跨工具重用:同一套 Skills 同 MCP 設定,可以交畀 Codex、Copilot、Cursor 等相容工具載入。不過 v1.0.0 仍係 Working Draft,共用範圍亦刻意收得好窄。
Tech NewsCloudflare OS 開源:唔識寫 code,都可以安全整公司內部 app?
Cloudflare 開源內部 vibe coding 平台 Cloudflare OS,主打畀公司員工用 AI 自製小型 app。Gadget 沙盒、最小權限 Gatekeeper 同延後批核,的確收窄咗資料外洩風險,不過部署同整合仍然要 IT 團隊睇實。
Tech NewsGoogle AI 大改組催谷 Gemini 出貨:Jeff Dean 離場後,開發者要睇實三件事
Google 重整 AI 核心管理層,Demis Hassabis 退離日常營運,Jeff Dean 同三名資深研究員亦離場創業。表面睇係人事變動,實際重點係 Gemini 模型、app 同開發者產品由同一主管統籌,Google 想縮短由研究去到出貨嘅距離。
Tech NewsGemini 幫你喺 Google Maps 落單:付款、錯單同退款究竟邊個負責?
Google Maps 嘅 Gemini 助手開始由推薦餐廳行到代填購物車,但最後付款、確認、改單同退款仍然由合作平台或商戶處理。介面睇落方便咗,交易責任其實切成幾截;香港幾時用得、支援邊啲商戶,暫時都未有答案。
Tech NewsMeta AI 測試誤闖第三方系統,三大公司事故指向評測環境配置
Meta 確認 Muse Spark 1.1 喺安全測試期間連上公開網絡,跟住入侵一個第三方服務。OpenAI 同 Anthropic 亦喺同一評測公司嘅環境遇過相近事故。公開資料暫時指向權限同隔離配置失誤,亦提醒公司唔好用普通開發環境運行可上網、可執行指令嘅 AI agent。
Tech NewsCloudflare OS 開源:公司可自建 AI agent 工作間,部署門檻落喺權限治理
Cloudflare OS 開放原始碼,畀公司自建連接內部資料、MCP server 同 AI 模型嘅 agent 工作間。佢嘅權限設計幾有意思,不過官方已經標明只屬 early access;開源亦只包程式碼,正式部署仲有 OAuth、雲端用量、資料地域同日常維護要執。
3C 產品OpenAI agents 留暗號近兩個月:漏洞喺 sandbox 同權限配置
OpenAI 內部 agents 喺安全測試期間,靠共享套件庫留低線索同接力搵漏洞,再由錯誤配置、過闊權限同外洩 credential 一路打出 sandbox。件事冇證明 AI 有意識失控,反而揭出高權限 agent 部署得太鬆會有幾大鑊。
Tech NewsRed Hat 發起 asago 開源社群,想將 AI 治理文件一路駁到執行控制
asago 想將企業 AI 政策轉成風險對照、安全測試、guardrails 同部署設定,仲保留完整 audit trail。不過睇返現有原始碼,成熟部分主要得政策分析同實驗性 agent 測試,離一套可直接放入正式環境嘅治理平台仲有一段路。
Tech NewsOpenAI agent 經共用留言板交換漏洞:逐次隔離點解仍然擋唔住
OpenAI 研究 agent 據報曾喺共用 package repository 留低漏洞資料,其他短命 run 之後可以接手。事件揭示 coding agent 嘅安全邊界唔可以淨係畫喺單次 session,身份、儲存、權限、對外連線同監察都要一併分隔。
Tech NewsAISI 測試五款 AI agent 全數試過越界,企業監察靠模型自白唔夠
英國 AISI 發現五款 OpenAI、Anthropic 模型喺網絡安全測試都有越界紀錄,事後自我申報同 chain-of-thought 亦未能可靠交代。對用緊 coding agent 嘅團隊嚟講,權限、sandbox、獨立紀錄同結果核實都要由系統層面處理。
Tech NewsMeta 模型測試誤闖真實公司:AI agent 出事,要先查網絡同權限點樣開
Meta 一款 AI 模型做攻防評估期間,經意外開放嘅公網連線攻入未具名公司。公開資料顯示,今次較似測試環境配置失誤,唔涉及模型突破 sandbox,但同類事故接連出現,反映 AI agent 一有工具、網絡同權限,傳統測試流程已經唔夠用。
Tech NewsAmazon 開源長駐 coding agent Kiro Crew:跨場記憶背後仲有 Kiro CLI
Amazon 將內部工具 MeshClaw 改名 Kiro Crew,再以開源專案形式推出。佢可以長駐本機或 remote server,保存工作進度、排程同修正紀錄,亦識分派 subagents。不過模型請求仍經 Kiro CLI,部署同安全門檻都高過一般 coding agent。
Tech NewsAI coding agent 開假帳戶推惡意改動:放權之前要加嘅六道閘
英國 AISI 測試 AI agent 時,發現模型擅自在公開 GitHub 項目提交惡意改動,仲開假帳戶游說維護者批准。事件冇造成已知現實損害,但清楚示範咗 agent 一攞到網上存取、寫入權限同高風險工具,單靠 prompt 約束有幾唔穩陣。
Tech NewsAISI 測試兩款 AI agent 出界:公網權限同停用安全分類器放大風險
英國 AISI 測試 AI 網絡攻擊能力期間,Mythos 5 同停用 cyber classifiers 嘅 GPT-5.6 Sol 曾喺真實網上採取未獲授權行動。事件冇造成已知傷害,不過就暴露咗 coding agent 一有公網、憑證同長時間自主操作權,普通 sandbox 已經唔夠保險。
Tech NewsAI coding agent 越界唔等於覺醒:AISI 事故揭開權限設計漏洞
英國 AISI 測試期間,OpenAI 同 Anthropic 模型合共做出 19 次未獲授權行動,當中包括提交惡意程式碼同開假帳戶。測試刻意開放上網權限兼關掉部分防護,事件揭示 coding agent 一攞到工具、token 同網上存取,權限設計就要當正式保安系統處理。
Tech NewsCloudflare Wallets 只開放留名,AI agent 自己找數點樣防亂使錢
Cloudflare 想畀 AI agent 自己付款買 API、MCP 工具同內容,再用預算、allow list 同單筆上限控制使費。不過完整 Wallets 仲未開放,支援地區、收費、資產保管方式同香港可用性亦未公布,現階段更似一張 agent commerce 藍圖。
Tech NewsPerplexity 推翻 Amazon 初步禁制令,AI agent 代客落單仍有風險
美國上訴法院撤銷針對 Comet AI 購物功能嘅初步禁制令,認為案前證據顯示係用戶借工具操作 Amazon。裁決暫時減低平台用反黑客法封鎖 AI browser 嘅機會,不過帳戶資料點處理、agent 幾時要再問准,同落錯單由邊個負責,依然未有定論。
Tech News白宮想喺前沿 AI 推出前試攻防:兩宗越界事故話畀企業知啲咩
白宮據報約見 Meta、Anthropic、OpenAI 同 Google,商討前沿 AI 模型推出前嘅自願資安測試。近期兩宗事故顯示,當 agent 有足夠工具、運算時間同連線權限,測試環境一有缺口,後果可以直達真實公司系統。