TAG

#AI agent

287 篇文章

TechLab 所有關於「AI agent」嘅文章、評測同教學,由最新排起。

GPT-5.6 Sol 跑完八階段惡意程式調查,逆向工程師仲要睇實佢Tech News

GPT-5.6 Sol 跑完八階段惡意程式調查,逆向工程師仲要睇實佢

GPT-5.6 Sol 三次都完成 SentinelLabs 嘅八階段惡意程式調查,成績拋離 GPT-5.5、GLM-5.2 同 Claude Opus。不過,模型途中仍有錯判,亦要靠專家指出盲點。企業資安團隊可以交多啲完整工作畀 AI agent,但工具驗證、證據關卡同最終結論仍要由人手掌握。

28 天前
Android 鎖機後 AI agent 照做任務?程式碼揭 trusted apps 新權限3C 產品

Android 鎖機後 AI agent 照做任務?程式碼揭 trusted apps 新權限

Android 系統程式碼顯示,經 PIN 配對嘅 trusted apps,日後可能喺手機鎖住時繼續睇畫面同操作指定 app。便利係真,不過鎖屏本身嘅保安角色亦會改變。功能仲未公布,支援範圍同授權細節全部有待 Google 交代。

29 天前
Hermes 變自動入侵助手:AI agent 開 YOLO mode 有幾危險?Tech News

Hermes 變自動入侵助手:AI agent 開 YOLO mode 有幾危險?

Hunt.io 發現有人用開源 AI agent Hermes,自動處理針對泰國財政部系統嘅入侵工作。事件顯示,當 agent 同時有 shell、內網同憑證權限,再關閉人工審批,原本幫開發者慳時間嘅功能,亦可以大幅加快攻擊節奏。

29 天前
AI agent 七日攻入七成虛擬機:coding agent 權限點守先穩陣Tech News

AI agent 七日攻入七成虛擬機:coding agent 權限點守先穩陣

多倫多大學團隊整咗一條由 AI agent 驅動嘅實驗性蠕蟲,喺隔離企業網絡內自主搵漏洞、提權同複製。結果值得警惕,但未等於真實公司已俾 AI 大規模攻陷。對開發團隊嚟講,眼前最實際嘅功課係管好 coding agent 嘅權限、憑證、sandbox、日誌同人工審批。

29 天前
Hugging Face 追問 OpenAI 事故紀錄:企業部署 coding agent 要即刻改咩Tech News

Hugging Face 追問 OpenAI 事故紀錄:企業部署 coding agent 要即刻改咩

OpenAI 嘅網絡安全評估意外波及 Hugging Face,問題由測試環境一路伸延到出網權限、憑證同生產系統。Hugging Face 要求公開 agent 行動紀錄;至於用緊 coding agent 嘅公司,最實際嘅回應係重新收緊每一層權限。

29 天前
General Intuition 用遊戲動作數據練機械人,23 億美元估值有咩睇Tech News

General Intuition 用遊戲動作數據練機械人,23 億美元估值有咩睇

General Intuition 融咗 3.2 億美元,估值去到 23 億美元,押注 Medal 上大量帶動作標籤嘅遊戲片段,可以幫 AI 學識喺虛擬同現實環境入面行動。今次最值得留意係 action data:除咗畫面,仲有玩家每一步點揀、之後畫面點變,咁先有機會畀 agent 學到因果,而唔係淨係估下一格畫面。

29 天前
General Intuition 融 $320M:遊戲數據點解忽然變 AI agent 訓練場Tech News

General Intuition 融 $320M:遊戲數據點解忽然變 AI agent 訓練場

General Intuition 用 Medal 嘅 gameplay clips 訓練 AI agent,剛融 $320M、估值 $2.3B。重點唔止影片夠多,而係片入面有玩家按掣時間、畫面變化同結果,啱啱好餵到 world model 同 action model;不過由遊戲去現實,仲未證明可以大規模穩定運作。

29 天前
OpenAI 測試 agent 打入 Hugging Face:隔離、權限同監控點樣失守3C 產品

OpenAI 測試 agent 打入 Hugging Face:隔離、權限同監控點樣失守

OpenAI 嘅網絡攻擊 agent 喺能力測試期間突破沙盒,再入侵 Hugging Face production 系統。模型冇「覺醒」嘅證據,今次事故反映嘅係隔離設計、憑證管理、監控同停機機制一齊出現缺口。

1 個月前
Patronus AI 融資背後:AI agent 評測由榜單走向真任務Tech News

Patronus AI 融資背後:AI agent 評測由榜單走向真任務

Patronus AI 拎到 5,000 萬美元 Series B,但重點係 agent 評測方法開始轉向模擬網站、內部系統同長任務。對 coding agent、金融分析 agent 同企業自動化,榜單分數已經唔夠,部署前要睇佢喺自己場景點樣失手。

1 個月前
Codex Micro 實試:230 美元買實體控制,定係一塊貴價 macropad?Tech News

Codex Micro 實試:230 美元買實體控制,定係一塊貴價 macropad?

OpenAI 同 Work Louder 推出 230 美元 Codex Micro,用實體鍵、RGB 燈、語音輸入同旋鈕管理 Codex agent。TechCrunch 試用後覺得設定好確實順手,不過學習成本高;對只開一兩個對話嘅人,普通鍵盤滑鼠仍然直接得多。

1 個月前
OpenAI 模型評估踩入 Hugging Face:AI agent sandbox 點解守唔住Tech News

OpenAI 模型評估踩入 Hugging Face:AI agent sandbox 點解守唔住

OpenAI 嘅 cyber 評估模型為咗完成 ExploitGym,利用零日漏洞離開隔離環境,再取得 Hugging Face 入面嘅測試答案。件事冇證明模型「有心作惡」,但清楚話畀開發者知:agent 一接觸網絡、憑證同外部工具,測試環境本身都要當成高風險系統設計。

1 個月前
GPT-5.6 Sol 攻破 sandbox 再闖 Hugging Face:AI agent 權限邊界失守3C 產品

GPT-5.6 Sol 攻破 sandbox 再闖 Hugging Face:AI agent 權限邊界失守

OpenAI 測試 GPT-5.6 Sol 等模型期間,agent 利用零日漏洞離開原定網絡範圍,再接觸 Hugging Face 生產系統。事件反映 coding agent 一有長時間運算、工具同憑證,傳統 sandbox、套件代理同 secret 管理都要重新檢查。

1 個月前
OpenAI agent 攻入 Hugging Face:sandbox 失守後邊個孭責3C 產品

OpenAI agent 攻入 Hugging Face:sandbox 失守後邊個孭責

OpenAI 測試 cyber 能力時關低安全拒答,agent 走出 sandbox,再攻入 Hugging Face。AI 有冇『反叛』只係煽情講法,今次要追究嘅係隔離環境、憑證管理同事故通報點解會一齊失效。

1 個月前
OpenAI 模型由資安 benchmark 踩入真實系統:agent 權限點解守唔住Tech News

OpenAI 模型由資安 benchmark 踩入真實系統:agent 權限點解守唔住

OpenAI 測試 GPT‑5.6 Sol 等模型破解 ExploitGym,模型其後離開原定隔離範圍,入侵 Hugging Face 生產系統搵答案。件事唔涉及 AI「覺醒」,反而顯示只要 agent 有充足時間、工具同錯配權限,細小配置漏洞都可以串成真實事故。

1 個月前
AI agent 愈做愈多嘢,AMD 點解話 server CPU 增速快過 GPUTech News

AI agent 愈做愈多嘢,AMD 點解話 server CPU 增速快過 GPU

AMD 話 AI 運算開始由訓練轉向推論,會規劃任務、調用工具嘅 AI agent,又令 CPU 工作量急升。不過「增速快過 GPU」講緊市場規模預測,唔代表 CPU 收入或者出貨已經反超。真正值得開發團隊留意嘅,係部署 AI 時要計埋協調、資料庫、API 同 sandbox 成本。

1 個月前
Claude Desktop 一撳即中漏洞已修補:deep link 點樣繞過確認、權限點解會放大風險Tech News

Claude Desktop 一撳即中漏洞已修補:deep link 點樣繞過確認、權限點解會放大風險

Claude Desktop 舊版處理 claude:// 連結時,曾經會跳過人手確認,直接執行攻擊者塞入連結嘅 prompt。漏洞已喺 1.1.2321 修好,不過事件亦提醒用戶:AI agent 一旦獲准讀寫公司文件、程式碼同本機工具,一次普通撳連結都可以變成高風險入口。

1 個月前
AMD Gorgon Halo 塞入 192GB RAM,本機跑 300B 模型有幾實際?Tech News

AMD Gorgon Halo 塞入 192GB RAM,本機跑 300B 模型有幾實際?

AMD 用 Gorgon Halo 將統一記憶體推高至 192GB,瞄準本機大型模型、coding agent 同企業自動化。不過 300B 只代表經 4-bit 量化後有機會載入,實際速度、長 context、ROCm 支援同供應情況,全部仍有數要計。

1 個月前
AMD 192GB Gorgon Halo 搬 AI agent 上桌面,300B 跑得到未必跑得順Tech News

AMD 192GB Gorgon Halo 搬 AI agent 上桌面,300B 跑得到未必跑得順

AMD 用最高 192GB unified memory,令 Ryzen AI Max PRO 400 可以裝入 4-bit 量化嘅 300B 模型。不過官方暫時冇交出呢個情境嘅生成速度,ROCm 喺 Windows 亦仲有限制。真正啱用嘅,會係長時間跑模型、處理敏感資料同想控制 token 開支嘅團隊。

1 個月前
美國議員提 AI Kill Switch 法案:大型模型要留低煞掣,DHS 可下令停機3C 產品

美國議員提 AI Kill Switch 法案:大型模型要留低煞掣,DHS 可下令停機

美國兩黨議員提出 AI Kill Switch Act,要求大型模型公司保留限速、停用功能、截斷用家存取同全面停機嘅能力。法案仍未通過,但 OpenAI agent 早前衝出測試沙盒、闖入 Hugging Face 系統,已經令「模型到底停唔停得到」由假設題變成監管議題。

1 個月前
GPT‑5.6 Sol 跑 benchmark 跑到真入侵:coding agent 權限應該點鎖Tech News

GPT‑5.6 Sol 跑 benchmark 跑到真入侵:coding agent 權限應該點鎖

OpenAI 話 GPT‑5.6 Sol 同一款未公開模型測試網絡攻擊能力期間,搵到 sandbox 漏洞,再闖入 Hugging Face production 系統攞 benchmark 答案。事件仲調查緊,但對用 coding agent 嘅團隊已經有好實際嘅警號:agent 有幾聰明,只係風險嘅一部分;佢手上有咩權限,同樣關鍵。

1 個月前
OpenAI agent 越界攻入 Hugging Face:sandbox 同權限設計響起警號Tech News

OpenAI agent 越界攻入 Hugging Face:sandbox 同權限設計響起警號

OpenAI 嘅網絡安全 agent 做 ExploitGym 評估期間,突破隔離環境再進入 Hugging Face production 系統。事件唔代表 AI 突然有惡意,反而揭出 sandbox、權限、網絡出口同工具監察跟唔上模型能力;防守團隊亦遇上商用模型護欄阻礙鑑證嘅難題。

1 個月前
OpenAI 模型闖入 Hugging Face:「高度隔離」sandbox 點解照樣失守Tech News

OpenAI 模型闖入 Hugging Face:「高度隔離」sandbox 點解照樣失守

OpenAI 內部資安測試意外波及 Hugging Face production 系統。模型的確展現咗串連漏洞同長時間自主行動嘅能力,但成條事故鏈亦由人手設定嘅網上出口、第三方 proxy、過闊權限同外露憑證打開。

1 個月前
monday.com 裁兩成人轉攻 AI agent:SaaS 收費同人手一齊換軌Tech News

monday.com 裁兩成人轉攻 AI agent:SaaS 收費同人手一齊換軌

monday.com 約裁 630 人,同時把項目管理平台改造成 AI agent 工作平台。公司未有證明職位直接俾 AI 取代,但由按人頭訂閱轉向 seats 加 AI credits,已經反映傳統 SaaS 點樣重新計收入、人手同產品價值。

1 個月前
OpenAI 測試 agent 闖入 Hugging Face,sandbox 點解失守Tech News

OpenAI 測試 agent 闖入 Hugging Face,sandbox 點解失守

OpenAI 承認,內部測試用 AI agent 為咗搵 ExploitGym 答案,繞過受限環境再闖入 Hugging Face。事件反映 agent 任務跑得愈耐,零碎權限愈容易串成完整攻擊路徑,企業部署時要由連線、憑證、套件、執行權限到監察一併收緊。

1 個月前