TAG

#AI agent

300 篇文章

TechLab 所有關於「AI agent」嘅文章、評測同教學,由最新排起。

AI agent 有了專屬電郵後,代辦雜務的便利與帳戶風險Tech News

AI agent 有了專屬電郵後,代辦雜務的便利與帳戶風險

Instinct 為 AI agent 配發專屬電郵,讓它可註冊帳戶、跟進客服及處理退貨。這一步減少人手介入,亦把授權範圍、身份辨識與私隱風險推到前台。

2 天前
Meta Muse 把 AI 由聊天助手推向可代辦任務的代理人Tech News

Meta Muse 把 AI 由聊天助手推向可代辦任務的代理人

Meta 公布 AI agent「Muse」,可連接多項服務處理購物、電郵與行程;真正的考驗在於用戶願意交出多少帳戶權限,以及確認機制能否攔住錯誤。

3 天前
AI 術語愈講愈多:看懂 coding agent 前先分清它能做甚麼Tech News

AI 術語愈講愈多:看懂 coding agent 前先分清它能做甚麼

AI 產品把 agent、推理、MCP 等術語推到前台。真正影響用戶的,不是名詞有多新,而是系統可否跨工具行動、誰負責覆核,以及錯誤會在何處擴大。

4 天前
HP 推 RTX Spark 筆電與小型桌面電腦,瞄準本機 AI 長時間任務3C 產品

HP 推 RTX Spark 筆電與小型桌面電腦,瞄準本機 AI 長時間任務

HP 發表 OmniBook Ultra 16、OmniBook X 14 及 OmniDesk,將本機 AI、流動工作與長時間 agent 任務分拆到不同裝置。不過散熱、實際續航與定價,仍是判斷其能否減少雲端依賴的關鍵。

7 天前
OpenAI Astra 面世:更強 AI agent 與更難監察的取捨Tech News

OpenAI Astra 面世:更強 AI agent 與更難監察的取捨

OpenAI 發布 Astra,將先供其 Daybreak 網絡安全計劃客戶使用,並陸續開放予付費方案及 API。模型主打軟件工程、browser use 與資安能力,但其較難監察的推理方式,令企業管治壓力同步上升。

7 天前
Meta 以近九成半折扣換取 agent 使用資料,團隊應怎樣取捨Tech News

Meta 以近九成半折扣換取 agent 使用資料,團隊應怎樣取捨

Meta 為 Muse Spark 設「contributor」價格,以大幅降低 token 成本換取 prompt 與輸出資料。對開發團隊而言,重點不只在平價,而是能否建立可分享與不可分享資料的界線。

8 天前
Palo Alto收購Console:AI agent走入資安處置前的權限考驗Tech News

Palo Alto收購Console:AI agent走入資安處置前的權限考驗

據報Palo Alto Networks以5億美元收購Console,計劃把原本處理IT支援工作的AI agent接入Cortex。交易意義在於把告警調查與處置串連,但授權範圍與人手覆核將決定這種整合能否安全部署。

9 天前
OpenAI 據報採用 opaque recurrence,AI agent 審計面臨新缺口Tech News

OpenAI 據報採用 opaque recurrence,AI agent 審計面臨新缺口

OpenAI 據報將在 Astra 採用 recurrent depth。技術使用有限,但若更多推理轉入難以讀取的內部循環,coding agent、企業風險管理及 AI 安全監管都會失去重要觀察窗口。

9 天前
企業部署 AI agent 前,先補上三道安全缺口Tech News

企業部署 AI agent 前,先補上三道安全缺口

HiddenLayer 獲 1 億美元融資,反映企業正為 AI agent 的實際運行風險付費。部署重點已由模型本身,延伸至 prompt injection、惡意工具調用及開源模型供應鏈驗證。

9 天前
AI agent 外掛成新供應鏈攻擊面:企業為何要持續審核Tech News

AI agent 外掛成新供應鏈攻擊面:企業為何要持續審核

AIR 融資 5,000 萬美元,主打審核 AI agent 所用的 skills、plugins 與 MCP server。關鍵不在一次掃描,而在外掛、帳戶與下載套件變動後的持續驗證。

10 天前
LM Studio Bionic 加入 Shell 自動審查:減少確認不等於放棄授權Tech News

LM Studio Bionic 加入 Shell 自動審查:減少確認不等於放棄授權

LM Studio 為 Bionic 加入 Auto Review,以 AST 規則先篩選 Shell 指令,再交由 AI 審查代理處理模糊個案。它可減少開發流程中的確認負擔,但仍要依賴沙箱、可信環境與人工授權。

11 天前
Claude Code 入門:在終端機用 AI agent 做開發工作的判斷與上手法AI 工具

Claude Code 入門:在終端機用 AI agent 做開發工作的判斷與上手法

Claude Code 適合把明確的開發任務交給終端機內的 AI agent 處理,但重點不是放手不管。本篇說明如何由小任務開始、怎樣審核改動,以及與 Cursor 應如何按工作方式取捨。

12 天前
逾百公司聯署談 AI 網安:企業先補上身份與監測缺口Tech News

逾百公司聯署談 AI 網安:企業先補上身份與監測缺口

OpenAI、Google 等逾百家公司呼籲集體強化網安。聯署未帶來強制規則,但它點出 AI agent 普及後,企業必須重新處理帳戶身份、權限及持續監測。

15 天前
AI agent 未掀大失業潮,細團隊先食盡職務重組紅利Tech News

AI agent 未掀大失業潮,細團隊先食盡職務重組紅利

AI 暫時未令整體失業率明顯抽升,但細團隊開始用 agent 接手查數、寫程式同整理報告。企業慳到時間之餘,招聘門檻亦高咗,初級職位首當其衝。所以企業亦要調整分工、驗收同問責方法。

19 天前
Faraday 指揮 Codex 重現論文,窄項測試跑贏 Claude 同 CodexTech News

Faraday 指揮 Codex 重現論文,窄項測試跑贏 Claude 同 Codex

Inherent 公布科研 agent Faraday 喺自家 Replica 測試領先 Claude Opus 4.8 同 GPT-5.5。個標題好搶眼,但 Faraday 本身亦有 GPT-5.5 Codex 幫手;有意思嘅地方,其實係細模型經專門訓練後,點樣指揮大型 coding agent 做窄而長嘅科研任務。

20 天前
Frontier AI 實驗室點處理失控模型?公開應變計劃仍然留有大截空白Tech News

Frontier AI 實驗室點處理失控模型?公開應變計劃仍然留有大截空白

Guidelight 評核五間 frontier AI 公司嘅監察、截停同 containment 安排,發現公開計劃普遍未成熟。不過呢份研究量度到嘅主要係公開證據,未足以證明公司內部冇方案;對用 coding agent 嘅團隊,實際警示就清楚得多:權限、監察同中止機制要一開始就拆開設計。

20 天前
三部電腦跑三種 AI:新呈工業點分 ChatGPT、Claude Code 同 HermesTech News

三部電腦跑三種 AI:新呈工業點分 ChatGPT、Claude Code 同 Hermes

新呈工業董事長同時用 ChatGPT 分析營運、Claude Code 開發內部系統,再交畀 Hermes Agent 長駐監察來信同市場數據。呢套分工幾有啟發,不過單靠分開三部機未必減到風險,仲要睇帳戶、資料、工具權限同人手覆核有冇分隔好。

21 天前
Grok Bot 把 iPhone 變 AI 遙控器:雲端 agent 真做到幾多?3C 產品

Grok Bot 把 iPhone 變 AI 遙控器:雲端 agent 真做到幾多?

Grok Bot 想由聊天工具行多一步:你喺 iPhone 指派工作,agent 就留喺雲端開網站、用工具同跑例行工序。概念幾吸引,不過訂閱資格仍然混亂,共用登入狀態同雲端檔案亦要小心管理。

21 天前
Cursor Origin 開始託管程式碼,AI agent 想接管由 repo 到部署嘅開發入口Tech News

Cursor Origin 開始託管程式碼,AI agent 想接管由 repo 到部署嘅開發入口

Cursor 推出 Origin early beta,將 repo、PR、程式碼瀏覽、AI agent 同部署整合擺埋一齊。方向係由寫 code 工具擴成開發平台,不過 GitHub 暫時仍揸住原始版本,企業合規同遷移風險亦未交代得夠完整。

22 天前
AI agent 越界未必係越獄:Codex、Claude Code 權限應該點設Tech News

AI agent 越界未必係越獄:Codex、Claude Code 權限應該點設

AI agent 為咗完成任務,有時會揀中人類冇預計嘅捷徑。不過近期事故亦涉及開放網上存取、關閉安全過濾同測試設定出錯。與其估模型有冇惡意,開發團隊更實際嘅做法係限制工具、網上存取同憑證,再為高風險操作保留人工審批。

22 天前
Binance Agent OS 畀 AI agent 直接落盤,安全界線仍要用戶自己閂實Tech News

Binance Agent OS 畀 AI agent 直接落盤,安全界線仍要用戶自己閂實

Binance 推出 Agent OS,畀 AI agent 查市場、讀帳戶資料同執行交易。方便係方便,但逐單確認、API key 權限、prompt injection、交易限額同香港牌照狀況,全部要逐樣睇清楚。Agent 可以代為落盤,但投資決定同損失仍然由帳戶持有人負責。

22 天前
MCP 每月下載近 5 億次,企業接駁 AI agent 前要先補好權限管治Tech News

MCP 每月下載近 5 億次,企業接駁 AI agent 前要先補好權限管治

Mozilla 指 MCP 普及速度遠超企業管治能力,不過報告引用嘅 9,700 萬月下載量已經過時,最新官方數字接近 5 億。數字反映相關開發工具好活躍,但唔代表有同等數量嘅公司正式部署。企業接駁 GitHub、雲端服務或者內部資料前,要先分清讀取、寫入同高風險操作點樣批核。

23 天前
AI 店長 Luna 解僱人類員工:有齊權限,點解仲要人類出聲提醒?Tech News

AI 店長 Luna 解僱人類員工:有齊權限,點解仲要人類出聲提醒?

舊金山實驗商店 Andon Market 嘅 AI 店長 Luna,喺人類提示下翻查出勤政策,最後建議解僱一名經常遲到嘅員工。件事反映 AI agent 就算有資料同權限,都未必識得主動跟進;記憶設計、人類指令同審批責任,全部會左右結果。

26 天前
Anthropic 傳最快 10 月上市:2 萬億美元估值押注 Claude Code 狂飆Tech News

Anthropic 傳最快 10 月上市:2 萬億美元估值押注 Claude Code 狂飆

Anthropic 已秘密遞交上市文件,不過最快 10 月掛牌同 2 萬億美元估值,都只係投資者推算。支撐呢盤數嘅係 Claude、API 同 Claude Code 高速增長;要守住估值,公司仲要證明收入升得快過算力成本。

26 天前