#AI agent
102 篇文章
TechLab 所有關於「AI agent」嘅文章、評測同教學,由最新排起。
3C 產品ChatGPT Work 殺入桌面同手機:AI 開始接手跨 app 任務
OpenAI 推出 ChatGPT Work,同時把 Codex 合入新 ChatGPT desktop app,配合 GPT-5.6 Sol、Terra、Luna。最值得睇嘅位係 AI 可以喺手機、桌面同 connected apps 之間做完整任務;好用,但權限同資料邊界要先諗清楚。
3C 產品Gemini 用戶最想 Google 修嘅,係 Workspace 同 tool calling
Google Gemini 負責人 Josh Woodward 整理用戶 feedback,排頭兩項係 Workspace 接駁同 tool calling 可靠性。呢個仲有意思過新功能列表,因為 Gmail、Docs、Drive 同 AI agent 要真係幫到手,第一步係少出錯。
Tech NewsGemini Spark 登陸 Mac:Google 想 AI 幫你執文件,但香港暫時未有份
Google 喺 Gemini Mac app 加入 Spark,想由聊天變成幫你執本機文件、跟進題目同串連 app 嘅長駐 agent。不過 Beta 先俾美國 AI Ultra 用戶試,官方支援頁仲列明香港未支援,權限同公司資料風險要睇清楚。
3C 產品Claude Code 執 Windows 桌面:下載、截圖同 startup apps 點樣交畀 agent 做
XDA 作者 Joe Rice-Jones 用 Claude Code 清 Downloads、截圖、startup apps 同大檔案。呢件事唔算重大發布,但幾啱望清 AI agent 點幫 Windows 用戶處理日常雜務,又要守住私隱同誤刪風險。
Tech NewsClaude Cowork 上 Web 同手機:AI agent 長任務可以離枱跟進
Anthropic 官方公告講嘅其實係 Claude Cowork,不過 iThome 標題寫咗 Claude Code,呢點要先分清。Web 同手機版重點放喺長任務中途有人拍板;價錢、權限同香港可用性先係門檻。
Tech NewsAI agent 入公司之後,最先要管好權限、工具調用同審計 log
AI agent 由寫文、寫 code 走到自動叫工具同讀資料,風險就唔再停喺 prompt injection。企業要睇得見邊個 agent 有咩權、攞咩資料、讀過咩檔案,仲要可以快手撤權同查 log。
3C 產品Alexa 想變 AI agent,但 Amazon 先要吞 GPU 巨帳
Business Insider 話 Amazon 內部文件提到 Moonraker,Amazon 想令 Alexa Plus 唔止逐個指令做,而係可以一次過處理叫車、傳訊、訂票呢類串連任務。不過過億美元 GPU 成本,可能先卡住呢個 AI agent 夢。
Tech NewsGeneral Intuition 用遊戲片段教機械人,AI 下一步睇 action data
General Intuition 6 月底攞咗 3.2 億美元 Series A,估值 23 億美元,今次再講佢點用遊戲片段同玩家動作數據教 AI 理解空間同後果。呢個方向好吸引,但暫時重係 demo 同公司 thesis 多過大規模真實驗證。
Tech NewsAmazon 傳搞 Moonraker,Alexa 想由答問題升級到幫你辦事
Engadget 引述 Business Insider 報道,Amazon 內部有個代號 Moonraker 嘅 Alexa 項目,想令 Alexa+ 一次過處理叫車、send 訊息、訂服務呢類多步任務。但係香港支援、廣東話同地區服務暫時都未有清楚答案。
Tech NewsGPT-5.6 三檔 preview 撞正 Claude Fable 5 重開,寫 code 點揀
OpenAI GPT-5.6 Sol/Terra/Luna 同 Claude Fable 5 同時搶開發者注意。今次要睇嘅唔止模型有幾叻,仲有 API token 成本、Codex/Claude Code 可用性、安全 classifier 同 usage credits 點影響寫 code。
Tech NewsOpenAI 請投行專家,金融 AI 開始鬥估值、覆核同實戰判斷
OpenAI 官方職位頁顯示,Applied AI 團隊想搵投行背景專家,負責評估模型做研究、建模、估值、due diligence 同客戶材料嘅能力。呢件事講緊金融 AI 下一步:唔只答得快,仲要交到可追溯、可覆核嘅專業成果。
3C 產品Claude Cowork 上 web 同手機:AI agent 開始接手辦公雜務
Anthropic 將 Claude Cowork 擴展到 web 同 iOS / Android,長任務預設喺雲端跑,手機可以追進度同批示。吸引位係辦公雜務終於有 agent 跟,但公司資料、app 權限同香港帳戶可用性都要先睇清。
3C 產品Claude Cowork 上手機同網頁:AI agent 終於唔使黐住部 Mac
Claude Cowork beta 開始推到 web 同手機 app,Max 用戶先行。重點唔止係多咗入口,而係 AI 可以喺雲端背景做任務,用手機批動作同跟進;但 local files、browser 同 connected tools 權限風險亦放大咗。
Tech NewsClaude Cowork 上手機同 web,方便咗但 desktop 仍係主場
Anthropic 開始把 Claude Cowork 帶到手機同 web,Max 用家先有,其他付費 plan 之後跟上。重點唔係多咗個入口,而係 Cowork 開始由 desktop 工具,變成可以跨裝置跟進嘅 agent.;不過本機檔案、browser 同電腦操作仍然要靠 desktop app。
Tech NewsClaude Cowork 上手機:AI agent 開始接手辦公雜務
Claude Cowork 今次由 desktop 走到 web 同 mobile,賣點唔止多一個 app:agent 可以閂埋 laptop 後繼續跑,卡住先喺手機叫你批。呢套玩法,其實係 coding agent 嘅辦公版。
3C 產品Perplexity Computer 同 Claude 點揀:資料搜集、寫稿、文件工序逐樣睇
AI agent 已經由答問題走到幫你開 app、拉資料、交文件;慳時間嘅位好實際,但資料查證、私隱同 credits 成本都要計清楚。
3C 產品Google Health CLI 俾 AI 讀 Fitbit 數據,方便但唔係冇風險
Google 新出 Health CLI,重點唔係多一個 command-line 工具,而係 Fitbit 同 Google Health 數據開始變成 AI agent 可以直接處理嘅材料。個人 dashboard、睡眠整理、運動摘要都啱玩,但權限同私隱要先諗清楚。
Tech NewsGartner 講主權 AI 同 agent 風險:公司唔好只買 Copilot 就算
iThome 報道,Gartner 喺未來兩年資料與分析重點入面,放入主權 AI、AI agent 風險同 AI governance 平台。對香港公司嚟講,買 Copilot 或 OpenAI API 只係起步;資料留喺邊、agent 可以做幾多、出事有冇 audit log 同人手覆核,會直接影響可唔可以放入正式流程。
3C 產品Windsurf 變 Devin Desktop:AI coding 之後要識管 agent
XDA 作者近日揀 Devin Desktop 做首選 AI coding 工具,但件事唔只係口味問題。Windsurf 改名後,Cognition 主打用 Kanban 管多個 agent,小 team 揀工具前要諗清楚成本、私隱同審批。
Tech NewsOpenClaw 幫人約會唔止搞笑,帳戶權限係最易出事位
一個創作者用 OpenClaw、Claude Code 同 Instagram trial reels 批量出帖引 DM,自稱幾日有大量回覆。件事有趣,但重點係 AI agent 一接入社交帳戶、日曆同交友 app,就會攞到好私密嘅資料同代你出手嘅權限。
3C 產品Claude Code subagents 點用:拆細 code review、查 bug 同跑測試
Claude Code 而家支援 subagent 再開 subagent,適合用嚟做 code review、查大型 repo、跑測試同整理 logs。玩法有用,但唔好一開就放任佢掃 repo:context、token、secrets 同 permission 先係成敗位。
3C 產品Mac mini 俾 AI agent 用到熱,Apple 呢套本機 AI 算盤點睇
Apple silicon 產品經理 Doug Brooks 喺 The Deep View 訪問入面話,Mac mini 同 Mac Studio 正受 AI agent 用家追捧。呢件事值得睇,因為本機 AI 由玩具慢慢變成長開任務:私隱、token 成本同硬件取捨一齊擺上枱。
Tech NewsClaude Cowork 俾指可攞 VM root,AI agent 上機要點管
Armadin 指 Claude Cowork for Windows 嘅 VM 沙箱可俾本機攻擊者借 CoworkVMService 攞 root,外連限制亦可放寬。呢個唔係 remote 漏洞,但反映 AI office agent 一上機,IT 就要管權限、app 白名單同 telemetry。
Tech NewsEdgeBench 想量度 AI agent 點樣喺 12 小時任務入面學嘢
ByteDance Seed 推出 EdgeBench,用 134 個長任務睇 AI agent 點樣靠回饋慢慢改好成果。呢套 benchmark 值得開發者睇,因為佢關心成本、上下文、回饋 loop 同長時間穩定度。三個月翻倍呢句,暫時要當成論文 claim。