TAG

#coding agent

45 篇文章

TechLab 所有關於「coding agent」嘅文章、評測同教學,由最新排起。

Kimi K3 前端 coding 登頂:平價百萬 token 模型值唔值得開發者轉用?Tech News

Kimi K3 前端 coding 登頂:平價百萬 token 模型值唔值得開發者轉用?

Moonshot AI 推出 Kimi K3,靠前端 coding、百萬 token context 同較低 API 價錢搶眼球。獨立評測顯示佢部分能力已經貼近頂級模型,不過速度、幻覺、agent 相容性同企業資料處理仍有數要計,現階段較適合小規模試跑。

10 天前
Kimi K3 前端生成贏 Arena,coding agent 賣點係 API 平同 100 萬 token context3C 產品

Kimi K3 前端生成贏 Arena,coding agent 賣點係 API 平同 100 萬 token context

Moonshot AI 推出 2.8T 參數 Kimi K3,喺 Frontend Code Arena 排第一,API 價亦低過 Claude Fable 5 同 GPT-5.6 Sol。不過 benchmark 未足以證明整體 coding 稱王,而完整權重、授權同香港帳戶支援仍有幾個問號。

11 天前
Codex Micro 用 RGB 睇實多個 coding agents,US$230 買實體控制值唔值?Tech News

Codex Micro 用 RGB 睇實多個 coding agents,US$230 買實體控制值唔值?

OpenAI 同 Work Louder 推出限量 Codex Micro,用 RGB 顯示多個 coding agents 嘅狀態,亦可用實體鍵控制常用操作。硬件有心思,不過 US$230 買到幾多效率,取決於你係咪長期同時開住多個 Codex 任務。

12 天前
Coding agent 同時開幾個,產出多咗點解收工反而攰過自己寫?Tech News

Coding agent 同時開幾個,產出多咗點解收工反而攰過自己寫?

Midjourney 創辦人 David Holz 話,身邊朋友用新一代 coding model 後覺得產出多咗,人亦攰得好快。幾個 agent 一齊跑,開發者要不停委派、轉 context 同驗收。限制同時跑緊嘅 agent 數目、分開委派同驗收時段,再用測試同清單收窄判斷,可以減低呢種隱形負荷。

16 天前
Claude Sonnet 5 上線:coding agent 平咗,但 token 帳要重計Tech News

Claude Sonnet 5 上線:coding agent 平咗,但 token 帳要重計

Anthropic 推 Claude Sonnet 5,主攻 coding agent 同多步任務。價錢睇落低過 Opus 4.8,但新 tokenizer 令同一段 prompt token 數可能高咗,企業同開發 team 要重計每次任務成本。

16 天前
Discord 叫 AI 改 code:方便,但唔好跳過 review 同安全位3C 產品

Discord 叫 AI 改 code:方便,但唔好跳過 review 同安全位

XDA 作者用 OpenClaw 令 Discord 變成 AI coding 入口,背後其實係 chat app 做控制台、agent 喺本機或雲端跑 code。呢招對 freelancer、細 team 有用,但 repo 權限、secret 同 prompt 注入要先守住。

17 天前
Claude 近排成日駁嘴:安全線收緊後,長文同 coding 都要改玩法3C 產品

Claude 近排成日駁嘴:安全線收緊後,長文同 coding 都要改玩法

Android Authority 作者 Andrew Grush 話,Claude 最近對創作、宗教同策劃題目出現更多 pushback,甚至同一段 prompt 開新對話又答得返。官方文件其實畀咗線索:新模型做 agent 任務強咗,安全分類器亦收得緊,誤判就變成效率問題。

17 天前
HalluSquatting 盯上 AI coding agent:亂估 repo 名都可以變供應鏈風險Tech News

HalluSquatting 盯上 AI coding agent:亂估 repo 名都可以變供應鏈風險

iThome 報道 HalluSquatting 研究後,值得拉返去睇開發者日常用 AI agent 嘅習慣:叫工具 clone repo、裝 skill、拉 package 之前,名稱同來源都要自己核清楚;一開自動執行,錯一次就可能變供應鏈入口。

18 天前
Ollama 融資 $6,500 萬:本機 AI 點解突然值錢Tech News

Ollama 融資 $6,500 萬:本機 AI 點解突然值錢

TechCrunch 報道 Ollama 完成 $6,500 萬美元 Series B,月活 developer 接近 890 萬。呢件事值得睇,因為本機跑 LLM 已經由玩具變成開發者日常:私隱、成本、離線測試、coding agent,全都拉埋一齊。

19 天前
Grok 4.5 平價殺入 AI coding,開發 team 要計每個任務成本Tech News

Grok 4.5 平價殺入 AI coding,開發 team 要計每個任務成本

Grok 4.5 主打 coding agent 同知識工作,API 價平過 GPT-5.5 同 Opus 4.8,但真正值唔值得轉,要睇每個成功任務用幾多 token、幾多工具 call,同你用唔用到 cache。

19 天前
AI agent 入公司之後,最先要管好權限、工具調用同審計 logTech News

AI agent 入公司之後,最先要管好權限、工具調用同審計 log

AI agent 由寫文、寫 code 走到自動叫工具同讀資料,風險就唔再停喺 prompt injection。企業要睇得見邊個 agent 有咩權、攞咩資料、讀過咩檔案,仲要可以快手撤權同查 log。

19 天前
AI agent 搵錯 repo:HalluSquatting 點樣變供應鏈風險Tech News

AI agent 搵錯 repo:HalluSquatting 點樣變供應鏈風險

HalluSquatting 利用 LLM 將熱門 repo 或 skill 位置估錯呢個習慣,預先霸住假資源名。對用緊 Cursor、Copilot、Gemini CLI 呢類 agent 嘅團隊,真正風險係工具連住 shell、repo 同雲端 token。

20 天前
AI-native 初創點解人少估值照高,HBS 研究睇到產品位Tech News

AI-native 初創點解人少估值照高,HBS 研究睇到產品位

HBS 同 INSEAD working paper 睇咗 YC 同美國 venture-backed 初創,AI-native 公司平均人少、層級薄、估值冇明顯輸蝕。最值得睇嗰位,係 AI 放咗入產品後,職位結構同擴張方法點樣跟住變。

22 天前
MCP server 裝到成百個,coding agent 點解會慢同亂3C 產品

MCP server 裝到成百個,coding agent 點解會慢同亂

XDA 作者用 172 個 MCP tools 跑 Claude Code,發現工具定義可以食走 141k tokens。呢件事唔只係慢,仲牽涉 context 污染、工具揀錯同 token 權限風險。開發者應該按 project 開 server、收細權限,唔好一份全家桶設定走天涯。

22 天前
Tesla 據報每星期封頂 US$200,企業 AI 成本開始入正帳Tech News

Tesla 據報每星期封頂 US$200,企業 AI 成本開始入正帳

TechNews 科技新報報道,The Information 指 Tesla 由 7 月 6 日起限制員工第三方 AI 工具開支,每人每星期 US$200。呢件事唔止關 Tesla,亦反映公司用 AI 由衝 adoption,轉去睇 token、批核同 dashboard 成本。

22 天前
EdgeBench 想量度 AI agent 點樣喺 12 小時任務入面學嘢Tech News

EdgeBench 想量度 AI agent 點樣喺 12 小時任務入面學嘢

ByteDance Seed 推出 EdgeBench,用 134 個長任務睇 AI agent 點樣靠回饋慢慢改好成果。呢套 benchmark 值得開發者睇,因為佢關心成本、上下文、回饋 loop 同長時間穩定度。三個月翻倍呢句,暫時要當成論文 claim。

22 天前
開源 AI 由口號變後備路:企業避 Big Tech lock-in,要計清成本同資料Tech News

開源 AI 由口號變後備路:企業避 Big Tech lock-in,要計清成本同資料

TechNews 科技新報報道 Mozilla 總裁 Mark Surman 倡議中等強國推開源 AI。呢件事最值得睇嘅位,係企業同開發者點保住轉台能力:模型價錢、資料放邊、coding agent 可唔可以換引擎,全部都會受影響。

25 天前
Anthropic 新模型畀美國一封信掣停:AI 安全變成可用性風險Tech News

Anthropic 新模型畀美國一封信掣停:AI 安全變成可用性風險

美國政府要求 Anthropic 停用 Fable 5 同 Mythos 5,表面係 jailbreak 風險,實際亦係 AI 工具可用性、資料保留同供應商依賴嘅警號。用 Claude API 或 coding agent 嘅團隊,要當呢次係一次 vendor risk 演習。

1 個月前
Codex 可儲 rate limit reset:Plus / Pro referral 點樣幫工作流補血3C 產品

Codex 可儲 rate limit reset:Plus / Pro referral 點樣幫工作流補血

OpenAI 開始畀 Codex 用戶儲起 rate limit reset,需要時先用。Go、Plus、Pro、Business 有一個免費 reset;Plus / Pro 可透過短期 referral pilot 再攞最多三個,實際影響係開發者可以更穩陣安排 coding agent 工作。

2 個月前
AI 每人每月燒 US$7,449,公司係時候計清 token 帳Tech News

AI 每人每月燒 US$7,449,公司係時候計清 token 帳

Ramp AI Index 話最重度用 AI 嘅 1% 美國公司,每名員工每月 AI 支出達 US$7,449。呢個唔係香港市場調查,但足夠提醒公司:AI 採購已經由買帳號,變成 token、API、coding agent 同 vendor 組合管理。

2 個月前
Claude Fable 5 登場:AI coding agent 開始接手長任務3C 產品

Claude Fable 5 登場:AI coding agent 開始接手長任務

Anthropic 推出 Fable 5 同 Mythos 5,AA 個標題講得驚,但核心係同一個高能力模型點分公開版同受邀版。對開發者嚟講,最值得睇係長任務 coding、1M context、30 日資料留存同 API / Bedrock 可用性。

2 個月前