#AI 編程
45 篇文章
TechLab 所有關於「AI 編程」嘅文章、評測同教學,由最新排起。
Tech NewsClaude Opus 5 半價逼近 Fable 5,Claude Code 用家點揀 effort 先抵
Anthropic 推出 Claude Opus 5,同上代收費一樣,部分 coding agent 測試就貼近 Fable 5。新模型識得自己驗證同修正成果,不過 effort、工具調用同分派子任務都會推高用量,Pro、Max 同 API 用戶揀模型時要分開計。
3C 產品AI coding agent 做完都唔識停:四道閘減少佢亂改 code
XDA 作者用 Google Antigravity 起 app,功能完成後 agent 仍然繼續改,連 Stop 掣都有失靈情況。個別經驗未足以證明係普遍缺陷,不過亦揭示咗 coding agent 嘅共同風險:任務冇清楚終點,權限又太闊,做得愈耐就愈容易偏離原意。
Tech NewsClaude Opus 5 同價升級:token 效率同 Claude Code 實際有咩改變
Anthropic 推出 Claude Opus 5,API 單價跟 Opus 4.8 一樣,重點落喺低 effort 慳 token、100 萬 token context 同 Fast mode。對 Claude Code 同 API 團隊,升級前仲要處理 thinking 預設開啟、輸出變長同 400 error 風險。
Tech NewsClaude Opus 5 搶做 coding agent 主力:接近 Fable,限制少好多
Anthropic 推出 Claude Opus 5,主打複雜 coding、長時間 agent 任務同知識工作。官方話部分測試已貼近 Fable 5,標準 API 價錢只係一半,安全分類器亦冇咁易誤傷正常開發工作。不過官方跑分仲要等獨立測試驗證,香港帳戶亦未列入正式支援地區。
Tech NewsClaude Opus 5 半價追到 Fable:coding agent 應該點揀模型
Anthropic 推出 Claude Opus 5,API 價錢維持 Opus 4.8 水平,能力就逼近貴一倍嘅 Fable 5。對 coding agent 用戶嚟講,模型識唔識自己驗證、會唔會突然觸發安全限制,同公司可唔可以保留零資料留存設定,實際上都重要過單一跑分。
3C 產品Claude Code 太貴?多個本地細模型分工,慳錢之前要計清楚硬件同時間
XDA 作者嫌 Claude Code 太食 token,改用多個本地 Qwen 細模型分工。個做法勝在任務清楚、權限收窄、出錯容易追,不過原文冇速度、成功率同硬件數據,未足以證明程式碼質素贏過 Claude。
Tech NewsGoogle CodeMender 開放有限預覽:AI 修漏洞前先落場驗證
CodeMender 由研究項目走到有限公開預覽,識得掃描程式碼、建立 PoC 驗證漏洞,再產生同測試修補。呢套做法有望減少 false positive,不過代理會執行程式碼,企業要管好 sandbox、雲端資料同審批權限。
3C 產品Claude Code 接通 iOS Simulator:寫 Code、試畫面同改 App 一條龍
Claude Code Desktop 加入 iOS Simulator 專用面板,可以 build、啟動同操作開發中嘅 app,再按畫面結果改 code。呢個 public beta 補上 AI 編程工具一直欠缺嘅視覺回饋,不過只限指定計劃、Mac 本機 session,而且截圖保存安排要睇清楚。
3C 產品Vibecoding 推高 App Store 新作量,下載只升 2% 暴露另一道難關
Sensor Tower 估算指,App Store 今年上半年多咗約 56 萬款新 app,按年接近翻倍,下載量就只升 2%。AI coding tools 的確令更多人交到成品,不過 app 愈出愈快,用家時間冇跟住增加,獨立開發者要面對嘅競爭反而更迫。
Tech NewsKimi K3 暫停個人新訂閱,Kimi Code 權益就嚟獨立計
Kimi K3 上線後需求急升,官方暫停個人新訂閱,現有會員就繼續用。免費服務同 API 暫時未有一併停用,而 Kimi Code 權益亦會獨立成另一套計劃。新用戶等唔切,仍可經 API 或轉用其他模型維持 coding workflow。
Tech NewsKimi K3 寫前端贏 Claude,平價背後仍然食晶片同電力
月之暗面推出 Kimi K3,前端編程排名一出即登頂,API token 單價亦低過頂級 Claude。不過獨立評測顯示,佢嘅成本優勢視乎任務同 token 用量,完整權重亦未正式放出。模型競爭愈激烈,未必會令晶片、電力同雲端需求縮水。
3C 產品用 VS Code 加 Foam 砌本地筆記:Git、搜尋同 AI 共用 Markdown
VS Code 本身已經識開 Markdown、跨檔搜尋同管理 Git,再裝 Foam 就有 wikilink、backlink、daily note 同關係圖。對寫開 code、儲技術資料同用 AI agent 嘅人,最大著數係筆記、程式碼片段同專案文件可以放喺同一套純文字資料入面。
3C 產品Claude Code sandbox 實用指南:少撳批准之前,先封好 Bash 邊界
Claude Code 內置 sandbox 可以隔離 Bash 指令,令測試、build 同改檔案少啲停低等批准。不過佢預設仍可讀取電腦大部分位置,亦留有 unsandboxed escape hatch;Read、Edit、Write、MCP 同 hooks 更有另一套邊界。開啟之前,最好先搞清楚佢保護到邊。
3C 產品同一個裝修財務 dashboard,Codex、Claude Code、Copilot 點揀先實際
XDA 作者叫三款 coding agent 整同一個裝修財務 dashboard,Codex 交出最完整兼最靚嘅版本,Claude Code 功能深入但介面失色,Copilot 就快得嚟做漏流程。結果幾有意思,不過測試欠缺原始碼、實際用量同自動測試,揀工具前仲要拆開睇。
3C 產品Kimi K3 前端生成贏 Arena,coding agent 賣點係 API 平同 100 萬 token context
Moonshot AI 推出 2.8T 參數 Kimi K3,喺 Frontend Code Arena 排第一,API 價亦低過 Claude Fable 5 同 GPT-5.6 Sol。不過 benchmark 未足以證明整體 coding 稱王,而完整權重、授權同香港帳戶支援仍有幾個問號。
3C 產品OpenAI Codex Micro 賣 US$230:用實體掣管理多個 coding agent 值唔值?
OpenAI 同 Work Louder 推出 Codex Micro,用 RGB 燈、搖桿同旋鈕管理多個 Codex agent,售 US$230。概念對重度開發者有用,不過硬件建基於現有 Creator Micro 2,增值主要來自 Codex 整合同特別版設計。香港買家仲要分清楚硬件寄送同服務支援係兩回事。
Tech NewsOpenAI Codex Micro 賣 US$230:六粒 Agent 狀態鍵值唔值聯名價?
Codex Micro 售 US$230,六粒 Agent Keys 可用 RGB 顯示多個 Codex task 狀態,亦可實體 approve、reject 同調校 reasoning。硬件沿用 Creator Micro 2 路線,主要分別落喺 ChatGPT 整合,同時亦有明顯平台限制。
Tech NewsGrok Build 曾上載完整 Git repo:用過嘅開發者應點樣檢查風險
Cereblab 封包測試顯示,Grok Build 0.2.93 曾將完整 Git repo 連 history 傳去 Google Cloud。SpaceXAI 已停咗功能,又承諾刪除舊數據;用過嘅開發者仍要檢查 Git history,同更換可能外傳嘅 credential。
3C 產品MCP server 裝到成百個,coding agent 點解會慢同亂
XDA 作者用 172 個 MCP tools 跑 Claude Code,發現工具定義可以食走 141k tokens。呢件事唔只係慢,仲牽涉 context 污染、工具揀錯同 token 權限風險。開發者應該按 project 開 server、收細權限,唔好一份全家桶設定走天涯。
Tech News阿里傳 7 月 10 日禁 Claude Code,AI 編程工具管治要認真做
TechCrunch 引述 Reuters 等報道,阿里會由 7 月 10 日起禁員工喺工作環境用 Claude Code,改推 Qoder。呢件事最值得睇嘅位,係公司用 Codex、Claude Code、Cursor 時,code、secret 同客戶資料要點劃界。
Tech NewsOpenAI Codex 入手機:搭車都可批核 AI 寫 code,香港可用性仍未明
OpenAI 將 Codex 帶入 ChatGPT iOS/Android app,重點唔係喺手機寫 code,而係用手機跟進長時間任務、睇 diff、批核命令、收測試結果。對香港開發者有用,但香港帳戶同 App Store 可用性仍要標示 [待確認]。