TAG

#AI 編程

45 篇文章

TechLab 所有關於「AI 編程」嘅文章、評測同教學,由最新排起。

Claude Opus 5 半價逼近 Fable 5,Claude Code 用家點揀 effort 先抵Tech News

Claude Opus 5 半價逼近 Fable 5,Claude Code 用家點揀 effort 先抵

Anthropic 推出 Claude Opus 5,同上代收費一樣,部分 coding agent 測試就貼近 Fable 5。新模型識得自己驗證同修正成果,不過 effort、工具調用同分派子任務都會推高用量,Pro、Max 同 API 用戶揀模型時要分開計。

2 個月前
AI coding agent 做完都唔識停:四道閘減少佢亂改 code3C 產品

AI coding agent 做完都唔識停:四道閘減少佢亂改 code

XDA 作者用 Google Antigravity 起 app,功能完成後 agent 仍然繼續改,連 Stop 掣都有失靈情況。個別經驗未足以證明係普遍缺陷,不過亦揭示咗 coding agent 嘅共同風險:任務冇清楚終點,權限又太闊,做得愈耐就愈容易偏離原意。

2 個月前
Claude Opus 5 同價升級:token 效率同 Claude Code 實際有咩改變Tech News

Claude Opus 5 同價升級:token 效率同 Claude Code 實際有咩改變

Anthropic 推出 Claude Opus 5,API 單價跟 Opus 4.8 一樣,重點落喺低 effort 慳 token、100 萬 token context 同 Fast mode。對 Claude Code 同 API 團隊,升級前仲要處理 thinking 預設開啟、輸出變長同 400 error 風險。

2 個月前
Claude Opus 5 搶做 coding agent 主力:接近 Fable,限制少好多Tech News

Claude Opus 5 搶做 coding agent 主力:接近 Fable,限制少好多

Anthropic 推出 Claude Opus 5,主打複雜 coding、長時間 agent 任務同知識工作。官方話部分測試已貼近 Fable 5,標準 API 價錢只係一半,安全分類器亦冇咁易誤傷正常開發工作。不過官方跑分仲要等獨立測試驗證,香港帳戶亦未列入正式支援地區。

2 個月前
Claude Opus 5 半價追到 Fable:coding agent 應該點揀模型Tech News

Claude Opus 5 半價追到 Fable:coding agent 應該點揀模型

Anthropic 推出 Claude Opus 5,API 價錢維持 Opus 4.8 水平,能力就逼近貴一倍嘅 Fable 5。對 coding agent 用戶嚟講,模型識唔識自己驗證、會唔會突然觸發安全限制,同公司可唔可以保留零資料留存設定,實際上都重要過單一跑分。

2 個月前
Claude Code 太貴?多個本地細模型分工,慳錢之前要計清楚硬件同時間3C 產品

Claude Code 太貴?多個本地細模型分工,慳錢之前要計清楚硬件同時間

XDA 作者嫌 Claude Code 太食 token,改用多個本地 Qwen 細模型分工。個做法勝在任務清楚、權限收窄、出錯容易追,不過原文冇速度、成功率同硬件數據,未足以證明程式碼質素贏過 Claude。

2 個月前
Google CodeMender 開放有限預覽:AI 修漏洞前先落場驗證Tech News

Google CodeMender 開放有限預覽:AI 修漏洞前先落場驗證

CodeMender 由研究項目走到有限公開預覽,識得掃描程式碼、建立 PoC 驗證漏洞,再產生同測試修補。呢套做法有望減少 false positive,不過代理會執行程式碼,企業要管好 sandbox、雲端資料同審批權限。

2 個月前
Claude Code 接通 iOS Simulator:寫 Code、試畫面同改 App 一條龍3C 產品

Claude Code 接通 iOS Simulator:寫 Code、試畫面同改 App 一條龍

Claude Code Desktop 加入 iOS Simulator 專用面板,可以 build、啟動同操作開發中嘅 app,再按畫面結果改 code。呢個 public beta 補上 AI 編程工具一直欠缺嘅視覺回饋,不過只限指定計劃、Mac 本機 session,而且截圖保存安排要睇清楚。

3 個月前
Vibecoding 推高 App Store 新作量,下載只升 2% 暴露另一道難關3C 產品

Vibecoding 推高 App Store 新作量,下載只升 2% 暴露另一道難關

Sensor Tower 估算指,App Store 今年上半年多咗約 56 萬款新 app,按年接近翻倍,下載量就只升 2%。AI coding tools 的確令更多人交到成品,不過 app 愈出愈快,用家時間冇跟住增加,獨立開發者要面對嘅競爭反而更迫。

3 個月前
Kimi K3 暫停個人新訂閱,Kimi Code 權益就嚟獨立計Tech News

Kimi K3 暫停個人新訂閱,Kimi Code 權益就嚟獨立計

Kimi K3 上線後需求急升,官方暫停個人新訂閱,現有會員就繼續用。免費服務同 API 暫時未有一併停用,而 Kimi Code 權益亦會獨立成另一套計劃。新用戶等唔切,仍可經 API 或轉用其他模型維持 coding workflow。

3 個月前
Kimi K3 寫前端贏 Claude,平價背後仍然食晶片同電力Tech News

Kimi K3 寫前端贏 Claude,平價背後仍然食晶片同電力

月之暗面推出 Kimi K3,前端編程排名一出即登頂,API token 單價亦低過頂級 Claude。不過獨立評測顯示,佢嘅成本優勢視乎任務同 token 用量,完整權重亦未正式放出。模型競爭愈激烈,未必會令晶片、電力同雲端需求縮水。

3 個月前
用 VS Code 加 Foam 砌本地筆記:Git、搜尋同 AI 共用 Markdown3C 產品

用 VS Code 加 Foam 砌本地筆記:Git、搜尋同 AI 共用 Markdown

VS Code 本身已經識開 Markdown、跨檔搜尋同管理 Git,再裝 Foam 就有 wikilink、backlink、daily note 同關係圖。對寫開 code、儲技術資料同用 AI agent 嘅人,最大著數係筆記、程式碼片段同專案文件可以放喺同一套純文字資料入面。

3 個月前
Claude Code sandbox 實用指南:少撳批准之前,先封好 Bash 邊界3C 產品

Claude Code sandbox 實用指南:少撳批准之前,先封好 Bash 邊界

Claude Code 內置 sandbox 可以隔離 Bash 指令,令測試、build 同改檔案少啲停低等批准。不過佢預設仍可讀取電腦大部分位置,亦留有 unsandboxed escape hatch;Read、Edit、Write、MCP 同 hooks 更有另一套邊界。開啟之前,最好先搞清楚佢保護到邊。

3 個月前
同一個裝修財務 dashboard,Codex、Claude Code、Copilot 點揀先實際3C 產品

同一個裝修財務 dashboard,Codex、Claude Code、Copilot 點揀先實際

XDA 作者叫三款 coding agent 整同一個裝修財務 dashboard,Codex 交出最完整兼最靚嘅版本,Claude Code 功能深入但介面失色,Copilot 就快得嚟做漏流程。結果幾有意思,不過測試欠缺原始碼、實際用量同自動測試,揀工具前仲要拆開睇。

3 個月前
Kimi K3 前端生成贏 Arena,coding agent 賣點係 API 平同 100 萬 token context3C 產品

Kimi K3 前端生成贏 Arena,coding agent 賣點係 API 平同 100 萬 token context

Moonshot AI 推出 2.8T 參數 Kimi K3,喺 Frontend Code Arena 排第一,API 價亦低過 Claude Fable 5 同 GPT-5.6 Sol。不過 benchmark 未足以證明整體 coding 稱王,而完整權重、授權同香港帳戶支援仍有幾個問號。

3 個月前
OpenAI Codex Micro 賣 US$230:用實體掣管理多個 coding agent 值唔值?3C 產品

OpenAI Codex Micro 賣 US$230:用實體掣管理多個 coding agent 值唔值?

OpenAI 同 Work Louder 推出 Codex Micro,用 RGB 燈、搖桿同旋鈕管理多個 Codex agent,售 US$230。概念對重度開發者有用,不過硬件建基於現有 Creator Micro 2,增值主要來自 Codex 整合同特別版設計。香港買家仲要分清楚硬件寄送同服務支援係兩回事。

3 個月前
OpenAI Codex Micro 賣 US$230:六粒 Agent 狀態鍵值唔值聯名價?Tech News

OpenAI Codex Micro 賣 US$230:六粒 Agent 狀態鍵值唔值聯名價?

Codex Micro 售 US$230,六粒 Agent Keys 可用 RGB 顯示多個 Codex task 狀態,亦可實體 approve、reject 同調校 reasoning。硬件沿用 Creator Micro 2 路線,主要分別落喺 ChatGPT 整合,同時亦有明顯平台限制。

3 個月前
Grok Build 曾上載完整 Git repo:用過嘅開發者應點樣檢查風險Tech News

Grok Build 曾上載完整 Git repo:用過嘅開發者應點樣檢查風險

Cereblab 封包測試顯示,Grok Build 0.2.93 曾將完整 Git repo 連 history 傳去 Google Cloud。SpaceXAI 已停咗功能,又承諾刪除舊數據;用過嘅開發者仍要檢查 Git history,同更換可能外傳嘅 credential。

3 個月前
MCP server 裝到成百個,coding agent 點解會慢同亂3C 產品

MCP server 裝到成百個,coding agent 點解會慢同亂

XDA 作者用 172 個 MCP tools 跑 Claude Code,發現工具定義可以食走 141k tokens。呢件事唔只係慢,仲牽涉 context 污染、工具揀錯同 token 權限風險。開發者應該按 project 開 server、收細權限,唔好一份全家桶設定走天涯。

3 個月前
阿里傳 7 月 10 日禁 Claude Code,AI 編程工具管治要認真做Tech News

阿里傳 7 月 10 日禁 Claude Code,AI 編程工具管治要認真做

TechCrunch 引述 Reuters 等報道,阿里會由 7 月 10 日起禁員工喺工作環境用 Claude Code,改推 Qoder。呢件事最值得睇嘅位,係公司用 Codex、Claude Code、Cursor 時,code、secret 同客戶資料要點劃界。

3 個月前
OpenAI Codex 入手機:搭車都可批核 AI 寫 code,香港可用性仍未明Tech News

OpenAI Codex 入手機:搭車都可批核 AI 寫 code,香港可用性仍未明

OpenAI 將 Codex 帶入 ChatGPT iOS/Android app,重點唔係喺手機寫 code,而係用手機跟進長時間任務、睇 diff、批核命令、收測試結果。對香港開發者有用,但香港帳戶同 App Store 可用性仍要標示 [待確認]。

5 個月前