TAG

#AI coding

70 篇文章

TechLab 所有關於「AI coding」嘅文章、評測同教學,由最新排起。

Claude Opus 5 半價追 Fable 5:開發者要點計每項任務成本Tech News

Claude Opus 5 半價追 Fable 5:開發者要點計每項任務成本

Anthropic 推出 Claude Opus 5,API 定價維持 Opus 4.8 水平,官方話部分 coding 同知識工作表現貼近、甚至贏過貴一倍嘅 Fable 5。對開發者嚟講,實際帳單幾多,仲要睇 effort、prompt cache 同工具配置點樣配合。

2 個月前
Bun 11 日由 Zig 搬到 Rust:64 個 Claude agent 點樣避撞 codeTech News

Bun 11 日由 Zig 搬到 Rust:64 個 Claude agent 點樣避撞 code

Bun 用 Claude Code 喺 11 日內完成大型 Rust 遷移,最高同時跑 64 個 agent。速度夠搶眼,不過行數口徑、unsafe、測試覆蓋同真人 review 都要拆開睇,先知一般開發團隊可以學到幾多。

2 個月前
Claude Code 對 Google Antigravity:一星期後點揀先啱用3C 產品

Claude Code 對 Google Antigravity:一星期後點揀先啱用

XDA 作者連續一星期改用 Google Antigravity,發現佢砌完整 app 夠快,任務進度亦睇得清楚;Claude Code 就喺細改、debug 同介面執細節較穩。不過揀工具仲要計 quota、瀏覽器權限同 agent 可以掂到幾多檔案。

2 個月前
Corgi 否認抄 code:AI coding 點樣劃清產品參考界線Tech News

Corgi 否認抄 code:AI coding 點樣劃清產品參考界線

Corgi 否認用咗 Papermark code,但報道指雙方頁面有一模一樣嘅文案同功能叫法。呢件事值得 developer tools 圈留意:冇用同一份 code,都唔代表成個產品來源冇問題。

2 個月前
GPT-5.6 Sol/Terra/Luna 點揀:成本、cache 同安全限制Tech News

GPT-5.6 Sol/Terra/Luna 點揀:成本、cache 同安全限制

OpenAI 發布 GPT-5.6 Sol、Terra、Luna 時,先向少數 trusted partners 開放 API 同 Codex。三款模型點分工、token 點收費、安全閘有咩限制,全部都會影響 AI coding agent 嘅成本同可用性。

2 個月前
AI coding agents 約 25 美元挖出 WordPress 大洞,網站管理員要即刻更新Tech News

AI coding agents 約 25 美元挖出 WordPress 大洞,網站管理員要即刻更新

GPT-5.6 Sol Ultra 用四個 agent 長時間分析 WordPress 源碼,據報約 10 小時、折算約 25 美元就搵到可接成遙距執行程式碼嘅漏洞。研究未經獨立重跑驗證,但公開攻擊程式已經出現,網站管理員應立即更新。

2 個月前
Docker Model Runner 可唔可以取代 Ollama?轉唔轉要睇開發流程3C 產品

Docker Model Runner 可唔可以取代 Ollama?轉唔轉要睇開發流程

Docker Model Runner 已經做到拉模型、GPU 加速、OpenAI/Ollama-compatible API,仲可以直接接入 Compose。不過對用開 Ollama 嘅人,功能齊唔代表值得搬;值唔值得轉,主要睇模型格式、平台支援同現有開發流程。

2 個月前
Kimi K3 前端 coding 登頂:平價百萬 token 模型值唔值得開發者轉用?Tech News

Kimi K3 前端 coding 登頂:平價百萬 token 模型值唔值得開發者轉用?

Moonshot AI 推出 Kimi K3,靠前端 coding、百萬 token context 同較低 API 價錢搶眼球。獨立評測顯示佢部分能力已經貼近頂級模型,不過速度、幻覺、agent 相容性同企業資料處理仍有數要計,現階段較適合小規模試跑。

2 個月前
Flathub 標記嘅 AI app 七成停更,vibe coding 留低一筆維護賬3C 產品

Flathub 標記嘅 AI app 七成停更,vibe coding 留低一筆維護賬

有人翻查 Flathub 標上「AI Slop」標籤嘅 submission,發現 120 個相關 repository 入面,88 個已停更或者消失。不過呢批數據冇普通 app 對照組,證明唔到 AI 直接令人棄坑;佢揭示得最清楚嘅,其實係快速生成 app 點樣將維護成本推咗畀平台同用戶。

2 個月前
8090 融資 1.35 億美元,主攻企業 AI coding 管控Tech News

8090 融資 1.35 億美元,主攻企業 AI coding 管控

Chamath Palihapitiya 親自做 8090 CEO,再加上 1.35 億美元 Series A,反映 AI coding 工具開始由 IDE 補全,擴展到需求、work order、MCP、成本同審計。企業 IT team 要睇嘅,係佢管唔管得住 agent。

2 個月前
《Mario Kart Wii》靜態重編譯上 PC:4K 有得試,無限幀率先唔好信住3C 產品

《Mario Kart Wii》靜態重編譯上 PC:4K 有得試,無限幀率先唔好信住

Mario Kart Wiicompiled 話要將 Wii 經典賽車搬上 PC,支援 4K、網上對戰同 Retro Rewind。不過遊戲物理綁住幀率,60fps 以上仲未搞掂;AI 亦只係幫手處理程式碼,冇生成賽道、角色或者其他素材。

2 個月前
Google 自己都甩期:Gemini 3.5 Pro 卡喺 coding,開發者要點部署?3C 產品

Google 自己都甩期:Gemini 3.5 Pro 卡喺 coding,開發者要點部署?

Google 5 月明講 Gemini 3.5 Pro 會喺下個月推出,但去到 7 月中仍然未見影。Bloomberg 報道指模型主要卡喺 coding 能力,更新訓練資料後亦未達內部預期。延誤未至於令 Gemini API 停擺,不過足以打亂開發者測試新模型同部署 coding agents 嘅時間表。

2 個月前
Gemini 3.5 Pro 錯過六月死線,Google 卡喺最睇重嘅 coding 能力3C 產品

Gemini 3.5 Pro 錯過六月死線,Google 卡喺最睇重嘅 coding 能力

Google I/O 預告 Gemini 3.5 Pro 六月推出,但限期過咗仍然冇影。Bloomberg 指模型嘅 coding 表現未達內部目標,六月尾調整訓練資料亦未見理想結果;Google只確認模型仍在測試,未有交代新日期。

2 個月前
Devin Desktop 管得住一班 coding agents,但未去到完勝 Claude Code3C 產品

Devin Desktop 管得住一班 coding agents,但未去到完勝 Claude Code

Vibe coding 去到認真 project,麻煩通常由第二輪修改先開始。Devin Desktop 將本機同雲端 agents、程式碼、PR 同 project context 放返喺同一個 IDE,方便開發者隨時介入;不過 XDA 嘅使用體驗未足以證明佢全面贏過 Claude Code 或 Google Antigravity。

2 個月前
AI coding agent 寫得快,工程師要守住邊六個開發關口?Tech News

AI coding agent 寫得快,工程師要守住邊六個開發關口?

AI agent 可以快手產 code 同砌 prototype,但由需求定義、task 拆解、測試、code review、安全檢查到最後驗收,仍然要有人守住。官方文件清楚保留 review 閘口,獨立研究亦只證實部分產量提升,未證實整體成本會按比例下降。

2 個月前
Claude Sonnet 5 上線:coding agent 平咗,但 token 帳要重計Tech News

Claude Sonnet 5 上線:coding agent 平咗,但 token 帳要重計

Anthropic 推 Claude Sonnet 5,主攻 coding agent 同多步任務。價錢睇落低過 Opus 4.8,但新 tokenizer 令同一段 prompt token 數可能高咗,企業同開發 team 要重計每次任務成本。

2 個月前
Meta 平價 API 推 Muse Spark 1.1,開發者值唔值得試?Tech News

Meta 平價 API 推 Muse Spark 1.1,開發者值唔值得試?

Meta 用 Muse Spark 1.1 同 Meta Model API 入場,價錢平過一線對手,仲有 $20 credit。但係 public preview 官方只寫開畀美國開發者,香港團隊暫時要當觀望,先睇自家 workflow 跑唔跑得穩。

2 個月前
Claude Code、Codex、Antigravity 同題砌網站,差距喺收尾手勢3C 產品

Claude Code、Codex、Antigravity 同題砌網站,差距喺收尾手勢

XDA 作者用同一個複雜 sneaker 網站 prompt 試 Claude Code、Codex 同 Google Antigravity。三個都交到頁面,但差距出喺字體層次、hero、互動細節同可維護性;對小團隊嚟講,揀 agent 要睇收尾能力,唔好淨係睇速度。

2 個月前
Grok 4.5 入 Cursor:平過 Claude,公司 code 可唔可以畀佢睇Tech News

Grok 4.5 入 Cursor:平過 Claude,公司 code 可唔可以畀佢睇

Grok 4.5 已經入咗 Cursor,同時開放 SpaceXAI API。官方價錢係每百萬 input token 2 美元、output 6 美元,平過唔少旗艦模型;但 Cursor 明講訓練用過大量 Cursor data,公司 code 同客戶資料點處理,要睇 Privacy Mode、ZDR 同 API retention。

2 個月前
Grok 4.5 平價殺入 AI coding,開發 team 要計每個任務成本Tech News

Grok 4.5 平價殺入 AI coding,開發 team 要計每個任務成本

Grok 4.5 主打 coding agent 同知識工作,API 價平過 GPT-5.5 同 Opus 4.8,但真正值唔值得轉,要睇每個成功任務用幾多 token、幾多工具 call,同你用唔用到 cache。

2 個月前
Grok 4.5 推出:X 訂閱可以睇,Cursor 同 Office 用家要計成本3C 產品

Grok 4.5 推出:X 訂閱可以睇,Cursor 同 Office 用家要計成本

Grok 4.5 喺 2026 年 7 月 8 日推出,官方主打 coding agent、Excel workbook、PowerPoint 同 Word 文件,API 定價 US$2/US$6 per million input/output tokens。真正要計係 Cursor、Grok Build 或 API 入面,任務成功率同覆改成本夠唔夠低。

2 個月前
Android Bench更新:Claude Fable 5跑贏,Gemini排後,成本同私隱要計Tech News

Android Bench更新:Claude Fable 5跑贏,Gemini排後,成本同私隱要計

Google 7月8日更新 Android Bench,Claude Fable 5以84.5分排第一,Gemini 3.1 Pro Preview排第五。呢份榜對Android開發有參考價值,但真用coding agent仲要計IDE整合、token成本同公司codebase可唔可以交畀雲端模型。

2 個月前
Android Bench 換評測方法:AI 寫 Android app 排名要重新睇3C 產品

Android Bench 換評測方法:AI 寫 Android app 排名要重新睇

Google 更新 Android Bench,改用 Harbor framework 評測 AI model 寫 Android code,仲開放開發者提交任務。Fable 5 截至 2026 年 7 月 8 日排第一,不過今次最值得睇係方法轉咗:揀 coding agent,要用自己 app codebase 再試一次。

2 個月前
Antigravity 2.0 午飯時間寫到 app,細 team 要先諗點驗貨3C 產品

Antigravity 2.0 午飯時間寫到 app,細 team 要先諗點驗貨

XDA 作者用 Google Antigravity 2.0 由零砌 habit tracker microservice,結果似樣過普通 demo。睇完最值得諗嘅位:開發者未至於即刻冇用,但細 team 會俾大量「似啱」嘅 code 追住,要補返架構、測試、權限同安全驗收。

2 個月前