#AI coding
40 篇文章
TechLab 所有關於「AI coding」嘅文章、評測同教學,由最新排起。
3C 產品Docker Model Runner 可唔可以取代 Ollama?轉唔轉要睇開發流程
Docker Model Runner 已經做到拉模型、GPU 加速、OpenAI/Ollama-compatible API,仲可以直接接入 Compose。不過對用開 Ollama 嘅人,功能齊唔代表值得搬;值唔值得轉,主要睇模型格式、平台支援同現有開發流程。
Tech NewsKimi K3 前端 coding 登頂:平價百萬 token 模型值唔值得開發者轉用?
Moonshot AI 推出 Kimi K3,靠前端 coding、百萬 token context 同較低 API 價錢搶眼球。獨立評測顯示佢部分能力已經貼近頂級模型,不過速度、幻覺、agent 相容性同企業資料處理仍有數要計,現階段較適合小規模試跑。
3C 產品Flathub 標記嘅 AI app 七成停更,vibe coding 留低一筆維護賬
有人翻查 Flathub 標上「AI Slop」標籤嘅 submission,發現 120 個相關 repository 入面,88 個已停更或者消失。不過呢批數據冇普通 app 對照組,證明唔到 AI 直接令人棄坑;佢揭示得最清楚嘅,其實係快速生成 app 點樣將維護成本推咗畀平台同用戶。
Tech News8090 融資 1.35 億美元,主攻企業 AI coding 管控
Chamath Palihapitiya 親自做 8090 CEO,再加上 1.35 億美元 Series A,反映 AI coding 工具開始由 IDE 補全,擴展到需求、work order、MCP、成本同審計。企業 IT team 要睇嘅,係佢管唔管得住 agent。
3C 產品《Mario Kart Wii》靜態重編譯上 PC:4K 有得試,無限幀率先唔好信住
Mario Kart Wiicompiled 話要將 Wii 經典賽車搬上 PC,支援 4K、網上對戰同 Retro Rewind。不過遊戲物理綁住幀率,60fps 以上仲未搞掂;AI 亦只係幫手處理程式碼,冇生成賽道、角色或者其他素材。
3C 產品Google 自己都甩期:Gemini 3.5 Pro 卡喺 coding,開發者要點部署?
Google 5 月明講 Gemini 3.5 Pro 會喺下個月推出,但去到 7 月中仍然未見影。Bloomberg 報道指模型主要卡喺 coding 能力,更新訓練資料後亦未達內部預期。延誤未至於令 Gemini API 停擺,不過足以打亂開發者測試新模型同部署 coding agents 嘅時間表。
3C 產品Gemini 3.5 Pro 錯過六月死線,Google 卡喺最睇重嘅 coding 能力
Google I/O 預告 Gemini 3.5 Pro 六月推出,但限期過咗仍然冇影。Bloomberg 指模型嘅 coding 表現未達內部目標,六月尾調整訓練資料亦未見理想結果;Google只確認模型仍在測試,未有交代新日期。
3C 產品Devin Desktop 管得住一班 coding agents,但未去到完勝 Claude Code
Vibe coding 去到認真 project,麻煩通常由第二輪修改先開始。Devin Desktop 將本機同雲端 agents、程式碼、PR 同 project context 放返喺同一個 IDE,方便開發者隨時介入;不過 XDA 嘅使用體驗未足以證明佢全面贏過 Claude Code 或 Google Antigravity。
Tech NewsAI coding agent 寫得快,工程師要守住邊六個開發關口?
AI agent 可以快手產 code 同砌 prototype,但由需求定義、task 拆解、測試、code review、安全檢查到最後驗收,仍然要有人守住。官方文件清楚保留 review 閘口,獨立研究亦只證實部分產量提升,未證實整體成本會按比例下降。
Tech NewsClaude Sonnet 5 上線:coding agent 平咗,但 token 帳要重計
Anthropic 推 Claude Sonnet 5,主攻 coding agent 同多步任務。價錢睇落低過 Opus 4.8,但新 tokenizer 令同一段 prompt token 數可能高咗,企業同開發 team 要重計每次任務成本。
Tech NewsMeta 平價 API 推 Muse Spark 1.1,開發者值唔值得試?
Meta 用 Muse Spark 1.1 同 Meta Model API 入場,價錢平過一線對手,仲有 $20 credit。但係 public preview 官方只寫開畀美國開發者,香港團隊暫時要當觀望,先睇自家 workflow 跑唔跑得穩。
3C 產品Claude Code、Codex、Antigravity 同題砌網站,差距喺收尾手勢
XDA 作者用同一個複雜 sneaker 網站 prompt 試 Claude Code、Codex 同 Google Antigravity。三個都交到頁面,但差距出喺字體層次、hero、互動細節同可維護性;對小團隊嚟講,揀 agent 要睇收尾能力,唔好淨係睇速度。
Tech NewsGrok 4.5 入 Cursor:平過 Claude,公司 code 可唔可以畀佢睇
Grok 4.5 已經入咗 Cursor,同時開放 SpaceXAI API。官方價錢係每百萬 input token 2 美元、output 6 美元,平過唔少旗艦模型;但 Cursor 明講訓練用過大量 Cursor data,公司 code 同客戶資料點處理,要睇 Privacy Mode、ZDR 同 API retention。
Tech NewsGrok 4.5 平價殺入 AI coding,開發 team 要計每個任務成本
Grok 4.5 主打 coding agent 同知識工作,API 價平過 GPT-5.5 同 Opus 4.8,但真正值唔值得轉,要睇每個成功任務用幾多 token、幾多工具 call,同你用唔用到 cache。
3C 產品Grok 4.5 推出:X 訂閱可以睇,Cursor 同 Office 用家要計成本
Grok 4.5 喺 2026 年 7 月 8 日推出,官方主打 coding agent、Excel workbook、PowerPoint 同 Word 文件,API 定價 US$2/US$6 per million input/output tokens。真正要計係 Cursor、Grok Build 或 API 入面,任務成功率同覆改成本夠唔夠低。
Tech NewsAndroid Bench更新:Claude Fable 5跑贏,Gemini排後,成本同私隱要計
Google 7月8日更新 Android Bench,Claude Fable 5以84.5分排第一,Gemini 3.1 Pro Preview排第五。呢份榜對Android開發有參考價值,但真用coding agent仲要計IDE整合、token成本同公司codebase可唔可以交畀雲端模型。
3C 產品Android Bench 換評測方法:AI 寫 Android app 排名要重新睇
Google 更新 Android Bench,改用 Harbor framework 評測 AI model 寫 Android code,仲開放開發者提交任務。Fable 5 截至 2026 年 7 月 8 日排第一,不過今次最值得睇係方法轉咗:揀 coding agent,要用自己 app codebase 再試一次。
3C 產品Antigravity 2.0 午飯時間寫到 app,細 team 要先諗點驗貨
XDA 作者用 Google Antigravity 2.0 由零砌 habit tracker microservice,結果似樣過普通 demo。睇完最值得諗嘅位:開發者未至於即刻冇用,但細 team 會俾大量「似啱」嘅 code 追住,要補返架構、測試、權限同安全驗收。
Tech NewsBase44 自研 Base 1,AI coding 工具開始鬥 UI 風格
Base44 推出自研 Base 1,官方話已喺平台使用。表面睇係想擺脫 AI app 倒模 UI,背後仲有成本、數據同平台控制權;香港 startup 用嚟砌 MVP,仍然要睇可維護性。
3C 產品Windsurf 變 Devin Desktop:AI coding 之後要識管 agent
XDA 作者近日揀 Devin Desktop 做首選 AI coding 工具,但件事唔只係口味問題。Windsurf 改名後,Cognition 主打用 Kanban 管多個 agent,小 team 揀工具前要諗清楚成本、私隱同審批。
3C 產品AI agent 幫手 port 舊 engine:《Zero Hour》跑上 iPhone 真正勁喺邊
Ammaar Reshi 用 Claude Fable 5 / Claude Code,將《Command & Conquer: Generals Zero Hour》舊 engine 跑到 Apple Silicon、iPhone 同 iPad。呢件事比懷舊花邊實際得多:佢示範咗 AI agent 喺 legacy C++ porting 入面可以幫到邊,同埋邊啲位仍然要人手判斷。
Tech News41 年 IOCCC 再爆話題:怪到癲嘅 C code 點解仲值得工程師睇
iThome 報道 IOCCC 2025 名單出爐,官方頁列出 22 件作品。366 bytes emulator、會吐出下一幀原始碼嘅 Pong、Doctor Who ASCII 動畫,全部都係用荒謬方式講返 C 語言、compiler 同可讀性。
3C 產品Claude Code project 設定點先穩陣:權限、model 同 MCP 要逐個收窄
XDA 作者分享每個 project 都會改 Claude Code 設定,但最值得拎走嘅係:prompt 寫得幾清楚都唔等於有安全邊界。權限、deny rules、model 同 MCP scope 要分開處理,團隊設定同個人 override 都要擺啱位。
3C 產品Claude Code 加長期記憶可以慳 prompt,但公司 repo 唔可以亂畀佢記
XDA 作者用 Claude Code 內置記憶加 claude-mem,令新 session 自動接返上次專案脈絡。呢套做法慳到重複 prompt,但同時放大 codebase、客戶資料同 secret 嘅風險。