#AI coding
70 篇文章
TechLab 所有關於「AI coding」嘅文章、評測同教學,由最新排起。
3C 產品Qwen 3.8 27B 半小時拆商用 app:單機 AI coding 去到邊?
XDA 作者用一部 ThinkStation PGX 跑 Qwen 3.8 27B,聲稱半小時內拆解商用 app 嘅授權機制,仲整出可用繞過方案。個案反映本地模型已經識處理長程式碼任務,不過測試冇公開目標、prompt 同完整紀錄,暫時未足以證明一般人都可重現。
Tech NewsCursor Builds 預熱 Cloud Agents:省低開工等待,3 倍快要睇 repo
Cursor 用 Builds 喺背景預先拉 code、安裝 dependencies 同保存環境,等 Cloud Agents 一啟動就可以開工。方向幾實際,尤其啱大型 repo 同多 agent 並行,不過「最高快 3 倍」只係官方內部數據,實際效果會相差好遠。
Tech News微軟 Intelligent Terminal 0.2:一個視窗並行多款 coding agent
Intelligent Terminal 0.2 可以喺唔同分頁分別跑 Copilot、Claude、Codex 同 OpenCode,又加入本機模型同 WSL 支援。個方向幾啱 Windows 開發者口味,不過本機運算有指定接法,資料去向亦始終取決於所揀嘅 agent CLI。
Tech News一個 GitHub issue 點樣污染 coding agent:三款工具風險拆解
公開 repository 入面一段普通 issue 文字,原來可以借 coding agent 嘅工具同權限,影響 CI runner、讀取 secrets,甚至污染下一次 agent 執行。Novee 研究嘅三個案例各有唔同前置條件,但都指向同一個部署盲點:外部輸入同共享檔案唔可以因為經 agent 處理過,就當成可信資料。
3C 產品Claude Code 慳 token 實用設定:日常 coding 可先調去 Medium
XDA 作者用同一個 codebase 跑咗五項任務,Medium effort 產生嘅 output tokens 少過 High 約 45%。個結果值得參考,不過唔代表總 token、訂閱配額或者帳單同樣減 45%;真正實用嘅做法,係按工作難度調整 `/effort`。
3C 產品有用戶稱 Claude Code 刪錯 Windows 使用者目錄:AI agent 權限應該點鎖
有開發者聲稱 Claude Code 備份期間誤刪 Windows 使用者目錄,事後只回一句「Sorry, typo」。事件細節仲有疑點,不過當事人承認開咗 bypass 權限,已經示範咗點解 AI coding agent 唔應該任行刪除指令。
Tech NewsCursor 同 xAI 夾手訓練 Grok 4.5:AI coding 入口點樣爭
Grok 4.5 同 Cursor 一齊訓練,第三方 coding agent 測試亦追到 Codex 附近。呢次合作顯示 AI coding 競爭已經由鬥模型,擴展到開發工具、算力、產品介面同開發者回饋;不過距離證明 xAI 已經全面追平對手,仲差實際項目同長期穩定性呢兩關。
3C 產品Apple 限制漏洞報告數量:AI 搵到真 bug,亦塞爆安全團隊條 queue
Apple 為漏洞提交設上限同 30 日冷靜期,背後係 AI security agent 一口氣帶嚟大量發現。當中有真漏洞,亦有未驗證推論;安全團隊要逐份分辨,結果連有效報告同軟件修補速度都受拖累。
Tech NewsMeta Muse Code 挑戰 Codex、Claude Code:平價主攻長時間 coding task
Meta 推出終端 coding agent Muse Code beta,用 Muse Spark 1.2 跑多個常駐背景 agents,遇上崩潰亦可以接住做。價錢低過 Claude Sonnet 5,但多 agent 長跑會食幾多 token、權限控制夠唔夠細,同香港帳戶有冇 API 可用,暫時仲未完全講清楚。
3C 產品Zed 對 Cursor:貪原生速度同 AI agent,轉 editor 前要計清呢幾筆
Zed 用 Rust 同自家 GPUI 換取輕快反應,而家又接到 Codex 等外部 agent,對嫌 Cursor 愈用愈重嘅開發者幾吸引。不過 XDA 今次只係單一作者用咗一星期嘅體驗,冇公開 RAM、啟動時間或測試環境;轉唔轉,仲要計 extension、AI 用量同團隊政策。
Tech NewsMeta Muse Code 挑戰 Claude Code 同 Codex,平價背後要交出幾多程式碼?
Meta 推出 Muse Code beta,用 Muse Spark 1.2 接手大型程式庫、協調背景 agent,死機後亦可以接住做。設計方向幾啱長任務,不過香港資格、1.2 正式收費同 Contributor 資料條款仍未完全核實,未適合直接擺入公司核心項目。
3C 產品Claude Code 模型揀得少反而易用?Sonnet、Opus、Haiku 點分工
AI coding 工具塞滿唔同供應商嘅模型,睇落選擇多,實際每次開工都要重新估速度、成本同能力。Claude Code 用較短嘅模型清單減少切換成本,Sonnet、Opus、Haiku 亦有清楚分工,不過呢套做法同時綁住 Anthropic 生態。
3C 產品Zed 可唔可以取代 VS Code?拆解 AI agent 工作台優勢同轉會代價
Zed 已經可以喺同一個 sidebar 管理 Codex、Claude 同其他 coding agent,ACP 同 Terminal Threads 亦照顧到圖形介面、CLI 兩種玩法。不過效能宣傳未有獨立同機實測,而 VS Code extension 相容性仍然係轉會前最實際嗰關。
Tech NewsApple 為漏洞懸賞報告加配額:AI 搵到線索,研究員仲要交到證據
Apple 由 6 月起限制每名研究員提交漏洞報告嘅數量,另設 30 日冷靜期。改動冇封閉懸賞計劃,亦冇全面拒收 AI 輔助研究;重點係提交者要重現問題、證明實際影響,再交出可用 PoC,唔可以直接轉寄模型推測。
Tech NewsQwen3.8-Max API 平過 Claude,2.4 兆權重開放都唔代表人人自建
阿里巴巴用 2.4 兆參數、長時間 coding agent 同進取 API 收費推 Qwen3.8-Max,不過官方 benchmark 未有獨立驗證。香港開發者用得到唔代表資料一定留港,而開放權重亦唔代表普通公司有條件自己部署。
3C 產品Apple 限制漏洞報告數量:AI coding agent 搵到 bug,驗證跟唔上
AI coding agent 掃 code 愈來愈快,Apple 收到嘅漏洞報告亦多到要設提交上限。不過真正拖慢安全團隊嘅,係大量未經驗證、無法重現同重複嘅發現。識用 AI 搵 bug 只係起步,交得出可靠 PoC、講得清攻擊影響,先有機會獲處理。
Tech NewsVibe coding 砌 app 快到飛起,上線前先補返呢幾個安全洞
The Verge 報道多個 vibe-coded app 出現 SQL injection、冇 auth、資料外洩風險。重點好簡單:只要 app 連到客戶資料、付款、會員戶口,佢就要按正式系統處理,booking、CRM、內部 dashboard 都走唔甩。
3C 產品唔識 coding 靠 Claude 整家庭 app:原型做到,私隱同維護要自己執
Android Authority 作者用 Claude 整咗一個每日都用到嘅家庭管理 PWA,證明少量 coding 經驗都可以砌出貼身工具。不過同步、權限、備份同保安全部要自己負責,放入家庭行程、住址或物資紀錄之前,仲有一大輪功夫要做。
3C 產品搵唔到啱用 app?用 AI coding agent 整件只服務自己嘅小工具
AI coding agent 最啱幫你整嗰類市面冇人會賣、但每日真係用得着嘅小工具。檔案改名、家居庫存、NAS dashboard 都可以由簡單版本開始,不過本機運行、LAN 分享同公開上網,三者嘅安全要求差好遠,好多新手未必察覺。
3C 產品Cursor 點讀 project:揀 AI coding 工具仲要睇索引、rules 同私隱
XDA 作者認為 Cursor 勝在理解成個 project,不過呢句容易令人誤會。模型每次只會收到工具搵出嚟嘅部分檔案;真正影響結果嘅,係搜尋方式、context 揀選、project rules 同私隱設定。
Tech NewsAI agent 接手寫 code:團隊點重整 spec、review 同 CI/CD
AI coding agent 已經可以包辦生成、測試同除錯,不過 code 出得快,review、安全檢查同責任分工亦更易塞車。團隊要拆細 spec、設獨立驗收條件、收窄 agent 權限,再用交付品質衡量成效。
Tech NewsKimi K3 點解令市場緊張:開放權重、coding 成績同成本逐樣拆
Moonshot AI 推出 Kimi K3,靠 coding、agent 能力同開放權重承諾搶盡焦點。不過獨立測試顯示,佢做複雜工作又慢又食 token;香港開發者仲要核實付款、授權同資料處理條款,未係可以閉眼搬入 production 嘅模型。
3C 產品Google Antigravity 2.0 實際做到咩?由拆需求到改檔測試一次講清
Antigravity 2.0 可以接住一個模糊要求,先拆計劃,再跨檔案改 code、跑測試同整理結果。方便背後亦代表佢攞到相當高權限,開發者要識得用 worktree、收窄 terminal 權限,同逐段覆核改動。
Tech NewsClaude Opus 5 半價講法要睇清:coding agent 慳幾多要計 effort
Claude Opus 5 用 Fable 5 一半 token 單價,官方 coding benchmark 亦交到接近甚至高過 Fable 嘅成績。不過呢次冇減 Opus 價,effort、Fast mode、agent 重試次數同安全 fallback,先會決定每項工作最後慳到幾多。