TAG

#AI 編程

38 篇文章

TechLab 所有關於「AI 編程」嘅文章、評測同教學,由最新排起。

Linus 用 AI 追 Intel GPU bug:肯做苦工,但幾次叫人放棄3C 產品

Linus 用 AI 追 Intel GPU bug:肯做苦工,但幾次叫人放棄

Intel Xe GPU driver 一個記憶體邊界錯誤,令部分機器開機後黑畫面。Linus Torvalds 用 AI 幫手加診斷碼同分析數據,但 AI 幾次判定問題無解。呢次經歷幾具體咁示範咗 coding agent 擅長咩,同點解工程師仍然要掌舵。

17 小時前
AI 寫 Obsidian 插件愈來愈快,安裝前要識睇呢幾個風險訊號3C 產品

AI 寫 Obsidian 插件愈來愈快,安裝前要識睇呢幾個風險訊號

Obsidian 插件數量急升,AI 又令整插件快咗好多。不過 AI 有份寫,唔代表插件一定危險;安裝前應該睇維護狀態、更新紀錄、GitHub issues、官方評分,亦要留意插件會接觸幾多筆記同電腦資料。

2 天前
Debian 開投票定 AI 寫 code 規矩:披露、版權同責任點樣計3C 產品

Debian 開投票定 AI 寫 code 規矩:披露、版權同責任點樣計

Debian Developer 正喺度表決點樣處理 AI-assisted contribution,選項由全面禁止到附條件接受都有。對用 Codex、Copilot 參與開源項目嘅 developer,最實際係搞清楚披露、授權、敏感資料同人工審核責任。

6 天前
Cursor 正式歸入 SpaceXAI:模型選擇、收費同程式碼私隱會點變?3C 產品

Cursor 正式歸入 SpaceXAI:模型選擇、收費同程式碼私隱會點變?

SpaceX 已完成收購 Cursor,後者會加入 SpaceXAI 團隊開發 Cursor、Grok Build 同 Grok Bot。交易本身已落實,但模型會唔會減少、訂閱點改、程式碼資料會點處理,官方暫時都未交代清楚。

8 天前
Spotify Xirp 幫 AI coding agents 補齊企業系統背景Tech News

Spotify Xirp 幫 AI coding agents 補齊企業系統背景

Claude Code、Codex 同 Gemini 識得睇 code,未必知道改動會連累邊個服務。Spotify 推出 Xirp 管理多個 agent session,再用 Portal 補上服務依賴、負責團隊同架構決策。不過企業 context 帶來嘅權限同資料外洩風險,一樣要有人管。

9 天前
Claude Code 預設開 Auto mode:少撳批准,分類器代你把關Tech News

Claude Code 預設開 Auto mode:少撳批准,分類器代你把關

Claude Code 就嚟預設用 Auto mode,由獨立分類器逐次判斷工具操作,減少開發者不停撳批准。用落方便過手動審批,亦有幾重安全檢查,但分類器仍有漏判,涉及刪資料、推送程式碼同改權限時,唔應該當佢係最後防線。

13 天前
Claude Code sessions 識互相傳話:多 agent 開發少咗人肉搬摘要3C 產品

Claude Code sessions 識互相傳話:多 agent 開發少咗人肉搬摘要

Claude Code 2.1.224 加入 cross-session messaging,兩個獨立 session 可以互報 API 改動、測試結果同阻塞位。功能幾實用,不過佢只係一條文字通知通道,唔會搬走完整對話、檔案或權限,跨機傳送亦有另一套規矩。

14 天前
Claude Code 兩個獨立 session 識互通:研究交接快咗,權限照樣各自把關3C 產品

Claude Code 兩個獨立 session 識互通:研究交接快咗,權限照樣各自把關

Claude Code v2.1.224 加入跨 session 訊息,兩個獨立工作中嘅 Claude 可以交換研究結果、API 改動同進度。功能慳返人手複製貼上,不過每個 session 仍然有自己嘅 context 同權限,收到嘅內容亦唔應直接當成可信指令。

15 天前
Meta Muse Code 平價攻 Claude Code、Codex,慳錢背後要計埋私隱成本Tech News

Meta Muse Code 平價攻 Claude Code、Codex,慳錢背後要計埋私隱成本

Muse Code 用低至每百萬輸入 token 0.1 美元搶開發者,尤其啱長時間處理大型 codebase。不過平價方案要同意 Meta 用使用活動改善產品,加上香港帳戶、付款支援仲未確認,企業用之前要計清楚資料風險。

17 天前
Cursor 為 Composer 改造 MoE 訓練:MoK 點樣拆走跨 GPU 樽頸Tech News

Cursor 為 Composer 改造 MoE 訓練:MoK 點樣拆走跨 GPU 樽頸

Cursor 開源 MoE 訓練 megakernel「MoK」,將跨 GPU 傳送 token 同專家運算放入同一個核心。官方話 Composer 訓練吞吐量升咗 41%,不過呢個係大型 Blackwell 叢集嘅內部結果,同 Cursor 寫 code 快唔快係兩回事。

18 天前
Cursor 用量頁一度收起逐筆成本:token 有數,帳單仍然難自己核對Tech News

Cursor 用量頁一度收起逐筆成本:token 有數,帳單仍然難自己核對

Cursor 7 月 31 日一度刪走個人同 Teams 用量頁嘅逐筆美元成本,連 CSV 同舊記錄都受影響,翌日先撤回。介面恢復唔代表計費變簡單:模型牌價、Cursor 名義成本同實際額外收費,本身就係三盤數。

19 天前
VS Code 追到 AI IDE 幾近?Cursor、Kiro、Devin 點揀3C 產品

VS Code 追到 AI IDE 幾近?Cursor、Kiro、Devin 點揀

VS Code 加入完整 agent 管理、BYOK 同多 agent 支援後,同專用 AI IDE 嘅距離已經細咗好多。不過 Cursor 嘅預測輸入、Antigravity 嘅平行 agent、Kiro 嘅規格先行同 Devin Desktop 嘅團隊管理,仍然各有明確用途。

20 天前
用本地 LLM 代替 Claude Code:慳咗月費,邊類開發工作真係頂得上?3C 產品

用本地 LLM 代替 Claude Code:慳咗月費,邊類開發工作真係頂得上?

XDA 作者取消每月 US$20 嘅 Claude Pro,改用 Continue、Docker Model Runner 同 Qwen2.5-Coder 14B。呢套組合冇固定用量上限,日常補碼同細修正幾實用,不過 16GB RAM 只係勉強夠,大型跨檔案改動、測試同 agent 自主執行仍然追唔上 Claude Code。

21 天前
叫 AI 寫少啲 code:由加功能轉去刪重複邏輯,點樣先唔會愈改愈亂3C 產品

叫 AI 寫少啲 code:由加功能轉去刪重複邏輯,點樣先唔會愈改愈亂

AI coding agent 好識加功能,亦好容易為每個要求另開一套邏輯。叫佢搵重複功能同 dead code 的確實用,不過落手刪之前,要先鎖住現有行為,再用細 diff、細 commit 同人工 review 控制風險。

22 天前
Claude Code sub-agents 幾時幫到手?拆工、驗收同隔離先決定快定慢3C 產品

Claude Code sub-agents 幾時幫到手?拆工、驗收同隔離先決定快定慢

Claude Code sub-agents 可以將搜尋、測試同大量輸出搬離主對話,亦可以平行處理獨立任務。不過交接資料一漏、幾個 agent 同時改相連程式碼,慳返嘅時間好快會喺執手尾時用晒。實際點拆工、點驗收同點限制權限,先值得開之前諗清楚。

22 天前
Claude Code 帶住 Codex 平行改碼:多 agent 值唔值得燒多一輪 token?3C 產品

Claude Code 帶住 Codex 平行改碼:多 agent 值唔值得燒多一輪 token?

codex-orchestrator 由 Claude Code 拆任務,再叫多個 Codex agent 分頭查 code、改功能同 review。XDA 個案顯示二次驗證同 journal 確實救到場,不過時間、token、權限風險同改碼衝突都會一齊放大,細 project 未必抵用。

24 天前
Kimi K3 開放權重:2.8T 模型放入 coding workflow,邊個真係用得着?Tech News

Kimi K3 開放權重:2.8T 模型放入 coding workflow,邊個真係用得着?

Kimi K3 公開咗 2.8T 參數模型權重,主打 1M context 同 coding agent。不過一般開發者多數只會經 API 用,token 單價亦未必等於整項工作平;硬件、agent 效率、授權同資料安排都要逐樣計。

26 天前
Claude Opus 5 半價逼近 Fable 5,Claude Code 用家點揀 effort 先抵Tech News

Claude Opus 5 半價逼近 Fable 5,Claude Code 用家點揀 effort 先抵

Anthropic 推出 Claude Opus 5,同上代收費一樣,部分 coding agent 測試就貼近 Fable 5。新模型識得自己驗證同修正成果,不過 effort、工具調用同分派子任務都會推高用量,Pro、Max 同 API 用戶揀模型時要分開計。

27 天前
AI coding agent 做完都唔識停:四道閘減少佢亂改 code3C 產品

AI coding agent 做完都唔識停:四道閘減少佢亂改 code

XDA 作者用 Google Antigravity 起 app,功能完成後 agent 仍然繼續改,連 Stop 掣都有失靈情況。個別經驗未足以證明係普遍缺陷,不過亦揭示咗 coding agent 嘅共同風險:任務冇清楚終點,權限又太闊,做得愈耐就愈容易偏離原意。

28 天前
Claude Opus 5 同價升級:token 效率同 Claude Code 實際有咩改變Tech News

Claude Opus 5 同價升級:token 效率同 Claude Code 實際有咩改變

Anthropic 推出 Claude Opus 5,API 單價跟 Opus 4.8 一樣,重點落喺低 effort 慳 token、100 萬 token context 同 Fast mode。對 Claude Code 同 API 團隊,升級前仲要處理 thinking 預設開啟、輸出變長同 400 error 風險。

29 天前
Claude Opus 5 半價追到 Fable:coding agent 應該點揀模型Tech News

Claude Opus 5 半價追到 Fable:coding agent 應該點揀模型

Anthropic 推出 Claude Opus 5,API 價錢維持 Opus 4.8 水平,能力就逼近貴一倍嘅 Fable 5。對 coding agent 用戶嚟講,模型識唔識自己驗證、會唔會突然觸發安全限制,同公司可唔可以保留零資料留存設定,實際上都重要過單一跑分。

29 天前
Claude Opus 5 搶做 coding agent 主力:接近 Fable,限制少好多Tech News

Claude Opus 5 搶做 coding agent 主力:接近 Fable,限制少好多

Anthropic 推出 Claude Opus 5,主打複雜 coding、長時間 agent 任務同知識工作。官方話部分測試已貼近 Fable 5,標準 API 價錢只係一半,安全分類器亦冇咁易誤傷正常開發工作。不過官方跑分仲要等獨立測試驗證,香港帳戶亦未列入正式支援地區。

29 天前
Claude Code 太貴?多個本地細模型分工,慳錢之前要計清楚硬件同時間3C 產品

Claude Code 太貴?多個本地細模型分工,慳錢之前要計清楚硬件同時間

XDA 作者嫌 Claude Code 太食 token,改用多個本地 Qwen 細模型分工。個做法勝在任務清楚、權限收窄、出錯容易追,不過原文冇速度、成功率同硬件數據,未足以證明程式碼質素贏過 Claude。

29 天前
Google CodeMender 開放有限預覽:AI 修漏洞前先落場驗證Tech News

Google CodeMender 開放有限預覽:AI 修漏洞前先落場驗證

CodeMender 由研究項目走到有限公開預覽,識得掃描程式碼、建立 PoC 驗證漏洞,再產生同測試修補。呢套做法有望減少 false positive,不過代理會執行程式碼,企業要管好 sandbox、雲端資料同審批權限。

29 天前