AI coding agent 做完都唔識停:四道閘減少佢亂改 code
3C 產品

AI coding agent 做完都唔識停:四道閘減少佢亂改 code

圖片:via XDA Developers — https://www.xda-developers.com/antigravity-build-app-wouldnt-stop-working/
TechLab 編輯部(譯)·

用完成條件、短 session、Git checkpoint 同最小權限管住 agent

功能做完,個 agent 仲未覺得收工

XDA 作者 Anurag Singh 話,Google Antigravity 由零起一個 app 嗰段相當強:佢會拆工作、平行處理介面同程式邏輯,再自己測試。不過當第一版已經做到要求,agent 有時仍然繼續執細節、改無關部分,甚至重複同一個失敗指令。作者亦試過介面失去反應,撳 Stop 都停唔到。Google AI Developers Forum 今年亦有人回報相近情況,要離開 workspace 或重開程式先攞返控制權;呢啲都係用家個案,暫時未見 Google 公布一個適用於所有案例嘅統一根因。

Google Antigravity Editor 同 Agent Manager 介面,展示開發者點樣監察多個 coding agent

圖片:Google Developers Blog

自主能力愈強,「完成」就愈要寫得實

Google 對 Antigravity 嘅定位,本身就係畀 agent 跨 editor、terminal 同 browser 自己規劃、執行同驗證,仲可以放喺背景長時間工作。問題係「整好個 app」「順便執靚啲」呢類要求冇天然終點:測試過關之後,agent 仍然搵得到可以重構、補註解或者調 UI 嘅地方。模型未必知道邊項改善值得冒險,亦唔知道你想保留邊啲現有行為。完成條件其實同時限制咗改動範圍,可以直接減低 agent 自把自為擴充任務嘅機會。

Google Antigravity 人手審批設定畫面,用嚟控制 agent 執行動作前要唔要確認

圖片:Google Developers Blog

Definition of done 要寫埋邊啲嘢唔准掂

一個實用任務可以咁落:只修改指定功能;保留公開 API 同資料格式;指定測試全部通過就停止;唔好重構無關檔案;最多用兩種方法處理同一個 blocker,仍然失敗就回報;完成後列出改過嘅檔案、測試結果同剩低風險,唔好再加改善。 呢段比「幫我修好」長少少,但 agent 有咗可驗證終點、禁區同失敗出口。尤其係「遇到 blocker 就回報」嗰句,可以截斷反覆跑指令、修一處又整壞另一處嗰種循環。

一個 session 只處理一件可驗收嘅事

XDA 作者認為長對話累積太多舊指示後,Antigravity 嘅判斷會變差;呢點屬於佢嘅使用觀察,唔宜當成所有 coding agent 都必然出現嘅定律。不過拆短 session 仍然係好實際嘅做法:起第一版、加登入、修付款錯誤各開一段新對話,每次只帶現況、相關檔案同驗收條件。交接資料可以放入一份短 Markdown,記低架構決定、已知問題同點樣跑測試。用 Codex、Claude Code 或其他 agent 都一樣,context 整理得乾淨,就冇咁容易翻舊帳,行返已經放棄嘅方向。

Git checkpoint 要喺 agent 開工前整好

每個任務開始前先留一個可運行 commit,再開獨立 branch;同時跑幾個 agent,就用 Git worktree 分開目錄,避免兩邊一齊改同一批檔案。完成後先睇 diff、跑測試,再決定合唔合併。Claude Code 官方文件提到內置 checkpoint 可以還原 session 內嘅檔案修改,但 remote API、database、部署同其他外部動作唔包喺裏面,所以 Git checkpoint 仍然取代唔到。涉及 migration 或 production 資料,最好由人手確認,agent 只負責準備同驗證。

最小權限先至係有效嘅煞車

Google 現行文件將 terminal 設定分成 Request Review 同 Always Proceed,後者亦直接標成高風險;Strict Mode 會要求 terminal 指令逐次確認、限制 workspace 外存取,同啟用 sandbox。Antigravity CLI 亦有 deny、ask、allow 三層規則,官方例子會擋 sudo、破壞性刪除同寫入 SSH 目錄。權限唔好因為 agent 頭幾次做得啱就一次過放盡:普通改 code 只開 workspace 讀寫同必要測試,網上存取、安裝套件、Git push、雲端操作逐項問。Stop 掣只係介面控制;權限設定收得夠窄,就算遲幾秒先停到,agent 可以造成嘅改動都有限。

安全問題要同介面卡死分開睇

Pillar Security 今年披露過 Antigravity 原生檔案搜尋工具嘅參數注入漏洞,攻擊者可用惡意內容引導 agent 繞過 Secure Mode 執行程式;研究披露時間線顯示,Google 接納咗報告,2 月 28 日標示已修正。呢宗漏洞唔等於 XDA 遇到嘅循環有惡意成分,但佢證明只盯住 terminal 指令未必涵蓋所有工具路徑。如果 Stop 失靈,穩陣處理係終止個 session 或程式,跟住先查 Git 狀態、完整 diff、測試結果同有冇外部副作用,唔好直接接住舊對話叫 agent 自己執手尾。

coding agent 可以大幅縮短起第一版嘅時間,但 freelancer 同細團隊尤其要守住四道閘:任務有明確終點、session 夠短、每次改動有 Git checkpoint、權限按工作逐項開。做到呢幾步,就算 agent 偶爾唔識停,清理範圍都仲係可控。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook