
AI coding agent 做完都唔識停:四道閘減少佢亂改 code
用完成條件、短 session、Git checkpoint 同最小權限管住 agent
功能做完,個 agent 仲未覺得收工
XDA 作者 Anurag Singh 話,Google Antigravity 由零起一個 app 嗰段相當強:佢會拆工作、平行處理介面同程式邏輯,再自己測試。不過當第一版已經做到要求,agent 有時仍然繼續執細節、改無關部分,甚至重複同一個失敗指令。作者亦試過介面失去反應,撳 Stop 都停唔到。Google AI Developers Forum 今年亦有人回報相近情況,要離開 workspace 或重開程式先攞返控制權;呢啲都係用家個案,暫時未見 Google 公布一個適用於所有案例嘅統一根因。

圖片:Google Developers Blog
自主能力愈強,「完成」就愈要寫得實
Google 對 Antigravity 嘅定位,本身就係畀 agent 跨 editor、terminal 同 browser 自己規劃、執行同驗證,仲可以放喺背景長時間工作。問題係「整好個 app」「順便執靚啲」呢類要求冇天然終點:測試過關之後,agent 仍然搵得到可以重構、補註解或者調 UI 嘅地方。模型未必知道邊項改善值得冒險,亦唔知道你想保留邊啲現有行為。完成條件其實同時限制咗改動範圍,可以直接減低 agent 自把自為擴充任務嘅機會。

圖片:Google Developers Blog
Definition of done 要寫埋邊啲嘢唔准掂
一個實用任務可以咁落:只修改指定功能;保留公開 API 同資料格式;指定測試全部通過就停止;唔好重構無關檔案;最多用兩種方法處理同一個 blocker,仍然失敗就回報;完成後列出改過嘅檔案、測試結果同剩低風險,唔好再加改善。 呢段比「幫我修好」長少少,但 agent 有咗可驗證終點、禁區同失敗出口。尤其係「遇到 blocker 就回報」嗰句,可以截斷反覆跑指令、修一處又整壞另一處嗰種循環。
一個 session 只處理一件可驗收嘅事
XDA 作者認為長對話累積太多舊指示後,Antigravity 嘅判斷會變差;呢點屬於佢嘅使用觀察,唔宜當成所有 coding agent 都必然出現嘅定律。不過拆短 session 仍然係好實際嘅做法:起第一版、加登入、修付款錯誤各開一段新對話,每次只帶現況、相關檔案同驗收條件。交接資料可以放入一份短 Markdown,記低架構決定、已知問題同點樣跑測試。用 Codex、Claude Code 或其他 agent 都一樣,context 整理得乾淨,就冇咁容易翻舊帳,行返已經放棄嘅方向。
Git checkpoint 要喺 agent 開工前整好
每個任務開始前先留一個可運行 commit,再開獨立 branch;同時跑幾個 agent,就用 Git worktree 分開目錄,避免兩邊一齊改同一批檔案。完成後先睇 diff、跑測試,再決定合唔合併。Claude Code 官方文件提到內置 checkpoint 可以還原 session 內嘅檔案修改,但 remote API、database、部署同其他外部動作唔包喺裏面,所以 Git checkpoint 仍然取代唔到。涉及 migration 或 production 資料,最好由人手確認,agent 只負責準備同驗證。
最小權限先至係有效嘅煞車
Google 現行文件將 terminal 設定分成 Request Review 同 Always Proceed,後者亦直接標成高風險;Strict Mode 會要求 terminal 指令逐次確認、限制 workspace 外存取,同啟用 sandbox。Antigravity CLI 亦有 deny、ask、allow 三層規則,官方例子會擋 sudo、破壞性刪除同寫入 SSH 目錄。權限唔好因為 agent 頭幾次做得啱就一次過放盡:普通改 code 只開 workspace 讀寫同必要測試,網上存取、安裝套件、Git push、雲端操作逐項問。Stop 掣只係介面控制;權限設定收得夠窄,就算遲幾秒先停到,agent 可以造成嘅改動都有限。
安全問題要同介面卡死分開睇
Pillar Security 今年披露過 Antigravity 原生檔案搜尋工具嘅參數注入漏洞,攻擊者可用惡意內容引導 agent 繞過 Secure Mode 執行程式;研究披露時間線顯示,Google 接納咗報告,2 月 28 日標示已修正。呢宗漏洞唔等於 XDA 遇到嘅循環有惡意成分,但佢證明只盯住 terminal 指令未必涵蓋所有工具路徑。如果 Stop 失靈,穩陣處理係終止個 session 或程式,跟住先查 Git 狀態、完整 diff、測試結果同有冇外部副作用,唔好直接接住舊對話叫 agent 自己執手尾。
coding agent 可以大幅縮短起第一版嘅時間,但 freelancer 同細團隊尤其要守住四道閘:任務有明確終點、session 夠短、每次改動有 Git checkpoint、權限按工作逐項開。做到呢幾步,就算 agent 偶爾唔識停,清理範圍都仲係可控。
參考來源
- XDA Developers — I let Antigravity build an app and it wouldn't stop working, even after I told it to — original report
- Build with Google Antigravity, our new agentic development platform — Google 官方介紹 Antigravity 跨 editor、terminal、browser 自主規劃同驗證嘅產品設計
- Google Antigravity IDE Settings — 核對 Request Review、Always Proceed、Strict Mode、workspace 隔離同 terminal sandbox 設定
- Google Antigravity CLI Permissions — 核對 deny、ask、allow 權限規則同官方限制高風險指令嘅例子
- Agent stuck can't be stopped — Google 開發者論壇嘅獨立用家回報,用嚟交叉核實 Stop 掣失靈案例
- Prompt Injection leads to RCE and Sandbox Escape in Antigravity — 原始安全研究、技術細節同 Google 修正時間線
- How Claude Code works — 核對 Claude Code checkpoint 同權限機制,以及外部副作用唔受檔案 checkpoint 保護嘅限制
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







