
Claude Code、Codex、Antigravity 同題砌網站,差距喺收尾手勢
同一 prompt 試三個 agent,Claude Code 完成度較高。
同一個 prompt,今次主要睇產品完成度
XDA 作者 Parth Shah 今次冇叫三個 AI coding agent 砌一頁簡單 landing page;佢畀出一個高要求 sneaker launch 網站 prompt:大幅視覺、colorway selector、倒數、產品故事、規格、比較、gallery,同埋 mobile polish。佢講明用 Google Antigravity 入面嘅 Gemini 3.5(High)、Codex 入面嘅 GPT-5.5(High),同 Claude Code 入面嘅 Fable 5。呢個測試有意思,因為三個工具都識跟 checklist,分別藏喺邊個做到一個似真產品嘅頁面,少啲交功課 demo 味。

圖片:OpenAI Developers
Codex 快,但 XDA 覺得佢未夠老練
Codex 喺原文入面最明顯優點係快,同埋好識照 prompt 補齊功能:colorway、倒數、規格、產品 section、FAQ 都有。OpenAI 官方文件寫明 Codex 係 coding agent,可以寫 code、讀 codebase、review、debug 同自動化開發工作;所以快同完整,算係佢應有嘅底線。不過 XDA 作者睇落覺得佢嘅 typography 分層太近,header、subheader、正文唔夠清楚,鞋圖又唔夠似一對真 sneaker。對 website 交付嚟講,呢啲唔係 cosmetic 咁簡單,因為視覺層次差會拖低 conversion,同埋後續要 designer 或 frontend 再執好多。

圖片:Google Developers Blog
Antigravity 主要輸喺 hero 第一眼
Google Antigravity 喺呢次測試入面接近追到 Claude Code。原文作者尤其鍾意佢嘅 generated images、spacing、copy,同埋工程拆解互動:滑過編號會見到材料結構、抓地力等資料,呢種細節令頁面似賣緊一對有故事嘅鞋。Google 官方介紹 Antigravity 時,重點放喺 agent 可以喺 editor、terminal、browser 入面自己 plan、execute、verify,2.0 codelab 仲列出 standalone app、Antigravity IDE、CLI、SDK。換句話講,Antigravity 賣點唔止係寫 code,仲係管理多個 agent 嘅工作台。今次 XDA 覺得佢輸少少,主因係 hero 第一眼未夠戲劇性,產品相唔夠搶,launch page 個氣勢弱咗。

圖片:Anthropic
Claude Code 贏喺設計判斷
Claude Code 喺 XDA 呢輪最得分,關鍵係 hero、字體層次、spacing、colorway menu 同整體平衡都比較穩。Anthropic 官方講 Claude Code 跑喺 terminal,可以配合 IDE、command line tools、GitHub/GitLab 同 MCP server,亦會喺改檔或跑 command 前問 permission;產品頁同成本文件都提醒用量會按 token、model、codebase size 同 workflow 變動。呢啲背景解釋到點解 Claude Code 特別似 developer 工具:重點放喺現有 repo、測試、版本控制入面做事,生成 UI 只係其中一截。XDA 作者話佢唯一較弱係 Lookbook section 未夠 campaign 感,但整體最平衡。
小團隊點揀
如果係 freelancer、agency 或 startup,要用 AI coding agent 快速砌 prototype、活動頁、internal tool,可以咁睇:趕時間出骨架,Codex 速度同工程工作流有優勢;想試多 agent 平行做嘢、又想經 browser/terminal 驗證流程,Antigravity 值得研究;要交一個視覺完成度較高、少啲「AI demo 味」嘅網站,XDA 呢次結果就偏向 Claude Code。不過呢個只係單一作者用單一 prompt 嘅體驗,唔好當成總排名。真正揀工具,要睇你團隊有冇 designer、code review 習慣、測試要求,同埋日後邊個維護。
AI coding agent 最花時間係收尾
呢類工具而家最易令人誤判嘅地方,係 demo 好快出到,但交付成本藏喺最後 20%。字體 hierarchy、mobile spacing、圖片可信度、互動狀態、accessibility、error state、component 命名、測試覆蓋,呢啲全部都會影響維護成本。AI agent 如果只係幫你慳第一日,之後要人手執三日,條數未必抵;如果佢可以交到一個有結構、可 review、容易改嘅版本,咁先值得放入正式 workflow。下一步要睇嘅係更多實際 repo 測試:有 API、有 auth、有錯誤處理、有 deploy,先睇到邊個真係靠得住。
參考來源
- XDA Developers — I asked Claude Code, Codex, and Google Antigravity to build the same complex website – only one felt like a seasoned developer — original report
- Codex | OpenAI Developers — 確認 Codex 官方定位、功能範圍同支援計劃。
- Claude Code by Anthropic | AI Coding Agent, Terminal, IDE — 確認 Claude Code 喺 terminal、IDE、Slack 等工作方式同權限說法。
- Manage costs effectively - Claude Code Docs — 補充 Claude Code token 成本、團隊試行同用量管理。
- Build with Google Antigravity, our new agentic development platform — 確認 Antigravity 係 agentic development platform,重點係 plan、execute、verify 同 manager surface。
- Getting Started with Google Antigravity — 確認 Antigravity 2.0 可用產品形態、系統支援同安裝要求。
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







