Claude Code、Codex、Antigravity 同題砌網站,差距喺收尾手勢
3C 產品

Claude Code、Codex、Antigravity 同題砌網站,差距喺收尾手勢

圖片:via XDA Developers — https://www.xda-developers.com/asked-claude-code-codex-google-antigravity-build-same-complex-website/
TechLab 編輯部(譯)·

同一 prompt 試三個 agent,Claude Code 完成度較高。

同一個 prompt,今次主要睇產品完成度

XDA 作者 Parth Shah 今次冇叫三個 AI coding agent 砌一頁簡單 landing page;佢畀出一個高要求 sneaker launch 網站 prompt:大幅視覺、colorway selector、倒數、產品故事、規格、比較、gallery,同埋 mobile polish。佢講明用 Google Antigravity 入面嘅 Gemini 3.5(High)、Codex 入面嘅 GPT-5.5(High),同 Claude Code 入面嘅 Fable 5。呢個測試有意思,因為三個工具都識跟 checklist,分別藏喺邊個做到一個似真產品嘅頁面,少啲交功課 demo 味。

Codex app 顯示 project sidebar 同新 chat prompt 介面

圖片:OpenAI Developers

Codex 快,但 XDA 覺得佢未夠老練

Codex 喺原文入面最明顯優點係快,同埋好識照 prompt 補齊功能:colorway、倒數、規格、產品 section、FAQ 都有。OpenAI 官方文件寫明 Codex 係 coding agent,可以寫 code、讀 codebase、review、debug 同自動化開發工作;所以快同完整,算係佢應有嘅底線。不過 XDA 作者睇落覺得佢嘅 typography 分層太近,header、subheader、正文唔夠清楚,鞋圖又唔夠似一對真 sneaker。對 website 交付嚟講,呢啲唔係 cosmetic 咁簡單,因為視覺層次差會拖低 conversion,同埋後續要 designer 或 frontend 再執好多。

Google Antigravity IDE 入面打開 Agent Manager 嘅介面

圖片:Google Developers Blog

Antigravity 主要輸喺 hero 第一眼

Google Antigravity 喺呢次測試入面接近追到 Claude Code。原文作者尤其鍾意佢嘅 generated images、spacing、copy,同埋工程拆解互動:滑過編號會見到材料結構、抓地力等資料,呢種細節令頁面似賣緊一對有故事嘅鞋。Google 官方介紹 Antigravity 時,重點放喺 agent 可以喺 editor、terminal、browser 入面自己 plan、execute、verify,2.0 codelab 仲列出 standalone app、Antigravity IDE、CLI、SDK。換句話講,Antigravity 賣點唔止係寫 code,仲係管理多個 agent 嘅工作台。今次 XDA 覺得佢輸少少,主因係 hero 第一眼未夠戲劇性,產品相唔夠搶,launch page 個氣勢弱咗。

Claude Code 回應加入測試嘅 terminal 介面示意

圖片:Anthropic

Claude Code 贏喺設計判斷

Claude Code 喺 XDA 呢輪最得分,關鍵係 hero、字體層次、spacing、colorway menu 同整體平衡都比較穩。Anthropic 官方講 Claude Code 跑喺 terminal,可以配合 IDE、command line tools、GitHub/GitLab 同 MCP server,亦會喺改檔或跑 command 前問 permission;產品頁同成本文件都提醒用量會按 token、model、codebase size 同 workflow 變動。呢啲背景解釋到點解 Claude Code 特別似 developer 工具:重點放喺現有 repo、測試、版本控制入面做事,生成 UI 只係其中一截。XDA 作者話佢唯一較弱係 Lookbook section 未夠 campaign 感,但整體最平衡。

小團隊點揀

如果係 freelancer、agency 或 startup,要用 AI coding agent 快速砌 prototype、活動頁、internal tool,可以咁睇:趕時間出骨架,Codex 速度同工程工作流有優勢;想試多 agent 平行做嘢、又想經 browser/terminal 驗證流程,Antigravity 值得研究;要交一個視覺完成度較高、少啲「AI demo 味」嘅網站,XDA 呢次結果就偏向 Claude Code。不過呢個只係單一作者用單一 prompt 嘅體驗,唔好當成總排名。真正揀工具,要睇你團隊有冇 designer、code review 習慣、測試要求,同埋日後邊個維護。

AI coding agent 最花時間係收尾

呢類工具而家最易令人誤判嘅地方,係 demo 好快出到,但交付成本藏喺最後 20%。字體 hierarchy、mobile spacing、圖片可信度、互動狀態、accessibility、error state、component 命名、測試覆蓋,呢啲全部都會影響維護成本。AI agent 如果只係幫你慳第一日,之後要人手執三日,條數未必抵;如果佢可以交到一個有結構、可 review、容易改嘅版本,咁先值得放入正式 workflow。下一步要睇嘅係更多實際 repo 測試:有 API、有 auth、有錯誤處理、有 deploy,先睇到邊個真係靠得住。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook