Grok 4.5 喺 Cursor 寫 code:快手慳 token,未夠膽全面取代 Claude
3C 產品

Grok 4.5 喺 Cursor 寫 code:快手慳 token,未夠膽全面取代 Claude

圖片:via XDA Developers — https://www.xda-developers.com/cant-believe-how-good-ai-coding-model-is-it-isnt-from-openai-or-anthropic/
TechLab 編輯部(譯)·

單次體驗幾吸引,獨立數據亦支持慳 token,但複雜項目要留後手

XDA 作者用 Grok 4.5 喺 Cursor 由零砌網站,最深印象係模型好快捉到方向,完成後只用咗約 40k token。跟住改間距、文字同細微介面問題,佢通常直接搵相關檔案落手,冇先掃半個 codebase 或寫一大輪計劃。對日日反覆執 UI 嘅人,少等一輪、少燒一輪 context,確實會令工作順好多

40k token 好睇,但未算 benchmark

呢個數字只來自一個網站項目,原文冇交代同一 prompt、同一 codebase 下,GPT 或 Claude 究竟用幾多 token,亦冇自動測試、錯誤率同後續維護成本。網站視覺做到「可以繼續用」,同程式邏輯真係穩陣亦係兩回事。所以 40k token 可以當使用個案,未足以證明 Grok 4.5 普遍慳過所有對手

Cursor 官方 Grok 4.5 發布頁主視覺

圖片:Cursor

獨立測試支持效率,但「快」要拆開睇

Artificial Analysis 用 Grok Build 跑 Coding Agent Index,Grok 4.5 得 76 分,成績同 GPT-5.5 xhigh 配 Codex 相若,低過 Fable 5 max 配 Claude Code。佢平均每題用 190 萬 token;後兩者分別用 620 萬同 720 萬,估算成本亦係每題 US$2.49、US$5.07 同 US$11.80。呢組數據支持佢幾慳,但測試用嘅 agent harness 各有分別,唔可以直接當成 Cursor 入面嘅一對一賽果

至於速度,Artificial Analysis 量到 Grok 4.5 high 約每秒輸出 59 token,仲慢過同類模型平均約 78 token。原文感受到嘅爽快,較合理嘅解讀係佢用少啲步驟、少啲贅述完成工作,令整體等候時間縮短;模型逐粒 token 吐字本身未算特別快。呢個分別幾重要,尤其你成日叫 agent 做十幾個細改動。

Cursor 官方展示 Grok 4.5 模型測試結果嘅圖表

圖片:Cursor

收費平,Cursor 方案仍然有上限

xAI API 標準版每 100 萬 input、output token 分別收 US$2 同 US$6,Fast 版就係 US$4 同 US$18;超過 200k context 嘅 request 另有較高收費。Cursor 已把 Grok 4.5 放入自家模型用量池,Pro 月費 US$20,Pro Plus 同 Ultra 分別係 US$60、US$200。官方只寫「generous included usage」,冇承諾無限任用;用爆後要開按量收費或者升級,長時間跑 agent 前最好先睇清楚用量頁。

同 OpenAI、Anthropic 點分工

Grok 4.5 而家最啱用喺一般日常開發:由零開始砌頁面、執介面,或者加要求清楚嘅功能,佢都有機會用少啲步驟搞掂。去到跨多個 service、舊 codebase 重構、權限或付款邏輯,原文作者仍會轉用 Claude Code;喺呢項 Coding Agent Index 入面,頂級 Anthropic 模型仍然領先。實際用法可以先交畀 Grok 快做,再用測試同 code review 把關,唔好純粹因為 token 少就直接 merge。

公司 code 記得先開 Privacy Mode

Cursor 官方話,開啟 Privacy Mode 後,客戶資料唔會用嚟訓練模型,供應商亦受零資料保留安排約束;濫用偵測觸發調查係例外。關閉後,Cursor 可能儲存 codebase、prompt、編輯操作同程式片段,用嚟改善及訓練模型。就算自備 API key,request 仍會經 Cursor backend。公司 repository 有客戶資料、內部 API 或商業邏輯,IT 團隊應該先鎖好私隱設定,再考慮慳到幾多 token。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook