Claude Code 慳 token 實用設定:日常 coding 可先調去 Medium
3C 產品

Claude Code 慳 token 實用設定:日常 coding 可先調去 Medium

圖片:via XDA Developers — https://www.xda-developers.com/changed-one-setting-in-claude-code-token-burn-dropped/
TechLab 編輯部(譯)·

一個指令減少輸出用量,複雜除錯先轉返 High

先講清楚個 45% 點計

XDA 作者用 Claude Sonnet 5 喺同一個項目測試五項工作,包括修 bug、加搜尋、重構、補測試同追查效能問題。每次都由未改動嘅 codebase 開始,再用相同 prompt 分別跑 High 同 Medium。五次合計,High 產生約 26,000 個 output tokens,Medium 約 14,300 個,相差約 45%。呢個數字幾搶眼,但樣本始終只得一個項目同五項任務,當實例睇就好,暫時證明唔到其他 codebase 都有相同結果。

Claude Code model 同 effort level 選擇官方文章封面

圖片:Anthropic

Medium 慳到嘅,其實係 Claude 做幾多功夫

Effort 唔只控制 Claude 靜靜思考幾耐。Anthropic 官方解釋,佢亦會影響 Claude 讀幾多檔案、用幾多工具、驗證幾多次,同埋完成幾多步先返嚟交代。換句話講,調去 Medium 後,Claude 可能少查一條支線、少跑一次測試,或者早啲判斷工作已經完成。Thinking、tool call 同最後回覆都屬於 output tokens,所以少做幾輪,輸出用量自然會跌。

五次都完成,未等於品質完全一樣

XDA 呢輪測試入面,Medium 五項工作都做得完。修 bug 一項少用約 25% output tokens,加搜尋少約 48%,重構少約 54%,補測試少約 40%,效能問題就少約 39%。其中補測試嗰次,兩個設定揀中同一段欠缺測試嘅邏輯、搵到同一個 bug,改完亦同樣通過 12 項測試。結果的確幾實用,不過「完成任務」只係基本門檻;有冇漏睇邊界情況、改動係咪容易維護、面對大型 repo 會唔會行錯方向,五次測試未答到。

日常工作點樣設定

互動模式直接輸入 /effort medium 就得,官方文件話呢個選擇會保存,之後開新 session 都沿用。想只改今次 session,可以啟動時用 claude --effort medium;想跟返模型預設,就輸入 /effort auto。Anthropic 暫時將 High 定做大部分支援模型嘅預設值,Medium 則定位做成本敏感、接受少量能力取捨嘅工作,所以最好先喺熟悉、容易驗證嘅任務試。

邊類工作用 Medium 最合理

改文案、補一個清楚定義嘅欄位、機械式重構、寫已知行為嘅測試,或者修一個有明確重現步驟嘅 bug,都幾適合由 Medium 開始。呢類工作範圍細,開發者亦容易用 diff、type check 同測試驗收。若果 Claude 開始漏讀相關檔案、冇跑測試、改到一半就停,官方建議先調高 effort;呢啲跡象反映佢做得唔夠深入。

High 留畀邊啲情況

跨模組架構改動、間歇性 bug、race condition、資料遷移、權限邏輯,同埋要追多條假設嘅效能問題,High 仍然有價值。佢較傾向多讀檔案、跑完整測試同再驗證一次。若果 Claude 已經查齊資料、亦認真試過,但答案依然錯,單純推高 effort 未必有幫助;官方建議嗰種情況考慮能力較高嘅模型,因為問題可能出喺模型能力,而唔只係做得唔夠多。

45% output tokens 唔等於帳單平 45%

API 成本會分開計 input、output、cache 讀寫同部分工具用量。XDA 只比較 output tokens,冇交代兩邊完整 input、cache 命中或者總費用,所以最多可以話 輸出嗰部分少咗約 45%。用訂閱版亦唔應直接當成配額耐用 45%,實際限制仲會受模型、工作長度同使用模式影響。穩陣做法係先用 Medium 跑可驗證嘅日常工作,再睇完整 usage report;遇到漏檔案、漏測試或者複雜推理,先調返 High。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook