
Meta Muse Code 挑戰 Codex、Claude Code:平價主攻長時間 coding task
崩潰後可續跑夠吸引,權限邊界同香港 API 仍有問號
Meta 正式踩入終端 coding agent 戰場,推出 Muse Code beta,直接同 Codex、Claude Code 同 OpenCode 爭開發者。佢由新模型 Muse Spark 1.2 驅動,可以規劃改動、寫 code、跑工具同驗證結果。Meta 今次主打常駐背景 agents、崩潰後續跑同長時間任務,目標係處理要跑幾個鐘、甚至成日嘅大型工程。
背景 agents 唔使每次重新熱身
一般 coding agent 開子任務時,往往要重新讀 repo、搵檔案同整理背景。Muse Code 嘅做法係保留多個 persistent background agents,佢哋會喺成個 session 入面繼續運作,自行做下一步,適當時先向主 agent 匯報。Meta 話咁樣可以減少重複搵資料、降低延遲,亦少啲要人手逐步提示;不過多個 agent 同時跑,token 用量自然亦可能升得快,官方暫時冇提供典型任務嘅總成本數字。Meta 發布資料
呢個設計對大型 migration、跨模組除錯同研究型任務幾啱用。Meta 甚至用超過 1,000 次工具呼叫、最長 24 小時嘅 GPU kernel 優化任務示範 Muse Spark 1.2。不過呢啲係 Meta 自家測試,模型效能、低延遲同長跑可靠性都未有足夠獨立數據支持;Muse Code 又仲係 beta,暫時應該當佢係有潛力嘅新工具,未適合單靠發布 benchmark 決定全公司轉用。

圖片:Meta
崩潰後接住跑,長 task 少一個痛點
Muse Code 會喺本機 event log 追加每次模型呼叫、工具執行、審批同檔案改動。Meta 話呢份記錄可以準確重播執行狀態,所以程式中途崩潰,重新啟動後都可以喺原位繼續。對要跑幾個鐘嘅任務,呢點幾實際:agent 最麻煩往往係斷線或者工具死咗之後失憶,要人重新解釋做到邊,長時間自動化亦會因為呢類小故障變得唔可靠。
Codex 而家同樣有 /goal 長時間任務、暫停及恢復,亦可以用獨立 Git worktree 隔開平行工作;Claude Code 有 session resume 同 permission mode;OpenCode 就畀開發者按工具、指令同 subagent 設定 allow、ask 或 deny。Muse Code 嘅 event log 令「程序崩潰後點接續」講得幾具體,但 Meta 首份公告未有交代同樣仔細嘅 sandbox、網上存取、repo 外檔案權限同 background agent 隔離方式,呢部分暫時落後過對手公開文件。

圖片:Meta
有計劃審批,權限細節仍然唔夠
Muse Code 內置 /plan、/grill 同 /goal:/plan 先產生要審批嘅執行計劃,/grill 會挑戰計劃入面嘅假設,/goal 就持續做到指定結果。不過,批准一份計劃同逐項限制 shell 指令、檔案路徑、網上存取係兩回事。Meta 公告只確認 event log 會記低 approval,冇清楚列出預設會自動批准咩操作,亦冇展示好似 OpenCode 或 Codex 嗰種細分權限規則。
Coding agent 可以讀寫原始碼、執行 package script,同接觸設定檔或者憑證,風險唔止係寫錯 code。惡意 dependency、repo 入面嘅 prompt injection、安裝腳本同供應鏈攻擊,都可能借 agent 權限擴大影響。團隊試 Muse Code,最好先用冇 production secrets 嘅獨立 repo 或 container,逐份 diff 審核,亦唔好畀背景 agents 任意讀取 home directory;等 Meta 補齊安全文件後,先再考慮放入敏感 codebase。
API 價夠進取,但多 agent 會放大用量
據 Engadget 報道,Muse Code 預設跟 Meta Model API 按量收費,每 100 萬 input token US$1.25,output token US$4.25。Wall Street Journal 另指,願意提供產品改進 feedback 嘅 contributor tier 低至 input US$0.10、output US$0.20;呢個方案嘅申請資格、資料用途同正式條款,仍要等 Meta 公開說明。
同期 Claude Sonnet 5 正做限時 API 優惠,每 100 萬 input/output token 收 US$2/US$10,8 月 31 日後標準價係 US$3/US$15。Muse Spark 1.2 紙面價的確平好多,但 coding agent 成本取決於重讀 context、工具輸出、重試次數同背景 agents 數量。不過實際每個 issue 用幾多錢,仲要計埋完整任務成本、成功率、人工覆核時間同背景 agents 嘅用量。Anthropic API 收費
安裝簡單,香港 API 狀態仍待確認
Meta 官方提供一行 shell 安裝器,正式列出 macOS 同 Linux;Windows 原生版未見於發布資料,WSL 亦未獲官方清楚列作支援平台。安裝到工具唔代表一定開到模型,Muse Code 仲要登入 Meta 開發者服務或者使用 Meta Model API。公司電腦亦應先檢查安裝器內容同來源,唔好因為得一行指令就直接用管理員權限執行。
8 月 5 日嘅 1.2 公告話已擴大至全球。香港 API key、信用卡付款同帳單地區支援:[待確認]。公開頁暫時冇國家名單,相關文件又要登入先睇,未能確認香港帳戶可唔可以完成申請及付款。香港開發者可以先查自己帳戶有冇 API key 同 billing 入口,未見入口就唔好為 Muse Code 預設開發排期。
Muse Code 最吸引係將背景 agents、長跑同崩潰恢復組成一套完整 runtime,價錢亦有攻勢。早期試用者可以用佢處理低風險、大量重複驗證嘅 repo 任務;公司團隊就等 Meta 交代權限、資料政策、香港 billing 同獨立可靠性數據,再決定使唔使由 Codex、Claude Code 或 OpenCode 搬過去。
參考來源
- Engadget — Meta introduces Muse Code, its take on a coding agent — original report
- Introducing Muse Code and Muse Spark 1.2 — Meta 官方公告,核對背景 agents、event log、崩潰恢復、內置指令、安裝平台同長時間測試。
- Agent approvals & security — OpenAI 官方 Codex 文件,用嚟核對 sandbox、審批、網上存取同預設安全邊界。
- Long-running work — OpenAI 官方文件,核對 Codex Goal mode、平行任務同 worktree 用法。
- Permissions | OpenCode — OpenCode 官方文件,核對 allow、ask、deny 同細分工具權限。
- CLI reference | Claude Code — Anthropic 官方文件,核對 Claude Code session resume 同 permission mode。
- Plans & Pricing | Claude — Anthropic 官方即時 API 收費,核對 Sonnet 5 限時價同標準價。
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







