
16GB Mac 跑免費本地 coding agent:慳月費要接受細模型限制
Qwen2.5-Coder 7B 易裝易跑,大 repo 同安全設定仍有限制
XDA 作者 Anurag Singh 幾星期前停咗每月 US$20 嘅 Claude Pro,改用 16GB MacBook Air 跑 Ollama、OpenCode 同 Qwen2.5-Coder 7B。成件事講工作流多過模型勝負:作者自己講明本地模型慢啲、冇咁醒、出錯多啲,遇到複雜工作仍然係 Claude Code 靠譜。佢做到更多,靠嘅係冇用量窗口突然截停,可以不停改 UI、重跑測試同修錯。產量高咗,唔代表每次輸出質素高咗。 XDA 原文
4.7GB 模型,兩個指令開始
安裝門檻唔高:先裝 Ollama,再用 ollama run qwen2.5-coder:7b 拉模型;Ollama 而家亦可用 ollama launch opencode 幫手接好 OpenCode。官方模型頁顯示呢個版本係 7.62B 參數、Q4_K_M 量化、4.7GB,授權係 Apache 2.0。OpenCode 負責讀檔、改檔同跑指令,Qwen 就負責推理同出 code。不過 4.7GB 只係模型檔,Mac 仲要同時畀 RAM 去 macOS、IDE、dev server 同 context;原文冇交代晶片型號、峰值 RAM 或完整儲存佔用,所以「16GB 跑到」只可當一部機嘅經驗。Ollama 模型頁

圖片:Ollama
程式碼質素夠做細活,速度就冇數字支持
原文對質素講得幾誠實:作者用佢做細 feature、UI 改動、script、設定檔同短 debug loop,做法係先叫 agent 睇相關檔案、每次只改一樣,再跑指令驗證。含糊嘅大型工作就明顯冇 Claude 咁穩。不過文中冇 token/s、首個 token 等候時間、完成一個任務要幾多輪、同一題成功率,亦冇固定 repo 對照。「做得多」反映佢可以任試,未證明 7B 模型寫得好過 Claude。 Qwen 自家 benchmark 可以交代模型背景,但唔可以直接攞嚟同而家嘅 Claude Code 比。
16GB 最易撞牆嘅位係 context
Qwen 官方列出 7B 版支援最多 131,072 tokens,但同一份 model card 亦寫明預設設定去到 32,768 tokens,超出就要另外開 YaRN。Ollama 而家嘅通用預設仲現實:少過 24GiB VRAM 只會開 4K context,但 coding agent 建議至少 64K。Context 一調大,RAM 用量亦會升;16GB Mac 仲要留位畀系統、編輯器同開發環境。128K 規格唔等於 16GB Mac 可以舒服開盡,大型 repo 好容易要揀檔案、壓縮舊對話,甚至因為 swap 而慢落嚟。原文冇測 64K 設定下嘅速度同峰值 RAM。Ollama context 文件
同 Claude Code 比,慳到月費但未必慳到時間
Claude 官方美元標價顯示,Pro 月繳係 US$20,年繳折算每月 US$17,方案包括 Claude Code;Max 就由每月 US$100 起,提供 Pro 五倍或二十倍用量。呢啲唔係香港結帳價,稅項同實際顯示貨幣會有差異。本地方案冇 API 或訂閱帳單,但硬件、電力、4.7GB 起跳嘅儲存、設定時間同覆核錯誤全部都係成本。如果係學生、整個人 side project,或者本身已有 16GB Mac、成日要做重複小改動,條數就幾吸引。;趕 deadline、處理大型架構或安全問題,細模型多試幾輪所花嘅時間可能貴過月費。Claude 方案定價
程式碼留喺本機都有條件
Ollama 官方話,使用本機模型時唔會見到用家嘅 prompt 或資料,亦可以關閉 cloud 功能,呢點對公司原始碼同未公開項目確實有價值。不過 OpenCode 一旦獲准用 web、MCP、雲端模型或者自行安裝套件,資料同指令仍有機會離開部機;「本機模型」四個字唔會自動變成隔離環境。公司用之前要收緊網上工具、停用 cloud、限制可讀目錄,再跟返內部資料政策。Agent 拉返嚟嘅第三方套件亦要照常檢查,Apache 2.0 模型授權唔會包埋供應鏈安全。Ollama 私隱說明
「Never says no」用喺權限上就危險
原文標題嘅 never says no 主要係講冇訂閱用量截停;安全層面要分開睇。OpenCode 其實有 ask、allow 同 deny 權限,唔可以話完全冇確認機制。不過官方文件亦寫明,多數工具權限預設係 allow,只有外部目錄同重複指令保護預設會問,.env 檔案則預設拒絕讀取。照住偏鬆設定跑,agent 可以直接改檔同執行 shell;判斷錯誤、惡意 repo 指示或有問題嘅安裝 script,都可能變成鏟檔、洩漏資料同引入惡意套件。較穩陣嘅做法係將 bash 權限設做先問,同時拒絕 rm 同 git push。,再配合乾淨 branch、備份或 container。OpenCode 權限文件
適合做長氣助手,複雜工作保留 Claude
呢套組合最啱細而清楚、可以靠測試逐步驗證嘅工作;作者遇到難題時亦會切返 Claude,再回到本地模型處理重複工序。呢種混合用法幾合理,尤其係學生同個人開發者,可以把訂閱留畀真正棘手嘅月份;公司團隊就要先做好權限同網上隔離。要判斷 16GB Mac 夠唔夠用,最好攞自己個 repo 跑同一組工作,記低成功率、重試次數、token/s、峰值 RAM 同人工覆核時間,先會知道慳返嘅月費值唔值得。
參考來源
- XDA Developers — My $0 local coding agent does more than $20 Claude Code because it never says no — original report
- Ollama:Qwen2.5-Coder 7B 模型頁 — 核對模型大小、參數量、量化版本、執行指令同 Apache 2.0 授權。
- Ollama Launch 官方介紹 — 確認 Ollama 可以直接設定同啟動 OpenCode,亦係官方配圖來源。
- Qwen2.5-Coder 系列介紹 — 核對 7B 版本嘅 context 規格、模型定位同官方 benchmark 背景。
- Ollama Context Length 文件 — 確認唔同記憶體級別嘅預設 context,同 coding agent 建議至少使用 64K。
- OpenCode 權限文件 — 核對 ask/allow/deny、預設權限,以及限制 shell、外部目錄同敏感檔案嘅方法。
- Claude 官方方案定價 — 核對 Pro、Max 月費、Claude Code 包含情況同用量差異。
- Ollama FAQ — 核對本機 prompt 私隱、cloud 模式同關閉 cloud 功能嘅設定。
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







