Cursor 點讀 project:揀 AI coding 工具仲要睇索引、rules 同私隱
3C 產品

Cursor 點讀 project:揀 AI coding 工具仲要睇索引、rules 同私隱

圖片:via XDA Developers — https://www.xda-developers.com/cursors-real-edge-isnt-speed-deeply-reads-entire-project/
TechLab 編輯部(譯)·

同一個模型換個 agent,搵檔案同揀 context 已經可以差好遠

「讀完整個 project」容易令人會錯意

XDA 作者 Anurag Singh 長期用 Cursor,佢觀察到同一款 Claude 或 GPT 模型放入 Cursor,處理現有 project 時有機會醒目啲。不過原文係個人長期使用感受,冇用同一批任務、同一版本同一組條件比較 Cursor、Claude Code 同 Codex。「理解成個 project」只係方便講法:agent 會搜尋目錄、追 function reference,再揀相關段落放入 context,模型唔會每次由頭到尾吞晒成個 repository。

Cursor 官方圖解 codebase 檔案點樣組成 Merkle tree,方便索引系統追蹤改動

圖片:Cursor

模型收到咩,同個模型本身一樣咁重要

一個 coding agent 包住模型嘅 harness,會決定用咩指令、幾時搜尋、開邊份檔案、每段截幾多內容,同埋改完會唔會跑 test。假設 authentication logic 分散喺 middleware、API client、database model 同測試檔,agent 漏咗其中一層,再強嘅模型都可能重複整多套 helper,或者只改到表面。模型名只講到推理引擎,講唔到佢手上有幾完整嘅線索。

Cursor 自己都正改緊搵 context 嘅方法

Cursor 過往會切細 code、建立 embeddings,再用語意搜尋搵意思相近嘅段落。去到 2026 年 7 月,Cursor 團隊成員確認 semantic indexing 正逐步退場,改用本機 Instant Grep index 同一般檔案讀取;agent 會試幾組搜尋字、逐層睇目錄,再打開可疑檔案。呢個轉變幾值得留意:Cursor 嘅優勢唔應綁死喺 embeddings,而係佢點安排整段搜尋、閱讀、修改同驗證流程。新舊版本行緊邊套 retrieval,亦會直接影響體驗。

先睇 agent 搵咗咩,唔好一開波叫佢改 code

用家可以先去 Cursor Settings 嘅 Indexing 頁睇狀態同錯誤;介面名稱會隨版本改,部分新版已轉向 Instant Grep。跟住畀一條只讀任務,例如叫 agent 列出 login request 由 route 去到 database 嘅路徑、相關檔案同測試,再核對有冇漏。已知關鍵位置就直接用 @file@folder 或指定 symbol。如果第一輪已經搵錯檔案,之後就算換頂級模型,結果都未必會準。

Ignore 同 rules 要分工,兩樣都唔好亂塞

.cursorignore 適合擋住 secrets、generated files、大型 build output 同唔應送去 AI 嘅客戶資料;官方 security 文件話佢會盡力阻止呢啲檔案入索引或 AI request,但公司仍然要當成資料管治設定,唔好當絕對安全邊界。架構慣例、測試指令同「先重用現有 API client」呢類要求,就放入 .cursor/rules,再按目錄或 glob 收窄範圍。Rules 太長會食 context,過時規矩亦會令 agent 穩定噉做錯。

Codex、Claude Code 走另一條路,但問題其實相通

Codex 同 Claude Code 呢類 terminal agent,會喺工作目錄用搜尋、讀檔同 shell 工具逐步收集 context;Codex 會讀 repository 入面分層嘅 AGENTS.md,Claude Code 就可以用 CLAUDE.md 保存 project 慣例。佢哋未必依賴 Cursor 過往嗰種雲端 semantic index,但一樣會受搜尋字、工具權限、工作目錄同 instructions 質素影響。實際比較時,應該睇 agent 有冇搵齊 reference、識唔識重用現有 pattern、改完有冇驗證,唔好淨係比較 model picker。

Source code 私隱要逐層睇清楚

Cursor 官方講明,AI 功能嘅 code data 會送到 Cursor server;開咗 Privacy Mode 後,官方承諾模型供應商唔會儲存或用嚟訓練。舊有 semantic indexing 流程會短暫上傳明文 code 生成 embeddings,之後保存 embeddings、hash 同模糊化路徑;Instant Grep index 就按 Cursor 團隊講法留喺本機。不過 agent 最後揀中嘅 code 段落仍要送去 backend 產生答案。公司用之前要核對 Privacy Mode、subprocessor、資料地域、retention 同內部政策,唔可以淨係見到「local index」就當 source code 冇離開部機。

三個 US$20 計劃,實際價值差得幾遠

截至 2026 年 7 月 29 日,Cursor Pro、Claude Pro 同 ChatGPT Plus 個人月費都係 US$20,後兩者亦分別可以用 Claude Code 同 Codex。不過三邊嘅 included usage、模型路由、額外收費同限額算法唔同,而且一直有改。XDA 作者覺得 Cursor 抵用,只能代表佢嗰種 workload。學生做細 project,免費額度或者單一訂閱可能夠;日日改大型 repository 嘅 developer,就要睇每月實際完成幾多可合併改動、慳到幾多搵 code 時間,同埋公司可唔可以接受資料處理方式。

點揀:用自己個 repository 試一輪

揀三個橫跨多份檔案、又有現成測試嘅真實任務,畀每款工具先解釋依賴關係,再改 code、跑 test 同交代讀過邊啲檔案。記低漏檔、重複造輪子、錯改範圍同修正次數,實際過淨係睇網上啲「邊款最勁」感想。大型 project 仲要加一項:故意收窄 rules 同 ignore 範圍,睇結果有冇改善。試完呢輪,先決定嗰 US$20 應該畀邊款工具。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook