六塊備齊之後,下一個問題馬上來:這麼多東西,難道每次開對話都全部載進去?
不行。Anthropic 的文件說 context 是公共財,每次都載的東西越多,AI 越顧不到重點;而且按 token 計費的工具,每次載入都是錢。可是不載,它又可能忘記。這是一個真正的取捨,沒有免費的答案。
我把它拆成兩種配置:靜態,每次開場強制讀;動態,需要時才去拿。這一篇講怎麼分。
Context 配置:常駐核心 vs 按需載入
最高原則、專案核心規則、長期偏好。
RAG 文件、特定任務 Skill、大量格式範例。
兩邊各自的代價
靜態配置可靠,但貴,而且會擠。Claude Code 的 CLAUDE.md、Codex 的 AGENTS.md 就是這一類,每次開場自動讀進來(常駐檔是便條不是憲法那篇細講)。好處是它絕對看得到。壞處是每個對話、每一輪都在重複付這段的費用,而且規則塞太多,它反而要花力氣處理規則之間的衝突,顧不到眼前的任務。官方文件對 CLAUDE.md 的建議是 200 行以內,理由就是這個。
動態配置便宜、無上限,但會漏。Skill、參考檔、RAG 知識庫都是這一類,平常不佔空間,對話命中關鍵字或被主文件指引時才讀。壞處是「沒被撈到」:檢索沒抓對文件、或 AI 沒想到要去讀,它就在資訊不足的狀態下開工,而且你事後看不出來它少讀了什麼。
所以分法只有一句:做錯了代價高、而且每次都用得到的,放靜態。其他的都放動態。
一百萬行程式碼,常駐檔只留一百行
OpenAI 在 2026 年公開了一個內部實驗:三個工程師從空的程式庫開始,五個月做出一個約一百萬行的產品,合併約一千五百個 PR,沒有一行是人手寫的。全部由 Codex 代理產出,人負責設計環境和方向。他們把這套做法叫 harness engineering。
跟這一篇最相關的是他們怎麼處理常駐脈絡:AGENTS.md 刻意修剪到一百行左右,只放最高原則和「東西在哪裡」的地圖。真正的知識——架構說明、設計規範、各模組的細節——放進分層的 docs/ 資料夾,代理需要時自己去讀。他們還跑一個「文件園丁」代理,定期掃描哪些文件已經過期。
我讀到這個案例時的感想是:連一百萬行的專案都只需要一百行常駐,我們多數人的專案,常駐檔超過一百行多半是塞了不該常駐的東西。
實際切法我分三步。常駐檔只留兩種東西:不可違背的原則(改價格必須從試算表開始、對外文字不准用簡體),和指路的地圖(UI 規範在 docs/ui.md、退款流程在 docs/refund.md)。細節搬到專屬資料夾,常駐檔裡只寫一句「詳見某某」,AI 遇到 UI 問題會自己去讀,沒遇到就不讀。局部規則放在局部:前端的規範放 frontend/ 資料夾自己的常駐檔,後端的放 backend/。Claude Code 的做法是子資料夾的 CLAUDE.md 在它讀到那個資料夾的檔案時才載入,正好是「按需」的形式。疊加的細節在規則放哪一層那篇,這裡先記住一句:不是全域的,就不要放在全域。
動手做
常駐檔已經很長、不知道該砍什麼的,貼上去讓 AI 幫你分:
下面是我目前每次都會載給 AI 的規則。請逐條分成兩類,並說明理由: 【靜態】每次都用得到,而且做錯代價高:不可違背的原則、指路的地圖(東西在哪)。目標:全部加起來 100 行以內。 【動態】格式範例、特定任務的步驟、只跟某個資料夾或某類工作有關的規則、AI 打開專案自己就查得到的事實。這些告訴我該搬到哪個檔案,並在靜態檔留一句指路。 規則:分不出來的,預設放動態;每一條放靜態的都要回答「少了它會做錯什麼」。 規則清單:(貼上)
用網頁版、沒有檔案系統的人,等價的做法是:Claude 專案的「專案指令」和 ChatGPT 的自訂指令是靜態,寫少,只放原則;專案裡上傳的檔案是動態,它需要時才會去翻。同樣的分法,指令裡只寫「格式照附件的範本」,不要把範本整份貼進指令。還沒有常駐檔的,先做第一份常駐檔再回來。
分對了的樣子:常駐檔在 100 行上下,每一條你都答得出「少了它會出什麼事」;搬走的東西 AI 在需要時有去讀,看它的回應有沒有引用那份文件;開場的 token 用量明顯下降,Claude Code 打 /context 可以看到;三個月後回頭看,裡面沒有一條是「當時暫時這樣」的過渡規則。
一個五分鐘的練習:打開你的常駐檔,把每一條分成「原則」「地圖」「其他」三堆。「其他」那一堆通常最大,而且全部都可以搬走。
靜態絕不漏但貴且擠,動態便宜無限但會漏,沒有免費的答案。做錯代價高、每次都用到的放靜態,其他放動態。一百萬行的專案只留一百行常駐,你的多半也不需要更多。
站內延伸
- 常駐檔本身怎麼寫 → 常駐檔是便條不是憲法
- /init 生出來之後怎麼砍 → 先砍掉一半
- 動態那一側的做法 → 找方法AI 建知識庫
來源: OpenAI:Harness engineering: leveraging Codex in an agent-first world(三人、五個月、約一百萬行、約一千五百個 PR、零手寫、AGENTS.md 約一百行、分層 docs 與文件園丁);Claude Code:How Claude remembers your project(200 行建議、子資料夾按需載入)。
做錯代價高的,
才值得每次都讀
什麼時候看這張:你想把更多規則寫進常駐檔,又怕它越長越沒人看。
- 常駐的絕不會忘,但每次都付費、也擠掉注意力
- 按需的便宜又無限,壞在可能沒被撈到
- 一百萬行的專案,常駐檔也只留一百行
第一個動作打開常駐檔,把每一條分成原則、地圖、其他三堆,其他那堆搬走。五分鐘,其他那堆通常最大。