前言
Claude Code 跑到一半跳出額度快用完的提醒,是很多人共同的經驗。Claude Code 費用怎麼算、額度花在哪,先搞清楚這兩件事再談怎麼省,會比一開始就緊張兮兮划算。這篇整理 8 個實際壓得下 token 花費的做法,從日常的上下文管理,到模型怎麼選、哪些工作該交給 subagent 處理。
Claude Code 怎麼計費
訂閱方案分成幾個級距,數字代表的是額度倍數,不是功能差異。
| 方案 | 月繳 | 年繳(每月平均) |
|---|---|---|
| Pro | 20 美元 | 17 美元 |
| Max 5x | 100 美元 | — |
| Max 20x | 200 美元 | — |
| Team 標準席位 | 25 美元 | 20 美元 |
| Team Premium 席位 | 125 美元 | 100 美元 |
至於實際花費,Anthropic 公布的數字來自企業團隊的部署:平均每位開發者在有使用的日子大約花 13 美元,每月落在 150 到 250 美元之間,九成使用者單日花費不會超過 30 美元。個人使用者的量通常低於這個區間。
新手真正該擔心的通常不是 token 花得多不多,是怕花錢而不敢用、結果學得特別慢。打 /usage 就能看到目前這個 session 用了多少。這裡有個容易搞混的地方:Pro、Max 訂閱用戶看到的那個金額是照 API 牌價換算出來的,用量已經含在訂閱費裡,那個數字不等於你要付的錢,訂閱用戶要看的是同一個畫面上的額度條。先確認花費在自己能接受的範圍內,再放心用,等用順手了,省 token 才是該煩惱的事。
做好上下文管理
1. /compact 可以自訂要保留什麼
對話變長之後,Claude Code 會自動把舊的內容摘要壓縮,釋放出空間繼續對話。claude code compact 預設的摘要邏輯是通用的,但也可以自己指定要保留什麼,例如打 /compact 保留程式碼片段跟 API 用法,摘要的時候就會優先留住這些內容,不會把重要細節壓縮不見。壓縮本身也是一次不小的請求,因為要讀完整段對話才能摘要,所以壓縮的時機也有講究,累積到一定長度才壓縮,比每講幾句就壓縮一次划算。分析 2,848 次真實 Claude Code 執行紀錄的研究也發現,壓縮太積極反而會弄丟關鍵資訊(Weinberger & Hozez, 2026)。
2. 換任務就 /clear,別硬拖一條長對話
切換到不相關的新工作,直接用 /clear 開一個乾淨的對話,比把舊對話硬拖下去便宜得多。舊的內容還留在對話裡,代表每一次新的請求都會連同這些舊內容一起送出。Claude Code 有快取機制,重讀舊內容的單價比較低,但那還是算在用量裡,一個開了一整天沒清過的對話,用量會遠比實際做的事情還要高。想保留這次對話方便之後找回來,可以先用 /rename 取個名字,再用 /clear 清掉,之後用 /resume 就能接回去。
📖 延伸閱讀:Claude Code 指令教學|30 個必學指令與使用情境
選對模型、減少工具開銷
3. Sonnet 跟 Opus 怎麼選
多數日常的寫程式工作,Sonnet 就處理得來,花費也比 Opus 低不少。claude code sonnet 適合當預設模型,把 claude code opus 留給真的需要深度推理的場合,例如複雜的架構決策、牽動多個系統的判斷。用 /model 可以隨時切換,也能在 /config 裡設定預設要用哪一個,不用每次開新對話都重選。
4. MCP 開銷怎麼減
claude code mcp 連接的工具越多,能用的功能越多。現在的版本已經把 MCP 工具定義改成延後載入,平常只有工具名稱會進上下文,真的用到某個工具時才載入完整說明,所以開銷比以前小。不過命令列工具(例如 gh、aws)還是更省,因為它們連工具清單都不用列。想知道上下文現在被什麼佔著,打 /context 看一眼;接了很多 MCP 伺服器又不是每個都常用,打 /mcp 把用不到的先停用。
省 token 說到底是在管理「每次請求帶了哪些不必要的東西」。同樣的思路放到團隊每天在跑的自動化流程上也成立,浪費掉的往往不是工具本身,是重複搬運的那些資料。
善用 Skills 跟 Subagent
5. 常用指令搬去 Skills,別每次都塞進 CLAUDE.md
CLAUDE.md 是每次開對話都會被讀進去的,內容越肥,每一次請求要負擔的量就越大。claude code skills 不一樣,是需要用到才會被載入,平常不會佔用空間。特定情境才用得到的操作流程(例如某種資料庫遷移的固定步驟),放進 Skills 比寫進 CLAUDE.md 划算,CLAUDE.md 盡量只留真正每次都需要知道的規則,控制在 200 行以內。分析大量 Skills 使用情況的研究也指出,把不必要的內容拿掉能減少注意力被分散的問題,同時維持甚至提升功能品質(Gao et al., 2026)。
6. 耗量操作丟給 subagent 處理
跑測試、抓文件、翻找一份很長的紀錄檔,這類會產生大量輸出的操作,交給 subagent 去做,冗長的輸出留在 subagent 自己的對話裡,只有整理過的摘要會回傳到主線的對話中。主線對話因此能保持乾淨,不會被一大串你根本不需要逐字看的內容塞滿。簡單的 subagent 任務還可以在設定裡指定 model: haiku,讓它用更便宜的模型跑。
📖 延伸閱讀:2026 Claude Code 新手教學|從安裝到 GitHub 部署
留意 Worktree 跟複雜任務
7. Worktree/多代理協作更耗 token
claude code worktree 讓好幾個任務同時並行,每個都在獨立的分支裡跑。代價是每開一個 worktree 就是一條獨立的 Claude Code 對話,各自維護一份完整的上下文,用量是加乘上去的,不是分攤。另一種更耗的做法是 Agent teams,它會直接開出多個 Claude Code 實例協作,官方文件給的數字是 teammates 跑在 plan mode 時,用量大約是一般對話的 7 倍(這功能預設關閉,要自己設定環境變數才打得開)。真的需要平行處理多個獨立任務時再開,任務盡量拆小、做完就收掉,不要為了圖方便同時開一堆用不到的分支。
8. 複雜任務先進 Plan Mode,走錯方向重工才是真的燒錢
牽動多個檔案、方向還沒想清楚的任務,先按 Shift+Tab 切到 Plan Mode 讓它探索、提計畫,等看過計畫再放行,比讓它直接動手改、改到一半才發現方向錯了划算得多。方向錯了才回頭收拾,代表前面做的事全部白費,這才是真正的浪費,不是省了那五分鐘看計畫的時間。過程中如果發現它已經走偏,按 Escape 立刻叫停,也能用 /rewind 直接退回上一個乾淨的狀態,不用等它把錯的方向做完才回頭改。
常見問題 FAQ
Q1:Claude Code 每個月大概要花多少錢?
公開數據來自企業團隊部署,平均每位開發者在有使用的日子約 13 美元,每月 150 到 250 美元,九成使用者單日不超過 30 美元。個人使用者通常低於這個區間,新手剛開始更是。先用 /usage 觀察自己實際的使用型態,比看網路上的平均數字準。
Q2:省 token 是不是代表要犧牲程式碼品質?
不是。這篇講的省 token 技巧都是減少不必要的浪費(拖太長的對話、塞太肥的 CLAUDE.md、開太多用不到的分支),不是叫你少給它資訊或跳過驗證步驟,那樣反而會讓它猜錯更多次、花更多 token 收拾殘局。
Q3:Sonnet 跟 Opus 真的差很多錢嗎?
差在單價不在用量。Opus 每一百萬 token 的價格大約是 Sonnet 的 1.7 倍,不是 Opus 會多吃 token。日常大部分的寫程式工作 Sonnet 就處理得來,把 Opus 留給真的需要深度推理的場合,這個習慣本身就能省下不少花費,不需要額外做什麼複雜設定。
Q4:CLAUDE.md 搬去 Skills,會不會反而更麻煩?
不會,方向剛好相反。CLAUDE.md 是每次對話都要讀一次,Skills 是要用到才載入,平常放著不會佔用任何空間。只有特定情境才用得到的操作流程,放 Skills 反而比塞進 CLAUDE.md 更省事,也更好維護。
Q5:Worktree 聽起來很好用,為什麼要小心用?
Worktree 本身沒有問題,問題是每開一個就是一條獨立的對話、各維護一份完整上下文,用量疊加上去,多開幾個很容易在不知不覺中把額度燒完。Agent teams 那種多實例協作更明顯,官方給的參考值是一般對話的 7 倍。真的需要同時處理多個獨立任務時再開,用完記得收掉,不要習慣性開著。
總結
這 8 個技巧說到底都是同一件事:讓花費花在真正需要的地方,不是花在拖太長的對話、塞太肥的設定檔、或是開了卻用不到的分支上。搞懂 Claude Code 怎麼計費、養成上下文管理跟選模型的習慣、把耗量操作交給對的工具處理,成本自然會降下來。省 token 不是要你縮手不敢用,是把浪費掉的部分省下來,讓你能安心用在真正重要的事情上。
如果你也在幫團隊導入 AI 開發工具、想聊聊怎麼把成本控制得更精準,歡迎跟我聊聊你的需求。


