Claude Code 省 Token 技巧(Anthropic 官方)
- URL: https://www.threads.com/@oneday0013/post/DcLBxHvjswe
- Date Saved: 2026-08-18
- Source: Threads (@oneday0013)
- Tags: ai-engineering, dev-tools
- Repo: https://claude.com/blog (Maximizing the value of your Claude Code sessions)
Summary
Anthropic 官方 Claude Code 省 token 攻略整理:
成本結構
- Output token ≈ Input 的 5 倍價
- Cache hit 只算 input 的 0.1 倍(命中 vs 不命中差 10 倍)
- Cache 失效條件:中途換模型、換 effort level、開關 fast mode
6 個實際做法
- 用 @ 提檔案 — 不要打字描述路徑,後者會讓 Claude 額外跑一次 Read
- Subagent 指定用 Haiku 或 Sonnet — 省大模型 token
- CLAUDE.md 只放核心 — 流程類指令搬到 skills
- 常用指令連 flag 一起寫進 CLAUDE.md — 每次 session 少一輪、少幾百行輸出
- 離開前先 /compact — 訂閱制 cache 一小時過期(Codex/GPT-5.6 是 30 分鐘)
- 做完任務就 /clear — 舊任務的文件/輸出別佔後續 context
優先順序
context 大小 > session 長度 > 輪數 > 指令輸出量
補充(回覆區)
- Cache 冷掉後才 /compact 反而浪費(重新處理所有 context),不如直接 /clear
- Context 用到 70-80% 但還相關且模型沒降智,不必急著清
- Claude Code v2.1.217:子代理並行上限 20、—max-budget-usd 真正阻止背景子代理擴張