Threads (@oneday0013)
ai-engineeringdev-tools
Original source

Claude Code 省 Token 技巧(Anthropic 官方)

Summary

Anthropic 官方 Claude Code 省 token 攻略整理:

成本結構

  • Output token ≈ Input 的 5 倍價
  • Cache hit 只算 input 的 0.1 倍(命中 vs 不命中差 10 倍)
  • Cache 失效條件:中途換模型、換 effort level、開關 fast mode

6 個實際做法

  1. 用 @ 提檔案 — 不要打字描述路徑,後者會讓 Claude 額外跑一次 Read
  2. Subagent 指定用 Haiku 或 Sonnet — 省大模型 token
  3. CLAUDE.md 只放核心 — 流程類指令搬到 skills
  4. 常用指令連 flag 一起寫進 CLAUDE.md — 每次 session 少一輪、少幾百行輸出
  5. 離開前先 /compact — 訂閱制 cache 一小時過期(Codex/GPT-5.6 是 30 分鐘)
  6. 做完任務就 /clear — 舊任務的文件/輸出別佔後續 context

優先順序

context 大小 > session 長度 > 輪數 > 指令輸出量

補充(回覆區)

  • Cache 冷掉後才 /compact 反而浪費(重新處理所有 context),不如直接 /clear
  • Context 用到 70-80% 但還相關且模型沒降智,不必急著清
  • Claude Code v2.1.217:子代理並行上限 20、—max-budget-usd 真正阻止背景子代理擴張