# Claude Code 工程师 Lydia Hallie 公开课讲解真实 Token 账本与缓存省费方法

- 来源：AYi (@AYi_AInotes)
- 发布时间：2026-09-13 23:56
- AIHOT 分数：68
- AIHOT 链接：https://aihot.news/items/cmu00f2sw07n3roymh6guau5l
- 原文链接：https://x.com/AYi_AInotes/status/2099165413170958840

## AI 摘要

Claude Code 团队工程师 Lydia Hallie 的约 27 分钟公开课讲解 Claude Code 的真实 Token 计费逻辑。

## 正文

@AnthropicAI Claude Code 团队核心工程师 Lydia Hallie 内部实操，强讲透 Claude Code 真实Token账本的公开课，约 27 分钟，强烈推荐！！
很多工程师用 Claude Code 喜欢中途频繁切换模型，一会儿切 Sonnet，一会儿切 Opus，自以为在省钱，
但真相极其残酷——Anthropic 的缓存依赖极其严苛的前缀精确匹配，一旦命中缓存，每轮读取只要 0.1x（直接打一折），

也就是说你在长会话中途敲一次 /model，整个历史前缀全部作废，等于逼着系统把过去几十轮的所有对话按全价（1.0x）重新算一遍！

这个视频里的核心认知极其狠辣，说是刺破了 90% 工程师的盲区也不为过：
效率从来不是“少花 Token”，而是保证花出去的每一个 Token 都精准打在交付物上，绝不交任何一分冤枉税！

很多团队用 Claude Code 账单居高不下，往往是因为犯了这几个极其隐蔽的常识性错误：

1️⃣ 别亲手砸碎你的一折缓存（最大的成本杠杆）：
大模型的缓存是极度严苛的“前缀精确匹配”。
只要前缀命中，每一轮上下文读取直接按 0.1x（打一折）算钱！
但很多人喜欢在长会话中途敲 /model 换模型、或者频繁切 /effort——
你自以为在省钱，实际上换模型的瞬间，整个历史前缀全部作废！等于逼着系统把过去几十轮对话按 1.0x 全价重新算一遍；
2️⃣ 400 行全绿的测试，比报错崩溃更有毒：
这是最反直觉的一点：报错日志通常只有几行，排完就过去了；
但如果你跑测试没加过滤，那 400 行“通过通过通过”的废话会挂在会话里，在此后的每一轮对话中，被当成无意义的启动税反复计费！
必须在 CLAUDE.md 里写死安静输出（例如 npx vitest run <file> --reporter=dot），彻底消灭上下文噪音；

3️⃣ 子代理（Subagents）不是“专家团队”，是“隔音墙”：
别把多智能体想得太神圣。子代理最大的工业价值在于“物理隔离上下文”——
让它带着独立的临时记忆去扫几千行日志、搜整个仓库、跑吵闹的验证，最后只把干净的几行结论带回主线程，主会话滚烫的前缀缓存丝毫不受污染；

4️⃣ 走偏了用 /rewind，千万别用 /compact：
AI 一旦方向跑偏，立刻用 /rewind 回滚，它只砍掉尾巴，前面的缓存还在；
如果你手抖敲了 /compact，历史记录会被一段摘要替换，前缀瞬间对不上，整段缓存当场报废。

还有一个极度老练的实操细节：
每次离开工位去吃饭或开会前，趁着缓存还热（在 5 分钟或 1 小时窗口内），先主动跑一次 /compact 做摘要；
如果等缓存彻底凉透了你再回来摘要，等于逼着系统按全价去重读整座历史屎山。

工具会写代码早就不稀奇了，
看懂底层的数据流动与计费逻辑，把上下文当成干净的总线、而不是丢垃圾的废纸篓，
你才能在用最顶配模型的同时，把每一分钱都烧在刀刃上。
https://x.com/0xCodez/status/2098782845183410287/video/1
