Claude Code 工程师 Lydia Hallie 公开课讲解真实 Token 账本与缓存省费方法

AYi · @AYi_AInotes · X·2026-09-13 23:56·53分钟前
AI 导读

Claude Code 团队工程师 Lydia Hallie 的约 27 分钟公开课讲解 Claude Code 的真实 Token 计费逻辑。

AYi@AYi_AInotes
68AI 编辑部评分,满分 100

Claude Code 工程师 Lydia Hallie 公开课讲解真实 Token 账本与缓存省费方法

2026-09-13 23:56· 53分钟前
AI 导读

Claude Code 团队工程师 Lydia Hallie 的约 27 分钟公开课讲解 Claude Code 的真实 Token 计费逻辑。

@AnthropicAI Claude Code 团队核心工程师 Lydia Hallie 内部实操,强讲透 Claude Code 真实Token账本的公开课,约 27 分钟,强烈推荐!! 很多工程师用 Claude Code 喜欢中途频繁切换模型,一会儿切 Sonnet,一会儿切 Opus,自以为在省钱, 但真相极其残酷——Anthropic 的缓存依赖极其严苛的前缀精确匹配,一旦命中缓存,每轮读取只要 0.1x(直接打一折),

也就是说你在长会话中途敲一次 /model,整个历史前缀全部作废,等于逼着系统把过去几十轮的所有对话按全价(1.0x)重新算一遍!

这个视频里的核心认知极其狠辣,说是刺破了 90% 工程师的盲区也不为过: 效率从来不是“少花 Token”,而是保证花出去的每一个 Token 都精准打在交付物上,绝不交任何一分冤枉税!

很多团队用 Claude Code 账单居高不下,往往是因为犯了这几个极其隐蔽的常识性错误:

1️⃣ 别亲手砸碎你的一折缓存(最大的成本杠杆): 大模型的缓存是极度严苛的“前缀精确匹配”。 只要前缀命中,每一轮上下文读取直接按 0.1x(打一折)算钱! 但很多人喜欢在长会话中途敲 /model 换模型、或者频繁切 /effort—— 你自以为在省钱,实际上换模型的瞬间,整个历史前缀全部作废!等于逼着系统把过去几十轮对话按 1.0x 全价重新算一遍; 2️⃣ 400 行全绿的测试,比报错崩溃更有毒: 这是最反直觉的一点:报错日志通常只有几行,排完就过去了; 但如果你跑测试没加过滤,那 400 行“通过通过通过”的废话会挂在会话里,在此后的每一轮对话中,被当成无意义的启动税反复计费! 必须在 CLAUDE.md 里写死安静输出(例如 npx vitest run <file> --reporter=dot),彻底消灭上下文噪音;

3️⃣ 子代理(Subagents)不是“专家团队”,是“隔音墙”: 别把多智能体想得太神圣。子代理最大的工业价值在于“物理隔离上下文”—— 让它带着独立的临时记忆去扫几千行日志、搜整个仓库、跑吵闹的验证,最后只把干净的几行结论带回主线程,主会话滚烫的前缀缓存丝毫不受污染;

4️⃣ 走偏了用 /rewind,千万别用 /compact: AI 一旦方向跑偏,立刻用 /rewind 回滚,它只砍掉尾巴,前面的缓存还在; 如果你手抖敲了 /compact,历史记录会被一段摘要替换,前缀瞬间对不上,整段缓存当场报废。

还有一个极度老练的实操细节: 每次离开工位去吃饭或开会前,趁着缓存还热(在 5 分钟或 1 小时窗口内),先主动跑一次 /compact 做摘要; 如果等缓存彻底凉透了你再回来摘要,等于逼着系统按全价去重读整座历史屎山。

工具会写代码早就不稀奇了, 看懂底层的数据流动与计费逻辑,把上下文当成干净的总线、而不是丢垃圾的废纸篓, 你才能在用最顶配模型的同时,把每一分钱都烧在刀刃上。 https://x.com/0xCodez/status/2098782845183410287/video/1