Claude Code 会话效率手册:九条技巧让每个 token 物有所值

Anthropic 官方梳理了让 Claude Code 会话更高效的九条核心技巧:从 /clear 与 /compact 的使用时机、@-mention 的省 token 逻辑,到 CLAUDE.md 精简策略与"短会话思维",把上下文成本控制的思路讲透。

阅读时长: 4 分钟
共 1827字
作者: longlikun

每发一条消息,Claude Code 都会把整段对话历史作为输入 token 重新发送一次。这意味着第 201 条消息消耗的输入 token,等于前 200 条消息的总和。理解这一点,是压低 token 成本、让每次会话物有所值的起点。

下面九条技巧来自 Anthropic 官方梳理,覆盖从会话启动到收尾的完整链路。


一、任务切换时跑 /clear

会话里堆积的旧上下文会随着每条消息持续"滚雪球",而且往往对新任务毫无帮助。切换到下一个任务之前,先运行 /clear——它会重置对话历史,不让上一个任务的上下文拖着新任务一起烧 token。

时机:两个任务之间有明确的断点时,立刻 /clear,而不是等到上下文窗口撑满。


二、开头设好模型和 effort 等级,不要中途改

在一次对话中途更换模型或调整 effort(推理强度)等级,会让已有的 prompt cache 失效,直接导致 token 成本飙升。

正确做法是在启动会话前就确定好这两个参数。如果发现设错了,最好的办法是 /clear 后重设,而不是直接改。


三、用 @ 引用文件,不要只是"说说文件名"

在消息里 @-mention 一个文件(例如 @src/utils.ts),Claude 会把该文件内容直接附加到你的消息里,省去一次 Read 工具调用,也省去 Claude 先去搜索再找到文件的过程。

在高频读取的场景下,这个细节值得养成习惯。每省一次工具调用,就少一轮上下文往返。


四、给噪声命令加 quiet 标志,或放进子 agent

命令的输出内容会像文件一样追加进对话,并且在会话剩余时间里一直留着。一条输出几千行的测试命令,可能让你的上下文窗口瞬间爆红。

两种处理方式:

  • 加安静标志:许多 CLI 工具有 --quiet-q--brief 等选项,善加利用。
  • 放进子 agent:让子 agent 单独执行,只把关键结果返回给主会话,噪声留在子 agent 的独立上下文里。

五、限制工具输出的大小上限

Claude Code 支持为工具的输出内容设置最大 token 上限。把它设在 8000 左右是一个经验值,既保留足够细节,又避免一次工具调用就吃掉大量上下文空间。

过长的工具输出不仅浪费 token,还会把真正有用的信息"淹没"在大量无关内容里,反而降低 Claude 的判断质量。


六、CLAUDE.md 只放通用内容,workflow 专用指令移进 Skills

CLAUDE.md 在每次会话启动时都会被自动加载,内容越多,每次会话的起始 token 成本就越高。建议原则是:

  • CLAUDE.md 只保留通用指令:项目约定、代码库知识、高频陷阱提示。
  • workflow 专用指令放进 Skills:Skills 只在真正被调用时才加载,不会污染不需要它们的会话。

具体做法:把"如何跑集成测试"、“部署前检查清单"这类场景化内容独立成 Skill,而不是全部堆在 CLAUDE.md 里。


七、在新会话里跑一次 /context

/context 命令会列出当前会话里已加载的所有内容:CLAUDE.md 文件、MCP 工具定义,以及其他随配置自动载入的上下文。

在一个全新会话里跑一次,你可以直观地看到起始负载有多重——有没有多余的内容、有没有重复加载的东西。发现冗余,及时清理,比事后优化省力得多。


八、上下文到 40–50% 时手动跑 /compact

会话积累到一定程度后,上下文里大量早期内容其实已经不再必要。/compact 命令会把整段对话压缩成一份摘要,重置上下文窗口,同时保留当前正在构建的内容的关键状态。

推荐时机:上下文使用率到达 40–50% 时手动触发,而不是等到接近上限才被动压缩。主动压缩,能让后续的上下文利用率更高。


九、用"短会话思维"替代"一个超长会话”

长会话的上下文会持续膨胀,成本越来越高,而里面真正有用的信息密度却在下降。更好的工作方式是:把工作拆成一组有明确开始和结束状态的短会话

每个短会话聚焦一个清晰的子任务,结束时在外部(文件、笔记)记录下关键成果和下一步的上下文,下一个会话从这份记录出发。这样每次进入的 Claude 都在一个干净、轻量的环境里工作,效率比在一个几千 token 对话里翻找上下文要高得多。


小结

技巧 核心作用
/clear 任务间清空旧上下文
开头设好模型/effort 避免 prompt cache 失效
@ 引用文件 省工具调用开销
限制命令输出 避免噪声占满上下文
工具输出上限 8000 平衡细节与开销
CLAUDE.md 精简 + Skills 降低启动上下文成本
/context 审查 发现冗余加载
/compact at 40–50% 主动控制上下文膨胀
短会话思维 从根本上控制成本

这九条不需要全部一次性落地——优先把 /clear@-mention 和 CLAUDE.md 精简做起来,效果通常就已经相当明显。


原文:Maximizing the value of your Claude Code sessions,发布于 Anthropic 官方博客,2026 年 8 月 14 日,作者 Lydia Hallie。

关于

关注我获取更多资讯

月球基地博客公众号二维码,扫码关注获取更多 AI 与编程资讯
📢 公众号
月球基地博客作者个人微信二维码,扫码交流 AI 与编程话题
💬 个人号
使用 Hugo 构建
主题 StackJimmy 设计