6 大技巧总结:
在不同任务之间运行 /clear。这样可以避免把之前无关的上下文继续发送给模型,从而减少 Token 消耗。
开始工作前,先确定好模型和推理强度。中途更改其中任何一个,都可能导致提示词缓存失效,进而增加 Token 成本。
不要只写出文件名,而是直接用 @ 提及文件。这样文件会直接附加到消息中,可以省去一次 Read 调用,也避免 Claude 再去搜索文件。
对输出冗长的命令加上静默参数,或者把命令交给子代理执行。因为命令输出会像文件一样被加入对话,并且在整个会话期间都会保留。
在新会话开始时运行一次 /context。它会显示当前加载的内容(例如 CLAUDE.md 和 MCP 工具定义),方便你删掉不必要的内容。
暂时离开键盘前运行 /compact。提示词缓存通常一小时后就会过期,而在缓存仍然有效时进行对话压缩,成本要低得多。