Caveman实战教程:给你的Claude Code装上token压缩术
Caveman实战教程:给你的Claude Code装上token压缩术
上一篇介绍了能省65% API费用的Caveman项目。今天直接上手——这篇教程教你在30秒内给Claude Code装上Caveman,然后看看每月的API账单能缩水多少。

### 前提条件
– 已安装Claude Code CLI(`npm install -g @anthropic-ai/claude-code`)
– 已配置Anthropic API Key
– 一个用于测试的项目目录
### Step 1: 安装Caveman(一行命令)
claude plugin marketplace add JuliusBrussee/caveman安装完成后,Claude Code会自动加载Caveman技能。你可以通过以下命令确认:
claude plugin list输出中如果看到 `caveman` 状态为 `active`,说明安装成功。
### Step 2: 选择压缩级别
Caveman提供三种模式,在对话中直接告诉Claude切换:
# 轻度压缩 — 去掉寒暄,保留必要解释
/caveman:lite
# 完全压缩 — 电报式风格,所有回复极度精简
/caveman:full
# 极限压缩 — 仅关键字和代码,几乎无自然语言
/caveman:ultra对于日常开发,推荐从 `full` 模式开始。如果觉得太简洁导致理解困难,降到 `lite`。写单元测试或重构代码时用 `ultra`——这些场景只需要代码,不需要解释。
### Step 3: 实测对比
找一个真实的编程任务来测试效果。比如”帮我找出这个React组件中所有可能导致重复渲染的地方”:
普通模式输出(约180 tokens):
我分析了你的ShoppingCart组件,发现有以下几个可能导致不必要重复渲染的问题:第一个问题是你在useEffect中调用了setCartItems,而这个effect的依赖数组包含了cartItems本身。这会导致一个无限循环的更新。第二个问题是在render函数中直接创建了一个新的对象作为props传递给子组件…
Caveman full模式输出(约45 tokens):
3 re-render causes found:
1. `useEffect` deps has `cartItems` — infinite loop risk. Fix: use functional update.
2. Line 23: object literal in JSX prop. Fix: `useMemo`.
3. Line 31: inline arrow fn. Fix: `useCallback`.
节省:75%的token,但信息密度反而更高。
### Step 4: 进阶配置
创建 `~/.claude/caveman-config.yaml` 来自定义行为:
mode: full
keep_verbosity_for:
- "explain this error" # 错误解释保持详细
- "what does this do" # 代码解释保持详细
- "security review" # 安全审查必须详细
aggressive_for:
- "write tests" # 测试用例极限压缩
- "refactor" # 重构极限压缩
- "fix bug" # Bug修复极限压缩这个配置的意思是:当你的prompt匹配关键词时,自动切换压缩策略。安全审查需要AI给出详尽的解释——不能省;但写测试用例只需代码和覆盖范围——可以极限压缩。
### Step 5: 和Cursor/Windsurf/Codex一起用
Caveman支持30+工具。以Cursor为例:
npx skills add JuliusBrussee/caveman -a cursor安装后在Cursor的设置中可以看到新增的Caveman技能。在 `.cursorrules` 中添加:
Always use caveman:full mode for all responses.
Keep code blocks intact.
Only compress natural language explanations.对于Codex CLI:
# 方法1:通过技能注册表
npx skills add JuliusBrussee/caveman -a codex
# 方法2:手动添加Rule
codex rules add caveman --content "caveman:full mode. Terse replies. Code unchanged."### Step 6: 量化你的节省
使用一周后,通过Anthropic控制台查看token消耗对比:
# 导出使用数据
claude usage export --start $(date -d '7 days ago' +%Y-%m-%d) --format csv > usage.csv
# 快速计算(Python一行)
python3 -c "
import csv
total = 0
with open('usage.csv') as f:
for row in csv.DictReader(f):
total += int(row['output_tokens'])
print(f'7天输出token总量: {total:,}')
print(f'按\$15/M tokens计算: \${total/1e6*15:.2f}')
print(f'Caveman省65%: 约节省 \${total/1e6*15*0.65:.2f}')
"根据社区反馈,重度Claude Code用户安装Caveman后,API月费从$200-400降到$70-140。对于个人开发者,这可能意味着每个月省下一顿火锅钱。
### 常见问题
Q: Caveman会影响代码质量吗?
A: 不会。代码和命令完全不变,被压缩的只是AI的解释性文字。事实上,很多用户反馈Caveman模式下AI给出的代码更精准——因为它没空写”当然,这里还有另一种实现方式,不过我个人推荐…”这种冗余。
Q: 能中途切换模式吗?
A: 可以,随时在对话中说 `/caveman:lite` 或 `/caveman:full` 切换。切换立即生效,不需要重启。
Q: 支持中文吗?
A: Caveman的压缩策略基于英文语义。中文对话中效果会打折扣,但仍然能省20-30%的token。
**小结**:Caveman解决了AI编程中最现实的问题——不是AI不够聪明,是它太爱说话。30秒安装,立竿见影地省钱。
🔥 关注LC智趣厅,每篇教程都让你学到立刻能用的技能。
👇 关注不错过,下期带你搭建自己的AI工作流。
— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn
