Caveman:Claude Code省Token利器教程

GitHub:JuliusBrussee/caveman · ⭐ 57K+ · Shell · MIT协议

项目简介

Caveman是一款Claude Code的Agent Skill,核心理念是"why use many token when few do trick"——用更少的Token完成同样的任务。基准测试显示,Caveman 2能减少33.2%的输入Token消耗,且不损失Agent的任务完成质量。

它通过两层优化实现省Token:第一层是上下文压缩(把冗长的对话历史和文件内容压缩为精简摘要),第二层是读取优化(Caveman 2新增,减少Agent读取文件时的Token消耗,只读关键片段而非全文)。

安装

# 一行命令安装(需已安装Claude Code)
npx caveman install

# 或手动安装
git clone https://github.com/JuliusBrussee/caveman.git
cd caveman
./install.sh

# 验证安装
claude skills list
# 应看到 caveman 已激活

工作原理

优化层机制省Token效果
Caveman 1:上下文压缩对话历史超过阈值时,自动用LLM生成摘要替代原始历史~15-20%
Caveman 2:读取优化读取文件时只提取与当前任务相关的代码段,跳过注释/空行/无关函数~13-18%
组合效果两层叠加~33.2%(基准测试验证)

基准测试结果

# 运行官方基准测试
npx caveman benchmark --task benchmark_counterfactual

# 结果示例:
# ┌─────────────────┬──────────┬──────────┬──────────┐
# │ Metric          │ Baseline │ Caveman  │ Delta    │
# ├─────────────────┼──────────┼──────────┼──────────┤
# │ Input Tokens    │ 1,847K   │ 1,234K   │ -33.2%   │
# │ Output Tokens   │ 892K     │ 887K     │ -0.6%    │
# │ Task Success    │ 94%      │ 93%      │ -1%      │
# │ Wall Time       │ 12m34s   │ 11m58s   │ -4.9%    │
# └─────────────────┴──────────┴──────────┴──────────┘

关键发现:Token消耗减少33.2%,任务成功率几乎不变(94%→93%),Wall Time也略有下降(减少了Agent等待API响应的时间)。

配置与调优

# .claude/caveman.toml
[compression]
enabled = true
threshold_tokens = 50000  # 对话超过5万Token时触发压缩
summary_ratio = 0.3       # 压缩为原文30%长度

[read_optimization]
enabled = true
max_file_tokens = 2000    # 单文件最多读取2000 Token
smart_truncation = true   # 智能截断:保留函数签名/关键逻辑

[exclude]
paths = ["node_modules", ".git", "dist", "build"]

ECC Claude Code增强工具 不同,Caveman专注做一件事:省Token。它不添加新功能,只优化已有交互的Token效率,适合API费用敏感的重度用户。

适用场景

场景说明
重度Claude Code用户每天消耗50K+ Token,月省数十美元
大型代码库文件动辄上千行,Caveman 2读取优化效果显著
团队协作多人共用API Key时,省Token等于省钱
长对话场景对话轮次多、上下文累积大时效果最明显

📚 常见问题

Caveman是什么?

GitHub:JuliusBrussee/caveman · ⭐ 57K+ · Shell · MIT协议

如何上手Caveman?

ECC:Claude Code增强工具教程