GitHub:JuliusBrussee/caveman · ⭐ 57K+ · Shell · MIT协议
Caveman是一款Claude Code的Agent Skill,核心理念是"why use many token when few do trick"——用更少的Token完成同样的任务。基准测试显示,Caveman 2能减少33.2%的输入Token消耗,且不损失Agent的任务完成质量。
它通过两层优化实现省Token:第一层是上下文压缩(把冗长的对话历史和文件内容压缩为精简摘要),第二层是读取优化(Caveman 2新增,减少Agent读取文件时的Token消耗,只读关键片段而非全文)。
# 一行命令安装(需已安装Claude Code)
npx caveman install
# 或手动安装
git clone https://github.com/JuliusBrussee/caveman.git
cd caveman
./install.sh
# 验证安装
claude skills list
# 应看到 caveman 已激活
| 优化层 | 机制 | 省Token效果 |
|---|---|---|
| Caveman 1:上下文压缩 | 对话历史超过阈值时,自动用LLM生成摘要替代原始历史 | ~15-20% |
| Caveman 2:读取优化 | 读取文件时只提取与当前任务相关的代码段,跳过注释/空行/无关函数 | ~13-18% |
| 组合效果 | 两层叠加 | ~33.2%(基准测试验证) |
# 运行官方基准测试
npx caveman benchmark --task benchmark_counterfactual
# 结果示例:
# ┌─────────────────┬──────────┬──────────┬──────────┐
# │ Metric │ Baseline │ Caveman │ Delta │
# ├─────────────────┼──────────┼──────────┼──────────┤
# │ Input Tokens │ 1,847K │ 1,234K │ -33.2% │
# │ Output Tokens │ 892K │ 887K │ -0.6% │
# │ Task Success │ 94% │ 93% │ -1% │
# │ Wall Time │ 12m34s │ 11m58s │ -4.9% │
# └─────────────────┴──────────┴──────────┴──────────┘
关键发现:Token消耗减少33.2%,任务成功率几乎不变(94%→93%),Wall Time也略有下降(减少了Agent等待API响应的时间)。
# .claude/caveman.toml
[compression]
enabled = true
threshold_tokens = 50000 # 对话超过5万Token时触发压缩
summary_ratio = 0.3 # 压缩为原文30%长度
[read_optimization]
enabled = true
max_file_tokens = 2000 # 单文件最多读取2000 Token
smart_truncation = true # 智能截断:保留函数签名/关键逻辑
[exclude]
paths = ["node_modules", ".git", "dist", "build"]
与 ECC Claude Code增强工具 不同,Caveman专注做一件事:省Token。它不添加新功能,只优化已有交互的Token效率,适合API费用敏感的重度用户。
| 场景 | 说明 |
|---|---|
| 重度Claude Code用户 | 每天消耗50K+ Token,月省数十美元 |
| 大型代码库 | 文件动辄上千行,Caveman 2读取优化效果显著 |
| 团队协作 | 多人共用API Key时,省Token等于省钱 |
| 长对话场景 | 对话轮次多、上下文累积大时效果最明显 |
GitHub:JuliusBrussee/caveman · ⭐ 57K+ · Shell · MIT协议
ECC:Claude Code增强工具教程