caveman JuliusBrussee
🪨 why use many token when few token do trick — Claude Code skill that cuts 65% of tokens by talking like caveman
- 主要语言
- Go
- Stars
- 99,456
- Forks
- 5,764
标签
- Claude技能
- 成本监控
- 推理优化
- CLI工具
- 编程Agent
- 上下文管理
- 本地部署
- Go
摘要
Caveman 是一套面向 AI 编程副驾驶的 Token 节省方案,包含 Claude 技能与本地代理两大产品:技能让 Agent 用精简的「原始人」风格回答以减少输出 Token,而代理则在每个 provider 调用前压缩 Agent 读取的上下文(工具 schema、文件、日志、历史),实现架构化压缩与 TOON 编码重编码,保持字节级精确恢复。附带 caveman learn 本地只读分析工具,可评估各 Token 消耗点并给出修复建议。适用于 Claude Code、Codex、Gemini 等 30+ 编程 Agent,帮助降低 LLM 调用成本。
README
<p align="center"> <img src="docs/assets/caveman-logo-banner.png" alt="Caveman" width="720"> </p> <p align="center"> <strong>何必用许多token,少许即可成事</strong> </p> <p align="center"> 原始技能让智能体少说话。Caveman 2 让它们少读点。<br> <strong>在固定的 Claude Code 基准测试中,<a href="./docs/WRAP-BENCHMARK.md">提供商报告的输入 token 减少 33.2%…