caveman JuliusBrussee

🪨 why use many token when few token do trick — Claude Code skill that cuts 65% of tokens by talking like caveman

主要语言
Go
Stars
99,456
Forks
5,764

标签

  • Claude技能
  • 成本监控
  • 推理优化
  • CLI工具
  • 编程Agent
  • 上下文管理
  • 本地部署
  • Go

摘要

Caveman 是一套面向 AI 编程副驾驶的 Token 节省方案,包含 Claude 技能与本地代理两大产品:技能让 Agent 用精简的「原始人」风格回答以减少输出 Token,而代理则在每个 provider 调用前压缩 Agent 读取的上下文(工具 schema、文件、日志、历史),实现架构化压缩与 TOON 编码重编码,保持字节级精确恢复。附带 caveman learn 本地只读分析工具,可评估各 Token 消耗点并给出修复建议。适用于 Claude Code、Codex、Gemini 等 30+ 编程 Agent,帮助降低 LLM 调用成本。

README

<p align="center"> <img src="docs/assets/caveman-logo-banner.png" alt="Caveman" width="720"> </p> <p align="center"> <strong>何必用许多token,少许即可成事</strong> </p> <p align="center"> 原始技能让智能体少说话。Caveman 2 让它们少读点。<br> <strong>在固定的 Claude Code 基准测试中,<a href="./docs/WRAP-BENCHMARK.md">提供商报告的输入 token 减少 33.2%…

查看完整页面