这个项目能做什么

Caveman 为 AI 驱动的编程助手提供两个互补组件。 第一个是"skill"——一个规则文件,将智能体的回复中自然语言部分重写为简洁的洞穴人风格措辞,同时保留代码、命令、文件路径和错误信息不变。仓库中的基准测试显示,在十种典型编程提示下,平均输出 token 减少了约 65%。 第二个组件是一个本地代理,位于智能体和 LLM 提供商之间。它分析传入的数据负载(JSON、日志、代码、diff、搜索结果、纯文本/HTML),在上行发送前对其进行压缩,并为原始数据保留 SQLite 备份以实现精确恢复。报告称输入 token 整体节省约 33%,在大型日志或 CSV 数据上减少幅度更大。 安装分为两个部分:小型"rock"(skill)和较大的"rock"(代理)。Skill 可通过单个 npx 命令添加,并在受支持的智能体中通过 /caveman 命令激活。代理通过 npm 全局安装,并使用 caveman CLI 进行配置,该 CLI 可包装 Claude Code、OpenAI Codex、Gemini CLI、Aider、Kilo Code、Qwen Code、opencode、Hermes、OpenClaw 和 Pi 等代理。CLI 还提供完整的安装脚本,用于在 Unix 或 Windows 系统上自动检测和设置。 Caveman 附带一系列命令来控制其行为:/caveman [lite|full|ultra|wenyan‐lite|...|off] 选择压缩强度,caveman‐commit 生成简洁的提交信息,caveman‐review 输出一行代码评审,caveman‐compress 压缩 markdown 文件,caveman‐stats 查看 token 使用情况,以及 caveman‐learn 分析历史会话数据并建议节省 token 的修复方案。附加功能包括浏览压缩、记忆召回、将 skill 文本转换为像素模式图片,以及 A/B 试验报告。 项目包含针对 skill 和代理的详细基准测试表,以及关于每种负载类型的压缩方式和相关性排名(BM25、时效性、错误信号)如何应用于适配上下文 token 预算的文档。所有转换均可逆,原始内容可从本地存储中检索。 隐私得到高度重视:skill 和代理完全在用户机器上运行,无需注册账户,默认仅发送匿名使用统计信息(命令名称和 token 数量)。用户可以通过一条命令或设置环境变量永久禁用遥测。 许可证分开:skill、CLI、SDK 及相关代码采用 MIT 许可,而运行时引擎以 BSL‐1.1 源码可用许可发布,在变更日期之后转为完全开源。 总体而言,Caveman 旨在通过让智能体少说少读来降低 AI 辅助编程的成本和延迟,同时不牺牲正确性和可读性。