每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

JuliusBrussee/caveman

99,331今日 +286Go

让AI编程助手说话像原始人、还少读数据的省token工具

Caveman最初是一个让Claude Code等编程智能体用简短生硬的语气回答问题的插件,以此减少输出的token数量。后来它扩展成一个本地代理,连智能体每轮读取的工具说明、文件、日志、历史记录等输入内容也一起压缩。在一次固定基准测试中,它比原版Claude Code少用33.2%的输入token,而原始插件平均能把输出token减少65%。

它做什么

  1. 从缩短智能体的回复开始,现在也压缩智能体读取的内容,包括工具描述、文件、日志和对话历史
  2. 本地代理针对代码、JSON、日志、搜索结果等不同类型内容采用不同压缩方式,原始字节始终保存在本地磁盘,需要时可完整还原
  3. 像素模式会把密集文本渲染成PNG图片给视觉模型读取,因为图片消耗的token通常比等量文本少
  4. 在一次固定的54次运行基准测试中,比直接使用Claude Code少用33.2%的输入token,并通过全部18项精确答案检查
  5. README明确说明原始插件只减少输出token,不影响输入和推理token,且插件本身每轮会额外增加约1000到1500个输入token

为什么重要

对经常使用AI编程智能体的开发者来说,token用量直接关系到成本和响应速度,这个项目展示了不只压缩回复、还压缩智能体所读内容的省钱空间。项目还专门写了一份说明何时省钱何时不省钱的文档,这种坦诚态度有助于判断其宣传数字的可信度。

本仓库术语

  • token · AI模型处理文本的基本单位,使用费用通常按token数量计算
  • 代理(proxy) · 介于智能体和AI服务商之间、拦截并压缩还原数据的中间服务器
  • MCP · 一种让AI智能体调用外部工具的标准接口
  • TOON · 该项目自创的格式,用于把JSON格式的工具返回结果重新编码得更小

仓库简介(英文)

Claude Code skill that cuts 65% of tokens by talking like caveman

在 GitHub 打开

热门仓库

全部仓库 →

METAL LAB 最新报道