JuliusBrussee/caveman
让AI编程助手说话像原始人、还少读数据的省token工具
Caveman最初是一个让Claude Code等编程智能体用简短生硬的语气回答问题的插件,以此减少输出的token数量。后来它扩展成一个本地代理,连智能体每轮读取的工具说明、文件、日志、历史记录等输入内容也一起压缩。在一次固定基准测试中,它比原版Claude Code少用33.2%的输入token,而原始插件平均能把输出token减少65%。
它做什么
- 从缩短智能体的回复开始,现在也压缩智能体读取的内容,包括工具描述、文件、日志和对话历史
- 本地代理针对代码、JSON、日志、搜索结果等不同类型内容采用不同压缩方式,原始字节始终保存在本地磁盘,需要时可完整还原
- 像素模式会把密集文本渲染成PNG图片给视觉模型读取,因为图片消耗的token通常比等量文本少
- 在一次固定的54次运行基准测试中,比直接使用Claude Code少用33.2%的输入token,并通过全部18项精确答案检查
- README明确说明原始插件只减少输出token,不影响输入和推理token,且插件本身每轮会额外增加约1000到1500个输入token
为什么重要
对经常使用AI编程智能体的开发者来说,token用量直接关系到成本和响应速度,这个项目展示了不只压缩回复、还压缩智能体所读内容的省钱空间。项目还专门写了一份说明何时省钱何时不省钱的文档,这种坦诚态度有助于判断其宣传数字的可信度。
本仓库术语
仓库简介(英文)
Claude Code skill that cuts 65% of tokens by talking like caveman
在 GitHub 打开热门仓库
- cathrynlavery/diagram-design让AI编程工具画出杂志排版质感图表,而不是千篇一律的圆角方框
- public-apis/public-apis一份由社区维护的免费API大全仓库
- semantica-agi/semantica一个让AI智能体的决策可追溯、可审计的开源图谱基础设施
- cactus-compute/needle一个14MB的AI模型,让手机和可穿戴设备无需联网就能调用工具
- unslothai/unsloth一款让你在自己电脑上运行和训练AI模型的桌面应用,无需写代码
- macro-inc/macro把邮件、聊天、文档、任务和CRM互相链接、共享同一份AI团队记忆的一体化办公平台
- harry0703/MoneyPrinterTurbo只需一个主题或关键词,就能自动生成配好文案、素材、字幕和音乐的完整短视频的开源工具
- basecamp/omarchyDHH打造的、开箱即用且风格统一的Linux发行版