https://github.com/juliusbrussee/caveman)
从插件作者 Julius Brussee 那里得知, 此项目不光引得 OpenAI、NVIDIA、GitHub 等公司的开发者去使用, 就连 OpenAI 的一名高级工程师都亲自到项目中贡献了代码, 还增添了对自家 Codex 的支持。
于是乎, 问题就出现了: 一款专门用于教导 AI 做到“少言语”的插件, 为何突然间变得火爆起来了呢?
AI 不需要那么有礼貌
来自 Caveman 的作者 Julius Brussee 的介绍表明, 作为项目, 其出现的时间是今年 4 月。
那时的情况了, 他每一天都处于高频使用Claude Code的状态之中, 在这个期间之内, 并且发现了一个存在着些许“反直觉”特征的现象, 何为真正耗费大量Token的因素呢, 并非仅仅只是代码而已, 反而是AI所作的那些没有着什么实际价值意义的表达。
比如, “当然能够, 使我来帮你瞧瞧”, “你的念头是无误的”, “多谢你的提示”, “这是个挺好的问题”……就平常聊天来讲, 这些表述会让人工智能显得更为自然、更为友善;然而在人工智能智能体自动开展任务之际, 它们基本上没什么作用啦!
不会因为被说一句“谢谢”, Agent工作就会变得更认真, 不会因为被讲一句“我认为”, 代码质量就会提升。它真正需要的是指令, 是代码, 是路径, 是函数名称, 是执行结果, 而不是相互问候。
此情形致使Brussee着手予以思考, 鉴于这些内容并不会对任务结果造成影响, 那么为何不全数将其删除呢, 如此一来, Caveman便这般诞生了。
把 Claude 变成“浩克”
关于Brussee对Caveman的定位的情况, 是十分直接的, 它使得模型并非像那种礼貌的聊天机器人, 而是更加类似于一个简洁高效的工具。
平常的Claude也许会回应: “你讲得没错, 我先前理解存在偏差, 我们能够再次剖析一下这个问题。”然而开启Caveman之后, Claude可能就仅剩下: “有误, 改正。”——又或者, 按照Brussee的表述, 也就是将AI从“你说得在理, 我之前有错误”, 转变为“浩克, 给我砸(Hulk smash)。“。
记者对安装 Caveman 之后的 Claude Code 进行实则勘查了一番, 发觉变化比想象当中显眼得多, 像比如说: 。
没有进行铺垫, 没有作出解释, 没有带着客套, 差不多每一句话都好似终端命令那般简洁。
一次节省 65%开运真人app下载苹果版,开运真人app下载开云真人app官方版入口,开云真人app官网入口开云手机入口app下载,还能选择“原始程度”
于此处看到, 好多人或许会担忧, AI所给出的回答这般简短, 是不是会将关键内容也予以删除呢?
有关此情况, Brussee 作出这样的表示, Caveman 插件所进行压缩处理的仅仅是外围的自然语言, 它不会去修改那些真正需要维持精确性的信息, 像代码、Shell 命令、API、文件路径、URL、数字、函数名、技术细节等这些都会被完整地保留下来。而真正被删除掉的, 只是各种各样的解释性语言、连接词、礼貌表达以及过渡句。
终究对于AI编程来讲, 那开发者实际所关心的是, 代码是否存在问题, 命令可不可以执行, Bug有没有修好, 至于AI有没有说一句“谢谢”, 实际上根本没人留意。
那么, 如此这般去做究竟能够节省多少 Token 呢? 有外国媒体在测试期间发觉, 仅仅在一次使用的进程当中, Caveman 就曾呈现出累计节省了大概 5800 个 Token 的情况, 大约占到输出 Token 的 65%(该插件能够实现实时统计累计节省了何其多的 Token这样一种情形, 从而让开发者能够直观地看到节省所带来的效果)。

然而, 依据Brussee自身所做的评测, 于不同的任务状况之下, 输出之中的Token, 其平均下降幅度为65%至75%。

更具趣味的是, Brussee 特意与 Prompt 展开了对比。众多人会于 Prompt 之中写下这样一句: 请保持简洁。然而实验发觉, 实际借由 Prompt 令模型“减少话语量”, 成效依旧比不上 Caveman。这是由于 Caveman 是在输出阶段径直实施压缩, 成效更为稳定。
然而那最为特别之处在于, 用户能够自行选择 Caveman 的“原始程度”, 其存在轻量版(Lite), 有标准版(Full, 此为默认), 包含极限版(Ultra), 甚至还设有一个 “文言文(Wenyan)”模式。
当中, 最为离谱的便是 “文言文” 模式 , 开启此模式之后, AI 会径直将输出内容翻译成为古汉语。有记者在进行测试之后调侃着说道: “我也尝试了 , 确实能够使用 , 但是 Claude 说了些什么我完全看不懂了。”。
OpenAI 工程总监都亲自提交代码
虽然 Caveman 看上去好似个玩具类项目, 然而它的发展速率却超越了好多人的预估。
依据作者所讲, 当下已然存在源自OpenAI、NVIDIA、GitHub等公司的开发者以及工程师正在运用或者测试Caveman。三个月之前, OpenAI的一名工程总监Shayne Sweeney还亲自为项目递交了代码, Commit说明写着:
增添对Codex插件的支持,也就是Add Codex plugin support。

就是说, OpenAI的员工, 不但使用了这个工具, 而且还助力它为自家所拥有的AI编程产品Codex提供了支持。
Caveman 所提供的, 是一整套 AI Agent, 名为 caveman-code, 这其中, 除了插件之外。
按 GitHub 页面所讲, 它能够使整个终端 Agent 至始至终都维持 Caveman 风格输出, 于相同任务情形下, 相较于 Codex 能够减少大约 2 倍 Token 消耗, 并且支持 20 多家模型提供商, 还可以跟今年年初火起来的 Agent 工具 OpenClaw 协同运用。

其实, Caveman能够爆火起来的缘由并非难以去推测, 那就是AI成本方面的问题, 实际上, 大模型说的每一句客套性质的话语都会致使成本产生, 去年的时候, Sam Altman还曾经开玩笑讲过, 用户对着GPT说出“Please”、“Thank you”这类礼貌用语, 每年都会让OpenAI在电费上多花费数千万美元。
现如今再看, 并非仅仅是只有用户讲“谢谢”得花钱, 就连AI自身不间断地说些客气话, 这同样是一项数额不算小的支出。
最后, 在截至发稿之前, OpenAI没有回应关于使用Caveman的置评请求, NVIDIA也没有回应, GitHub同样没有回应。而Caveman GitHub库最后的一句介绍, 以最契合它风格的 manner总结了这个项目存在的意义: 那个项目存在的意义被总结为“Caveman save you token, save you money.”——亦即少说话, 省Token, 还省钱。
参考链接:
https://www.404media.co/companies-are-making-claude-and-codex-talk-like-cavemen-to-stop-ais-soaring-costs/
人工智能不应仅仅局限于概念以及演示版本, 而更应当切实地深入到业务实际场景之中。在 7 月 17 日至 18 日期间, 2026 奇点智能产品大会将会在北京金隅喜来登酒店举行。此次大会将会围绕智能体、企业级人工智能、人工智能编码、具身智能、行业应用落地等核心方面, 邀请处于一线的产业实践者, 一同剖析人工智能产品从构思到实际落地、从试点到大规模推广的关键路线。扫描二维码去领取人工智能实战能够落地的资料包, 提前去了解大会的亮点之处, 和超过1000个产业决策者在现场相聚, 一起奔赴智能奇点。
标签: AI 插件 OpenAI NVIDIA GitHub
还木有评论哦,快来抢沙发吧~