详情

首页手游攻略 Claude Code 怎么省 Token?caveman 短答技能包使用说明

Claude Code 怎么省 Token?caveman 短答技能包使用说明

佚名 2026-07-21 19:00:02

Claude Code 连续改 Bug 时,最烦人的浪费往往不是它不会写代码,而是每次都要先寒暄、解释背景、铺一长段判断。caveman 解决的是这类输出成本:让编程 Agent 用更短、更硬的句子回复,把 token 留给命令、文件名、错误行和真正的修改建议。

它不是新模型,而是回答方式的刹车

caveman 是 JuliusBrussee 开源的 AI Agent skill/plugin,项目页把它定位成面向 Claude Code 和多种编程 Agent 的输出压缩工具。它主打“同样答案,少 65% 输出 token”,核验时 GitHub 仓库显示约 86.9k stars,最新 release 标记为 v1.9.1。这里要先分清:它主要压缩输出表达,不会自动减少 Claude Code 读取项目、日志和上下文时产生的输入 token。

省 token 的地方在哪里

它的核心做法很朴素:删除礼貌话、弱化铺垫、避免长句,把回答压成“问题在哪、改什么、跑什么、失败看哪里”。比如测试失败时,普通回答可能先解释单元测试意义;caveman 更可能直接指出断言、文件和下一步命令。技术内容还在,包装层少很多。

适合它的场景很明确:报错已经贴出来,只需要定位;文件范围已经告诉 Agent,只需要它给 patch;或者你在一天里反复让 Claude Code 跑测试、修小问题。失败场景也要讲清:需求还没问明白就开短答模式,Agent 可能少追问关键条件,表面省了输出,实际多绕一轮。

SKILL.md 里写了什么规则

项目的 SKILL.md 把 caveman 定义成 ultra-compressed communication mode,并列出 lite、full、ultra、wenyan-lite、wenyan-full、wenyan-ultra 等强度。默认模式是 full,触发方式包括输入 /caveman,或直接说 caveman mode、less tokens、be brief。停止时说 normal mode 或 stop caveman。

什么时候不该开

写架构说明、整理需求、做代码评审复盘时,不建议全程开 caveman。短句会降低背景信息密度,尤其是多方案权衡、风险解释、跨团队交接这类任务,读者需要的是完整判断,不只是动作列表。安全提醒、不可逆操作和复杂步骤也不适合压得太狠。

更实际的用法

我更愿意把 caveman 当成“输出节流阀”。先正常模式讲清目标、目录、约束和验收标准,等任务进入改代码、跑测试、看报错阶段,再打开短答。这样省的是重复解释,不是必要沟通。若发现 Claude Code 开始只给结论、不说明原因,就切回 normal mode,让它把关键判断补完整。

上手前可以做一个小测试:选一个已经失败的测试文件,让 Claude Code 先用普通模式解释一次,再开 /caveman 让它只给修改点和验证命令。若第二次仍能看懂文件、命令和失败信号,说明这个项目适合短答;若你还要反复追问“为什么这样改”,就别急着常开。

适合谁

它适合已经熟悉项目、能判断代码方案好坏的开发者,也适合 token 紧张但仍要高频使用 Claude Code 的人。不适合新手把它当万能省钱按钮。真正的省 token 组合是:少喂无关文件、缩短日志、明确任务边界,再让 caveman 压缩输出。只装技能包却继续丢整仓库和长日志,成本不会从根上降下来。

相关资讯
点击查看更多
游戏推荐
推荐专题
热门阅读
推荐下载