强制AI输出极简文本省token
推荐指数 39.0 NO. 009 · 2026.09.03
Stars102,560
为什么值得看
Caveman 是一个代理输出压缩工具,通过约束模型用极简语言(类似"洞穴人"风格)回答问题,将 token 消耗从 69 压到 19。对按 token 计费的 AI 应用和 Agent 系统,这是直接降低运营成本的工程手段。
🪨 why use many token when few token do trick — Claude Code skill that cuts 65% of tokens by talking like caveman
媒体预览
编辑判断
之前团队省 token 主要靠提示词里加"请简洁回答",效果不稳定且容易牺牲信息密度。Caveman 的 trick 是把约束写进系统提示的深层结构,配合代理层的输出拦截和重写,相当于在应用层做了一层有损压缩协议。
跟直接换 cheaper model(比如 GPT-4 降 GPT-3.5)不同,它不牺牲模型能力,只牺牲表达冗余度。做高频 Agent 调用(如代码审查、日志分析、自动化客服)的团队最该试,这类场景往往 70% 的 token 花在客套话和重复解释上。
潜在风险是极端压缩可能丢失关键 nuance,需要配合置信度检测或人类兜底。
Star History
生态分析
Production
Claude Code生态中首个破圈的现象级输出压缩技能,以meme风格降低AI运营成本
独特价值:用洞穴人meme包装工程需求,10万星验证的病毒式传播力与实用价值兼具
竞品: