[NS :
最近用ClaudeCode/Codex这类Agent干活,发现token消耗大头根本不是对话,而是每次工具调用的返回——读个文件、跑个测试,几万token就没了。后来用上了开源的Headroom(压缩层,工具输出/日志先压缩再进模型,官方数据编码场景省15-20%、JSON能省60-95%,答案不变)。效果确实好,
LeeHow] 一键给 AI 编程 Agent 省 token,造了个开源小工具 HeadroomSwitch:给 Headroom 上下文压缩做了个 GUI最近用ClaudeCode/Codex这类Agent干活,发现token消耗大头根本不是对话,而是每次工具调用的返回——读个文件、跑个测试,几万token就没了。后来用上了开源的Headroom(压缩层,工具输出/日志先压缩再进模型,官方数据编码场景省15-20%、JSON能省60-95%,答案不变)。效果确实好,