RTK
一款开源Token压缩工具,宣称能通过过滤工具输出减少AI编程工具的Token消耗,从而降低API使用成本
时间轴 (近 90 天)
少读输出不等于少花钱,AI Agent的真正成本藏在上下文缓存、额外轮次和任务质量波动引发的反噬中,压缩工具无法压缩这些
RTK在Readme中的免责声明写明最多减少90%的工具输出,但不等于账单降90%
在无RTK情况下,工具输出只占非模型输出的7%,缓存读取占Token总量的94%到98%
RTK把工具字符压了9%,但提示Token反而涨了9%,平均单轮输入少7%但总轮次多了18%
实测中RTK压缩时触发Bug导致死循环,339次连续报错卡了12分钟才超时,单任务成本飙到基线的9倍
RTK(Rust Token Killer)在GitHub上已收获79K star
一篇实测博文花费1500多美元、跑了1700多次任务对RTK进行测试
测试最终形成174条任务、1744次尝试的样本量,采用同路由、同平台、同时段的AB对比方式
在Claude线上,无RTK总账单花了731美元,有RTK花了698美元,降约5%;DeepSeek线上无RTK为51美元,装RTK反而涨到54美元,成本上升5%
任务级成本核算上DeepSeek单任务成本暴涨17%,只看全通过的36个任务成本仍提升18%
还有 6 条时间轴事件
全部知识事实 (15)
少读输出不等于少花钱,AI Agent的真正成本藏在上下文缓存、额外轮次和任务质量波动引发的反噬中,压缩工具无法压缩这些
50%待验证装了RTK之后,Claude的任务通过率掉了1个百分点,DeepSeek掉了2%
50%待验证RTK的核心指标RTK gain计算方式是原始输出减去过滤后输出再除以4,统计的是被删掉的、根本不计费的Token,不算后续轮次成本
50%待验证RTK在Readme中的免责声明写明最多减少90%的工具输出,但不等于账单降90%
50%待验证在无RTK情况下,工具输出只占非模型输出的7%,缓存读取占Token总量的94%到98%
50%待验证RTK把工具字符压了9%,但提示Token反而涨了9%,平均单轮输入少7%但总轮次多了18%
50%待验证RTK(Rust Token Killer)在GitHub上已收获79K star
50%待验证测试最终形成174条任务、1744次尝试的样本量,采用同路由、同平台、同时段的AB对比方式
50%待验证在Claude线上,无RTK总账单花了731美元,有RTK花了698美元,降约5%;DeepSeek线上无RTK为51美元,装RTK反而涨到54美元,成本上升5%
50%待验证任务级成本核算上DeepSeek单任务成本暴涨17%,只看全通过的36个任务成本仍提升18%
50%待验证RTK对外宣称能够显著降低大语言模型调用中的Token消耗,从而帮助用户节省API成本
50%待验证工具内部统计的节省Token可能基于理论基线而非用户实际调用模式,基线设得越高节省数字越好看
50%待验证RTK(Rust Token Killer)是一个用Rust编写的实验性输出压缩工具,选择Rust是因为其极高的执行性能和内存安全保证
50%待验证一篇实测博文花费1500多美元、跑了1700多次任务对RTK进行测试
50%待验证实测中RTK压缩时触发Bug导致死循环,339次连续报错卡了12分钟才超时,单任务成本飙到基线的9倍
50%