Folia
← 返回头版

RTK节省成本承诺遭质疑 独立测试显示效果有限甚至反效

RTK(Rust Token Killer)是一款广受欢迎的工具,曾声称能将Claude Code的token成本削减高达60%1。其中一条社交媒体帖子因这一说法获得了31.3万次浏览1。RTK官方文档更是宣称可削减高达90%的bash输出1。然而,JetBrains研究团队通过大规模基准测试发现,RTK的实际效果与这些承诺存在显著偏差。

研究团队在Terminal-Bench 2.1上进行了1740次测试,耗资超过1500美元,覆盖85个Fable任务和89个DeepSeek任务1。测试结果显示,RTK对不同模型的影响差异巨大。按成本与通过率的综合计算,使用RTK后Fable模型成本下降3%,而DeepSeek模型成本反而上升7%1。若按任务平均水平衡量,Fable成本增加1%,DeepSeek成本平均增加17%1。值得注意的是,Fable所有的成本节省主要来自单个任务1,这进一步削弱了RTK效果的普遍性。

数据进一步暴露了RTK报告与实际成本的偏离。RTK声称节省了349.2百万token(减少89%),但这一庞大数字并未转化为相应的账单节省1。在DeepSeek的测试中,虽然终端输出字符减少了9%,但提示token反而增加了9%1。在58个增加turns数量的DeepSeek任务中,其中44个的成本反而更高1。此外,两个模型在使用RTK后的通过率都出现下滑,分别下降1%和2%1。


评论