RTK(Rust Token Killer)会在AI代理读取之前,过滤并压缩终端输出。今天它在GitHub上已经拿到超过79k颗星,是让AI编码更便宜的最热门工具之一。
一条声称RTK能把Claude Code的token砍掉最多60%的X帖子,浏览量冲到了313K。
![]()
但JetBrains的SkillsBench跑出来的结果是没有省下钱。RTK的README里本身就带着一句免责声明:
RTK最多能砍掉你的代理读取的90%的bash输出。……这并不等于把你的账单砍掉90%。
“终端输出更少”不等于“AI编码更便宜”
所以“终端输出更少”和“AI编码更便宜”不是一回事。它可能有用,可能是白干,也可能反噬——比如更多轮次,或者更低的输出质量。这篇文章里,我们给出花了好几天、烧掉超过1500美元token之后的发现。
RTK可以重写代理通过shell工具(Claude Code里的Bash,OpenCode里的bash)执行的Git、测试、打包和文件命令。每一次重写,返回的都是同一份输出更精简的版本。
举个例子,RTK会保留文件名、大小和权限(644就是rw-r—r—),但会丢掉所有者和日期:
$ ls -la /app/warriors
-rw-r--r-- 1 root root 824 Sep 13 2025 g2-clear.red
-rw-r--r-- 1 root root 487 Sep 13 2025 paper.red
$ rtk ls -la warriors/
644 g2-clear.red 824B
644 paper.red 487B
在Terminal-Bench 2.1上实测RTK
RTK压缩的是终端输出,所以我们把它放到Terminal-Bench 2.1上测——这是一个终端交互很重的基准。我们留在2.1,没有用更新的3.0和4.0:代理能通过2.1的大部分任务,而3.0和4.0仍然是个挑战。只有通过的任务,成本才有意义。
我们跑了Claude Code配Fable 5.0,以及OpenCode配DeepSeek V4 Pro 0813(通过OpenRouter)。每个任务在相同模型路由、相同平台、相同任务超时设置下,分别在不带RTK和带RTK的情况下各调度五次。
在剔除四个被拒绝的Fable安全任务之后,最终对比覆盖了85个Fable任务和89个DeepSeek任务,也就是1740次尝试。
带上RTK之后,Fable的成本下降了5%,DeepSeek的成本上升了5%。
Claude Code · Fable 5.0
- 基线:$596,通过率84%
- RTK:$546,通过率83%
OpenCode · DeepSeek V4 Pro 0813
- 基线:$26,通过率71%
- RTK:$31,通过率69%
带RTK的通过率更低:Fable低了1%,DeepSeek低了2%。两个通过率差距都不大。
当我们把所有花费(包括失败的尝试)除以通过次数时,Fable带RTK便宜了3%,DeepSeek贵了7%。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.