一条实测挂上时间线:同样的提示词,速度差出一倍来。
两组数摆开。主帖那句是结论,实测 tps 翻倍了,同样的提示词在 codex 里还在二十以下。引帖那组更具体,同类任务换 zcode 两分钟解决,codex 能磨上十分钟,光上下文压缩就吃掉三分钟;此前用 magpie 反代在 codex 里跑 GLM、DeepSeek 也一样慢,作者还留了句判断,因为 6.1 Sol 上线才变慢的。
"速度差一倍"这半句是全场重心。前面最牛组合还是那两位讲的是搭配省钱,这条讲的是搭配省时间。跟前面把 Opus 分给谁呼应,那条在选谁干活,这条在看谁跑得快,两头都在提醒同一件事,体感这东西榜单测不出来,但手一动就知道。跟前面一周只开两三次也接得上,慢的工具被晾在一边,快的被反复打开,开关的次数就是最诚实的评分。
压缩吃掉三分钟这个细节我单独拎出来。长任务真正的税不在模型本身,而在中途那次喘息,省下它的往往不是更强的模型,是更顺的链路。
我留的疑问有三处。tps 的测量环境没标;换 zcode 之后的正确率没对照;上下文压缩那三分钟是网络还是计算也没拆。
这周拿同一段提示在两边各跑五轮,把 tps 和完成时间都记成一张表。
话题来源 @tuboshu321
116.9K阅读 ❤️239 x.com/…↗ 已改写,非原文转载
19 浏览 0 评论
0 反应















