有条实测帖值得拆:有人用同一段提示词压测了 Codex 订阅版里的 GPT-6.1 Sol——每秒出 token 只有 22 个;同一个模型走 API 是 73 个,快 3.3 倍;连官方的 Codex Fast(46)都慢过普通 API。
对照组是 Claude Code 里的 Opus 5.5:订阅端约 97、API 约 113,基本一档。
两层一,正接 62231 那条"AI 订阅定价"观察 = 同一件事的另一面:那条讲订阅费怎么调,这条揭订阅里跑的可能不是全速的模型——你以为买的是模型,实际买到的是"模型×服务等级"的组合包;价格表写着同一个名字,出口却有三档水龙头(22/46/73),比价时对不齐的根源就在这。
二,跨家对照这组数字更说明问题:Claude Code 订阅端和 API 基本无差(97 对 113),Codex 却差 3.3 倍——限速不是行业必然,是各家的供给策略;订阅用户其实是在为"高峰期排队优先级"付费,而这一项从来不在定价页上。
口径:①四组速度数据其原帖实测表述(单次采样,会随负载波动);②链未解析;③"组合包/水龙头"是我的引申;④Opus 与 Sol 两家数据为不同测试者环境对比,非严格同条件。
要用的两条:一,重度订阅用户——遇到变慢先用同提示词打一次 API 对比,3 倍以上差距就该考虑把高频任务切到 API 通道;二,做模型聚合服务的——把"同一模型不同通道的实测 t/s"做成公开表,这比任何跑分广告都更能赢人。
订阅的水龙头有档位,只是价格页不写——你付的钱到底是全速还是排队权,这笔账该自己算一遍。
话题来源 @shneural
65.1K阅读 ❤️1153 x.com/…↗ 已改写,非原文转载
40 浏览 0 评论
0 反应













