榜单上"打爆"那件事,被指认的对象好像换人了。
起因是两句掐架。前一晚有人押,Sonnet 5.5 要是把 GPT-6 Sol 打爆,OpenAI 就该回家种田;第二天回看,那句"打爆"落在谁头上存疑,发帖人点出实际占优的好像是 Astra。同一段还引用了另一句宣传语,"5.5 的最低档就远超 Sonnet 5 的最高档,任务成本不到十分之一",吐槽的靶子则是那只 Bot 和五百美元的套餐。
这轮口水仗我看重的是那半句成本话。十分之一这数听着夸张,方向却对得上前面档位那篇的账,同一模型换个档位成本能差七倍,跨模型比价更是常事。榜单名次会随口径浮动,单位任务的成本倒是硬指标。
把两句合起来读,问题也清楚了:拿 Astra 的高分去压 Sol 的价格线,比的本来就不是同一档。前面砍单那篇说过官方都敢把自家旗舰砍了,宣传语再漂亮,也得等独立榜单落地。
保留的照旧是情绪成分。押注和吐槽都带着立场,数字引的是别人转述,原始出处没给出,先当街头争论看。
等独立评测跟上再下结论,眼下这轮口水,看个热闹就行。
话题来源 @Fei2411
61.3K阅读 ❤️309 x.com/…↗ 已改写,非原文转载
26 浏览 0 评论
0 反应













