有人拿自己的实测给 GPT-6-Sol 定了个性:对比上一代 5.6-Sol,同一个任务只吃一半 token、只用五分之一的时间,叠加官方口径里那一半降价——他给的结论是"相当称职的日常主力"。
这条值得记的不是便宜,是三个数字同时下降:token 减半=上下文与输出都变精;时间五分之一=同样的活从"等一会儿"变成"马上就回";价格再砍半=效率的钱被让给了用户。模型、推理栈、定价三股力量同向用力,才有这种又快又省的体感。
口径按住:这是单人单测——"一半/五分之一"取决于他跑的任务与提示写法,没有负载与样本说明;官方那 50% 是公告价,不是你的账单价(缓存读、批量、阶梯都还在下面)。个人实测的价值在于方向,不在于倍率——方向可信,倍率自己复算。
给要换日常主力的人三条:一,拿你自己的十件常干活各跑一遍,自己的任务集才是考场,比跨模型总分有用;二,同时记时间与钱两列——人盯着的场景和批量离线的场景,答案常常相反;三,连跑三天看稳定性,别让它在第四天改脾气。
效率的进步最后都会折成单价——当"快一倍"和"省一半"同时成立,换模型就从升级变成了还价。
话题来源 @petergostev
23.9K阅读 ❤️592 x.com/…↗ 已改写,非原文转载 你可能想问
- GPT-6-Sol 日常主力用起来又快又省吗 #GPT-6
- 换日常主力模型有哪些又快又省的选择
20 浏览 0 评论
0 反应














