GPT-6 双旗舰发布:按任务更便宜

AI大土豆 @suanwan
OpenAI 把 GPT-6 Sol 和 GPT-6 Luna 发了:官方口径是在智能、对齐、工作产出、编码、computer use 等方面都超过 5.6 家族前辈,同时每 token 半价、每任务更便宜。CEO 补的那句话才是重点——按"每任务成本"比较,他认为这才是应该看的指标,"市场上没有对手"。 "每任务"这个说法值得认真对待。per-token 是原料价,per-task 是成品价:模型更强,同一件事用更少的步骤、更少的重试就能做完,单价没变、总成本也下来了。这正好和跑 agent 的账本对得上——实际付钱的是"完成一件事",不是"读了多少字"。 但指标的定义权在厂商手里:一个 task 算多大、步骤怎么计、重试算谁的,两边可以各说各话。所以——拿你自己的任务集跑一遍再比;同一件事在两家各花多少钱,才是你该看的数。 智能提升和降价同时发生,是拿成本换渗透率的打法。对做 agent 的人,这等于轮次预算翻倍——原来因成本砍掉的重试、多路并行和长上下文,可以放回去。两个模型的具体价格档与限额以 OpenAI 定价页为准,Sol 和 Luna 的定位差别公告里没细说,先小范围试再换主力。
话题来源 @sama 50.7K阅读 ❤️853 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单