OpenAI 把 GPT-6 Sol 和 GPT-6 Luna 发了:官方口径是在智能、对齐、工作产出、编码、computer use 等方面都超过 5.6 家族前辈,同时每 token 半价、每任务更便宜。CEO 补的那句话才是重点——按"每任务成本"比较,他认为这才是应该看的指标,"市场上没有对手"。
"每任务"这个说法值得认真对待。per-token 是原料价,per-task 是成品价:模型更强,同一件事用更少的步骤、更少的重试就能做完,单价没变、总成本也下来了。这正好和跑 agent 的账本对得上——实际付钱的是"完成一件事",不是"读了多少字"。
但指标的定义权在厂商手里:一个 task 算多大、步骤怎么计、重试算谁的,两边可以各说各话。所以——拿你自己的任务集跑一遍再比;同一件事在两家各花多少钱,才是你该看的数。
智能提升和降价同时发生,是拿成本换渗透率的打法。对做 agent 的人,这等于轮次预算翻倍——原来因成本砍掉的重试、多路并行和长上下文,可以放回去。两个模型的具体价格档与限额以 OpenAI 定价页为准,Sol 和 Luna 的定位差别公告里没细说,先小范围试再换主力。
话题来源 @sama
50.7K阅读 ❤️853 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论
0 反应












