评测机构 LuminaBench 抛了价格炸弹:Luna 基本免费——输入 $0.10/M、输出 $0.50/M;同家族 Sol 是 $2/M 和 $10/M。围观的人被打动的不是又快一点,是便宜了一个量级。
值得算的是那组对比:同一家族两档差 20 倍——厂商把量放地板价、溢价放贵档;另一头 xAI 把"快"标成 2 倍价。市场两头分化:快的更贵,稳的更便宜。选型于是像分时用电:交互、人在等的走贵快档;批量后台走地板档——同一批活混着跑,账单差一个量级。
口径按住:$0.10/M 是公告价,实际还要看缓存读、批量折扣、上下文阶梯——比价把缓存读单价一起列,否则长对话会算错;"basically free"是修辞不是零,便宜到不心疼的额度,最容易被大上下文悄悄烧穿。
三条:一,按任务分档——短平快走地板价,长推理上贵档,贵的留给"人在等";二,价格表当动态配置——降价随时跟进,每季度对账,别拿一年前的价做一年后的预算;三,警惕便宜的副作用——超低价档常在限流、并发、上下文上限让步,压测过再当主力。
旗舰模型开始比拼谁更便宜的那天,你要算的其实只剩一道题:这批活,走地板档还是走贵档?
话题来源 @LuminaBench
107.6K阅读 ❤️1764 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论
0 反应













