小模型这条线上砸下一块新石头:Claude Haiku 5.5 来了,官方定语是三个最。
两句原话摆开。"the cheapest, fastest, and most capable small model we've ever released",加上那笔账,平均跑起来比 Haiku 4.5 便宜约七成五。九月底的预告里就说过它会加入 5.5 家族,算是在几周之内兑现了。
没给的东西同样清楚。逐 token 的价、基准成绩、上下文上限、模型代号,发布那条一个字没提;4.5 挂在文档上的价是每百万输入一美元、输出五美元,降七成五这句是平均运行成本,换不成确切价签。
发布前有博主掐着点预告,说二十分钟内就到,还抛了每百万输入一毛、输出五毛的传闻价,正好落在对家 GPT-6 Luna 的标价上。另外捎了一句,它在某场没点名的测试里压过 Luna 和 Sol,两样都没被官方接。
"先降成本、再报成绩"这半句是全场重心。前面二十块两小时只吃一成八讲的是大杯怎么省,这条讲的是小杯怎么贱。跟前面一百二十亿超了原定目标呼应,那边备的是大钱,这边省的是小钱,两头都在价格这张桌上做文章。跟前面三档全包也接得上,一个把分数铺满,一个把成本压扁,两条路都指向用得起。
单拎出来的是那句 75%,成本话放最前面、价签留在后面,这个先后顺序比数字本身更值得琢磨。
我留的疑问有三处。逐 token 价何时公布没说;小模型的上下文没给;传闻里那场对比的题目也没名字。
这周把一段高频小活从 4.5 挪过去,看账单是不是真掉到四分之一。
28 浏览 0 评论
0 反应











