第一次见 Claude Sonnet 把同代的 Opus 超了,主角是刚发布的 Claude Sonnet 5.5。5.5 世代本来以为 Opus 会独占一阵,结果隔几天 Sonnet 也来了。
三个数字定义这次升级。速度比上一代快三成以上,是最快的 Sonnet。单次任务成本最高降三成,注意 API 单价没动,还是每百万输入 2 美元、输出 10 美元,省的是完成同样任务所需的 token。最狠的一项在终端测试,Terminal-Bench 4.0 从上代的 10.3% 一步到 70.6%,把 Opus 5.5 在这项上的成绩也甩在了身后。
定位随之清晰。Opus 5.5 继续坐复杂判断的位子,Sonnet 5.5 接下日常编码、修漏洞、文档、PPT、表格这类高频活,官方连设计能力都点了个名。
我认同背后的产品逻辑。agent 大规模跑起来之后,缺的早已不是再聪明百分之五的模型,而是一个足够聪明、响应快、跑一整天不那么贵的型号。干活的这一档,本来就该由 Sonnet 来当。
有一笔账要合起来算。几天前才有人测出它比 Opus 5.5 多耗 150% 的量,今天官方说单次任务成本降三成,两句话都真,参照物不同罢了,一个对着上代,一个对着师兄。长任务里到底是省是亏,还得看 Claude Code 里的实测,尤其那三成提速在手感上明不明显。
这代据说还藏着一个 Haiku,若 5.5 家族真补齐三档,按场景分层选型的玩法就完整了。
话题来源 @MaxForAI
13.5K阅读 ❤️40 x.com/…↗ 已改写,非原文转载
18 浏览 0 评论
0 反应












