第一次见Sonnet超了Opus

我不是小布丁 @xiaobuding
第一次见 Claude Sonnet 把同代的 Opus 超了,主角是刚发布的 Claude Sonnet 5.5。5.5 世代本来以为 Opus 会独占一阵,结果隔几天 Sonnet 也来了。 三个数字定义这次升级。速度比上一代快三成以上,是最快的 Sonnet。单次任务成本最高降三成,注意 API 单价没动,还是每百万输入 2 美元、输出 10 美元,省的是完成同样任务所需的 token。最狠的一项在终端测试,Terminal-Bench 4.0 从上代的 10.3% 一步到 70.6%,把 Opus 5.5 在这项上的成绩也甩在了身后。 定位随之清晰。Opus 5.5 继续坐复杂判断的位子,Sonnet 5.5 接下日常编码、修漏洞、文档、PPT、表格这类高频活,官方连设计能力都点了个名。 我认同背后的产品逻辑。agent 大规模跑起来之后,缺的早已不是再聪明百分之五的模型,而是一个足够聪明、响应快、跑一整天不那么贵的型号。干活的这一档,本来就该由 Sonnet 来当。 有一笔账要合起来算。几天前才有人测出它比 Opus 5.5 多耗 150% 的量,今天官方说单次任务成本降三成,两句话都真,参照物不同罢了,一个对着上代,一个对着师兄。长任务里到底是省是亏,还得看 Claude Code 里的实测,尤其那三成提速在手感上明不明显。 这代据说还藏着一个 Haiku,若 5.5 家族真补齐三档,按场景分层选型的玩法就完整了。
话题来源 @MaxForAI 13.5K阅读 ❤️40 x.com/…↗ 已改写,非原文转载
18 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单