MiMo-V2.6-Pro 把 Artificial Analysis 的开放权重第一名拿下了,速度是它更硬的那半。
两条数字摆开。在 Wally 上每秒能吐三百二十个 token,比小米自家的 API 快七倍。引帖补的那半是,同价位里比 GPT Luna 好五成,价格却更低。当时和探路者那家合作给了个免费窗口,九月二十九日截止,如今已过,试用得看现价。
名次加速度这半句是全场重心。前面几篇讲的都是闭源谁第一,这条把开放权重那张榜单独拎出来。跟前面第二名的价钱接得上,那条讲闭源的单价,这条讲开源的速度,两边都在往"够用且便宜"挤。跟前面中档压上来那篇也呼应,基准在涨、价钱在降,两头夹。
免费到二十九日这种窗口我按截止日算,没赶上的也不亏,引帖那句"最该在每个人手里"的判断,落点从促销挪回了模型本身。
我留的疑问有三处。三百二十 token 是哪家服务上的峰值、长上下文还剩多少没给;比 Luna 好五成用的哪项指标没交代;自己部署要什么显存也没数。
跑得快不等于接得住活,拿自己最长的那条提示词过一遍,看它掉速发生在第几千个 token。
话题来源 @RunAnywhereAI
9K阅读 ❤️111 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论
0 反应














