mlx.fast
「BIG BREAKING」级别的热闹:同一个模型,三天之内在 Mac 上快了六倍,干活的是一群 agent。
挑战的对象是 PrismML 的 Ternary Bonsai 2,一个 27B 模型。Yukon Research 挂出的这道题,规则是拿它在自家硬件上跑出比冻结基线更高的速度。开赛时基线原地不动,两天冲到 4 倍,第三天 6 倍,超基线 503.2%。提交截止 10 月 1 日。
提速的记录也换了一批人。最早全是 Claude 建的 agent 在刷,第二天 GPT 排到第二、Grok 4 挤进第五,如今 Claude、GPT、Grok、DeepSeek、Gemini 建的解法都有份。拼的不是人手快,是各家 agent 谁能把内核摸得更透。
上一轮记录里给了具体数:解码 237.4 token 比基线的 59 快出三倍多,压缩后的 27B 塞进 16GB 内存的 Mac 就能跑。这句才是重点,门槛本来在显卡,现在家用笔记本也够格。
这跟前面那篇 Open-Jev-Fast 遥相呼应。一个在 B300 上把决策模型压进 42 毫秒,一个在 Mac 上把 27B 榨出六倍。我读出的是同一件事:本地跑得动,靠内核和调度的细功夫,不是等更大显卡。
模型开放权重、Apache 2.0,挑战对任何人开放。规则摆在那里,截止前的榜位还会再变。
mlx.fast 上能看到当前排名和提交入口,想上手的人还有几天时间。
话题来源 @pratikg
101.1K阅读 ❤️471 x.com/…↗ 已改写,非原文转载
27 浏览 0 评论
0 反应












