小模型Agent能力测试的天梯在这里! 目前来看最值得使用的是我测试的 Qwen…

小模型Agent能力测试的天梯在这里! 目前来看最值得使用的是我测试的 Qwen3.8-27B-UD-Q4_K_XL 版本,Agent用使用 reasoning_effort = low,然后写代码开到 medium / high。 另外文中是统一使用单卡 H100 NVL+llama.cpp 最新版本测试的。如果是Mac用户还是建议优先使用MLX,实测 MLX 开 MTP 会比 llama.cpp 放在 Mac 上开MTP要快一些。 最后老铁们还想看什么模型的评测欢迎留言,我赶紧肝哈哈! 原帖链接:x.com/i/status/20943…
话题来源 @karminski3 · 14K阅读 · ❤️157 · x.com/…↗ · 已改写,非原文转载
21 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单