最近AI圈总算有点新东西了。
PrismML把Qwen3.8 27B压到了5.9GB,24GB统一内存的小Mac也能无痛本地跑,更关键的是综合跑分保住了原版的98.2%。
typesafeai则把大批量分类/路由做成了70–500ms级响应速度,不需要再忍受大模型慢吞吞吐字。
话题来源 @wquguru
40.3K阅读 ❤️164 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论
0 反应













