每个请求挑模型:路由器请 Jev 当管家

模型路由这件事,现在可以交给 Jev 来拍板了。 新上线的 typesafe/jev-router 是一个带缓存感知的模型路由器,由 Jev 和 @typesafeai 共同驱动。它要干的活很具体:每个请求进来,挑出最合适的模型和推理力度,把质量、速度和成本三头的账一起算平。 这个设计接住了前面几轮的讨论。先有带概率的决策模型,再有给开源模型的三级校准,现在轮到把决策放进路由层。判断力一旦变成可调用的服务,选模型这活就不必再写死在配置里。 缓存感知是其中的巧劲。路由不光看谁强谁便宜,还看谁的缓存里已经躺着这份上下文。命中的地方直接复用,钱省在别人看不见的层,这正对上前面算过的那笔账,贵的从来不是单价,是重复处理。 我的判断是,路由层会是接下来一年里性价比提升最猛的地方。单个模型的进步受训练周期约束,路由却随时能调,把现有模型重新组合一遍,账面立刻好看。有点像家里换灯泡不如先换开关。 保留的地方在于,路由器自己也要吃决策成本,请求量小的时候未必划算。而且它挑的模型好不好,最终还得看下游任务的实际表现,不是平衡分说了算。 手上如果有多家模型的接入,值得先在这个方向上试一轮。把真实流量接进路由,对比固定模型的账单和质量,一周下来差距自己会说话。
话题来源 @OpenRouter 130.7W阅读 ❤️2065 x.com/…↗ 已改写,非原文转载
22 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单