fireworks.ai/blog/introduci…
Fireworks 把"该用哪个模型"这道题做成了产品,FireRouter with Opus 是他们的第一个路由模型。
分工写得很直白。例行任务分给顶级的开源模型,剩下的硬骨头交给 Claude Opus;路由带缓存和任务感知,同一类活不会反复问贵的那个。数字也摆了出来,编码会话上保住 Opus 九十八点一的准确度,单次成本降五成七。
九十八点一对五成七这半句我看重。前面决策那篇讲的是把判断挪到便宜档,这里补的是执行前那一步,先看活的成色再决定给谁干。跟前面过夜循环的分诊钩子是同一个动作,只是这次由厂商打包好交出来。
缓存感知那条也值得记。同类请求命中缓存,省的不只是钱,还有排队时间,长会话的体感差别不小。
我的保留有两处。准确度的测法没给,九十八点一对的是哪套题、哪批任务得看原文;路由判断本身也有开销,省下的五成七是净账还是毛账,得自己接了才清楚。
用编码工具的先把 FireRouter 挂上跑一周,回来看看账单和之前差多少,再决定要不要一直开着。
话题来源 @FireworksAI_HQ
25K阅读 ❤️148 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论
0 反应













