Weave Router
模型路由器:为AI编程工具自动选型,每年节省40-70%成本
Weave Router 是由 AI 工程智能平台 Weave(WeaveOS)推出的开源模型路由器,核心理念是为 AI 编程工具提供智能化的模型选型能力,让每一次 API 调用都能自动匹配性价比最高的大模型,从而在不影响输出质量的前提下显著降低使用成本。开发者只需将 Claude Code、Codex、Cursor 或其他 AI 编程工具的端点指向 Weave Router,剩下的选型工作全部由路由器自动完成,无需人工干预。
从技术实现来看,Weave Router 基于 Avengers-Pro 论文中的聚类评分算法构建,能够根据每一次请求的具体任务类型(代码补全、代码审查、重构、调试等)在 50 毫秒内完成模型选择决策。路由器支持 Anthropic Messages API、OpenAI Chat Completions API 和 Google Gemini 原生 API 三种协议,同时兼容 DeepSeek、Kimi、GLM、Qwen、Llama、Mistral 等开源模型(通过 OpenRouter 接入)。所有请求均以流式方式转发,支持 tools 调用、视觉理解等高级特性,真正做到了对上层应用完全透明。
Weave Router 的最大价值在于将「模型选型」这一需要专业知识才能做好的决策自动化。对于企业而言,不同模型在不同任务上的表现差异巨大——比如 Claude Opus 4.8 在复杂架构设计任务上表现优异,但在简单代码补全上成本过高;而 DeepSeek V4 在保持 90 分质量的同时,成本仅为 Opus 4.8 的 1/40。路由器能根据每个请求的动作类型(action)自动选择最合适的模型,而非笼统地「总是用某个模型」。
在部署方式上,Weave Router 提供三种模式:云托管版(通过 npx @workweave/router 一键安装,自动配置路由密钥)、本地 Docker 版(自行部署在 localhost:8080,需提供 OpenRouter API 密钥)和企业自托管版(完整 Postgres + 路由服务,支持内网部署)。云托管版特别适合个人开发者和小型团队,无需任何运维工作即可享受路由服务;企业版则提供完整的 OTLP 链路追踪,可接入 Honeycomb、Datadog、Grafana 等主流可观测性平台。
Weave 公司已获得 1350 万美元 A 轮融资,由 Standard Capital 领投,Robinhood、PostHog、Reducto 等 500 多家工程团队已在生产环境使用其产品。Weave Router 作为 Weave 工程智能平台的核心组件之一,代表了大模型应用从「用什么模型」到「让系统自动选对模型」的关键转变,对于希望优化 AI 编程成本的企业和个人开发者而言,是一个值得关注的开源基础设施工具。
评论与建议
登录 后参与评论或提建议