Weave Router教程:50ms内给每个提示词选对模型,成本降40-70%

📅 2026-08-30 · 🏷️ 模型路由 · LLM成本 · Agent架构

项目概览

GitHub: workweave/router · 语言: Go · ⭐ 2.7k+ · 50ms级路由

Weave Router是什么?

一个模型路由器:接收你发往 Claude Code / Codex / opencode / pi 的每一条提示词,在 50ms 内判断这条任务适合哪个模型,然后路由过去——简单问答用便宜小模型,复杂编码用旗舰模型,自动帮你省下 40-70% 的 API 成本,且只需换一个 endpoint,客户端零改动。

它原生讲 Anthropic Messages API 和 OpenAI 兼容协议,/v1/messages/v1/chat/completions/v1beta/models 都支持。

30 秒快速接入(托管版)

npx @workweave/router

交互式问你要接哪个工具(Claude Code / Codex / opencode / pi),再问作用范围(用户级还是项目级),拿到 router key 后自动写配置。其他快捷方式:

npx @workweave/router --claude       # 直接接 Claude Code
npx @workweave/router --codex        # 接 OpenAI Codex CLI
npx @workweave/router --opencode     # 接 opencode
npx @workweave/router --pi           # 接 pi + Loom UI
npx @workweave/router --scope project # 只对当前仓库生效
npx @workweave/router --local        # 自托管 localhost:8080

要求 Node ≥ 18(Claude/opencode/pi 路径还需要 jq)。

自托管整套

# 1. 放一个供应商 Key(推荐 OpenRouter 打底)
echo "OPENROUTER_API_KEY=sk-or-v1-..." >> .env.local

# 2. 启动 Postgres + router(:8080)并生成 rk_ key
make full-setup

默认栈用进程内聚类打分器做路由;想要更强的 HMM 策略,加一个 Google API key 再跑 make up-hmm。密钥加密存储(BYOK 模式由你自己提供的 Key 加密),用量统计写进 Postgres,Dashboard 在 /ui(仅自托管模式)。

工作原理

client(Claude Code/Codex/opencode/pi)
   │  rk_… bearer token
   ▼
Router :8080  (/v1/messages · /v1/chat/completions · /v1/route)
   │  嵌入并打分这条任务
   ▼
Cluster scorer(进程内 ONNX embedder)
   │
   ▼
providers(Anthropic · OpenAI · Gemini · OpenRouter · 任意兼容端点)
   │  OTel spans / usage → 你的采集器(Honeycomb/Datadog/Grafana)

多副本部署需要 Pub/Sub 做缓存失效;docker compose 会帮你跑好模拟器。

常用运维命令

# 开关路由(随时切回直连)
npx @workweave/router off --claude
npx @workweave/router on --claude
npx @workweave/router status

# 管理可选模型
npx @workweave/router models --claude
npx @workweave/router models enable gpt-5.6-terra

# 强制某模型 / 反馈路由
$force-model gpt-5.6-terra      # Claude Code 斜杠指令
$router-feedback "这个回答太啰嗦"

适合谁

模型路由是 LLM 成本优化的核心手段之一,与其他网关思路互通。可横向对比AI Gateway统一网关教程FreeLLMAPI免费聚合网关教程;想了解整体自建 API 中转方案看New API网关教程

📚 相关阅读

FreeLLMAPI搭建教程:免费LLM聚合网关

AI Gateway教程:1600+模型统一接入

📚 常见问题

Weave Router是什么?

📅 2026-08-30 · 🏷️ 模型路由 · LLM成本 · Agent架构