📅 2026-08-30 · 🏷️ 模型路由 · LLM成本 · Agent架构
项目概览
GitHub: workweave/router · 语言: Go · ⭐ 2.7k+ · 50ms级路由
一个模型路由器:接收你发往 Claude Code / Codex / opencode / pi 的每一条提示词,在 50ms 内判断这条任务适合哪个模型,然后路由过去——简单问答用便宜小模型,复杂编码用旗舰模型,自动帮你省下 40-70% 的 API 成本,且只需换一个 endpoint,客户端零改动。
它原生讲 Anthropic Messages API 和 OpenAI 兼容协议,/v1/messages、/v1/chat/completions、/v1beta/models 都支持。
npx @workweave/router
交互式问你要接哪个工具(Claude Code / Codex / opencode / pi),再问作用范围(用户级还是项目级),拿到 router key 后自动写配置。其他快捷方式:
npx @workweave/router --claude # 直接接 Claude Code
npx @workweave/router --codex # 接 OpenAI Codex CLI
npx @workweave/router --opencode # 接 opencode
npx @workweave/router --pi # 接 pi + Loom UI
npx @workweave/router --scope project # 只对当前仓库生效
npx @workweave/router --local # 自托管 localhost:8080
要求 Node ≥ 18(Claude/opencode/pi 路径还需要 jq)。
# 1. 放一个供应商 Key(推荐 OpenRouter 打底)
echo "OPENROUTER_API_KEY=sk-or-v1-..." >> .env.local
# 2. 启动 Postgres + router(:8080)并生成 rk_ key
make full-setup
默认栈用进程内聚类打分器做路由;想要更强的 HMM 策略,加一个 Google API key 再跑 make up-hmm。密钥加密存储(BYOK 模式由你自己提供的 Key 加密),用量统计写进 Postgres,Dashboard 在 /ui(仅自托管模式)。
client(Claude Code/Codex/opencode/pi)
│ rk_… bearer token
▼
Router :8080 (/v1/messages · /v1/chat/completions · /v1/route)
│ 嵌入并打分这条任务
▼
Cluster scorer(进程内 ONNX embedder)
│
▼
providers(Anthropic · OpenAI · Gemini · OpenRouter · 任意兼容端点)
│ OTel spans / usage → 你的采集器(Honeycomb/Datadog/Grafana)
多副本部署需要 Pub/Sub 做缓存失效;docker compose 会帮你跑好模拟器。
# 开关路由(随时切回直连)
npx @workweave/router off --claude
npx @workweave/router on --claude
npx @workweave/router status
# 管理可选模型
npx @workweave/router models --claude
npx @workweave/router models enable gpt-5.6-terra
# 强制某模型 / 反馈路由
$force-model gpt-5.6-terra # Claude Code 斜杠指令
$router-feedback "这个回答太啰嗦"
模型路由是 LLM 成本优化的核心手段之一,与其他网关思路互通。可横向对比AI Gateway统一网关教程和FreeLLMAPI免费聚合网关教程;想了解整体自建 API 中转方案看New API网关教程。
📅 2026-08-30 · 🏷️ 模型路由 · LLM成本 · Agent架构