Workweave Router这个开源工具,能在50毫秒内判断每个提示该用哪个模型。集成Claude Code/Codex/Cursor只需改一个API端点,实测可砍掉40-70%的API费用。
事件回顾
HN热榜上一个名为 Workweave Router 的开源项目(github.com/workweave/router)吸引了216个赞和113条讨论。它的核心能力简单但实用:
作为一个AI模型"路由器",它在50ms内将每个提示(prompt)路由到最合适的模型,只需修改API端点就能集成到Claude Code、Codex或Cursor中。
为什么要路由?因为不是每个Agent请求都需要最贵的模型:
- 生成一个README文件 → GPT-4o就够了,不需要Claude Opus
- 写一个简单脚本 → Qwen3.8-Max的中档推理模式绰绰有余
- 只有复杂架构决策 → 才需要Claude Opus或顶级推理
但如果你不做路由,Agent默认把所有请求都发给同一个高价模型,费用自然失控。
Workweave Router背后有学术支撑——基于一篇arXiv论文(Beyond GPT-5: Making LLMs Cheaper and Better via Performance-Efficiency Optimized Routing),该论文提出了"性能-效率最优路由"方法,不是简单按任务类型分派,而是综合评估prompt的复杂度、模型在该类任务上的表现、以及成本后做出决策。
为什么重要
Agent的API费用是隐形杀手
如果你在用Claude Code或Codex做日常开发,可能没注意到每次Agent调用都在烧钱:
- Claude Opus 4.x:每百万token约$15-75(取决于输入/输出)
- 一个复杂的Agent任务可能消耗几十万到上百万token
- 日常编码工作每天10-20次Agent调用很正常
算下来一个重度Agent用户的月费轻松上千美元——但其中可能80%的请求用便宜模型就能完成。
Workweave Router的逻辑是:让Agent每次调用都自问"这个问题真的需要顶级模型吗?"
50ms延迟换40-70%成本节省
路由决策在50ms内完成,对用户体验几乎无感知。而节省幅度达到40-70%——意味着每月$1000的API账单可能降到$300-600。
对于一人公司或小团队来说,这个差异可能就是"用得起Agent"和"用不起Agent"的分界线。
零改造成本
Workweave Router实现了OpenAI兼容的API格式,所以现有工具几乎不需要代码改动:
- Claude Code → 配置里替换API endpoint
- Codex → 同样操作
- Cursor → 同上
不需要修改Agent逻辑,不需要重构工作流,一个配置变更就能上线。
我们能学到什么
第一,模型路由是Agent基础设施的关键一环。 随着可用模型越来越多(GPT-4o、Claude Sonnet/Opus、Qwen3.8-Max、DeepSeek-V3...),没有一个模型在所有任务上都最优。路由层让Agent能"脚踩多条船",按需选择。
第二,成本优化是AI创业的生死线。 很多AI创业项目死于API费用失控。如果你每天有100个Agent任务,每个省$0.5,一个月就是$1500——足够再雇一个人了。
第三,"只改端点不改造"的设计哲学值得学习。 Workweave Router没有要求你换Agent框架、换工作流、甚至换任何代码。它是"插入即用"的基础设施层——这种设计降低了采用门槛,也是它能在HN获得200+赞的原因。
行动建议
- 评估你的Agent API用量:过去一周Claude Code/Codex花了多少钱?如果不知道,先装上成本追踪
- 试用Workweave Router:克隆仓库→配置模型列表→替换API端点→跑一周对比账单
- 建立自己的路由规则:日常任务(文档、简单脚本、格式转换)→便宜模型;复杂任务(架构设计、bug调试、安全审计)→顶级模型
