问题
重度使用编码 Agent(如 Claude Code、Codex)的开发者直接把所有请求打到单一旗舰模型上,成本高、速度受限。Show HN 上的 Weave Router 2.0 用数据证明了这点:'On Terminal Bench, the router hit 52% of Astra's cost, and completed tasks 2.2x faster. On SWE Atlas, the router cost 54% as much as Astra and ran 2.5x faster.' 同时,匿名模型 Space Bunny Alpha 靠网友实测冲上 OpenRouter 和 OpenCode 日调用量第一,说明开发者已经在主动寻找便宜好用的替代模型,但缺少自动化的选择和切换工具。
目标用户
日均大量调用 LLM API 跑编码 Agent 的独立开发者和小团队(信号中提到 Claude Code、Codex、OpenCode 的用户,以及追逐 Space Bunny Alpha 的 OpenRouter 玩家)。属于开发者工具里的中高端重度用户群体,人数不多但 API 消费金额大,是典型的'小池塘大鱼'市场。
解决方案
编码 Agent 的智能模型路由层:
- 本地代理网关:以 OpenAI 兼容 API 形式插入 Claude Code / Codex / OpenCode 与模型之间,零改造接入
- 任务感知路由:用分类器把子任务(读代码、小改动、跑命令、重构)分桶,匹配便宜且够用的模型(如 Deepseek v4 Flash、Space Bunny Alpha 类新模型)
- 会话状态追踪:借鉴 Weave Router 的 HMM 思路,记住同一会话中哪些模型对当前代码库表现稳定,动态收敛到最优组合
- 成本/速度看板:按会话展示相对单一旗舰模型省了多少钱、快了多少,把 ROI 直接摆给用户
- 新模型自动评估:OpenRouter 上出现新模型(如匿名爆款)时自动小规模实测,决定是否纳入路由池
为什么是现在
信号显示三件事正在同时发生:1) 新模型密集发布且定位分化——Gemini 4 Argon 主打编码与安全、Claude Sonnet 5.5 以约 Opus 一半的价格做日常开发任务,'按任务选模型'的空间被打开;2) 匿名模型(Space Bunny Alpha、此前的'牛来')在无技术报告、无公司认领的情况下冲上 OpenRouter / OpenCode 日调用量第一,说明便宜好用的新模型层出不穷且更新极快,人工跟不过来;3) Weave Router 的基准数据(成本 52-54%、速度 2.2-2.5x)刚刚公开验证了'路由而非堆旗舰'这条路线的可行性和收益上限。
MVP 范围
第一版只做一件事:接入 3-5 家主流模型 API(含 OpenRouter 上的新模型),在用户本地跑的 Claude Code / Codex / OpenCode 会话中充当代理层,按任务类型(读代码、改文件、跑测试)做简单分类路由,并给出每次会话的成本/延迟对比报表。不做:自有评测基准发布、模型微调、长会话 HMM 状态追踪(先用无状态分类器)、企业级 SLA。
风险
先行者:Weave Router 已开源且公布了基准数据,需要在效果或易用性上明显超越它。平台依赖:产品是模型 API 之上的薄层,OpenRouter 若自己加智能路由功能会被直接吞掉。模型格局剧变:新一代旗舰(如 Gemini 4 Argon)若在低价位全面碾压,'混合路由'的价值窗口会收窄。评测成本:路由质量依赖持续跑 Terminal Bench / SWE Atlas 类基准,算力开销随模型数量线性增长。信任问题:匿名模型(如 Space Bunny Alpha)随时可能下线或变价,路由策略需要实时兜底。
已有产品
| 产品 | 定位 | 价格 |
|---|---|---|
| OpenRouter | 开发者调用多家模型的统一入口,Space Bunny Alpha 正是借它走红,具备最强的分发和调用数据优势 | — |
| Weave Router | 开源模型路由器,已在 Terminal Bench 4.0 和 SWE Atlas 上公开基准数据,是本机会最直接的先行验证者 | — |
信号证据
这张卡片依据的原始讨论。摘录保持原文,点“原文”查看上下文。
TechCrunch · AI9月30日新能力
“Google has released its latest Gemini model, marketing it as a workhorse for coding and cybersecurity work.”
Google has released Gemini 4 Argon, marketing it as its most powerful model yet and a workhorse for coding and cybersecurity work.原文
Hacker News · Show HN9月30日新品发布▲ 10936 条评论隐含付费意愿
“On Terminal Bench, the router hit 52% of Astra’s cost, and completed tasks 2.2x faster. On SWE Atlas, the router cost 54% as much as Astra and ran 2.5x faster.”
A new open-source model router for coding agents, Weave Router 2.0, matches GPT-6 Astra pass rates on Terminal Bench 4.0 and SWE Atlas at roughly half the cost and over 2x faster.原文
爱范儿9月29日新品发布
“和此前的匿名模型「牛来」一样,它没有技术报告,也没有哪家大模型公司出来认领,只是在 OpenRouter 和 OpenCode 上悄悄上线。然后靠着一批网友实测,一路冲上了两个平台的日调用量第一。”
一个匿名高性能 AI 模型「Space Bunny Alpha」在 OpenRouter 和 OpenCode 上悄悄上线并快速走红,尚无公司认领。原文