腾讯开源的Hy3 preview以$0.066/百万token的超低价在OpenRouter上超越Claude Opus 4.7和GPT-5.5——但它的评测分数平平。为什么一个"不够强"的模型能碾压所有对手?答案藏在Agent经济的底层逻辑里。
事件回顾
5月28日晚,数据分析师Max Woolf发表了一篇引人注目的博客:一个名为Hy3 preview的神秘模型在OpenRouter排行榜上使用量超越所有竞品,高出第二名50%以上。这个由腾讯发布、仅在新加坡SiliconFlow一家供应商提供的开源模型,正在悄悄改写AI市场的竞争规则。
几个令人震惊的数据点:
- 定价屠夫:$0.066/百万输入token,比DeepSeek V4 Flash($0.10)便宜近40%,比GPT-5.5便宜几十倍
- 使用模式极端:输入token占比98%,输出仅2%——这是典型的Agent/自动化场景特征,而非对话应用
- 用户极度分散:前5大app占总用量不到1%,说明是成千上万个中小开发者的个体决策,而非某个大厂统一配置
- 评测平庸:实际成绩不如DeepSeek V4等其他中国开源模型,但用户并不在乎
为什么重要
Hy3现象揭示了一个正在发生的结构性变革:Agent经济的最优模型 ≠ 最强模型。
传统AI产品追求的是单次输出的极致质量。但在Agent工作流中,核心指标是单位成本 × 调用次数的复合函数。一个质量70分但价格只有对手1/10的模型,在Agent场景中远比90分的模型有商业价值。Hy3的使用量不是运营推广的结果,而是成千上万个Agent工具在运行时做出的自主"投票"。
这对AI创业者意味着三重信号:
第一,Agent生态正在自主选择模型。 模型选择机制正在从人工决策转向运行时自动决策。如果你的产品还硬编码绑定单一模型,下一步就会被灵活路由的竞争对手淘汰。
第二,98%输入/2%输出比率的陷阱。 Agent需要大量上下文来完成复杂任务,但输出往往只有简短指令。如果你的AI产品成本大部分在输入侧,现在就必须考虑上下文缓存和压缩技术。否则模型供应商涨价时,你的产品利润率会直接崩溃。
第三,模型商品化不可逆转。 当腾讯的开源模型能以$0.066/百万token席卷市场时,大模型正在从"技术护城河"变成"通用商品"。创业者的核心竞争力不应押注在"用哪个模型",而应押注在数据飞轮、用户体验和垂直场景理解上。
对一人公司的额外启示:低成本模型组合让你可以用10%的API成本搭建MVP,跑通PMF后再优化质量。Hy3 + DeepSeek + 少量Claude的混合策略,月API成本可以从$500降到$50以下。
行动建议
- 立即建立模型路由机制:简单任务→Hy3/DeepSeek(低成本),复杂任务→Claude/GPT(高质量)。成本可降低50-80%,用户体验几乎不降级。
- 监控输入/输出比率:如果输入token占比超过80%,立即引入上下文缓存和压缩策略。
- 跟踪OpenRouter排行榜:这个榜单正在成为Agent经济的"天气预报"——谁在排名上升,谁就可能在改变市场格局。
- 重新定义产品价值锚点:不要卖"最强AI",要卖"用得起、够用的AI"。Hy3证明了市场在用脚投票——性价比才是Agent时代的第一竞争力。
