8月6日,DeepSeek在API后台挂出那句让整个开发者圈坐不住的话:"计划近期整体上调API服务定价,预计涨幅较大。"当时只有预告、没有数字。8月13日,答案落地了:官方定价页更新,新价格8月16日16:00 UTC(北京时间8月17日0:00)正式生效。而"涨幅较大"四个字翻译成具体数字,是一张让很多人倒吸凉气的表——缓存命中价格最高涨了12倍,也就是超过1000%。
先看最硬的数据。DeepSeek这次不是简单加价,而是把定价改成了"峰谷双轨":高峰时段价格是错峰时段的两倍,错峰时段本身也比现在贵。以V4 Pro为例,缓存命中价从每百万token 0.003625美元,涨到错峰0.022美元、高峰0.044美元——峰值是现在的12.1倍。缓存未命中(也就是正常输入)从0.435美元涨到高峰1.32美元,约3倍;输出从0.87美元涨到高峰3.96美元,约4.6倍。轻量级的V4 Flash温和一些:缓存命中从0.0028美元涨到高峰0.014美元(5倍),输入0.14美元涨到0.44美元(3倍),输出0.28美元涨到1.32美元(4.7倍)。
所谓的"高峰时段",官方定义是UTC 01:00-04:00和06:00-10:00,换算成北京时间,正好是每天上午9点到12点、下午2点到6点——也就是国内开发者最正常的工作时间。换句话说,你白天上班时间调DeepSeek API,结的就是"高峰价"。
但真正值得读懂的,不是那个吓人的"1000%",而是它落在账单的哪个位置。缓存命中这个数字,绝对值到现在依然低得离谱:涨了12倍之后,高峰价每百万token才0.044美元,折合人民币0.3元出头。它之所以能上头条,是因为之前被DeepSeek压到了近乎免费,涨幅看起来吓人,实际金额影响有限。真正让账单变厚的是输出价——4.6倍的涨幅落在输出token上,而输出永远是API成本的大头。一个典型的agentic编码会话,输入可以靠缓存命中摊薄,但模型每次"思考"和"写代码"吐出来的都是输出token。所以对一个重度用户来说,真实体感更接近"账单翻两三倍",而不是字面上的"涨10倍"。
那DeepSeek为什么要在这个时间点动价格?三个背景值得连起来看。第一,算力是真的贵了。V4 Flash上线后日消耗量一度冲到8万亿token,全球调用榜第一,低价策略跑量越大、现金流压力越狠。第二,DeepSeek今年已经历过一轮"永久降价",现在反向提价,本质是从"价格屠夫抢市场"切换到"商业可持续",国产大模型告别价格战进入成熟期的信号比涨价本身更值得注意。第三,峰谷定价本身就是行业趋势——算力不再是统一一口价,而是像电费一样按时段分层计费,有开发者直接点破:"Token越往后越趋近于电价模式。"
谁最受伤?答案很明确:靠DeepSeek API批量调用的中小开发者和SaaS工具厂商。HN评论区一位用户的提醒很到位:"重度使用agentic编码工具的人尤其要注意缓存命中价的涨幅,因为长会话里缓存命中能占到输入token的90%以上。"另一位的判断更狠:"Flash还是个能用的模型,但Pro对很多场景已经'死了'——涨价之后,Pro和Flash之间的问题解决能力与价格的性价比彻底不成立。"这背后是一个残酷的现实:那些把DeepSeek Pro当"便宜到忽略不计"的基础设施来搭客服机器人、文档解析、知识库产品的团队,商业模式需要当场重算。
▲ 图1
算一笔账:你的账单到底涨多少
与其被"1000%"这个数字吓住,不如算清楚自己到底多花多少。假设一个开发者每月在DeepSeek Pro上跑1亿输入token、2000万输出token,其中输入有90%命中缓存——这是agentic长会话的典型比例。按现行价,输入部分约9000万乘以0.003625、加1000万乘以0.435,输出2000万乘以0.87,合计约22美元;涨价后若全部落在高峰时段,输入变成9000万乘以0.044、加1000万乘以1.32,输出2000万乘以3.96,合计约96美元,涨了约4.4倍。如果全部错峰跑,则约48美元,涨约2.2倍。看明白了吗:对缓存命中占比高的重度用户,真实涨幅落在2到4.5倍之间,而不是字面上的10倍。恐惧往往来自没算账,算清这笔账,接下来的选择才有依据。
对开发者来说,这次涨价其实留了几条明确的出路。第一条是错峰调度:把批量任务、离线数据处理挪到夜间、周末跑,价格直接砍半。第二条是任务分层:内容整理、资料分类这类非关键批量任务切到Flash,只有客户、合同、关键决策才上Pro。第三条是缓存优化:在工程侧减少频繁新建会话、尽量复用长对话上下文,把输入尽可能压在缓存命中档位上——毕竟即便涨了12倍,缓存命中仍然是所有输入里最便宜的一档。第四条是评估替代方案:OpenRouter等第三方供应商的DeepSeek价格未必同步上涨,价格敏感型业务可以先做一轮比价,或直接测开源模型本地部署建立冗余。
▲ 图2
竞争格局正在重排
DeepSeek一动价格,牌桌上的对手立刻有了操作空间。HN评论区已经有人在提醒:GPT-5.6 Luna的价格此前已降到约原来的五分之一,此消彼长之下"Luna成了更划算的选择";但也有反方一针见血:"DeepSeek是开源的,有几十家供应商在竞争着服务它,价格随时能被市场压回来,而Luna只有一家供应商。"国内的Qwen、Kimi、MiniMax同样虎视眈眈,MiniMax此前推出的token套餐更是直接对标开发者预算。对创业者而言,这轮涨价最实在的副产品,是逼着你第一次认真做一次"多供应商比价"——而这本来就是你早就该做、却因为DeepSeek地板价而一直偷懒没做的事。
值得提醒的是,网页端和App端的普通用户基本不受影响,这次涨价精准命中的是API批量调用者。换句话说,它是一次"从开发者口袋里回收补贴"的动作。对AI创业者来说,这一课的真正价值不在"要不要逃离DeepSeek",而在于把成本结构从"依赖某个厂商的地板价"改造成"多模型冗余+错峰调度+缓存优先"——因为下一个涨价的,大概率不是最后一个。
总结成一句话:DeepSeek的"1000%涨价"是真实的,但它更该被读作一个行业转折点——AI大模型的免费午餐正在上桌结账,能活下来的,是那些把成本当成工程问题去解、而不是当成运气去赌的团队。
本文由AI辅助创作,经人工审核编辑发布
更多一人公司案例与工具,微信搜索「AI创业内参」关注我们