(文/赖家琪 编辑/吕栋)
8月6日,DeepSeek发公告预告:“计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。”
DeepSeek
目前,DeepSeek尚未正式公布涨价幅度及具体实行的时间。但在算力成本持续高企的当下,此番涨价似乎在意料之中。
事实上,今年以来DeepSeek多次调整API价格,而6月可被视为其定价调整的分水岭。
在6月之前,deepseek-v4-pro模型API曾在4月开启限时2.5折优惠活动,百万tokens输入价格(缓存命中)为0.25元,百万tokens输入价格(缓存未命中)为3元,百万tokens输出价格为6元。
5月,DeepSeek宣布将这一“限时优惠”正式变成“长期降价”,原先2.5折的专业版模型API调用价格,变成了“永久2.5折”,其最引以为傲的百万tokens输入价(缓存命中)低至0.025元。
然而,6月底,DeepSeek在发给用户的升级提醒邮件中,宣布DeepSeek V4正式版计划于7月中旬正式上线,同时表示正式版发布后将同步调整API定价策略,引入峰谷定价机制。
目前,DeepSeek API执行峰谷定价机制,高峰时段(北京时间工作日9时至12时、14时至18时)价格为平时的2倍。
在平时价格方面,deepseek-v4-Flash模型百万tokens输入价格(缓存命中)为0.02元,百万tokens输入价格(缓存未命中)为1元,百万tokens输出价格为2元;deepseek-v4-pro模型百万tokens输入价格(缓存命中)为0.025元,百万tokens输入价格(缓存未命中)为3元,百万tokens输出价格为6元。
DeepSeek
在DeepSeek引入峰谷定价机制时,业内人士将此举解读为其在算力资源稀缺背景下的标准化调度工具。最新的涨价预告,则被分析理解为算力成本高企压力下的应对策略。
就在8月4日,DeepSeek披露,当天上午deepseek-v4-Flash模型API出现性能下降的情况,但随后问题得到解决,服务已恢复。不过,这反映出海量用量给DeepSeek带来的定价压力。
多模型聚合平台OpenRouter发布的7月27日至8月2日全球AI大模型调用量周榜单显示,deepseek-v4-Flash以7.22万亿Token的调用量位居第一;而与之对照的是,OpenRouter平台接入了400余款模型,全平台日均规模约6.6万亿Token。
根据网络上流出的DeepSeek创始人梁文锋7月在投资者交流会上的发言,DeepSeek追求的只是“赚取一个合理的利润”,“我们的API定价,大概是在市场上买一批设备回来,十个月收回成本”。
在他看来,就算把价格设得更高,在这个价格区间的需求是没有弹性的,这意味着即便“价格再翻一倍,token消耗量区别不大,总收入接近一倍”。梁文锋的这番话,算是间接解释了DeepSeek如今上调API服务定价的原因。
有分析指出,DeepSeek最新宣布的涨价决定也表明,deepseek-v4-pro正式版即将上线,因为这显然将影响整体算力调用。
受算力供需影响,近半年来,多家国产大模型服务商都采取了涨价、调整付费模式等举措。例如,智谱CEO张鹏4月表示,2026年一季度智谱的API调用定价提升83%。豆包专业版于6月也宣布采用标准/加强/高级套餐连续包月分别为68元、200元、500元的三级阶梯定价模式。
Kimi也在上月发公告说,自Kimi K3发布以来,48小时内用户请求量大幅超出预估,并逼近现有集群承载极限。公司即日起暂停C端新用户订阅,全力推进算力扩容,待新算力到位后将逐步开放订阅名额。
去年,以DeepSeek为代表的国产大模型服务商通过低价模式,吸引了开发者,跑通了自己的商业模式。
彭博社8月4日在报道中指出,使用DeepSeek-V4-Flash完成一项复杂任务的成本仅为3美分,而美国企业成本的单位是美元,Claude Fable 5为3.15美元,OpenAI的GPT-5.6 Sol为1.86美元。 这一成本差距使得中美围绕AI客户的竞争格局开始发生实质性变化,尤其是在美国以外的市场,两国之间的科技竞争进一步加剧。
但这种模式在当前算力供需、芯片采购成本、运营成本持续走高的背景下,确实难以长期维持企业运转。DeepSeek此番涨价,可能意味着未来行业价格基准线的整体上移,厂商开始转向探索长期运营的新商业模式。
与此同时,DeepSeek据报已重启第二轮融资,本轮计划募资500亿元,投前估值约5000亿元,并计划将在8月下旬完成签约。另据美国彭博社报道,DeepSeek已开始筹备IPO,计划于A股上市,最快可能于今年提交申请,并在2027年完成上市。
本文系观察者网独家稿件,未经授权,不得转载。