在刚发布的最新模型因低成本引发大模型斩杀线的讨论后,DeepSeek反手宣布要涨价了。
8月6日,DeepSeek在开发者平台发布通知,计划近期整体上调其 API服务的定价,预计涨幅较大,具体方案以正式通知为准。随后,DeepSeek用户陆续收到了涨价邮件。
涨价似乎成为了今年国内大模型行业的主旋律。此前,智谱、月之暗面等都对老模型或新发模型进行了提价,主要云厂商也纷纷上调AI算力服务价格。
大模型价格战终于要走到尽头了吗?
从价格屠夫、斩杀线到突然涨价
搜狐科技了解到,在DeepSeek官宣涨价后,不少用户都陆续收到了DeepSeek团队发出的相关邮件。
邮件中除了提到DeepSeek API价格将有较大涨幅外,还提醒用户合理使用,并对涨价后的用户服务做出安排。“如您在计费调整后继续选择使用我们的服务,则代表您已同意调整后的计费方式;如不同意接受则可选择退出使用并申请退费。”
突然的涨价预告,让不少开发者措手不及。要知道,自DeepSeek出现在公众视野,其显著标签就是低价,基本发布的每款模型价格都远低于国内外多数大模型。
两年前,DeepSeek发布第二代MoE模型V2,API定价为输入1元、输出2元(单位均为1M Token),仅为当时最先进模型GPT-4-Turbo的百分之一,是当时已发布模型的最低价。
DeepSeek由此打响“价格屠夫”的名号,且从最初就坚持开源,这也让其在开发者群体里获得了“源神”的美誉。
随后DeepSeek发布的模型基本每次都没让人失望,无论是性能还是价格,尤其是R1创造的DeepSeek时刻更让这家公司彻底出圈,成为全球大模型行业备受瞩目的性价比之王。
DeepSeek自2024年以来发布的主要模型价格(单位:元/1M Token)
从DeepSeek自身来看,虽然模型性能在持续提升,但其API价格保持快速下降,输入价格已从1元降到最新的0.02元,输出价格也从此前高点16元降到2元。
一周前,DeepSeek正式上线的V4-Flash-0731创下其有史以来的模型最低价,这也在全球引发了大模型斩杀线的讨论。
对比来看,DeepSeek-V4-Flash-0731的价格显著低于Kimi K3、Qwen3.8-Max、GLM-5.2、GPT-5.6、Claude Opus 5和Fable 5等国内外头部模型,同时性能差距也不是很明显。
据独立研究公司Artificial Analysis,DeepSeek-V4-Flash-0731综合性能与GPT-5.6-Luna、Genimi-3.6 Flash并列,落后于国产模型Kimi K3、Qwen3.8-Max和GLM-5.2,以及OpenAI和Claude最新模型。
但是,DeepSeek-V4-Flash-0731是全球知名模型中运行成本最低的模型。从完成同等任务的花费来看,该模型平均成本为0.03美元,不到Kimi K3的4%,更不到Claude Fable 5的1%。
因此,此番DeepSeek罕见宣布涨价,则在开发者群体中炸开了锅,不少人呼吁不要涨太多。
开发者群体还玩起梗来,梁文锋的风评如同一只滑动变阻器,在“梁圣”、“梁叔”、“梁子”、“牢梁”之间演变,如今一夜之间则从“梁圣”变为“梁子”,以此来表达连“价格屠夫”也不得不向成本低头的感慨。
多位开发者认为,DeepSeek此次涨价并非是为了在模型火爆之际赚更多的钱,而是调用量的迅速攀升导致算力紧张,“梁老板说这钱我这不想挣,人家逼着我挣”。
其实DeepSeek此前发布V4预览版时,就有提到过,受限于高端算力,Pro的服务吞吐十分有限,预计下半年950超节点批量上市后,Pro价格会大幅下调。
业内认为,此次DeepSeek官宣涨价也意味着,V4-Pro正式版即将迎来上线。只不过,还未等到新的算力补充,DeepSeek就先迎来需求高峰。
为此DeepSeek此前实行了峰谷定价机制,高峰期调用价格翻倍,希望以此引导流量错峰,降低服务器压力。但有开发者对此吐槽称,现在DeepSeek就没有峰谷的问题,因为时差都是峰,国外那边用得也挺多。
海外开发者平台OpenCode披露,DeepSeek-V4-Flash单日处理量曾达8万亿Token,而模型聚合平台OpenRouter上400多款模型的日均总调用量才6.6万亿。
OpenCode高管透漏,其平台用户每天在DeepSeek模型上花费13万美元,请求过多导致API服务总是宕机,流量也因此遭到限制。
OpenRouter最新周榜显示,DeepSeek-V4-Flash在上周以7.22万亿Token的调用量首次登顶全球第一,本周目前仍以5.71万亿Token的调用量蝉联第一,且前五依然都是中国模型。
这些调用量不仅来自国内用户,海外用户也有贡献,越来越多的企业转向成本更低的中国开源模型。有美国AI创业公司创始人就表示,已切换到DeepSeek V4,这将在未来几个月能给公司省下数百万美元。
从“价格屠夫”到大模型斩杀线,再到突然宣布涨价,这并不是梁文锋要加速商业化变现的主动选择,而更多像是应对需求爆发而导致算力紧张的应对之举。
业内分析称,DeepSeek通过涨价希望对目前有限的算力进行再分配。对以技术优先的DeepSeek来说,留出更多算力训练更前沿的模型可能更重要,尤其是在对手们仍在持续进步的情况下。
梁文锋此前在投资交流中也多次强调要克制,不追求营收和利润最大化,API定价的逻辑是十个月收回设备成本,赚取合理的利润,要让大家用得起。
不少开发者判断,虽然DeepSeek预计涨幅较大,但最终价格可能仍会低于国内其它头部模型。
大模型终于告别价格战?
DeepSeek不是第一家宣布涨价的大模型公司。
今年2月,智谱推出新一代旗舰模型GLM-5,Coding Plan套餐价格涨幅30%起,随后发布的GLM-5-Turbo、GLM-5.1分别提价20%、10%,GLM-5.2综合定价则又比前一代高出13%。
智谱7月底又更新订阅紧张的GLM Coding Plan国内版套餐,Lite/Pro/Max套餐分别从40/149/469元涨至118/538/1078元,最低涨幅130%,最高则达超260%
此前,智谱CEO张鹏表示,今年一季度API涨价83%,但调用量不降反升400%,市场仍供不应求。这一定程度成为智谱涨价的底气,但持续上涨的算力成本依旧是涨价的关键驱动因素。
此前引发关注的Kimi K3的API价格同样迎来上涨,100元/1M Token的输出价格相较上代模型K2.7增长2.7倍,是目前国内定价最高的模型。
这一定程度是中国大模型试图剥离低价标签、通过智能水平掌握模型定价权的尝试,但背后都有着算力不够的苦涩。Kimi K3爆火后遭遇算力挑战,不得不暂停订阅,并进行算力扩容。
今年以来,阿里云、百度云、腾讯云等主要云厂商都对AI算力、存储等产品进行最低5%到超过30%不等的涨价。
从全球来看,大模型和云厂商涨价也是趋势。杰富瑞统计,今年二季度美国大模型API价格上涨了89%,典型如Claude Fable 5的价格相较上代模型翻倍。
不过,也有少数厂商在降价。今年5月底,小米MiMo宣布MiMo-V2.5系列API永久降价,新定价最高降幅达99%。这更多是后来者为追赶而采取的措施,该模型调用量随后迅速爆发。
最新宣布降价的则是OpenAI。上月底,OpenAI下调GPT 5.6系列两款新发布模型的价格,其中GPT-5.6 Luna下调80%,GPT-5.6 Terra下调 20%。仅过一周,OpenAI最新又宣布将ChatGPT免费用户的默认模型更新为GPT5.6 Luna。
业内普遍认为,这是OpenAI为应对外有中国开源模型来袭、内有劲敌Anthropic竞争而采取的应对举措。前者正在吸引越来越多的美国企业和开发者,而后者凭借更为强大的模型能力在企业端持续爆发。
两年前,DeepSeek闯入大模型赛道伊始就开启了轰轰烈烈的价格战,如今它自己按下了暂停键。随着需求爆发和定价提高,中国头部大模型公司商业化能力有望迎来重新定价。
高盛最近就将中国大模型厂商今年底的合计ARR(年度经常性收入)从100亿美元上调至130亿美元,并预测2030年将攀升至1250亿美元,实现五年25倍的增长。
但高盛也表示,今年行业训练总成本40亿美元、推理总成本70亿美元,合计将高于当期ARR,板块整体仍处于负EBIT状态,盈利拐点要到2030年才会出现。
不过,从长远看,DeepSeek可能依旧是一个变量。
梁文锋此前表示,在当前价格区间,用户需求没有太大弹性,继续降价并不会带来更多需求,价格翻倍也不会导致需求明显下降。但他也强调,未来包括模型优化等在内的整体降价空间还是比较大。
公开报道显示,DeepSeek年化收入已逼近5亿美元,V4旗舰API毛利率约70%-80%,远高于字节、智谱、MiniMax等公司的MaaS业务,反映出DeepSeek强悍的成本优化控制能力。
在此次涨价后,DeepSeek未来在算力解决后有没有可能再降价,仍存变数。毕竟,在目前的高毛利支撑下,其相较行业对手仍有下降空间。
目前,DeepSeek依然在广积粮,此前已完成首轮500亿元融资。虽然主要输血来源幻方因市场调整今年收益不佳,但最新报道称,其已开启寻求近80亿美元的第二轮融资。
这些资金中的部分计划用于采购算力资源,并推进大型数据中心建设,加强基础设施投入。算力,同样是月之暗面、智谱、MiniMax持续融资中的投入重点。
一面是越来越多的用户需求,一面是没有尽头的技术竞赛,大模型玩家们都需要权衡先后利弊,短期长期。暂时停下的风暴,未来也可能重来。