news 2026/8/9 7:25:08

DeepSeek发布第二代MoE模型V2

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
DeepSeek发布第二代MoE模型V2

在刚发布的最新模型因低成本引发大模型斩杀线的讨论后,DeepSeek反手宣布要涨价了。

8月6日,DeepSeek在开发者平台发布通知,计划近期整体上调其 API服务的定价,预计涨幅较大,具体方案以正式通知为准。随后,DeepSeek用户陆续收到了涨价邮件。

涨价似乎成为了今年国内大模型行业的主旋律。此前,智谱、月之暗面等都对老模型或新发模型进行了提价,主要云厂商也纷纷上调AI算力服务价格。

大模型价格战终于要走到尽头了吗?

从价格屠夫、斩杀线到突然涨价

搜狐科技了解到,在DeepSeek官宣涨价后,不少用户都陆续收到了DeepSeek团队发出的相关邮件。

邮件中除了提到DeepSeek API价格将有较大涨幅外,还提醒用户合理使用,并对涨价后的用户服务做出安排。“如您在计费调整后继续选择使用我们的服务,则代表您已同意调整后的计费方式;如不同意接受则可选择退出使用并申请退费。”

突然的涨价预告,让不少开发者措手不及。要知道,自DeepSeek出现在公众视野,其显著标签就是低价,基本发布的每款模型价格都远低于国内外多数大模型。

两年前,DeepSeek发布第二代MoE模型V2,API定价为输入1元、输出2元(单位均为1M Token),仅为当时最先进模型GPT-4-Turbo的百分之一,是当时已发布模型的最低价。

DeepSeek由此打响“价格屠夫”的名号,且从最初就坚持开源,这也让其在开发者群体里获得了“源神”的美誉。

随后DeepSeek发布的模型基本每次都没让人失望,无论是性能还是价格,尤其是R1创造的DeepSeek时刻更让这家公司彻底出圈,成为全球大模型行业备受瞩目的性价比之王。

DeepSeek自2024年以来发布的主要模型价格(单位:元/1M Token)

从DeepSeek自身来看,虽然模型性能在持续提升,但其API价格保持快速下降,输入价格已从1元降到最新的0.02元,输出价格也从此前高点16元降到2元。

一周前,DeepSeek正式上线的V4-Flash-0731创下其有史以来的模型最低价,这也在全球引发了大模型斩杀线的讨论。

对比来看,DeepSeek-V4-Flash-0731的价格显著低于Kimi K3、Qwen3.8-Max、GLM-5.2、GPT-5.6、Claude Opus 5和Fable 5等国内外头部模型,同时性能差距也不是很明显。

据独立研究公司Artificial Analysis,DeepSeek-V4-Flash-0731综合性能与GPT-5.6-Luna、Genimi-3.6 Flash并列,落后于国产模型Kimi K3、Qwen3.8-Max和GLM-5.2,以及OpenAI和Claude最新模型。

但是,DeepSeek-V4-Flash-0731是全球知名模型中运行成本最低的模型。从完成同等任务的花费来看,该模型平均成本为0.03美元,不到Kimi K3的4%,更不到Claude Fable 5的1%。

因此,此番DeepSeek罕见宣布涨价,则在开发者群体中炸开了锅,不少人呼吁不要涨太多。

开发者群体还玩起梗来,梁文锋的风评如同一只滑动变阻器,在“梁圣”、“梁叔”、“梁子”、“牢梁”之间演变,如今一夜之间则从“梁圣”变为“梁子”,以此来表达连“价格屠夫”也不得不向成本低头的感慨。

多位开发者认为,DeepSeek此次涨价并非是为了在模型火爆之际赚更多的钱,而是调用量的迅速攀升导致算力紧张,“梁老板说这钱我这不想挣,人家逼着我挣”。

其实DeepSeek此前发布V4预览版时,就有提到过,受限于高端算力,Pro的服务吞吐十分有限,预计下半年950超节点批量上市后,Pro价格会大幅下调。

业内认为,此次DeepSeek官宣涨价也意味着,V4-Pro正式版即将迎来上线。只不过,还未等到新的算力补充,DeepSeek就先迎来需求高峰。

为此DeepSeek此前实行了峰谷定价机制,高峰期调用价格翻倍,希望以此引导流量错峰,降低服务器压力。但有开发者对此吐槽称,现在DeepSeek就没有峰谷的问题,因为时差都是峰,国外那边用得也挺多。

海外开发者平台OpenCode披露,DeepSeek-V4-Flash单日处理量曾达8万亿Token,而模型聚合平台OpenRouter上400多款模型的日均总调用量才6.6万亿。

OpenCode高管透漏,其平台用户每天在DeepSeek模型上花费13万美元,请求过多导致API服务总是宕机,流量也因此遭到限制。

OpenRouter最新周榜显示,DeepSeek-V4-Flash在上周以7.22万亿Token的调用量首次登顶全球第一,本周目前仍以5.71万亿Token的调用量蝉联第一,且前五依然都是中国模型。

这些调用量不仅来自国内用户,海外用户也有贡献,越来越多的企业转向成本更低的中国开源模型。有美国AI创业公司创始人就表示,已切换到DeepSeek V4,这将在未来几个月能给公司省下数百万美元。

从“价格屠夫”到大模型斩杀线,再到突然宣布涨价,这并不是梁文锋要加速商业化变现的主动选择,而更多像是应对需求爆发而导致算力紧张的应对之举。

业内分析称,DeepSeek通过涨价希望对目前有限的算力进行再分配。对以技术优先的DeepSeek来说,留出更多算力训练更前沿的模型可能更重要,尤其是在对手们仍在持续进步的情况下。

梁文锋此前在投资交流中也多次强调要克制,不追求营收和利润最大化,API定价的逻辑是十个月收回设备成本,赚取合理的利润,要让大家用得起。

不少开发者判断,虽然DeepSeek预计涨幅较大,但最终价格可能仍会低于国内其它头部模型。

大模型终于告别价格战?

DeepSeek不是第一家宣布涨价的大模型公司。

今年2月,智谱推出新一代旗舰模型GLM-5,Coding Plan套餐价格涨幅30%起,随后发布的GLM-5-Turbo、GLM-5.1分别提价20%、10%,GLM-5.2综合定价则又比前一代高出13%。

智谱7月底又更新订阅紧张的GLM Coding Plan国内版套餐,Lite/Pro/Max套餐分别从40/149/469元涨至118/538/1078元,最低涨幅130%,最高则达超260%

此前,智谱CEO张鹏表示,今年一季度API涨价83%,但调用量不降反升400%,市场仍供不应求。这一定程度成为智谱涨价的底气,但持续上涨的算力成本依旧是涨价的关键驱动因素。

此前引发关注的Kimi K3的API价格同样迎来上涨,100元/1M Token的输出价格相较上代模型K2.7增长2.7倍,是目前国内定价最高的模型。

这一定程度是中国大模型试图剥离低价标签、通过智能水平掌握模型定价权的尝试,但背后都有着算力不够的苦涩。Kimi K3爆火后遭遇算力挑战,不得不暂停订阅,并进行算力扩容。

今年以来,阿里云、百度云、腾讯云等主要云厂商都对AI算力、存储等产品进行最低5%到超过30%不等的涨价。

从全球来看,大模型和云厂商涨价也是趋势。杰富瑞统计,今年二季度美国大模型API价格上涨了89%,典型如Claude Fable 5的价格相较上代模型翻倍。

不过,也有少数厂商在降价。今年5月底,小米MiMo宣布MiMo-V2.5系列API永久降价,新定价最高降幅达99%。这更多是后来者为追赶而采取的措施,该模型调用量随后迅速爆发。

最新宣布降价的则是OpenAI。上月底,OpenAI下调GPT 5.6系列两款新发布模型的价格,其中GPT-5.6 Luna下调80%,GPT-5.6 Terra下调 20%。仅过一周,OpenAI最新又宣布将ChatGPT免费用户的默认模型更新为GPT5.6 Luna。

业内普遍认为,这是OpenAI为应对外有中国开源模型来袭、内有劲敌Anthropic竞争而采取的应对举措。前者正在吸引越来越多的美国企业和开发者,而后者凭借更为强大的模型能力在企业端持续爆发。

两年前,DeepSeek闯入大模型赛道伊始就开启了轰轰烈烈的价格战,如今它自己按下了暂停键。随着需求爆发和定价提高,中国头部大模型公司商业化能力有望迎来重新定价。

高盛最近就将中国大模型厂商今年底的合计ARR(年度经常性收入)从100亿美元上调至130亿美元,并预测2030年将攀升至1250亿美元,实现五年25倍的增长。

但高盛也表示,今年行业训练总成本40亿美元、推理总成本70亿美元,合计将高于当期ARR,板块整体仍处于负EBIT状态,盈利拐点要到2030年才会出现。

不过,从长远看,DeepSeek可能依旧是一个变量。

梁文锋此前表示,在当前价格区间,用户需求没有太大弹性,继续降价并不会带来更多需求,价格翻倍也不会导致需求明显下降。但他也强调,未来包括模型优化等在内的整体降价空间还是比较大。

公开报道显示,DeepSeek年化收入已逼近5亿美元,V4旗舰API毛利率约70%-80%,远高于字节、智谱、MiniMax等公司的MaaS业务,反映出DeepSeek强悍的成本优化控制能力。

在此次涨价后,DeepSeek未来在算力解决后有没有可能再降价,仍存变数。毕竟,在目前的高毛利支撑下,其相较行业对手仍有下降空间。

目前,DeepSeek依然在广积粮,此前已完成首轮500亿元融资。虽然主要输血来源幻方因市场调整今年收益不佳,但最新报道称,其已开启寻求近80亿美元的第二轮融资。

这些资金中的部分计划用于采购算力资源,并推进大型数据中心建设,加强基础设施投入。算力,同样是月之暗面、智谱、MiniMax持续融资中的投入重点。

一面是越来越多的用户需求,一面是没有尽头的技术竞赛,大模型玩家们都需要权衡先后利弊,短期长期。暂时停下的风暴,未来也可能重来。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/9 7:21:50

InnoDB存储引擎架构与性能优化实战

1. InnoDB存储引擎核心架构解析 作为MySQL默认存储引擎,InnoDB的架构设计堪称数据库领域的经典之作。其核心采用多版本并发控制(MVCC)机制,通过回滚段(Undo Log)实现事务隔离。在具体实现上,Inn…

作者头像 李华
网站建设 2026/8/9 7:21:43

中介者模式:解耦复杂系统的星型通信方案

1. 中介者模式:模块间解耦的终极方案第一次接手大型电商系统重构时,我被订单、库存、支付、物流等模块间蜘蛛网般的调用关系震惊了。某个深夜,因为修改了优惠券模块的接口,导致积分系统异常崩溃——这正是典型的多模块直接耦合带来…

作者头像 李华
网站建设 2026/8/9 7:18:51

UE5汽车蓝图项目:高效文件夹结构与可视化工程管理实践

1. 项目概述:从混乱到有序的UE5汽车蓝图工程管理在UE5里折腾过汽车蓝图的朋友,十有八九都经历过这样的场景:项目做到一半,想回头改个轮胎摩擦力参数,结果在Content Browser里翻了五分钟,愣是没找到那个叫“…

作者头像 李华
网站建设 2026/8/9 7:18:03

网工毕业设计易上手选题集合

文章目录🚩 1 前言1.1 选题注意事项1.1.1 难度怎么把控?1.1.2 题目名称怎么取?1.2 选题推荐1.2.1 起因1.2.2 核心- 如何避坑(重中之重)1.2.3 怎么办呢?🚩2 选题概览🚩 3 项目概览题目1 : 基于协同过滤的电影…

作者头像 李华
网站建设 2026/8/9 7:17:46

多尺度计算方法:跨尺度科学计算的核心技术与应用

1. 多尺度计算方法:跨越时空维度的科学计算革命在材料科学实验室里,研究员小王正面临一个棘手问题——他需要同时模拟纳米级晶体缺陷和厘米级构件变形,传统单一尺度仿真要么丢失原子细节要么计算量爆炸。这恰恰是多尺度计算方法(M…

作者头像 李华
网站建设 2026/8/9 7:17:40

AI写作工具如何提升研究生论文效率与质量

1. 研究生写作困境与AI工具的崛起作为一名经历过论文煎熬的过来人,我深知研究生阶段写作的痛苦。从开题报告到期刊投稿,每个环节都伴随着巨大的心理压力和时间消耗。记得我写第一篇SCI时,光是Introduction部分就反复修改了17遍,那…

作者头像 李华