9月9日,DeepSeek突然宣布旗下V4 Flash大模型全面下调API价格,新价格于9月10日正式生效。
这场毫无预兆的 “闪电降价” 立刻引爆了国内大模型圈,也引发了市场对大模型价格战的担忧。摩根士丹利发布研究报告,对这次降价的动因、影响及行业走向做出了系统解读。
Part.01
DeepSeek V4 Flash降价详情
根据 DeepSeek 公布的最新定价,非高峰时段的调用价格调整分为三档:其中缓存输入价格降幅最大,直接下降 60% 至每千 token 0.02 元;非缓存输入价格下降 33% 至每千 token 1 元;输出价格下降 11% 至每千 token 4 元。与此同时,高峰时段的定价仍为非高峰时段的两倍,也随之下调,整体降价覆盖全时段全场景。
值得注意的是,即便这次调整的幅度不小,但 DeepSeek V4 Flash 的当前价格仍然高于今年 4 月该版本刚发布时的水平,同时和市场上的同级别产品相比,也比阿里通义千问 3.8-Flash、智谱 GLM-5.3 Flash 的定价更高。
Part.02
降价的两大核心动因
在摩根士丹利看来,DeepSeek 这次降价并非临时决策,而是内外双重压力下的主动选择。
第一重压力来自竞品的冲击。就在今年 8 月,阿里通义千问和智谱 AI 先后发布了各自的 Flash 级大模型,参数规模分别达到 125B 和 320B,上下文窗口均拉到了 1000K,和 DeepSeek V4 Flash 的硬件配置处于同一梯队。
从能力评分来看,两款新品的 AA Intelligence Index 分别达到 56 分和 57 分,略高于 DeepSeek V4 Flash 的 52 分,且定价普遍更低,直接挤压了 DeepSeek 的性价比优势。
第二重压力来自自身的产品迭代。DeepSeek 接下来即将推出 V4.1 Flash 版本,此时下调老款产品价格,一方面可以为新品留出清晰的定价空间,避免产品内部左右互搏;另一方面也可以提前锁定用户群体,巩固市场份额,为新品上线做好用户铺垫。
Part.03
双轨制成通用打法
DeepSeek 的调价动作,本质上是当前大模型行业产品策略的一个缩影。
如今头部厂商几乎都形成了 “双产品线” 的布局:一条是高定价、高性能的 Pro 版本,主打复杂推理、专业创作等高阶场景,用来树立技术标杆、服务高净值客户;另一条是低价格、高响应速度的 Flash 版本,主打高频调用、轻量化场景,用来覆盖广大开发者和中小企业客户,走规模效应。
这种 “高低搭配” 的双轨策略,已经从个别厂商的探索变成了全行业的标准产品框架。其核心逻辑是对用户需求进行分层,用差异化的产品和定价,同时覆盖专业市场和大众市场,最大化用户覆盖范围和商业空间。
Part.04
大摩:不会出现无序厮杀
DeepSeek 降价之后,市场最关心的问题就是:会不会引发行业跟风,最终演变成全面价格战?摩根士丹利给出的判断是:Flash 赛道的价格竞争会持续加剧,但不会出现不计成本的无序价格战。
核心原因在于,头部厂商依然会把毛利率作为经营的核心指标,不会为了抢市场牺牲长期的盈利健康。大模型的算力成本、研发成本都是刚性支出,盲目打价格战会直接反噬产品性能和服务稳定性,反而得不偿失。
从这次降价也能看出理性竞争的信号:DeepSeek 并没有把价格打到比竞品更低的水平,只是回调到了更有竞争力的区间,且依然高于自身首发时的定价,说明厂商并没有放弃利润底线,只是在合理范围内调整性价比。
Part.05
综合实力才是终局
这次降价带来的最直接影响,是大模型的商用门槛进一步降低。随着调用成本持续下探,更多中小企业、开发者和长尾场景能够负担得起 AI 能力,会加速大模型在各行各业的渗透落地。
但更重要的是,国内大模型的竞争正在悄悄换道。过去大家拼参数、拼上下文窗口、拼跑分,现在这些硬指标正在快速拉平,接下来的竞争核心会转向 “性能、速度、价格” 的综合性价比,以及场景适配能力、服务稳定性、生态完善度等综合实力。
接下来整个行业的看点也很清晰:一是 DeepSeek V4.1 Flash 上线后的实际表现,能不能拉开和竞品的体验差距;二是其他头部厂商会不会跟进调价,进一步下探大模型的价格底线;三是 Flash 赛道的竞争,会不会从单纯的价格比拼,转向精细化的运营和生态竞争。
报告认为,DeepSeek 这场闪电降价,是国内大模型产业从 “技术竞赛” 转向 “商业化竞赛” 的标志性事件。当技术参数不再是不可逾越的壁垒,当价格逐渐回归合理区间,谁能真正把技术转化为落地的价值,谁才能在接下来的长跑中胜出。


