国产大模型掀涨价潮,“百模大战”熄火?

2026-08-20 15:38:52
分享
文章提及标的
智谱--
腾讯控股-R--
阿里巴巴--
Lumentum控股--
科大讯飞--
摩根士丹利--
查看股票机会下载客户端

8月17日0点起,DeepSeek-V4 API新定价正式生效。

此轮调整实行分时定价,高峰时段输出价格升至27元/百万tokens,为此前价格的4.5倍;缓存未命中价格升至9元/百万tokens,为此前价格的3倍;缓存命中价格则大幅上调至0.30元/百万tokens,为此前价格的12倍。空闲时段价格则为高峰时段的一半。

涨价后,DeepSeek告别了曾经的“极致性价比”路线。有业内人士告诉记者,此前智谱(HK2513)的模型相对较贵,因为它能很好地解决coding问题;DeepSeek主打性价比,特别是很多24小时运作的智能体,其消耗的token数量极其巨大,开发者往往会选择DeepSeek模型。

但DeepSeek涨价,并非孤例。过去数月,智谱(HK2513)、Kimi、MiniMax等国产大模型也相继对部分API价格进行了上调。

“这轮调价不是全行业统一涨价,而是独立模型厂商领涨,自有算力的大厂按兵不动或变相调价。”致同咨询交易支持服务合伙人梁伟告诉21世纪经济报道记者,今年以来智谱(HK2513)、月之暗面、DeepSeek等独立厂商相继上调API定价,阿里(BABA)、字节、腾讯(K80700)等大厂则按兵不动。

在梁伟看来,涨价是对推理算力成本长期倒挂的修正。短期内这更像价格和价值的重新校准,但如果厂商只提价而稳定性等跟不上,用户会用脚投票,毕竟模型间替换成本在下降。后续需持续关注涨价策略的双重验证:一方面,厂商在涨价的同时是否匹配了新的模型能力,而非单纯的老模型涨价;另一方面,要关注涨价收入去向,是否进行了算力扩容、服务能力建设。

独立模型厂商领涨

2月12日,智谱(HK2513)发布GLM-5海外版及调价函,对GLM Coding Plan价格进行结构性上调,打响涨价“第一枪”。

2026年内,智谱(HK2513)已完成三轮API价格上调:继2月对GLM Coding Plan结构性调价后,3月GLM-5-Turbo发布时上调API价格20%,4月GLM-5.1发布时再度提价10%。

紧随其后,6月1日,MiniMax在发布第三代旗舰模型M3的同时,将API价格全面翻倍。月之暗面在7月发布Kimi K3时大幅上调定价:输入价格涨至20元/百万tokens,输出价格涨至100元/百万tokens,均较前代涨超3倍。

至此,“大模型六小虎”中智谱(HK2513)、月之暗面、MiniMax、DeepSeek均已涨价。上海证券研报指出,这在一定程度上反映出国产模型正从依靠性价比抢占市场,向价值变现的战略方向转型。

但与独立厂商形成对比的是,阿里(BABA)、字节、腾讯(K80700)等自有算力的大厂并未对旗舰模型清一色直涨,而是广泛采用阶梯定价策略,或拉开推理与非推理模式的差距。

4月,阿里(BABA)云先对百炼大模型单元提价2%~5%,后对DataWorks API取消无限制免费调用,转为按量付费。

5月,字节跳动豆包启动商业化付费体系,推出分档订阅服务——基础聊天功能继续免费,PPT生成、数据分析等高算力功能需付费。

相较独立模型厂商,大厂的涨价更为“含蓄”。梁伟告诉记者,大厂有自有算力集群和云业务可以交叉补贴,模型API对其而言是云服务的引流入口而非利润中心,低价能把客户锁定进自家云生态;而独立模型厂商没有云业务兜底,所以涨价是其重要的应对方式。但大厂同样通过调整收费结构等方式寻找回收路径,只是工具不同。

从降价到涨价

而在此前两年,行业都陷在“百模大战”的低价漩涡中。

2024年5月,DeepSeek-V2发布,API价格直接降至输入1元/百万tokens、输出2元/百万tokens。以DeepSeek为代表,国产大模型一路降价。

还有厂商推出免费策略:2024年5月,混元-lite(LITE)全面免费,文心ERNIE Speed和ERNIE lite(LITE)全面免费,科大讯飞(002230)也宣布讯飞星火API能力免费开放。

至今年5月,DeepSeek宣布V4 Pro模型API价格永久降至原价的1/4。调价后,百万tokens输入价格(缓存命中)为0.025元,百万tokens输入价格(缓存未命中)为3元,百万tokens输出价格为6元。

转折发生在今年。

摩根士丹利(MS)统计字节跳动、阿里巴巴(BABA)百度(BIDU)腾讯(K80700)、MiniMax、智谱(HK2513)、月之暗面和DeepSeek等厂商官方报价后发现,2026年第二季度,中国大模型平均API输入价格已经升至每百万tokens 4.9元,输出价格升至21.9元,相比2025年第一季度的3.3元和12.2元,分别上涨约48%和80%。

为何定价趋势逆转了?梁伟告诉记者,AI推理每次调用都产生真实算力成本,前期补贴和促销价格难以长期维持,比如长上下文、深度推理和Agent任务显著增加推理负载,高峰算力供给仍然紧张;更强模型开始按照其创造的业务价值,而不是单纯按照计算成本定价。

从市场表现看,涨价也并未吓退用户。智谱(HK2513)一季度API定价较去年底提升83%,调用量反而增长400%,说明企业级需求的价格弹性低于预期,客户为确定性付费的意愿已经形成。

“涨价之所以能够成立,也是因为行业已经走过了市场教育阶段。”梁伟指出,2024~2025年本质是市场教育阶段,用接近免费的价格让用户养成调用大模型的习惯,让开发者把AI嵌入工作流。到2026年,这个任务基本完成,企业客户从“要不要用”变成“用哪个、怎么用得稳”。“我们在《人工智能(885728)行业研究—基础大模型》报告中提到,2024年底至今行业已从‘技术突破驱动’转向‘商业化验证期’,这也是前期低价策略不可持续的原因。”

分层定价

从此轮定价调整看,国产大模型告别了“白菜价”时代,正迎来分层定价时代。

最直观的表现是峰谷定价机制的引入。DeepSeek新价格表按高峰、空闲时段两档区分:闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。

阿里(BABA)通义千问按场景分层定价,提供三套独立计费方案,包括按量即时计费、Token Plan包月订阅、Coding Plan专属编程订阅。

从海外来看,OpenAI则按“能力”分层,在GPT-5.6同代内搭建了三层产品矩阵:旗舰Sol守价,Terra降价,Luna大幅降价。梁伟指出,其意图很明确:高端守价、中端巩固、低端抢量,拉大各层价格梯度,形成覆盖不同预算与场景的完整产品矩阵。

华泰证券(HK6886)研报指出,DeepSeek因需求激增和推理算力成本上升,大幅上调高峰时段API价格,缓存命中输入价格涨至原价的12倍,行业定价从前期价格战转向理性定价;同时,OpenAI和Anthropic为应对中国模型竞争,选择部分降价。

在这背后,大模型厂商们不再试图用一套价格覆盖所有用户,而是转向了按价值定价的核心逻辑。

“这本质是在识别谁从模型中获取了更高价值,并据此多维度分层定价。”梁伟指出,高附加值场景的用户真正购买的不是更贵的token,而是更低的任务失败率和更稳定的生产系统。对于低附加值场景,大模型厂商通过轻量模型、谷时折扣和近乎免费的引流层,继续压低这部分客户的进入门槛和试错成本,比如个人开发者几十块钱就能跑起应用原型,没有实时性要求的小B客户可以享受夜间折扣。

在梁伟看来,分层定价的深层逻辑是匹配不同客户的“结果付费意愿”。他认为,国内开源生态更为繁荣,模型权重更易得,因此厂商必须在定价策略上做更多差异化方能保持竞争力。“我们不断在提任务成功率,而高端模型赚取的不是参数溢价,恰恰是任务成功率溢价,高端模型只有持续提高任务完成率、减少重试和人工接管,才能守住价格。”

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME