国产大模型竞争逻辑从拼价格转向拼生态
近期,国产大模型迎来新一轮密集调价。9月10日12时起,DeepSeek下调Flash系列模型API(应用程序编程接口)价格,其中闲时输入(缓存命中)价格由0.05元/百万词元降至0.02元/百万词元,降幅达60%。
“这一轮调价并非简单的价格竞争,而是大模型从‘卖能力’走向‘卖服务’的必然阶段。”有行业分析师对《证券日报》记者表示,“国产大模型之间的竞争已进入新阶段,行业的竞争逻辑正从‘拼价格’悄然转向‘拼生态’。”
价格呈梯队分化
国产大模型调价并非单一走势。智能体应用快速增长带来算力压力,长上下文请求高度依赖缓存,大幅推高推理成本,部分厂商率先提价以覆盖成本。8月,智谱GLM Coding Plan新版订阅套餐Lite、Pro、Max月费分别为118元、538元和1078元,此前为49元、149元、469元,三档分别上涨约141%、261%和130%。
与此同时,低价替代方案迅速跟进。8月26日,智谱开源GLM-5.3-Flash,定价仅为旗舰版的十分之一;同日,阿里开源Qwen3.8-Flash,官方称价格最低可至DeepSeek V4 Flash的三分之一。
当前,国产大模型API价格已呈明显的“梯队分化”。从9月各家官网定价看,经济型模型的输入价格普遍降至1元/百万词元左右;旗舰模型之间价差则显著拉大,Kimi K3输入、输出价格高达20元/百万词元、100元/百万词元,而MiniMax M3在“永久五折”后仅为2.1元/百万词元、8.4元/百万词元。有测算显示,同样一项典型任务,选用不同模型的成本差距接近60倍。
“看似矛盾的涨价与降价,实则是同一本账的两面:提价端以峰谷定价引导批量任务向低谷时段转移,摊薄单位算力成本;降价端则以贴近边际成本的价格抢占词元入口。”广州艾媒数聚信息咨询股份有限公司CEO张毅表示,降价有利于扩大智能体和推理调用量,但单位词元收入下降,云厂商需要依靠调用量增长和推理效率提升来维持算力回报。这也意味着,单纯降价换市场的空间正在收窄,竞争必须寻找新的支点。
从以价换量到生态筑墙
需求端的放量,是此轮调价的底层动因。中国电信研究院近日发布的《智能体时代AI基础设施发展研究报告(2026)》预计,2026年我国词元年消耗量将达10亿亿。智谱、MiniMax等厂商的财报亦显示,开放平台和API业务已成为主要增长来源——以低价开源抢占词元入口,正是各家的共同布局。
不过,单价降至“分币级”,并不意味着开发者和企业用户会单纯为低价买单。有软件开发企业负责人对《证券日报》记者表示,模型调用只是成本的一部分,若模型输出不稳定、需要反复调整和重复调用,综合成本未必划算,企业真正需要衡量的是“成功成本”与总拥有成本。但当旗舰模型的能力差距收窄到用户难以感知时,决定开发者去留的就不再是价目表上的数字,而是迁移成本。
“头部模型的用户可感知差距已经很小,比拼的是能力、成本与国产化适配的综合实力。”上述行业分析师认为,定价权来自推理成本控制和生态黏性,行业正从“稀缺溢价”走向“效率竞争”。原厂提价是对自家端点定价权的维护,托管商让利则是边际成本的竞争。
头部厂商已在为低价竞争之后的阶段布局。智谱构建“基础模型+编程工具+订阅服务”的生态组合,将模型深度嵌入开发工作流,以提高用户迁移成本;月之暗面则为Kimi K3量身定制开源许可条款,对通过MaaS服务第三方且连续12个月收入超过2000万美元的企业要求另行签署商业协议,试图将护城河“从权重挪到托管效率”;DeepSeek则以V4.1 Flash承接旗舰流量,探索“降本”与“稳价”之间的平衡。
事实上,三条路径打法各异,指向却一致:把一次性的模型买卖,变成对开发者工作流的长期绑定。正如综合开发研究院近日发表的观点,词元经济的上半场看产能、价格和调用规模,下半场则看“谁能用更少的词元,完成更复杂的任务”。当词元本身趋于同质,承载词元的平台、工具与服务,才是差异化竞争的真正战场。
从“拼参数”到“拼价格”,再到“拼生态”,密集调价正在加速行业格局重塑。张毅认为,能够在推理成本、服务稳定性与生态黏性之间找到平衡的厂商,才能在下一阶段占据主动。价格可以持续下探,但商业模式的护城河,终究要靠生态来构筑。
(本报记者 袁传玺)
1.本网刊载内容,凡注明来源为“飞象网”和“飞象原创”皆属飞象网版权所有,未经允许禁止转载、摘编及镜像,违者必究。对于经过授权可以转载,请必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和飞象网来源。
2.凡注明“来源:XXXX”的作品,均转载自其它媒体,在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。
3.如因作品内容、版权和其它问题,请在相关作品刊发之日起30日内与本网联系,我们将第一时间予以处理。
本站联系电话为86-010-87765777,邮件后缀为cctime.com,冒充本站员工以任何其他联系方式,进行的“内容核实”、“商务联系”等行为,均不能代表本站。本站拥有对此声明的最终解释权。
直击2026中国算力大会,查看三大运营商的算力成绩单
随着人工智能等新一代信息技术快速发展,算力已成为推动科技创新、产业升级和社会进步的重要驱动力。根据最新发布的《2026综合算力全景分析》显示,我国综合算力基础持续夯实,正从“建得多..[详细]
一阖一辟谓之变!读懂中国联通“四大图谱”
人工智能大潮涌动,越来越多的行业开始从技术进步中受益,继而更加坚决、深入地引入人工智能技术和服务。作为全球领先的电信运营商,中国联通将如何应对这场全新的科技革命?[详细]
专题报道丨2026中国算力大会
9月11日至13日,2026中国算力大会在河北省廊坊市举行。大会以“共织算力网 智启新未来”为主题,紧扣全国一体化算力网新部署,汇聚政产学研用金等各方资源,搭建国家级产业交流、创新赋能、..[详细]
专题报道丨第27届中国国际光电博览会
9月的深圳国际会展中心,人比光密。9月9日,第27届中国国际光电博览会(CIOE)开幕首日,超4000家光电企业,吸引进场观众101741人,同比增加38%,热门展台前要"插空"才看得清展品。..[详细]
突破物理瓶颈,在深圳光博会寻找AI算力持续增长的答案
根据相关机构预估,包括AI工厂、词元经济在内,市场对于AI的需求已呈现出爆发式增长,基本上每两年就会有100倍以上的增长。然而,受限于半导体工艺和物理规律的硬性限制,单体 GPU 本身的能..[详细]
msup刘付强:别再比Token消耗量了,AI不是成本,是利润变量
当AI从技术工具演变为核心生产方式,企业如何跨越有模型、无利润的落地鸿沟?又怎样将零散的Agent应用,升维为可沉淀、可复制的组织级智能资产?在9月4日召开的第十一届A2M人工智能创新峰会..[详细]













