首页必读视频专题飞象趣谈光通信人工智能低空机器人智能汽车终端会展特约记者

中国AI大模型调用量连续十五周领跑:环比增长570%,DeepSeek-V4-Flash正式版登顶!MiniMax M3、阶跃星辰Step 3.7 Flash跌出榜单

2026年8月10日 13:28每日经济新闻

每经记者:宋欣悦 每经编辑:兰素英

《每日经济新闻》根据OpenRouter最新数据测算,上周(8月3日至8月9日)全球AI大模型总调用量为69万亿Token,环比增长21.48%。

其中,上榜的AI大模型中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%;同期美国AI大模型周调用量为9.17万亿Token,环比增长109.36%。中国大模型周调用量连续十五周超过美国,稳居全球首位。

《每日经济新闻》注意到,上周,全球调用量排名前四均为中国AI大模型。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第一,周调用量达8.83万亿Token,环比增长570%;腾讯Hy3位居第二,周调用量达8.05万亿Token,环比增长67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)排名第三,周调用量达5.88万亿Token,环比下滑19%;小米MiMo-V2.5掉到第四,周调用量达5.39万亿Token,环比下滑14%。

7月31日,DeepSeek宣布,DeepSeek-V4-Flash正式版API上线公测。据了解,DeepSeek-V4-Flash正式版的模型结构、尺寸和DeepSeek-V4-Flash预览版保持一致,仅重新进行后训练。据官方更新日志显示,V4-Flash正式版在Agent能力上大幅增强,基准测试远超预览版本。

据Artificial Analysis测算,V4-Flash正式版完成单项测试任务的平均成本约为0.03美元,只有Anthropic旗舰模型Claude Fable 5的1/100,成为目前全球主流模型中成本最低的模型。

OpenAI旗下GPT-5.6 Luna进入前五,周调用量达4.43万亿Token,环比增长128%。

7月10日,OpenAI正式公开发布GPT-5.6系列模型,而GPT-5.6 Luna是该系列中速度最快、成本最低的模型,适用于大规模、高频率任务处理,可支持工具调用和多步骤工作流程。该系列模型上线不到三周之际,OpenAI宣布优化GPT-5.6系列模型定价和性能,以提升企业用户AI应用的性价比。其中,GPT-5.6 Luna模型价格下调80%。

谷歌Gemini 3.6 Flash首次进入榜单,排名第九,周调用量达2.33万亿Token,环比增长446%。

Gemini 3.6 Flash于7月22日发布。第三方测评机构Artificial Analysis Index的数据显示,Gemini 3.6 Flash在输出时消耗的token数量比上一代Gemini 3.5 Flash平均减少了17%。

其每百万输入Token价格保持在1.50美元,输出价格则由上一代的9美元降至7.50美元,降幅约16.7%。

值得注意的是,此前一周排名第七的MiniMax M3和排名第九的阶跃星辰Step 3.7 Flash跌出榜单。

免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。

编 辑:章芳
飞象网版权及免责声明:
1.本网刊载内容,凡注明来源为“飞象网”和“飞象原创”皆属飞象网版权所有,未经允许禁止转载、摘编及镜像,违者必究。对于经过授权可以转载,请必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和飞象网来源。
2.凡注明“来源:XXXX”的作品,均转载自其它媒体,在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。
3.如因作品内容、版权和其它问题,请在相关作品刊发之日起30日内与本网联系,我们将第一时间予以处理。
本站联系电话为86-010-87765777,邮件后缀为cctime.com,冒充本站员工以任何其他联系方式,进行的“内容核实”、“商务联系”等行为,均不能代表本站。本站拥有对此声明的最终解释权。
推荐阅读

精彩视频

精彩专题

关于我们广告报价联系我们隐私声明本站地图

CCTIME飞象网 CopyRight © 2007-2026 By CCTIME.COM

京ICP备08004280号-1 电信与信息服务业务经营许可证080234号 京公网安备110105000771号

公司名称: 北京飞象互动文化传媒有限公司

未经书面许可,禁止转载、摘编、复制、镜像