2026-08-10 10:27:08
上周(8月3日至8月9日),中国AI大模型周调用量达34.25万亿Token,环比增长21.76%,连续十五周超过美国。具体来看,DeepSeek-V4-Flash-0731位居榜单第一,环比增长570%。OpenAI旗下GPT-5.6 Luna进入前五,MiniMax M3和阶跃星辰Step 3.7 Flash跌出榜单。
每经记者|宋欣悦 每经编辑|兰素英
《每日经济新闻》根据OpenRouter最新数据测算,上周(8月3日至8月9日)全球AI大模型总调用量为69万亿Token,环比增长21.48%。
其中,上榜的AI大模型中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%;同期美国AI大模型周调用量为9.17万亿Token,环比增长109.36%。中国大模型周调用量连续十五周超过美国,稳居全球首位。


《每日经济新闻》注意到,上周,全球调用量排名前四均为中国AI大模型。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第一,周调用量达8.83万亿Token,环比增长570%;腾讯Hy3位居第二,周调用量达8.05万亿Token,环比增长67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)排名第三,周调用量达5.88万亿Token,环比下滑19%;小米MiMo-V2.5掉到第四,周调用量达5.39万亿Token,环比下滑14%。
7月31日,DeepSeek宣布,DeepSeek-V4-Flash正式版API上线公测。据了解,DeepSeek-V4-Flash正式版的模型结构、尺寸和DeepSeek-V4-Flash预览版保持一致,仅重新进行后训练。据官方更新日志显示,V4-Flash正式版在Agent能力上大幅增强,基准测试远超预览版本。
据Artificial Analysis测算,V4-Flash正式版完成单项测试任务的平均成本约为0.03美元,只有Anthropic旗舰模型Claude Fable 5的1/100,成为目前全球主流模型中成本最低的模型。

OpenAI旗下GPT-5.6 Luna进入前五,周调用量达4.43万亿Token,环比增长128%。
7月10日,OpenAI正式公开发布GPT-5.6系列模型,而GPT-5.6 Luna是该系列中速度最快、成本最低的模型,适用于大规模、高频率任务处理,可支持工具调用和多步骤工作流程。该系列模型上线不到三周之际,OpenAI宣布优化GPT-5.6系列模型定价和性能,以提升企业用户AI应用的性价比。其中,GPT-5.6 Luna模型价格下调80%。
谷歌Gemini 3.6 Flash首次进入榜单,排名第九,周调用量达2.33万亿Token,环比增长446%。
Gemini 3.6 Flash于7月22日发布。第三方测评机构Artificial Analysis Index的数据显示,Gemini 3.6 Flash在输出时消耗的token数量比上一代Gemini 3.5 Flash平均减少了17%。
其每百万输入Token价格保持在1.50美元,输出价格则由上一代的9美元降至7.50美元,降幅约16.7%。
值得注意的是,此前一周排名第七的MiniMax M3和排名第九的阶跃星辰Step 3.7 Flash跌出榜单。
免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。
封面图片来源:每经媒资库
如需转载请与《每日经济新闻》报社联系。
未经《每日经济新闻》报社授权,严禁转载或镜像,违者必究。
读者热线:4008890008
特别提醒:如果我们使用了您的图片,请作者与本站联系索取稿酬。如您不希望作品出现在本站,可联系我们要求撤下您的作品。
欢迎关注每日经济新闻APP