# 是美国的4.7倍！中国AI大模型周调用量连续二十一周领跑：DeepSeek V4.1-Flash登顶，环比增长219% - 每日经济新闻

*Источник: 每日经济新闻*
*Дата: 2026-09-21*
*Язык: zh*

**Кратко:** 2026-09-21 10:59:38
每经记者｜宋欣悦 每经编辑｜兰素英
《每日经济新闻》根据OpenRouter最新数据测算，上周（9月14日至9月20日）全球AI大模型总调用量为129万亿Token，环比增长1.57%。
其中，上榜的AI大模型中，中国AI大模型周调用量达67.46万亿Token，环比增长10.28%；同期美国AI大模型周调用量为14.21万亿Token，环比下滑34.7%。中国大模型周调用量连续二十一周超过美国，稳居全球首位。
《每日经济新闻》注意到，上周，全球调用量排名前五中，有四款中国AI大模型。其中，DeepSeek V4.1-Flash升至第一，周调用量达15.8万亿Token，环比增长219%。
该模型于9月10日正式发布，在实现Coding与Agent能力提升的同时强化多模态理解能力。V4.1-Flash采用全新的Causal-Encoder-Decoder（因果编码器—解码器）结构，全局KV Cache降至V4-Flash的约1/4。
架构优化释放推理降本空间。据DeepSeek官方定价，V4.1-Flash每百万Token闲时缓存命中输入、未命中输入及输出价格分别为0.02元、1元、4元，较前代的0.05元、1.5元、4.5元分别下降60.0%、33.3%、11.1%，高峰时段价格为闲时的两倍。
据DeepSeek介绍，DeepSeek V4.1-Flash在性能、费用、速度和任务总用时等指标上已全面超越V4-Pro。
中信证券认为，国产模型将沿高性价比与前沿智能两条路径继续展开竞争，DeepSeek深度适配下国产算力基础设施与国产模型同步受益，同时高性价比推理将加速FDE（前线部署工程师）及企业级Agent（智能体）落地。
不过，Token单价下降并不意味着单项任务总成本必然下降。据第三方机构Artificial Analysis的评测，在该机构测试中，V4.1-Flash平均每项任务使用约8.9万输出Token，高于上一代V4 Flash 0731的约6.2万。该机构评价V4.1-Flash的输出非常冗长（very verbose）。
智谱GLM 5.3 Flash位居第二，周调用量达14.1万亿Token，环比增长18%；腾讯混元Hy4 preview排名第三，周调用量达12.5万亿Token，环比下滑26%；DeepSeek-V4-Flash-0731（即DeepSeek-V4-Flash正式版）位居第五，周调用量达9.44万亿Token，环比下滑18%。
免责声明：本文内容与数据仅供参考，不构成投资建议，使用前请核实。据此操作，风险自担。
封面图片来源：每经媒资库
如需转载请与《每日经济新闻》报社联系。
未经《每日经济新闻》报社授权，严禁转载或镜像，违者必究。
读者热线：4008890008
特别提醒：如果我们使用了您的图片，请作者与本站联系索取稿酬。如您不希望作品出现在本站，可联系我们要求撤下您的作品。
欢迎关注每日经济新闻APP

2026-09-21 10:59:38
每经记者｜宋欣悦 每经编辑｜兰素英
《每日经济新闻》根据OpenRouter最新数据测算，上周（9月14日至9月20日）全球AI大模型总调用量为129万亿Token，环比增长1.57%。
其中，上榜的AI大模型中，中国AI大模型周调用量达67.46万亿Token，环比增长10.28%；同期美国AI大模型周调用量为14.21万亿Token，环比下滑34.7%。中国大模型周调用量连续二十一周超过美国，稳居全球首位。
《每日经济新闻》注意到，上周，全球调用量排名前五中，有四款中国AI大模型。其中，DeepSeek V4.1-Flash升至第一，周调用量达15.8万亿Token，环比增长219%。
该模型于9月10日正式发布，在实现Coding与Agent能力提升的同时强化多模态理解能力。V4.1-Flash采用全新的Causal-Encoder-Decoder（因果编码器—解码器）结构，全局KV Cache降至V4-Flash的约1/4。
架构优化释放推理降本空间。据DeepSeek官方定价，V4.1-Flash每百万Token闲时缓存命中输入、未命中输入及输出价格分别为0.02元、1元、4元，较前代的0.05元、1.5元、4.5元分别下降60.0%、33.3%、11.1%，高峰时段价格为闲时的两倍。
据DeepSeek介绍，DeepSeek V4.1-Flash在性能、费用、速度和任务总用时等指标上已全面超越V4-Pro。
中信证券认为，国产模型将沿高性价比与前沿智能两条路径继续展开竞争，DeepSeek深度适配下国产算力基础设施与国产模型同步受益，同时高性价比推理将加速FDE（前线部署工程师）及企业级Agent（智能体）落地。
不过，Token单价下降并不意味着单项任务总成本必然下降。据第三方机构Artificial Analysis的评测，在该机构测试中，V4.1-Flash平均每项任务使用约8.9万输出Token，高于上一代V4 Flash 0731的约6.2万。该机构评价V4.1-Flash的输出非常冗长（very verbose）。
智谱GLM 5.3 Flash位居第二，周调用量达14.1万亿Token，环比增长18%；腾讯混元Hy4 preview排名第三，周调用量达12.5万亿Token，环比下滑26%；DeepSeek-V4-Flash-0731（即DeepSeek-V4-Flash正式版）位居第五，周调用量达9.44万亿Token，环比下滑18%。
免责声明：本文内容与数据仅供参考，不构成投资建议，使用前请核实。据此操作，风险自担。
封面图片来源：每经媒资库
如需转载请与《每日经济新闻》报社联系。
未经《每日经济新闻》报社授权，严禁转载或镜像，违者必究。
读者热线：4008890008
特别提醒：如果我们使用了您的图片，请作者与本站联系索取稿酬。如您不希望作品出现在本站，可联系我们要求撤下您的作品。
欢迎关注每日经济新闻APP

[Оригинал](https://www.nbd.com.cn/articles/2026-09-21/4587100.html)