📥 Content Hub
← назад
AI / Искусственный интеллект 每日经济新闻 zh 2026-09-21 02:59 1 min

是美国的4.7倍!中国AI大模型周调用量连续二十一周领跑:DeepSeek V4.1-Flash登顶,环比增长219% - 每日经济新闻

Кратко: 2026-09-21 10:59:38 每经记者|宋欣悦 每经编辑|兰素英 《每日经济新闻》根据OpenRouter最新数据测算,上周(9月14日至9月20日)全球AI大模型总调用量为129万亿Token,环比增长1.57%。 其中,上榜的AI大模型中,中国AI大模型周调用量达67.46万亿Token,环比增长10.28%;同期美国AI大模型周调用量为14.21万亿Token,环比下滑34.7%。中国大模型周调用量连续二十一周超过美国,稳居全球首位。 《每日经济新闻》注意到,上周,全球调用量排名前五中,有四款中国AI大模型。其中,DeepSeek V4.1-Flash升至第一,周调用量达15.8万亿Token,环比增长219%。 该模型于9月10日正式发布,在实现Coding与Agent能力提升的同时强化多模态理解能力。V4.1-Flash采用全新的Causal-Encoder-Decoder(因果编码器—解码器)结构,全局KV Cache降至V4-Flash的约1/4。 架构优化释放推理降本空间。据DeepSeek官方定价,V4.1-Flash每百万Token闲时缓存命中输入、未命中输入及输出价格分别为0.02元、1元、4元,较前代的0.05元、1.5元、4.5元分别下降60.0%、33.3%、11.1%,高峰时段价格为闲时的两倍。 据DeepSeek介绍,DeepSeek V4.1-Flash在性能、费用、速度和任务总用时等指标上已全面超越V4-Pro。 中信证券认为,国产模型将沿高性价比与前沿智能两条路径继续展开竞争,DeepSeek深度适配下国产算力基础设施与国产模型同步受益,同时高性价比推理将加速FDE(前线部署工程师)及企业级Agent(智能体)落地。 不过,Token单价下降并不意味着单项任务总成本必然下降。据第三方机构Artificial Analysis的评测,在该机构测试中,V4.1-Flash平均每项任务使用约8.9万输出Token,高于上一代V4 Flash 0731的约6.2万。该机构评价V4.1-Flash的输出非常冗长(very verbose)。 智谱GLM 5.3 Flash位居第二,周调用量达14.1万亿Token,环比增长18%;腾讯混元Hy4 preview排名第三,周调用量达12.5万亿Token,环比下滑26%;DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第五,周调用量达9.44万亿Token,环比下滑18%。 免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。 封面图片来源:每经媒资库 如需转载请与《每日经济新闻》报社联系。 未经《每日经济新闻》报社授权,严禁转载或镜像,违者必究。 读者热线:4008890008 特别提醒:如果我们使用了您的图片,请作者与本站联系索取稿酬。如您不希望作品出现在本站,可联系我们要求撤下您的作品。 欢迎关注每日经济新闻APP
🧭 Извлечение: ok · confidence 90% · диагностика
High confidence: full text extraction produced 1263 characters.

2026-09-21 10:59:38

每经记者|宋欣悦 每经编辑|兰素英

《每日经济新闻》根据OpenRouter最新数据测算,上周(9月14日至9月20日)全球AI大模型总调用量为129万亿Token,环比增长1.57%。

其中,上榜的AI大模型中,中国AI大模型周调用量达67.46万亿Token,环比增长10.28%;同期美国AI大模型周调用量为14.21万亿Token,环比下滑34.7%。中国大模型周调用量连续二十一周超过美国,稳居全球首位。

《每日经济新闻》注意到,上周,全球调用量排名前五中,有四款中国AI大模型。其中,DeepSeek V4.1-Flash升至第一,周调用量达15.8万亿Token,环比增长219%。

该模型于9月10日正式发布,在实现Coding与Agent能力提升的同时强化多模态理解能力。V4.1-Flash采用全新的Causal-Encoder-Decoder(因果编码器—解码器)结构,全局KV Cache降至V4-Flash的约1/4。

架构优化释放推理降本空间。据DeepSeek官方定价,V4.1-Flash每百万Token闲时缓存命中输入、未命中输入及输出价格分别为0.02元、1元、4元,较前代的0.05元、1.5元、4.5元分别下降60.0%、33.3%、11.1%,高峰时段价格为闲时的两倍。

据DeepSeek介绍,DeepSeek V4.1-Flash在性能、费用、速度和任务总用时等指标上已全面超越V4-Pro。

中信证券认为,国产模型将沿高性价比与前沿智能两条路径继续展开竞争,DeepSeek深度适配下国产算力基础设施与国产模型同步受益,同时高性价比推理将加速FDE(前线部署工程师)及企业级Agent(智能体)落地。

不过,Token单价下降并不意味着单项任务总成本必然下降。据第三方机构Artificial Analysis的评测,在该机构测试中,V4.1-Flash平均每项任务使用约8.9万输出Token,高于上一代V4 Flash 0731的约6.2万。该机构评价V4.1-Flash的输出非常冗长(very verbose)。

智谱GLM 5.3 Flash位居第二,周调用量达14.1万亿Token,环比增长18%;腾讯混元Hy4 preview排名第三,周调用量达12.5万亿Token,环比下滑26%;DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第五,周调用量达9.44万亿Token,环比下滑18%。

免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。

封面图片来源:每经媒资库

如需转载请与《每日经济新闻》报社联系。

未经《每日经济新闻》报社授权,严禁转载或镜像,违者必究。

读者热线:4008890008

特别提醒:如果我们使用了您的图片,请作者与本站联系索取稿酬。如您不希望作品出现在本站,可联系我们要求撤下您的作品。

欢迎关注每日经济新闻APP

Читать оригинал ↗

Сделать контент из этого материала