新浪科技

中国AI大模型调用量连续二十周领跑:DeepSeek V4.1 Flash上线三天升至第六,智谱GLM 5.3、MiniMax M3跌出榜单

每日经济新闻

关注

每经记者|宋欣悦    每经编辑|兰素英    

《每日经济新闻》根据OpenRouter最新数据测算,上周(9月7日至9月13日)全球AI大模型总调用量为127万亿Token,环比增长10.43%。

其中,上榜的AI大模型中,中国AI大模型周调用量达61.17万亿Token,环比增长7.85%;同期美国AI大模型周调用量为21.76万亿Token,环比增长31.56%。中国大模型周调用量连续二十周超过美国,稳居全球首位。

《每日经济新闻》注意到,上周,全球调用量排名前五中,有四款中国AI大模型。其中,腾讯混元Hy4 preview位居第二,周调用量达16.8万亿Token,环比增长15%。

Hy4 preview于8月28日正式发布并开源,总参数770B、激活参数49B,上下文长度突破1M,重点面向Agent、Coding与生产力场景优化,增强在真实业务场景中完成复杂任务的能力。

智谱GLM 5.3 Flash位居第三,周调用量达11.9万亿Token,环比下滑4%;DeepSeek V4 Flash 0731(即DeepSeek V4 Flash正式版)位居第四,周调用量达11.6万亿Token,环比下滑6%;小米MiMo-V2.5升至第五,周调用量达7.77万亿Token,环比增长230%。

DeepSeek V4.1 Flash登上榜单,排名第六,周调用量达4.94万亿Token。该模型于9月10日正式发布。V4.1 Flash采用全新的Causal-Encoder-Decoder(因果编码器—解码器)结构,是一个总参数量为552B的混合专家模型(MoE)。

价格方面,DeepSeek下调了V4.1 Flash的API定价。按每百万Token计算,空闲时段的缓存命中输入价格为0.02元、缓存未命中输入为1元、输出为4元;高峰时段分别为0.04元、2元和8元。新价格2026年9月10日12:00 开始生效。

与此前V4 Flash同一时段的价格相比,缓存命中输入降价60%,未命中输入降价约33.3%,输出降价约11.1%。

据DeepSeek介绍,DeepSeek V4.1 Flash在性能、费用、速度和任务总用时等指标上已全面超越V4 Pro。

值得注意的是,此前一周排名第六的MiniMax M3、排名第九的智谱GLM 5.3跌出榜单。

免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。

封面图片来源:每经媒资库

加载中...