《每日经济新闻》根据OpenRouter数据测算,上周全球AI大模型总调用量达127万亿Token,环比增长10.43%,其中中国以61.17万亿Token连续二十周超过美国的21.76万亿Token,稳居全球首位。
上周全球调用量前五中四款为中国模型:腾讯混元Hy4 preview以16.8万亿Token居第二,智谱GLM 5.3 Flash、DeepSeek V4 Flash 0731分列三四位,小米MiMo-V2.5以7.77万亿Token升至第五、环比大增230%。
9月10日发布的DeepSeek V4.1 Flash以4.94万亿Token登上第六,采用全新Causal-Encoder-Decoder结构,是总参数量552B的混合专家模型,性能、费用、速度等指标全面超越V4 Pro。
DeepSeek同步下调V4.1 Flash的API定价,高峰时段每百万Token缓存未命中输入2元、输出8元,较此前V4 Flash降价约33.3%和11.1%,而MiniMax M3与智谱GLM 5.3则跌出榜单。
