我是 LongbridgeAI,我可以总结文章信息。OpenRouter 数据显示,DeepSeek V4 Flash 以 7.22 万亿 Token 单周调用量登顶全球第一。中国 AI 大模型周调用量连续 14 周超美国,稳居首位。小米 MiMo-V2.5 位列第二,但流量环比下滑。
多模型聚合平台 OpenRouter 发布的全球 AI 大模型调用量周榜单(7 月 27 日至 8 月 2 日)显示,DeepSeek V4 Flash 以 7.22 万亿 Token 的调用量位居第一。
另据开源项目团队 OpenCode 发文,其平台上 DeepSeek V4 Flash 的调用量大幅飙升,仅 8 月 1 日一天,模型单日处理达 8 万亿 Token。其中,5 万亿为免费试用额度消耗,3 万亿为开发者通过 OpenCode 平台付费使用。
OpenRouter 数据显示,上周全球 AI 大模型总调用量为 56.8 万亿 Token,环比下滑 2.07%。上榜的 AI 大模型中,中国 AI 大模型周调用量达 28.13 万亿 Token,环比下滑 14.76%。同期美国 AI 大模型周调用量为 4.38 万亿 Token,环比增长 87.18%。中国大模型周调用量已连续十四周超过美国,稳居全球首位。
8 月 5 日,界面新闻查询 OpenRouter 本周榜单看到,截至发稿,DeepSeek V4 Flash 0423 仍排在首位,调用量为 6.92 万亿 Token。该模型最早于今年 4 月推出,主打平衡推理速度、长上下文能力与调用成本,主要面向开发者、商用企业提供高吞吐推理服务。
排在第二位的是小米推出的 MiMo-V2.5,周调用量 5.1 万亿 Token,环比前一周下滑 52%,流量出现明显回调,市场热度有所回落。
小米这款模型于今年 4 月 23 日正式公测,4 月底完成全系列开源。其采用混合专家 MoE 架构,总参数突破万亿级别,激活参数 42B,标配 100 万 Token 超长上下文窗口,同时覆盖文本、语音、图像全模态交互。低廉推理成本与稳定智能体运行能力,是其吸引海外开发者批量接入的核心优势。
就在 7 月 20 日至 7 月 26 日当周,MiMo-V2.5 曾登顶 OpenRouter 周调用量榜单首位,单周调用量达到 10.5 万亿 Token,环比增长 12%。
目前第三名来自腾讯自研大模型混元 Hy3,调用规模 5.01 万亿 Token。Hy3 是腾讯自研通用大模型,该模型本期流量环比持平,增长幅度为 0%。Hy3 曾是 7 月 26 日所在周榜单增长势头最猛的模型,彼时周调用量 3.94 万亿 Tokens,环比增幅超 999%。
Hy3 于 7 月 6 日正式开源,总参数 295B、单次推理仅激活 21B 参数。其采用快慢思考融合架构,最大支持 256K 上下文,代码生成、智能交互能力大幅迭代。腾讯混元曾发文表示,截至 7 月 15 日,Hy3 总调用量较上一代模型 Hy2 增长已超 68 倍。
第四名同样来自 DeepSeek 的 V4 Flash 0731 模型。这是 DeepSeek 全新上线的新版本模型,周流量 3.45 万亿 Token。第五名则是 OpenAI 推出的 GPT-5.6 Luna,本周 Token 调用量 2.99 万亿,实现 738% 的爆发式增长。
榜单前五席位之中,国产大模型包揽前四位,展现出极强的市场调用热度。但 OpenAI 全新迭代模型强势追赶,意味着全球头部厂商之间的竞争并未放缓。
从前十来看,DeepSeek 占据三个席位,除两款 V4 Flash 版本外,DeepSeek V4 Pro 以 2.97 万亿 Token 排在第六位。Anthropic、谷歌、NVIDIA、MiniMax、阶跃星辰、智谱 AI 等多家企业模型纷纷上榜。免费模型正在占据越来越多流量份额,NVIDIA Nemotron 3 Ultra、Poolside Laguna S 2.1、Inclusion AI Ling-3.0-flash 等免费模型实现高速增长,不少免费模型环比涨幅突破 50%。
值得一提的是,此前备受马斯克关注的 Kimi K3 模型在本周暂时跌出了前十,目前位列第 12 位。该模型总参数达 2.8 万亿,配备 100 万 Token 超长上下文窗口,为当前全球参数规模最大开源大模型。
不同于过去依靠低价换取流量的竞争模式,当前国产模型依靠持续迭代的推理性能、稳定服务能力吸引海外开发者。但挑战同样存在,OpenAI、Anthropic 持续推出新版本模型,不断缩小性能差距;谷歌 Gemini 系列多款模型稳定盘踞榜单前列,海外巨头依旧拥有稳固基本盘。
赛道内部的分化同样值得警惕。部分国产模型本期出现调用量大幅下滑,小米 MiMo-V2.5、MiniMax M3、智谱 GLM5.2 均出现不同程度流量回落。由于热度轮换速度不断加快,一旦产品迭代节奏放缓,很容易快速流失开发者流量。
有人工智能行业分析师指出,海外独立开发者市场已经进入白热化竞争,仅仅依靠单次版本更新很难守住优势。如何持续迭代、高效控制推理成本,将决定各大模型能否长期留住用户。
风险提示及免责条款
市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。
