引言
最新的AI模型周度使用数据显示,中国模型继续在OpenRouter上吸引大量流量。
在2026年8月3日至9日这一周,基于OpenRouter数据的媒体统计显示,所追踪模型的Token总使用量达到69万亿,环比增长21.48%。
中国公司开发的模型贡献了34.25万亿Token,周环比增长21.76%。同期,被归类为美国开发的模型贡献了9.17万亿Token。
按照这一国家层面的统计口径,中国模型已连续15周超过美国模型。
本周表现最强劲的单一模型是DeepSeek-V4-Flash-0731,周使用量达到8.83万亿Token,较前一周飙升570%。腾讯的Hy3紧随其后,使用量为8.05万亿Token,环比增长67%。
数据范围说明: 这些数据描述的是通过OpenRouter观察到的使用情况,以及基于其模型排名计算的国家层面统计。这些数据不应被解读为所有AI模型在第一方应用、直接API、私有部署、企业云和本地推理方面的全球总使用量。
中国模型周Token使用量达34.25万亿
原始报告强调了最新OpenRouter快照中国产模型的使用规模。
主要数据如下:
| 指标 | 2026年8月3日至9日 | 环比变化 |
|---|---|---|
| 追踪模型总使用量 | 69万亿Token | +21.48% |
| 中国模型使用量 | 34.25万亿Token | +21.76% |
| 美国模型使用量 | 9.17万亿Token | +109.36% |
中国模型的累计使用量几乎占了当周69万亿Token总量的一半。
这也是中国媒体基于OpenRouter数据进行的统计中,中国模型总量连续第15周超过美国模型总量。
这一趋势值得关注,因为OpenRouter是一个多模型API路由平台,而非单一模型提供商。开发者通过统一接口访问来自多家公司的模型,这使得其使用量排名成为第三方开发者需求的有效信号。
OpenRouter表示,其排名基于通过其平台访问模型的数百万用户的真实使用数据。
然而,OpenRouter只是众多分发渠道之一。一个模型可能拥有大量不经过OpenRouter的第一方流量。腾讯、DeepSeek、OpenAI、Anthropic、Google等提供商也通过自己的API和产品服务用户,同时许多开源权重模型在私有环境或本地运行。
因此,这些数据最适合被解读为OpenRouter生态系统使用情况的有力指标,而非全球AI消费的完整统计。
DeepSeek-V4-Flash-0731飙升570%位居第一
本周表现最突出的模型是DeepSeek-V4-Flash-0731。
其在OpenRouter上的周使用量达到8.83万亿Token,较前一周增长570%,在所引用的排名中位居榜首。
此次飙升发生在DeepSeek于7月31日更新官方V4-Flash API之后。
DeepSeek的官方更新日志显示,新
DeepSeek-V4-Flash-0731 保持了与 V4-Flash 预览版相同的模型架构和规模,并通过额外的后训练进行了更新,而非采用新的基础架构。
该公司还表示,该版本大幅提升了智能体能力,并原生支持 Responses API,包括针对编码智能体工作流的定向兼容性。
DeepSeek-V4-Flash-0731 概览
DeepSeek 官方文档目前列出了以下特性:
| 规格 | DeepSeek-V4-Flash-0731 |
|---|---|
| API 模型名称 | deepseek-v4-flash |
| 上下文长度 | 100 万 tokens |
| 最大输出 | 最高 384K tokens |
| 思考模式 | 支持 |
| 非思考模式 | 支持 |
| 工具调用 | 支持 |
| Responses API | 支持 |
| Anthropic 兼容 API | 支持 |
DeepSeek 将 V4-Flash 描述为其更快、更经济的 V4 选项。V4 系列最初发布时采用了 284B 总参数 / 13B 激活参数 的 Flash 配置。
7 月 31 日的修订版特别聚焦于智能体工作负载。DeepSeek 公布的基准测试表报告了在 Terminal Bench、DeepSWE、CyberGym、Toolathlon 以及内部全栈编码评估等任务上的性能提升。
这些技术改进为使用量的跃升提供了有用的背景信息。编码智能体和工具使用系统每个任务消耗的 tokens 可能远超普通短式聊天,因为一项工作可能涉及反复规划、工具调用、文件检查、代码生成、执行和修订。
因此,token 使用量的急剧上升并不一定意味着独立用户数有相同百分比的增长。它可能反映了新用户采用、更长上下文、更重的智能体工作流、更高的可用性、提供商定价以及重复的机器间调用等多重因素的混合影响。
腾讯 Hy3 达到 8.05 万亿 Tokens
腾讯的 Hy3 在源数据中排名第二,当周 8.05 万亿 tokens,环比增长 67%。
Hy3 在发布后不久就已展现出强劲的 OpenRouter 势头。
腾讯表示,该模型在发布后一周内的 API 调用次数是 Hy2 的 68 倍以上,并在该早期阶段登顶 OpenRouter 使用量排行榜。
该模型于 7 月 6 日正式发布,并于 8 月 5 日扩展至更广泛的国际市场。
Hy3 概览
腾讯将 Hy3 描述为一种混合快慢思考的专家混合模型,具有以下特点:
| 规格 | 腾讯 Hy3 |
|---|---|
| 总参数 | 295B |
| 激活参数 | 21B |
| 上下文长度 | 最高 256K |
| 架构 | 专家混合 |
| 推理 | 可配置的快/慢推理 |
| 许可证 | Apache 2.0 |
腾讯将 Hy3 定位用于编码、文档处理、金融建模、前端设计、游戏制作和智能体工作流。
该公司还将该模型集成到 WorkBuddy、腾讯设计 Miora 和腾讯云 TokenHub 等产品中,同时通过第三方开发者平台和开放模型社区提供该模型。
这种更广泛的分发可能有助于解释为什么 Hy3 能保持在第三方使用量排名前列,而非依赖单一的第一方应用。
为什么 Token 使用量是一个有用的指标——以及它为何可能具有误导性
Token 用量是衡量模型推理发生量的有用方式,但它并不等同于衡量用户、收入、智能或市场份额。
一个运行长时编码代理的开发者可能比数百个提出简短问题的人消耗更多 token。
一个拥有百万级 token 上下文窗口的模型可能在单次请求中处理大量输入。另一个模型可能用更少的 token 完成同样的任务。不同的分词器对文本的切分方式也不同,因此一个模型的 token 数量并不总是与另一个模型的 token 数量直接等同。
多种因素可能推高 token 用量:
- 更多用户
- 更多 API 集成
- 更长的上下文
- 编码代理循环
- 工具调用
- 更低的价格
- 免费或折扣访问
- 更好的提供商可用性
- 大批量自动化工作负载
- 反复重试或低效提示
因此,token 用量应与其他信号一起解读,例如请求数量、独立用户、收入、延迟、单任务成本、基准测试表现和留存率。
原始报告的主要观点在其数据源内仍然成立:中国模型在 OpenRouter 上获得了异常高的使用量,且这一趋势已持续数周。
15 周连续趋势说明了什么
几分钟搭建展示站并增长获客
输入一句想法,We0 AI 即可生成展示站、页面与 CMS。发布上线后并帮你获取客户和流量。
用户注册赠送一次完整项目生成
适合先体验一次完整生成流程,快速看到项目初稿。
一周的峰值可能由发布活动、促销或临时定价引起。
连续十五周则是一个更持久的信号。
这种持续的地位表明,中国模型不再仅仅因为价格低廉而被使用。开发者正在反复选择它们用于生产环境和实验性工作负载,涵盖编码、代理、推理和通用 API 使用。
有三个因素显得尤为重要。
- 强劲的性价比竞争
DeepSeek 和腾讯都在提升推理和代理能力的同时强调成本效率。
对于 API 开发者来说,实际比较往往不仅仅是哪个模型的基准分数最高,而是哪个模型能够以可接受的总成本可靠地完成任务。
一个在某个基准上稍弱的模型,如果速度更快、价格更低、更易集成或足以满足大批量工作负载,仍然可能赢得大量流量。
- 开放且多平台的发布
Hy3 以 Apache 2.0 许可发布,DeepSeek 也在其发布周围构建了强大的开源模型生态。
开放且广泛分发的模型可以出现在众多网关、云平台、本地运行时、编码工具和代理框架中。
这种分发减少了对单一产品界面的依赖,并使已经拥有多模型基础设施的开发者更容易采用。
- 代理工作负载正成为 token 的主要来源
DeepSeek-V4-Flash 和 Hy3 都围绕代理能力进行了大量营销。
代理工作负载天然是 token 密集型的,因为模型可能反复检查上下文、制定计划、调用工具、读取结果,并持续到任务完成。
随着编码助手和自主工作流工具变得越来越普遍,每周 token 排名可能越来越反映哪些模型在软件系统内部受欢迎,而不仅仅是
哪些聊天机器人在消费者中受欢迎。
一个更准确地解读标题的方式
源标题称中国的AI生态系统正处于重大高光时刻,模型使用量领跑全球。
底层数据支持一个更狭义且更有说服力的表述:
中国开发的模型连续第15周领跑所引用的OpenRouter周度Token使用量统计。
这仍然具有重要意义。
OpenRouter是一个主要的多模型分发层,其高使用量表明,在众多厂商可供选择的情况下,开发者正在积极选用这些模型。
但用34.25万亿Token的数据来证明中国模型在整个全球AI市场中生成的Token总量超过美国模型,是不准确的。
来自ChatGPT、Gemini、Claude、DeepSeek、腾讯产品、企业部署、私有推理以及本地开源权重安装的第一方流量并未全面纳入OpenRouter的统计总量。
因此,最有力的结论关乎开发者平台的势头,而非绝对的全球AI消费总量。
常见问题解答
2026年8月3日至9日报告的AI模型使用总量是多少?
所引用的基于OpenRouter数据的统计显示,该周Token总量为69万亿,较前一周增长21.48%。这是平台层面的使用数据,不应被视为整个全球AI行业的Token消费总量。
中国AI模型被归因了多少Token?
中国开发的模型当周被统计为34.25万亿Token,环比增长21.76%。同一媒体统计将美国开发的模型列为9.17万亿Token。
在该排名中,中国模型领先美国模型多久了?
8月3日至9日期间标志着中国模型总量连续第15周超过美国模型总量。该比较基于OpenRouter使用数据以及媒体对所列模型的国别分类。
哪个模型排名第一?
DeepSeek-V4-Flash-0731在所引用的周度快照中以8.83万亿Token排名第一。其使用量环比增长570%。
什么是DeepSeek-V4-Flash-0731?
它是DeepSeek的V4-Flash API模型在7月31日的后训练更新版本。DeepSeek表示,它保持与预览版相同的架构和规模,同时显著增强了智能体能力。
腾讯Hy3记录了多少使用量?
消息源报告Hy3当周Token量为8.05万亿,增长67%。腾讯在该模型7月发布后不久就已报告OpenRouter上的强劲采用率。
OpenRouter数据是否代表全球所有AI使用量?
不是。OpenRouter衡量的是通过其自身多模型平台路由的活动。直接提供商API、第一方消费者应用、企业云、私有部署和本地推理可能未包含在内。
Token量是否等同于模型受欢迎程度?
不完全是。Token量可以反映受欢迎程度,但也受上下文长度、智能体循环、定价、工作负载类型和Token效率的影响。独立用户数、请求数、收入和留存率提供了不同的采用率视角。
相关工具
OpenRouter:一个统一的 API 平台,用于访问和路由来自数百个 AI 模型和提供商的请求。
- OpenRouter 排行榜:基于 OpenRouter 平台活动实时展示的模型排名和使用情况。
- DeepSeek API:DeepSeek 官方开发者平台,用于访问 V4-Flash 和其他 API 模型。
- DeepSeek API 文档:官方模型、定价、工具调用、上下文和集成文档。
- 腾讯 Hy3:腾讯官方 Hy3 模型网站和访问信息。
- 腾讯云 TokenHub:腾讯的多模型 API 和模型编排平台。
- WorkBuddy:腾讯集成了 Hy3 的 AI 智能体工作空间。
相关链接
- 原始 AIBase 报告:作为编辑起点的中文来源文章。
- OpenRouter AI 模型排行榜:当前模型使用和排名数据的主要平台页面。
- OpenRouter 模型:OpenRouter 上模型的可用性、描述、提供商、上下文窗口和定价。
- DeepSeek V4-Flash 7 月 31 日更新:DeepSeek 官方关于 V4-Flash-0731 版本和智能体基准更新的变更日志。
- DeepSeek 模型和定价:官方 V4-Flash 模型标识符、上下文限制、支持的 API 和当前定价信息。
- 腾讯 Hy3 全球可用性:腾讯官方关于 Hy3 采用、架构、集成和 OpenRouter 势头的描述。
- 腾讯 Hy3 官方发布公告:腾讯 7 月发布公告,包含 Hy3 架构和功能信息。
摘要
2026 年 8 月 3 日至 9 日的 OpenRouter 使用数据显示,中国开发的 AI 模型又迎来了强劲的一周。所引用的计算将其置于 34.25 万亿 token,标志着在该数据集中连续第 15 周领先于美国开发的模型。
DeepSeek-V4-Flash-0731 以 8.83 万亿 token 领跑单个模型排名,周环比激增 570%,而腾讯 Hy3 以 8.05 万亿 token 紧随其后,增长 67%。
这些数据是开发者采用情况的重要信号,尤其是对于智能体和编码工作负载而言,但并不能完全衡量全球 AI 使用情况。OpenRouter 并未覆盖所有第一方 API、消费级产品、私有部署或本地模型运行。
最明显的结论是,中国模型在 OpenRouter 生态系统中确立了持续的增长势头,DeepSeek 和腾讯目前推动了其中很大一部分使用量。



