📊 模型 · 全球榜单

DeepSeek-V4-Flash 登顶全球调用量榜首,单周 7.2 万亿 Token 背后的格局逆转

最新数据显示,上周(7 月 27 日至 8 月 2 日)全球 AI 大模型总调用量达 56.8 万亿 Token。其中,DeepSeek-V4-Flash 以 7.22 万亿 Token 的周调用量升至全球第一,中国大模型周调用量已连续十四周超过美国,稳居全球首位。

综合公开信息整理 2026-08-04 全文约 3 分钟读完
#DeepSeek #大模型调用量 #OpenAI Astra #AI竞争格局
🥇 第 1 名 全球大模型周调用量 · DeepSeek-V4-Flash
7.22万亿 周调用 Token 数 · 环比增长 13%
14 中国大模型调用量连续超越美国

⚡ 30 秒速览

  • 谁登顶了:DeepSeek-V4-Flash 周调用量达 7.22 万亿 Token,超越小米、腾讯及 OpenAI 等一众中外模型,升至全球第一。
  • 格局有多悬殊:中国大模型周调用量达 28.13 万亿 Token,美国仅为 4.38 万亿;全球前五名全被中国模型包揽。
  • 另一条战线:OpenAI 曝光下一代模型 Astra,以约 2000 美元算力成本破解十项数学与理论计算机难题,押注推理深度。
  • 同周动态:阿里发布 2.4 万亿参数 Qwen3.8,MiniMax 开源全模态视频模型 H3,欧盟 AI 法案透明度条款正式生效。
  • 核心信号:全球 AI 竞争正从"谁参数大"走向"谁用得多"与"谁算得深"的双轨分化。

01全球调用量 Top 5 中国模型包揽前五

🥇 DeepSeek-V4-Flash深度求索
7.22
小米 MiMo-V2.5小米
6.30
腾讯 Hy3腾讯
4.82
DeepSeek-V4-Pro深度求索
3.28
智谱 GLM-5.2智谱 AI
2.89

注:柱形图按相对比例缩放,数值单位为万亿 Token/周。全球总调用量 56.8 万亿 Token,前五名合计占全球总量的 43.7%。美国大模型同期周调用量为 4.38 万亿 Token,环比增长 87.18%,但总量仍与中国存在量级差距。

02中美调用量对比 连续十四周领先

从总量看,中国大模型上周调用量达 28.13 万亿 Token,美国为 4.38 万亿 Token。中国大模型周调用量已连续十四周超过美国。

但数据只是故事的一部分。

中国大模型

周调用量 28.13 万亿 Token
环比下滑 14.76%
占据全球前五名全部席位

美国大模型

周调用量 4.38 万亿 Token
环比增长 87.18%
增速反弹显著,但总量仍有差距

注:中国侧环比下滑主要受小米 MiMo-V2.5 调用量环比下滑 40% 拖累;美国侧高增长源于基较低及新模型 API 接入放量。全球总调用量环比下滑 2.07%。

一个诚实的注脚:调用量领先不等于技术全面领先。中国在工程化落地与规模化调用上已建立优势,但在前沿推理与基础理论突破上,OpenAI 等机构仍在另一条赛道上加速。

03OpenAI 的另一条路 以 2000 美元破解十项数学难题

就在中国模型拼调用量时,OpenAI 于 8 月 1 日发布了下一代模型 Astra 的内部测试成果——在数学与理论计算机科学领域取得十项突破。

不是刷榜,是解题。

🧮 Astra 的十项数学突破算力成本约 $2,000

  • 涵盖高维球体堆积密度上限康涅斯刚性猜想的推翻量子平行重复定理等十项理论难题。
  • 按 Sol API 费率计算,找到全部解决方案的总 Token 成本仅约 2000 美元
  • 还包括算术电路复杂性新下界多色拉姆齐数的超指数下界极值数猜想等。
编辑观察:这意味着 OpenAI 正在用极低算力成本攻克学术级难题,将模型能力从"对话工具"推向"理论研究者"。调用量是规模优势,解题能力是深度优势——两条路线同时在进行。

04同周技术速递 密集发布的一周

2.4万亿Qwen3.8 总参数量
2K·15sMiniMax H3 视频规格
10万+BaaS 区块链应用项目
154亿行云科技在手算力订单

注:以上为本周 AI 与算力相关关键数据切片。Qwen3.8 在 Arena 榜单中仅次于 Anthropic Claude 系列;MiniMax H3 支持 2K 分辨率、15 秒时长及原生立体声音频,已正式开源。

阿里于 8 月 3 日发布 Qwen3.8,总参数量 2.4 万亿,编程与专业办公能力大幅提升,API 已上线千问平台并接入"千问办公"Agent 产品。

MiniMax 正式开源全模态生成系统 H3,可统一理解文本、图像、视频与音频,并生成带原生立体声的视频。

政策侧,欧盟《人工智能法案》核心透明度条款正式生效——交互式系统须告知用户"正在与 AI 对话",AI 生成内容须附机器可读标记。

05两条路线,一个分水岭

把 DeepSeek-V4-Flash 登顶与 OpenAI Astra 解题放在一起看,全球 AI 竞争的路线分化已经非常清晰。

中国:规模驱动调用放量工程落地生态渗透
美国:深度驱动理论突破推理极限科研前沿

中国大模型连续十四周调用量领先,背后是 API 价格优势、本土应用生态成熟与开发者基数庞大的共同作用。DeepSeek-V4-Flash 正式版 API 已登陆国家超算互联网,进一步拉低调用门槛。

但 OpenAI 用 2000 美元算力破解十项数学难题,证明前沿推理能力的单美元产出正在快速提升。这不是同一个维量的竞争。

编辑核心判断

当"谁用得多"与"谁算得深"成为两条平行赛道,全球 AI 竞争的胜负标准,已从单一参数比拼,演化为规模渗透率与理论突破力的双轨博弈。

现在就能用

DeepSeek-V4-Flash 正式版 API 已在国家超算互联网开启公测,支持调用与下载服务。

国家超算互联网平台 → 调用 DeepSeek-V4-Flash