DeepSeek-V4-Flash 登顶全球调用量榜首,单周 7.2 万亿 Token 背后的格局逆转
最新数据显示,上周(7 月 27 日至 8 月 2 日)全球 AI 大模型总调用量达 56.8 万亿 Token。其中,DeepSeek-V4-Flash 以 7.22 万亿 Token 的周调用量升至全球第一,中国大模型周调用量已连续十四周超过美国,稳居全球首位。
最新数据显示,上周(7 月 27 日至 8 月 2 日)全球 AI 大模型总调用量达 56.8 万亿 Token。其中,DeepSeek-V4-Flash 以 7.22 万亿 Token 的周调用量升至全球第一,中国大模型周调用量已连续十四周超过美国,稳居全球首位。
注:柱形图按相对比例缩放,数值单位为万亿 Token/周。全球总调用量 56.8 万亿 Token,前五名合计占全球总量的 43.7%。美国大模型同期周调用量为 4.38 万亿 Token,环比增长 87.18%,但总量仍与中国存在量级差距。
从总量看,中国大模型上周调用量达 28.13 万亿 Token,美国为 4.38 万亿 Token。中国大模型周调用量已连续十四周超过美国。
但数据只是故事的一部分。
周调用量 28.13 万亿 Token
环比下滑 14.76%
占据全球前五名全部席位
周调用量 4.38 万亿 Token
环比增长 87.18%
增速反弹显著,但总量仍有差距
注:中国侧环比下滑主要受小米 MiMo-V2.5 调用量环比下滑 40% 拖累;美国侧高增长源于基较低及新模型 API 接入放量。全球总调用量环比下滑 2.07%。
一个诚实的注脚:调用量领先不等于技术全面领先。中国在工程化落地与规模化调用上已建立优势,但在前沿推理与基础理论突破上,OpenAI 等机构仍在另一条赛道上加速。
就在中国模型拼调用量时,OpenAI 于 8 月 1 日发布了下一代模型 Astra 的内部测试成果——在数学与理论计算机科学领域取得十项突破。
不是刷榜,是解题。
注:以上为本周 AI 与算力相关关键数据切片。Qwen3.8 在 Arena 榜单中仅次于 Anthropic Claude 系列;MiniMax H3 支持 2K 分辨率、15 秒时长及原生立体声音频,已正式开源。
阿里于 8 月 3 日发布 Qwen3.8,总参数量 2.4 万亿,编程与专业办公能力大幅提升,API 已上线千问平台并接入"千问办公"Agent 产品。
MiniMax 正式开源全模态生成系统 H3,可统一理解文本、图像、视频与音频,并生成带原生立体声的视频。
政策侧,欧盟《人工智能法案》核心透明度条款正式生效——交互式系统须告知用户"正在与 AI 对话",AI 生成内容须附机器可读标记。
把 DeepSeek-V4-Flash 登顶与 OpenAI Astra 解题放在一起看,全球 AI 竞争的路线分化已经非常清晰。
中国大模型连续十四周调用量领先,背后是 API 价格优势、本土应用生态成熟与开发者基数庞大的共同作用。DeepSeek-V4-Flash 正式版 API 已登陆国家超算互联网,进一步拉低调用门槛。
但 OpenAI 用 2000 美元算力破解十项数学难题,证明前沿推理能力的单美元产出正在快速提升。这不是同一个维量的竞争。
当"谁用得多"与"谁算得深"成为两条平行赛道,全球 AI 竞争的胜负标准,已从单一参数比拼,演化为规模渗透率与理论突破力的双轨博弈。
DeepSeek-V4-Flash 正式版 API 已在国家超算互联网开启公测,支持调用与下载服务。
国家超算互联网平台 → 调用 DeepSeek-V4-Flash