数据说了什么

每日经济新闻根据OpenRouter最新数据测算,上周(8月3日至9日)全球AI大模型总调用量69万亿Token,环比增长21.48%。其中中国大模型周调用量34.25万亿Token,环比增长21.76%;美国大模型9.17万亿Token,环比增长109.36%。中国大模型周调用量连续15周超过美国。

DeepSeek-V4-Flash8.83万亿腾讯Hy3 8.05万亿DeepSeek预览版5.88万亿小米MiMo5.39万亿
全球调用量TOP4(万亿Token/周)

DeepSeek-V4-Flash凭什么登顶

7月31日DeepSeek宣布V4-Flash正式版API上线公测。模型结构和尺寸与预览版一致,仅重新进行后训练,但Agent能力大幅增强。据Artificial Analysis测算,V4-Flash正式版完成单项测试任务的平均成本约0.03美元,只有Anthropic旗舰模型Claude Fable 5的1/100,是目前全球主流模型中成本最低的。

不只是DeepSeek的事

全球调用量前四全是中国模型——这本身就是信号。腾讯Hy3第二(8.05万亿Token,环比增67%),DeepSeek预览版第三(5.88万亿),小米MiMo-V2.5第四(5.39万亿)。OpenAI的GPT-5.6 Luna排第五(4.43万亿,环比增128%)。中国模型不是靠一款产品突破,是成建制地在不同价位段都站住了。

  • 美国企业调用中国AI模型的Token占比每周稳定在30%以上,峰值达46%。
  • 硅谷近200家科技初创企业联名致信美国政府,反对限制使用中国开放权重AI模型。
  • V4-Flash正式版成本仅为Claude Fable 5的1/100,中小企业从GPT/Claude迁移趋势加速。

格局判断

中国模型今年的叙事已经从「追赶」变成「用性价比杀人」。DeepSeek在文本、MiniMax在视频、阿里Qwen3.8在编程和办公——不同赛道都在用同一个公式:能力不输第一梯队 + 价格明显更低 + 开源可部署。对闭源高价厂商来说,不只是市场份额被吃,更重要的是客户对「什么是合理价格」的心理锚点被重置了。

前四全是中国模型,这不是偶然——是开源+极致成本控制打出来的结构性优势。