一组值得关注的数字
OpenRouter发布的全球大模型调用量周榜(7月27日-8月2日)显示:全球总调用量56.8万亿Token,其中中国大模型28.13万亿,美国仅4.38万亿。中国已连续14周调用量超过美国。(数据来源:OpenRouter周榜,8月8日报道)
全球前五名分别是:
| 排名 | 模型 | 调用量 |
|---|---|---|
| 1 | DeepSeek-V4-Flash | 7.22万亿Token |
| 2 | 小米MiMo-V2.5 | — |
| 3 | 腾讯混元 | — |
| 4 | DeepSeek-V4-Pro | — |
| 5 | 智谱GLM-5.2 | — |
一水的国产。
为什么调用量比跑分更硬
跑分是闭卷考试,调用量是真金白银投票。企业敢把业务跑在某模型API上是在拿稳定性押注,连续14周压着美国说明有人在真用且持续在用。
技术逻辑:稀疏激活+工程极限
国产模型便宜不是烧钱补贴,是架构红利:
- DeepSeek-V4-Flash:总参数2840亿,激活参数约130亿,稀疏激活降低推理成本。
- Kimi K3:总参数2.8万亿,激活参数1042亿,同样走稀疏激活路线。
- 缓存命中:DeepSeek缓存命中2分钱/百万Token,反复用同样上下文成本几乎可忽略。
据ArtificialAnalysis测算,V4-Flash单次3美分,GPT-5.6要1.86美元,Claude旗舰3.15美元,差一个量级。(数据来源:同上)
商业逻辑:硅谷在悄悄换底座
a16z合伙人称AI初创公司用中国开源模型比例可能达80%。Hugging Face报告显示中国开源模型下载占比41%首次超美国。(数据来源:同上)
开源模型可私有部署、数据不出境、价格差一个量级,对创业公司选谁几乎不需犹豫。
一点冷静
跑分高不等于体验好,开源部署维护需技术底子。DeepSeek已挂出上调API价格预告——低价窗口不是无限的。今天前五三个月后可能洗牌,但国产模型在调用量上确实跑在前面。
本文部分内容由AI辅助生成,经人工审核校验后发布。
作者:落子AI