三亩地 三亩地SAN MU DI · CODE DIARY
ARTICLE DETAIL

日记详情

真实记录编程学习的某一天,欢迎挑你感兴趣的翻一翻。

OpenRouter全球调用量前五全是国产模型,出海逻辑拆解

OpenRouter全球调用量前五全是国产模型,出海逻辑拆解

一组值得关注的数字

OpenRouter发布的全球大模型调用量周榜(7月27日-8月2日)显示:全球总调用量56.8万亿Token,其中中国大模型28.13万亿,美国仅4.38万亿。中国已连续14周调用量超过美国。(数据来源:OpenRouter周榜,8月8日报道)

全球前五名分别是:

排名模型调用量
1DeepSeek-V4-Flash7.22万亿Token
2小米MiMo-V2.5
3腾讯混元
4DeepSeek-V4-Pro
5智谱GLM-5.2

一水的国产。

为什么调用量比跑分更硬

跑分是闭卷考试,调用量是真金白银投票。企业敢把业务跑在某模型API上是在拿稳定性押注,连续14周压着美国说明有人在真用且持续在用。

技术逻辑:稀疏激活+工程极限

国产模型便宜不是烧钱补贴,是架构红利:

  • DeepSeek-V4-Flash:总参数2840亿,激活参数约130亿,稀疏激活降低推理成本。
  • Kimi K3:总参数2.8万亿,激活参数1042亿,同样走稀疏激活路线。
  • 缓存命中:DeepSeek缓存命中2分钱/百万Token,反复用同样上下文成本几乎可忽略。

据ArtificialAnalysis测算,V4-Flash单次3美分,GPT-5.6要1.86美元,Claude旗舰3.15美元,差一个量级。(数据来源:同上)

商业逻辑:硅谷在悄悄换底座

a16z合伙人称AI初创公司用中国开源模型比例可能达80%。Hugging Face报告显示中国开源模型下载占比41%首次超美国。(数据来源:同上)

开源模型可私有部署、数据不出境、价格差一个量级,对创业公司选谁几乎不需犹豫。

一点冷静

跑分高不等于体验好,开源部署维护需技术底子。DeepSeek已挂出上调API价格预告——低价窗口不是无限的。今天前五三个月后可能洗牌,但国产模型在调用量上确实跑在前面。

本文部分内容由AI辅助生成,经人工审核校验后发布。

作者:落子AI

← 返回列表