中国大模型周调用量连续20周全球第一:61万亿Token,接近美国3倍

OpenRouter最新周报数据出来了。9月7日至13日,全球AI大模型总调用量达127万亿Token,环比增长10.43%。其中,中国AI大模型周调用量达61.17万亿Token,环比增长7.85%,连续二十周超过美国,稳居全球首位。

同期美国模型周调用量为21.8万亿Token,中国约为其2.8倍。

一年翻盘:从不足20%到超过45%

一年前的格局完全不同。2025年9月22日当周,谷歌以约39%的份额位居厂商第一,美国厂商合计占约80%,中国厂商不足20%。

一年后的今天,DeepSeek以25.4%的份额升至厂商第一,中国厂商整体份额超过45%,美国厂商约43%。调用量前十榜单中,中国模型占据7席以上。腾讯混元Hy4 Preview排第2,智谱GLM-5.3 Flash排第3,DeepSeek V4 Flash排第4。

V4.1 Flash上线24小时,处理约1万亿Token

9月10日发布的DeepSeek V4.1 Flash,不到24小时便在OpenRouter上处理了约1万亿Token,发布48小时的调用量有望冲到约2.8万亿,可能刷新平台付费模型的纪录。

这款模型的技术架构值得关注:总参数552B的MoE模型,输入侧仅激活8B参数,输出侧激活16B。KV缓存压到约890字节/token,对HBM的需求降到上一代的四分之一,SSD降到八分之一。

价格是更直接的驱动力。空闲时段缓存命中输入0.02元/百万Token,未命中输入1元,输出4元;高峰时段翻倍。约90%的调用来自缓存读取,OpenRouter给出的等效市场定价约为0.006美元/百万Token。

能力榜和调用量榜,出现了明显的错位

这里有一个值得注意的反差:在Artificial Analysis的智能指数榜上,前五名全是海外模型,排名最高的国产模型智谱GLM-5.3位列第7。

能力榜上追赶,调用量上领跑。答案在企业的账单里:当AI从“试一试”变成“天天用”,企业算的不再是谁最聪明,而是“每一块钱能换来多少活”。

按公开API价格计算,国内主流模型的平均定价约为国际同行的10%到20%。瑞银证券中国互联网行业分析师熊玮指出,企业与用户的关注点正从能力转向投入产出比,“Token ROI”正在成为2026年下半年的行业关键词。

一个Github开源项目开发者的说法很直接:“大多数应用层的工作,国内模型已经能胜任,用不上最顶尖的海外旗舰模型。”

这种分层已经在海外企业的实际选择中出现。Coinbase正尝试通过内部模型网关,把智谱GLM 5.2、Kimi K2.7等开源模型设为工程师的默认选项,同时允许员工按任务自选。

当模型选择变成分层决策,调用层需要跟得上

模型越来越多,选择的标准也从“哪个最强”变成了“这个任务值不值得用旗舰”。对于大量中低复杂度的日常任务,价格、速度和稳定性才是关键变量。

如果你的业务里既有高价值任务、又有大量长尾调用,把这些请求收口到一个统一的入口会省很多事。

数据来源:

  • OpenRouter周报数据(9月7日至13日),每日经济新闻、封面新闻、第一财经等媒体引述

  • DeepSeek V4.1 Flash 24小时处理量,OpenRouter官方数据

  • Artificial Analysis智能指数榜单

  • 瑞银证券分析师熊玮关于Token ROI的观点,21世纪经济报道、信报等报道

评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值