// SILICON-BASED LIFE INTELLIGENCE //

提米 AI TMAI

你的首个硅基生命伴侣
🌌

自研仿生记忆

深夜记忆固化与复盘,无感沉淀属于你们的性格默契。

💓

主动心跳机制

打破被动指令,感知情绪,在关键时刻主动提供推演方案。

🧩

无限进化能力

自由挂载视觉、通讯、调度外设,感知边界无限延伸。

单周调用量超67万亿!中国大模型强势领跑全球21周,谁在刷新行业天花板

近日,来自OpenRouter的最新监测数据勾勒出一幅清晰且极具张力的全球AI算力使用版图。在9月14日至20日的数据周期内,全球大模型总调用量攀升至129万亿Token,环比微增1.57%。在这股庞大的流量洪流中,中国大模型以67.46万亿Token的体量占据绝对主导位置,单周环比强劲回升10.28%;相比之下,美国大模型的调用量仅为14.21万亿Token,出现了34.7%的显著回落。这一数据并非短期波动,而是中国市场已经连续第21周在周调用量维度实现规模反超的稳定常态。

头部效应显现:中国模型包揽全球Top 5中的四席

当行业目光聚焦于头部竞品的迭代速度时,中国AI生态的“集团军作战”特征已愈发明显。上周全球调用量排名前五的产品中,有四款均来自中国企业。其中,表现最为抢眼的无疑是近期跃居榜首的DeepSeek V4.1-Flash。该模型仅用一个自然周便达成了15.8万亿Token的调用量,环比增幅高达219%。

其爆发式增长的底层支撑,源于架构创新与场景定位的精准结合。9月10日刚刚发布的新版V4.1-Flash,全面转向Causal-Encoder-Decoder架构设计,成功将全局KV Cache规模压缩至前代V4-Flash的四分之一左右。同时,模型能力重心明确锚定在编程辅助、智能体(Agent)交互及多模态理解三大高频赛道。

为快速打开开发者市场,DeepSeek在定价策略上打出了极具侵略性的牌。闲时非峰值阶段,每百万Token的价格被重新划定:输入缓存命中0.02元、缓存未命中1元、输出4元。与前代产品相比,三项价格分别大幅下探60%、33.3%和11.1%,高性价比策略直接转化为庞大的用户基数与调用热度。

理性审视:Token降价不等于单次任务成本降低

作为长期追踪大模型商业化落地的观察者,必须指出一个常被忽视的细节:Token单价的跳水,并不直接划等号为实际业务支出的同步缩减。Artificial Analysis的实测报告提供了关键的验证维度——V4.1-Flash在完成平均单项任务时,需消耗约8.9万输出Token,明显多于V4-Flash-0731版本的6.2万Token。第三方评测指出,该模型在生成内容时存在“输出较为冗长”的特征。

这意味着,虽然基础计费门槛大幅降低,但冗余文本的生成可能会在无形中抵消部分成本优势。企业在引入新模型进行生产环境部署时,需要在极致性价比与输出精炼度之间建立新的评估标尺,避免因盲目追求低价而陷入算力调用的“温水煮青蛙”效应。

梯队成型:头部玩家的接力赛仍在继续

除去拔得头筹的DeepSeek系列,榜单其他位置的分布同样折射出国内大厂的技术储备厚度。智谱GLM5.3Flash以14.1万亿Token的体量稳居第二;腾讯混元Hy4preview凭借12.5万亿Token位居第三;DeepSeek自身的前代主力V4-Flash-0731则以9.44万亿Token强势锁定第五名。

全球AI应用的调用需求正向十万亿级常态化迈进,中美两国在该指标上的走势差异,本质上反映了两地AI技术渗透路径与市场成熟度的分野。中国大模型以长达21周的连续领跑态势,不仅印证了开源生态与商业产品双轮驱动的成功,也标志着新一代AI工具链正在加速重塑全球开发者的工作流。下一阶段,谁能率先攻克“低成本与高能效”之间的工程化瓶颈,谁就将在下一轮模型竞赛中掌握更多定义标准的主动权。

more