
据全球模型聚合平台OpenRouter数据测算,8月3日至9日,该平台统计口径下的AI大模型Token总调用量达69万亿,较前一周增长21.48%。其中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%,已经连续15周超过美国,稳居全球首位。
作为AI产业的“流量”,Token调用量直观反映了开发者、应用方对模型的实际使用规模,代表推理侧产业活跃度、外部开发者的接纳程度。我国AI大模型的Token调用量直线上升也反映了其在全球市场上的变化。
尤其当DeepSeek V4 Flash发布后,极致的“智效比”让它被称为大模型新的“斩杀线”,它不一定在每项测试里最强,但能力已经可以覆盖大量真实任务,而价格又足够低。
从AlphaGo称霸围棋界到ChatGPT面世,美国在算法大模型领域积累了显著的先发优势,但近几年中国大模型的崛起对全球AI格局有所冲击。美国《华尔街日报》等多家媒体提到,中国大模型独角兽月之暗面的新一代开源大模型Kimi K3正在撼动资本市场,并称其与DeepSeek在2025年发布时引发的市场恐慌如出一辙,连马斯克都赞其“令人印象深刻”。
赞誉声中,威胁悄然靠近。7月22日,白宫科技政策办公室主任迈克尔·克拉齐奥斯表示,月之暗面对美国人工智能企业Anthropic进行了蒸馏,从而开发出Kimi K3,美国财政部长贝森特威胁称,要用制裁和“实体清单”来应对中国企业的蒸馏。
阿里在Kimi K3发布三天后紧急preview Qwen 3.8-Max.2.4万亿参数,也宣称仅次于Fable 5。MoE架构、稀疏激活、FP8训练、MXFP4量化、强化学习后训练优化,这些算力稀缺大前提下的技术选择小前提,共同把顶级能力对算力的依赖,压到了硅谷童话里的几分之一。更重要的是,工程化降本的打法正在成为中国厂商的群体特征,群体效应会让算力堆砌的窗口更快关闭。
AI的成本结构和传统软件完全不同,AI有真实的COGS(销货成本),也就是推理算力,花钱规模直接挂钩收入规模。所以,中国厂商压低的不只是训练成本,也在挑战整个AI产业的经济结构。训练端的稀缺性被打破、推理端的成本战又被打响,硅谷讲给华尔街的“高投入换来高毛利”的逻辑,可能有朝一日就会崩塌。
“美国不应该禁止这类大模型。”英伟达首席执行官黄仁勋这样说,中国大模型非常优秀,人工智能技术将会渗透到更多行业。
结语
AI下半场不只是通过堆砌参数来抬高智能上限,更要让已有的智能真正进入业务流程。
(文/元素)
e-Mail:lab@enet16.com