《每日经济新闻》根据OpenRouter最新数据测算,上周(8月24日至8月30日)全球AI大模型总调用量为113万亿Token,环比增长21.11%。

其中,上榜的AI大模型中,中国AI大模型周调用量达55.16万亿Token,环比增长36.26%;同期美国AI大模型周调用量为17.07万亿Token,环比增长76.71%。中国大模型周调用量连续十八周超过美国,稳居全球首位。

https://file.tonglife.net/images/d1/9d99c2acbf87cb827c2515dceb394c.png

https://file.tonglife.net/images/e6/8d2d0ef852d8c8082f402a5ccd1def.png

《每日经济新闻》注意到,上周,全球调用量排名前三均为中国AI大模型。其中,代号为Ox Alpha(中文社区称“牛来”)的匿名模型升至第一,周调用量达15.7万亿Token,环比增长36%。

据OpenRouter,Ox Alpha于8月20日上线,其上下文窗口约为104.8万Token,最大输出长度为13.1万Token,同时支持文本、图像和视频输入,预览期间可以免费调用。

独立研究员本·戴维斯(Ben Davis)选取软件工程基准DeepSWE中的10个子任务进行测试,Ox Alpha的通过率约为80%,高于Claude Fable 5的65%、GLM-5.3和Grok 4.6的62%,以及GPT-5.6 Sol的52%。

凭借亮眼的调用数据与硬核性能表现,这款匿名大模型自面世以来,引发业界广泛讨论与多方猜测。8月26日晚,智谱公开认领了Ox Alpha,确认其为GLM系列新版本GLM-5.3-Flash,并已开源。该模型为GLM-5系列首个原生多模态版本,定价为GLM-5.3的十分之一,限时折扣为二十分之一。上线当周,GLM-5.3-Flash便冲上榜单,排名第六,周调用量达6.16万亿Token。

https://file.tonglife.net/images/48/992766e361c5a71332282713f0a881.png

此前一周位居榜首的DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)降至第二,周调用量达12.3万亿Token,环比增长6%;小米MiMo-V2.5连续两周位居第三,周调用量达9.14万亿Token,环比下滑8%。

谷歌Gemini 3.7 Flash首次登上榜单,周调用量达3.95万亿Token,环比增长120%。

Gemini 3.7 Flash于8月14日推出,相对前代模型,Gemini 3.7 Flash升级重点放在编程、智能体应用、Web开发以及复杂知识工作上。谷歌将其定义为“迄今为止用于编码和智能体领域最智能的Flash级主力模型”。

此外,谷歌为开发者提供了极为优惠的促销价格,以吸引开发者使用该模型。在12月31日之前,每百万输入Token仅收0.75美元,每百万输出Token仅收3.75美元。这相当于在Gemini 3.6 Flash原有标准价格的基础上直接打了五折。

值得注意的是,此前一周排名第八的GLM 5.2、排名第九的DeepSeek-V4-Pro-0423跌出榜单。

本文转自:凤凰网科技

原文地址: https://tech.ifeng.com/c/8w28TYag9aH