全球AI大模型呼叫量竞争格局出现新变化。在OpenRouter最新一周的呼叫量排名中,一款身份不明的模型Space Bunny Alpha(太空兔)以13.9兆Token的周呼叫量冲至全球第三,仅次于DeepSeek V4.1 Flash和智谱GLM 5.3 Flash。社群测试显示,该匿名模型的分词器特征与上海AI公司MiniMax高度吻合,真实身份引发广泛猜测。
据OpenRouter平台数据,9月21日至9月27日当周,全球AI大模型总呼叫量达146兆Token,较前一周成长13.18%。中国AI大模型合计贡献62.22兆Token的周呼叫量,尽管较前一周下滑7.77%,仍以压倒性优势超过美国的14.2兆Token。这也是中国大模型周呼叫量连续第二十二周位居全球首位。
全球呼叫量前五名中,中国模型占据三席。 DeepSeek V4.1 Flash连续两周排名第一,周呼叫量19.6兆Token,较前一周成长24%;智谱GLM 5.3 Flash以16.3兆Token紧随其后,较前一周成长16%;腾讯Hy4 preview位列第四,周呼叫量9.64兆Token,较前一周下滑23%。
引发最多讨论的则是排名第三的Space Bunny Alpha。该模型于9月23日上线OpenRouter,主打快速推理与程式开发能力,拥有100万Token上下文视窗,支援文字、图像和影片输入,并提供可调节的推理强度与工具呼叫能力。
Space Bunny的真实身份成为开发者社群热议话题。第三方分词器指纹测试显示,该模型在50个测试字串上的Token计数特征与MiniMax系列完全一致。有Reddit开发者进一步猜测,Space Bunny可能是MiniMax M3.1 Flash的预览版本。截至发稿,MiniMax官方尚未就此作出确认。
就在Space Bunny身份猜测升温之际,MiniMax于9月28日正式上线文字模型M3.1-Flash-Preview并开启公测。据该公司介绍,该模型支援原生多模态及百万上下文视窗,能够可靠完成Bug修复、完整功能开发等任务,形成从问题定位到成果交付的开发闭环。
MiniMax近期在开源领域动作频繁。此前该公司正式开源了新一代通用多模态生成模型MiniMax H3,在Artificial Analysis影片编辑评测榜及Arena图生影片排行榜中均位列全球第一,并在开源社群Hugging Face上热度一度超过DeepSeek V4 Flash,升至首位。
在财报后的电话会议中,MiniMax执行长阎俊杰透露,过去两个多月文字模型单位算力吞吐提升了3倍,M3.1的目标是把推理成本降到M3刚上线时的约三分之一。他表示,成本下降后,一部分将让利给客户以扩大Token规模,另一部分保留用于改善毛利。
阎俊杰还判断,随着模型能力和可靠性的提升,商业模式可能从按Token计费逐步转向按任务结果和专业价值计费。他预计文字业务将成为整体毛利率改善的重要驱动力,下半年毛利率继续改善,明年仍有提升空间。
榜单的另一变化来自小米。该公司于9月22日发布并开源MiMo-V2.6系列,包含Pro与Flash两个原生全模态模型。其中,Pro拥有1.02T总参数、42B启用参数,Flash为309B总参数、15B启用参数,两款模型均支援100万Token上下文,涵盖文字、图像、影片和音讯输入。 MiMo-V2.6-Flash上周以5.51兆Token的周呼叫量排名第八。
小米方面称,MiMo-V2.6-Pro在Artificial Analysis Intelligence Index中取得46分,超过Kimi K3和Qwen3.8 Max,成为当前最强的开源模型,但与Claude Fable 5.1和GPT-6 Astra等最强闭源模型相比仍有差距。定价方面,MiMo-V2.6系列沿用V2.5系列的API定价,在同等智慧水准下,价格仅为海外模型的二十分之一至六十分之一。
上周全球AI大模型呼叫量排名前五如下:
| 排名 | 模型 | 周呼叫量(兆Token) | 较前一周变化 |
|---|---|---|---|
| 1 | DeepSeek V4.1 Flash | 19.6 | 24% |
| 2 | 智谱GLM 5.3 Flash | 16.3 | 16% |
| 3 | Space Bunny Alpha | 13.9 | 新上榜 |
| 4 | 腾讯Hy4 preview | 9.64 | -23% |
| 5 | 其他模型 | — | — |
注:数据来源于OpenRouter平台,统计周期为2026年9月21日至9月27日。
前一周排名第六的小米MiMo-V2.5和排名第七的腾讯Hy3则跌出榜单,反映出AI大模型呼叫量排名的快速迭代特征。
从整体格局看,中国AI大模型在全球呼叫量上的领先优势依然稳固。尽管上周中国模型合计呼叫量较前一周有所回落,但62.22兆Token的绝对体量仍是美国模型14.2兆Token的四倍以上。这一差距的背后,既有中国模型在推理成本上的持续下降,也有开源策略带来的生态扩散效应。
Space Bunny的身份若最终被证实来自MiniMax,将进一步强化中国头部AI公司在全球呼叫量榜单中的存在感。届时,全球前四名中或将出现三款中国模型与一款匿名中国模型的格局。不过,在官方确认之前,Space Bunny的归属仍是一个悬而未决的话题。
转载请注明:拈花古佛 » 匿名模型「太空兔」冲进全球前三分词器测试指向MiniMax
