中国的大模型在全球市场上继续保持领先地位,上海的MiniMax公司近日也推出了其新产品。9月28日,澎湃新闻报道,MiniMax发布了文本模型M3.1-Flash-Preview,现已开放公测。该模型具备原生多模态功能和百万级上下文窗口,旨在为开发者提供稳定且可靠的生产力,能够有效执行Bug修复和完整功能开发等任务。M3.1还可以帮助定位问题、实现代码和进行测试验证,处理边界情况并完善回归测试,从而形成一个从问题识别到结果交付的完整开发流程。
M3.1-Flash-Preview推出后,有开发者将其与近期火爆的匿名模型Space Bunny(或称“玉兔”)联系在一起。根据全球模型聚合平台OpenRouter的最新数据,从9月21日至27日,全球AI大模型的调用总量达到146万亿Token,同比增长13.18%。其中,中国的AI大模型周调用量为62.22万亿Token,略有下降7.77%;相比之下,美国的AI大模型周调用量为14.2万亿Token,仅下降0.07%。中国的大模型调用量已经连续22周超过美国,稳居全球第一。
上周,在全球调用量排名前五的模型中,有三款来自中国。其中,DeepSeek V4.1 Flash连续两周位居榜首,周调用量为19.6万亿Token,同比增加24%;智谱GLM 5.3 Flash紧随其后,以16.3万亿Token的周调用量增长16%;腾讯的Hy4 preview排名第四,周调用量为9.64万亿Token,环比下降23%。匿名的“玉兔”大模型在中秋节期间也名列第三,周调用量达到13.9万亿Token。
围绕Space Bunny的身份,社区内对于其Token计数特性的测试引发了热议,相关测试显示其特征与MiniMax模型类似。有开发者猜测,这个匿名模型可能是MiniMax M3.1 Flash的预览版本,但这一说法尚未得到MiniMax的官方确认。此前,MiniMax还开源了新一代通用多模态生成模型MiniMax H3,该模型在多个评测榜单上表现优异,得到了业内人士的认可。
在最近的财报会议上,MiniMax的CEO闫俊杰透露,过去两个月文本模型的单位算力吞吐量提升了三倍,M3.1的目标是将推理成本降低至初期的三分之一。随着成本的下降,部分收益将回馈给客户,部分则用于提高毛利率。目前,多模态和语音的毛利率相对较高,_text模型的收入比例在快速提升,预计文本业务将成为毛利率改善的重要因素,未来还有提升空间。同时,闫俊杰认为,随着模型技术的提高,商业模式可能会从按Token计费转向按任务结果和专业价值计费。
发表评论