(文/赖家琪 编辑/吕栋)
中国人工智能(AI)大模型正在以一种更“隐蔽”的方式出海。
它们不一定以“中国模型”的名字出现,也不一定直接向海外用户提供服务,而是被当地企业和机构拿来作为底座,经过本地语言、数据和应用场景训练后,变成本土化的小语种大模型。
近期,沙特和西班牙的两个案例,就颇具代表性。
沙特AI公司胡迈因(HUMAIN)9月3日发布了humain-m3模型。HUMAIN是由主权财富基金沙特公共投资基金(PIF)支持的、承担着推动该国AI产业发展的重要平台。
humain-m3模型据称“与沙特文化和语言完全兼容”,在7项公开的阿拉伯语AI基准测试中综合表现优于前沿模型,平均得分达到89.37%,超过了GPT-5.6 SOL和Opus 5等美国闭源大模型,仅在检索增强生成和广泛知识翻译两项测试中以小数点后一位的微弱劣势不敌。
值得一提的是,这款模型是在中国AI公司MiniMax的M3模型基础上,进一步使用超过1万亿Token的阿拉伯语内容训练出来的。
HUMAIN表示,humain-m3模型采用4280亿参数的混合专家(MoE)架构,他们重点对模型进行了阿拉伯语专项训练,强化了阿拉伯语理解与生成、本地文化适配、AI智能体、工具调用和计算机操作等能力。
HUMAIN展示台
这正是开源模型最大的优势之一——企业可以在已有底座上继续训练、部署和修改,而不必从零开始研发。
MiniMax M3是中国首个同时具备前沿Coding能力、1M超长上下文、原生多模态三项能力的大模型,于今年6月发布并开源。在最新合作中,HUMAIN基于M3的模型架构和通用能力,根据自己的需求进行专项训练,最终打造出自己的AI模型。
类似的情况也在欧洲上演。
西班牙AI公司Multiverse Computing于2日发布了支持英语和西班牙语的4380亿参数推理模型Quasar 438B。该公司称其在全球AI大模型主流性能测试平台Artificial Analysis的评测中得到了43分的高分,与其他欧洲模型相比“排名领先”。
Artificial Analysis指出,Quasar 438B的输出速度高于同类推理模型的中位水平,同时支持100万Token的上下文窗口。
但值得注意的是,该机构将这款模型标注为“Quasar 438B(max,基于GLM-5.2)”,直言这个西班牙公司开发的“欧洲最强AI模型”其实与中国AI初创公司智谱开发的GLM-5.2模型存在相似性。
Multiverse Computing之后承认,Quasar 438B实际上是压缩GLM-5.2而来。该公司称,他们利用CompactifAI技术对GLM-5.2进行压缩,并针对编程和AI智能体任务进行调优。
Multiverse Computing以模型压缩技术见长,提升AI模型运行效率是其商业模式的重要组成部分。不过,该公司目前公开发布的信息,并未详细说明Quasar 438B的具体架构、训练过程,以及其与GLM-5.2之间究竟经过了怎样的技术转换。
事实上,这样的案例早前已开始出现。日本乐天的AI 3.0日语模型,底层架构就采用的是DeepSeek V3,新加坡SEA集团推出的SEA-LION V4,其底座则来自阿里巴巴的Qwen。
从亚洲到欧洲,中国AI开放权重模型正凭借高性价比、本地部署优势和灵活的二次开发能力,以一种全新的方式走向海外市场。
过去,中国大模型靠产品、API和解决方案走出国门;而如今出现了一套新打法,中国模型提供一块搭好的“地基”,海外AI企业能在这块地基之上进行本地化,二者合力在这块地基之上盖出更适合当地市场的“房子”。
随着越来越多海外企业选择将中国开放权重模型作为“底座”,全球AI竞争格局正在重塑,中国AI模型将一步一步在海外构建起自己的影响力。