![]()
最近海外科技圈炸开了一桩有意思的新闻。沙特高调发布号称100%本土血统的国家级大模型HUMAINM3,官宣之后全网一片欢呼,可没过几个小时就被网友扒出,这套备受期待的主权AI,底层底座来自中国企业MiniMax。
![]()
![]()
这不是小作坊的简单套壳,是手握千亿资金的沙特公共投资基金,认认真真把中国大模型当成本国AI产业的技术基石。这件事的意义,远远超出一次普通商业合作,标志中国大模型出海,已经走到全新的阶段。
![]()
一、一场热闹的发布,揭开底层真相
当地时间9月3日,沙特HUMAIN公司正式对外发布HUMAINM3大模型。这家公司来头不小,隶属于沙特公共投资基金PIF,沙特王储亲自出任董事长,肩负着沙特“2030愿景”当中AI转型的重任证券时报。
发布初期,不少沙特博主在社交平台X上大肆宣传,称这是完完全全沙特自研的大模型,适配阿拉伯本土文化,部署在本国服务器,未来还会开放权重,要撑起整个阿拉伯世界的AI发展,当地网友情绪高涨,评论区满是自豪感。
但发布热度还没维持一夜,海外AI圈的研究员就看出了破绽。4280亿总参数,230亿激活参数的混合专家架构,这套参数配置,和国内MiniMaxM3模型高度重合。很快就有网友在评论区直接提出质疑,舆论瞬间反转。
面对铺天盖地的疑问,项目相关人员只能出面回应,承认HUMAINM3底层依托MiniMaxM3搭建。后续官方新闻稿也直接写明,HUMAIN和MiniMax本就是战略合作伙伴,项目属于委托开发,并不是民间偷偷套壳的产物。
![]()
![]()
![]()
简单来说,沙特拿出真金白银,采购中国的基础模型底座,再由自己团队完成本土化改造。一个主权国家的国家级AI门面,内核是实打实的中国技术。
二、一万亿阿拉伯语Token,做真正懂本土的大模型
很多人第一眼看到消息,会下意识觉得,这不就是换皮套壳吗?如果这么理解,其实低估了沙特这边做的大量工作。
阿拉伯语本身就是世界上难度很高的语种。文字从右向左书写,字母形态会随位置发生变化,同时方言体系十分庞杂,海湾方言、埃及方言、黎凡特方言,互相之间差异巨大。互联网上面高质量阿拉伯语的文本素材本就稀缺。
![]()
![]()
直接拿来欧美的顶尖大模型处理阿拉伯语,翻译出来的内容常常生硬,充满机翻感,很难理解当地俚语、宗教习俗和社会思维习惯。
拿到MiniMaxM3底座之后,沙特团队投入海量资源,灌入超过1万亿Token纯正阿拉伯语语料做后训练,不光补齐语言能力,还把本地风俗、历史文化、日常表达全部融入模型当中。
最终的评测结果也很有说服力。在七项阿拉伯语专项基准测试当中,HUMAINM3拿下五项第一,平均得分89.37%,在阿拉伯语赛道的表现,超过GPT‑5.6Sol、ClaudeOpus5这些全球公认的顶尖闭源模型,对比原始底座,阿拉伯语能力直接提升9个百分点。
![]()
它还是原生多模态模型,支持图文、长视频理解,还能够直接操作电脑屏幕,面向未来智能体的工作流设计,不是一个只会简单对话的普通大模型。底座来自中国,但面向阿拉伯世界的理解,是沙特自己打磨出来的。
三、中国AI出海,不再只卖接口和App
过去国内AI产品出海,大多是两条路,要么把做好的APP放到海外市场买量推广,要么对外售卖API调用接口,海外开发者按次付费使用。
这种模式固然可以快速赚钱,但主动权握在别人手里。一旦合作终止,政策变动,业务随时就会被切断。
而这次MiniMax和沙特的合作,走出另一条路:输出基础模型底座,让海外国家在自己的机房,基于这套底座,搭建属于本国的整套AI体系。这就好比早年华为出海,不只是卖手机终端,而是帮各国搭建通信基站,铺设网络基础设施,输出底层能力,而不是只输出终端消费品。
HUMAIN后续会搭建HUMAINNode平台,作为沙特国家级AI基础设施,面向本土企业、科研人员、开发者开放。未来沙特的政务系统、医疗AI、自动驾驶相关应用,很多都跑在这套基于中国底座衍生出来的模型之上。
换句话说,中国大模型第一次真正进入全球主权AI的核心圈层。不只是输出服务,而是输出AI时代的“水电煤”底层基建。
四、为什么沙特一定要拥有自己的主权大模型
在AI时代,数据就等同于石油,模型就相当于炼油厂。对于沙特这样一心想要摆脱石油依赖,全力推进数字化转型的国家,绝对不愿意把政务、金融、医疗这些核心数据,全部上传到海外企业的服务器当中。
如果全部依赖美国大厂闭源模型,一旦遇到制裁、政策变动,一纸禁令,整个国家的AI生态就会直接瘫痪。这也是全球大量非英语国家共同的焦虑,“主权AI”已经变成很多国家的刚需。
主权AI的核心诉求很明确:模型可以部署在本国服务器,尊重本土文化价值观,核心能力自主可控。
美国巨头的闭源产品,很难满足这种诉求。而中国开源大模型恰好补上这个缺口。HuggingFace的数据显示,过去一年,中国研发大模型在平台下载占比达到41%,已经历史性超过美国模型的下载量。
![]()
硅谷巨头追求打造一套一统全球的超级大模型。而中国开源模型走了另外一条路径:提供强悍的基础底座,交给各个国家,结合本土语言、文化、数据,孵化属于自己的AI。
想要做好这件事,底座本身硬实力必须过硬,如果基座能力不足,再多本地数据的二次训练,也很难实现性能突破。HUMAINM3在阿拉伯语赛道实现对海外大厂的反超,也实实在在印证了这套“强底座加本地深度调优”模式的可行性。
五、从追随者,变成“造船人”
回望过去几十年科技发展历程,很长一段时间我们都处在跟随者的位置。PC时代,底层操作系统是Windows,我们做上层软件;移动互联网时代,底层是iOS和安卓,我们开发各类APP。哪怕国内互联网产业高速发展,很多时候,依然活在别人制定好的底层规则之下。
现在AI浪潮到来,局面正在发生改变。MiniMax、通义千问、DeepSeek、智谱GLM等一批国产大模型,开始成为海外国家搭建本土AI的备选底座。
沙特的千亿级AI计划,瞄准的是本国经济转型,他们有钱、有算力,也有海量阿拉伯语本土数据,但是缺少顶尖的基础模型架构和工程经验。中国拥有成熟的开源底座,双方刚好形成双向奔赴。
这也和国内提出的支持全球人工智能能力建设,面向阿盟打造AI合作中心的方向相互呼应。技术跨越山海,两种古老文明,在AI时代完成一场技术合作。
阿拉伯语有数亿使用者,放眼全球,还有印地语、西班牙语、斯瓦希里语等大量语种的市场等待开发。未来会有越来越多国家,选用中国开源底座,再结合自身资源,打造本土AI。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.