沙特主权 AI,基于 MiniMax
赛博禅心 · 人工智能
原创 金色传说大聪明 2026-09-04 23:18 北京 主权大模型 OEM 主权大模型OEM 沙特国家 AI 公司 HUMAIN 发布了主权大模型 HUMAIN M3,在七项 阿拉伯语 benchmark 上平均分第一,超过 GPT-5.6 SOL 和 Opus 5 当然,并不是说这个模型的编程水平超过了,而是这个模型背后有许多本土化的训练预料,因此在文化、语言、信仰等方面,超过了这些 OpenAI 与 Anthropic 的模型 于是就有了... 本文由此展开 底座是 MiniMax M3 首先得说一下, HUMAIN 很诚实的,直接说了:commissioned by HUMAIN and delivered by MiniMax MiniMax M3 是今年 6 月发布的模型,428B 总参数、23B active/token 的 MoE 架构,1M context,原生多模态&开源: 我们开源了 MiniMax M3 而 HUMAIN 对这个模型进行了后训练,加训了超过 1 万亿阿拉伯语 token ,加入 Saudi-specific 的 alignment 和 guardrail,搭在自己的 HUMAIN Node 平台上,支持 In-Kingdom sovereign hosting。因此, HUMAIN M3 在阿拉伯语的 bench 下有了大幅提升 但话说回来,这事儿也大概确实好像也就是他们官方能搞...要知道在互联网上,阿拉伯语的内容并不多,这里的数据采集尤其是宗教、教育等信息的文化对齐,好想也只有他们自己的官方有数据 还有另外的...这个事似乎也只能是基于开源模型🤔 主权的分层 其实看到这个新闻的时候,我是想到个问题「主权大模型,用开源模型进行后训练」这事儿,符合周礼么? 然后我去翻了他们具体的说法,刚巧的是他们 CEO 在 Linkedin 上发了篇内容,这里截取了一段 大概是说 HUMAIN 不想把未来押在一个模型上,明确是 model-agnostic,起真正目标是 Data centers → Compute → Cloud → Models → Platforms → Applications → Sector solutions 这整个 stack,而在内的东西,都是可以替换的 HUMAIN 也确实是在按这个 stack 花钱。去年美国商务部批准它购买相当于最多 3.5 万张 Nvidia GB300 的芯片;今年 8 月底,它又在 NEOM Oxagon 推进首期约 100MW 的 AI 数据中心 恰好我又找到了 The Information 的一个报道(并且为此支付了 $39 进行阅读),里面大致表达了这么个意思: 美国和中国主导先进 AI 研发,其他国家往往 have little choice but to depend on American or Chinese foundational models the difficulties most countries face when they try to develop sovereign AI systems using homegrown technologies 当大多数国家尝试用本国技术开发主权 AI 系统时,面临的现实困难 有趣的是,OpenAI 今年做模型本地化时,也表示只有少数国家有条件自行开发 frontier model。对更多国家,工作其实是把现有最强的 AI 重新适配到自己的语言、法律和文化里。 于是对于主权 AI 来说,就走上了这么一条路线: 主权方把控数据、训练方向、对齐、评测标准、算力、部署、治理,但然后其他部分,比如基模来自外部 开源的另一面 我一直觉得,开源是中国 AI 在地缘博弈里打出的一张奇牌 一方面,我们可以变相的利用 token 作为承载物,去以更低成本运送&销售电力 另一方面,我们可以膈应着美国,让他们眼看着更多实验室拿着中国的模型做后训练,然后还失去了道德的高点 然后还有一个,就是我觉得: 美国的出口管制,也在中国开源模型做推广 你看, 限制英伟达出口,就导致很多国家的 AI 基础设施建设受阻;限制模型输出,就让这些国家导向开源 尤其在主权模型这一块,虽然 OpenAI 是提供定制的后训练服务的,但他们的模型仍然不会给你所有的权重,你也无法有效的改变它的 alignment,让它完全符合沙特的文化语境和监管要求。一旦 OpenAI 调整政策,或者美国出台新的数据政策,可能就G了 而对于开源模型,就可以无视这些地缘政治风险影响,只要下载下来、就能自己训练、部署,按自己的节奏去推进。能管得了芯片贸易,还能管得了模型下载么? 于是,出口管制越严,想做主权模型的国家就越需要一个能本地部