沙烏地HUMAIN推出4280億參數阿拉伯語模型
沙烏地公司HUMAIN背靠主權基金PIF,推出與中國MiniMax合作開發的4280億參數阿拉伯語模型humain-m3,號稱在七項公開阿拉伯語基準測試中平均得分最高。

根據PR Newswire發布的公司新聞稿,沙烏地主權基金公共投資基金(PIF)旗下的人工智慧公司HUMAIN,於9月3日在利雅德舉行的LEAP科技大會上,發表了一款名為humain-m3的新一代阿拉伯語前沿模型。該模型由HUMAIN委託中國人工智慧實驗室MiniMax開發,是一個基於MiniMax-M3架構打造的4280億參數混合專家系統,並額外以超過一兆個原生阿拉伯語詞元進行預訓練。根據人工智慧新聞網站Unite.AI的詳細報導,該模型於同一天以研究預覽版形式在HUMAIN Node上線,這是HUMAIN面向開發者、研究人員與企業的平台;Unite.AI檢視了HUMAIN在其模型頁面上公布的基準測試結果。
根據HUMAIN在其Node模型頁面公布、並經Unite.AI轉載的數據,humain-m3預覽版在七項公開阿拉伯語基準測試中平均得分89.37%,高於GPT-5.6 SOL的87.30%與Anthropic Opus 5的87.34%,比其所基於的MiniMax-M3參考模型高出九個百分點。據稱,該模型在HUMAIN測試過的最強系統中,於七項基準裡的五項領先,其中在綜合知識測試ArabicMMLU上得分90.70%,在事實可靠度基準AraTrust上得分97.53%。HUMAIN表示,這些比較反映的是其自身對預覽版模型的內部評測;相關分數尚未提交至獨立運作的Open Arabic LLM Leaderboard排行榜,因此目前尚無外部驗證。
建立在中國技術基礎之上的阿拉伯語模型
該模型的架構揭示了這個地區已浮現的一種策略:在中國實驗室釋出的開放權重基礎上打造自主的人工智慧產品,而非從零開始或完全仰賴美國的技術授權。總部位於上海的MiniMax實驗室開發了底層的M3架構,據其自述,服務全球超過3億名使用者以及200萬家企業與開發者。HUMAIN將這項計畫定位為在「強化阿拉伯語人工智慧生態系的同時,為全球前沿智慧的發展做出貢獻」,其執行長塔里克·阿明(Tareq Amin)在新聞稿中表示:「阿拉伯語的使用人口多達數億,但在人工智慧的前沿領域仍明顯代表性不足。」
Unite.AI檢視HUMAIN Node文件後指出,humain-m3是一個原生多模態系統,自訓練之初便同時使用文字、影像與影片進行聯合訓練,在4280億參數中,每個詞元會啟用230億參數,並提供三種「思考」模式——常開、自適應與關閉。HUMAIN表示,該系統專為長週期代理工作流程而設計,涵蓋前沿工具使用與電腦操作任務,這項設計目標呼應了業界正邁向能規劃並執行多步驟任務、而非僅回答單一提問的代理式系統的更大趨勢。
- 模型規模:4280億參數,每個詞元啟用230億參數(混合專家架構)
- 訓練資料:在MiniMax-M3基礎上新增超過1兆個原生阿拉伯語詞元
- 7項公開阿拉伯語基準測試平均分:89.37%,對比GPT-5.6 SOL的87.30%與Opus 5的87.34%
- 取得方式:9月3日起透過HUMAIN Node提供研究預覽版;開放權重計劃於次月依MiniMax社群授權條款釋出
這對沙烏地本國市場之外意味著什麼
HUMAIN由PIF於2025年成立,作為沙烏地國家級人工智慧旗艦企業,先前已開發出ALLaM系列阿拉伯語模型,並與微軟、輝達、AMD、高通及Groq建立合作關係,據其表示目前已有超過100家模型供應商進駐HUMAIN Node。將humain-m3與西方前沿系統並列比較,而非僅與區域性的阿拉伯語工具相比,顯示HUMAIN的企圖心已超出波灣地區:一款在阿拉伯語任務上超越GPT-5.6 SOL與Opus 5的模型,對任何在黎凡特、北非或阿拉伯語僑民社群中打造阿拉伯語客服、教育或政府服務的企業而言都具有意義——在這個市場中,西方的通用模型向來在方言與文化細微差異上表現較弱。這也為世界其他地區正在權衡的人工智慧團隊提供了一個具體而非假設性的範例:究竟是要在中國開放權重基礎上打造本國語言產品,還是等待一個西方的對等方案。



