跳至主要內容
FAQ

阿里巴巴發布Qwen3.8 Max:2.4兆參數大模型挑戰全球前沿AI

阿里雲在WAIC 2026上發布史上最大規模公開預覽模型——擁有2.4兆參數的Qwen3.8 Max,採用稀疏Mixture-of-Experts架構,並號稱僅次於Anthropic的Fable 5。開放權重版本預計即將推出,但目前尚未公布任何評測基準數據。

1 分鐘閱讀

當阿里雲7月19日站上世界人工智慧大會(WAIC 2026)的舞台,帶來的不是例行更新,而是一個撼動業界的發布:Qwen3.8 Max——一個採用稀疏Mixture-of-Experts(混合專家)架構、擁有2.4兆參數的多模態大模型。阿里巴巴將其定位為「有史以來在封閉前沿實驗室以外公開預覽的最強大AI系統」,並聲稱其能力僅次於Anthropic的Fable 5。

若此說法能經受獨立驗證,這將是自Meta在2024年初發布Llama 3以來,開放模型生態系統中最重大的格局轉變。這次發布也緊接在月之暗面(Moonshot AI)推出Kimi K3開放權重模型的一週之後,凸顯了中國AI競賽愈演愈烈的態勢——而這場競賽正以完全公開的方式展開,讓西方競爭者清楚地看到每一步動作。

Qwen3.8 Max是什麼?

Qwen3.8 Max是阿里巴巴首個突破1兆參數的多模態模型。稀疏MoE架構意味著在處理任何給定輸入時,僅有一部分參數被激活——這使得模型的計算效率遠高於同等規模的密集模型。此方案類似於Google在Gemini 1.5和Mistral在Mixtral系列中採用的方法,但規模遠超兩者。

模型整合了文字、圖像、影片與文件的統一多模態架構,並配備100萬token的上下文視窗,與OpenAI的GPT-5.6 Sol及Anthropic Claude Sonnet 5的上下文容量相當。

目前,Qwen3.8 Max以預覽版形式在阿里巴巴的Token Plan訂閱服務、Qoder及企業開發者門戶QoderWork上線。完整的開放權重版本已確認即將推出,但阿里尚未披露發布日期、授權類型或將涵蓋哪些模型大小。

中國AI史上最大膽的宣言

阿里巴巴在行銷材料中將Qwen3.8 Max描述為「當今最強大的模型之一,僅次於Fable 5」。Anthropic的Fable 5——即Claude頂級未發布模型的內部代號——已成為全球每個嚴肅AI實驗室的基準目標,在程式碼生成、推理及長期自主任務上樹立了當前的最高標準。

這是一個需要謹慎看待的大膽主張。截至發布之時,阿里巴巴未發布任何評測表格、模型卡或獨立評估結果。儘管其前代Qwen 2.5和Qwen 3系列在多項標準基準測試中均優於同期西方開源模型,但主張能媲美封閉前沿系統是全然不同層級的宣言。

曾獲得早期API存取權限的獨立研究人員和開發者表示,在程式碼生成和多步驟推理任務上的表現令人印象深刻,但與Fable 5的系統性對比評測尚未發布。開放權重版本的公開,將是真正的終極考驗。

戰略時機與WAIC的信號意義

選擇WAIC 2026作為發布舞台並非偶然。這個大會已逐漸成為中國在AI領域的「達沃斯」,是國家戰略雄心與商業創新公開交匯的舞台。今年,習近平主席在開幕致詞中將AI發展定性為國家戰略要務,明確呼籲中國企業在「安全、可信、可控」的AI系統上引領全球。

對阿里巴巴而言,在此時機發布全球最大的公開預覽模型有雙重意義:一方面在中國激烈競爭的AI版圖中宣示技術領導地位,另一方面向全球企業客戶表明,阿里雲在原始能力上能與西方前沿實驗室抗衡。

時機選擇也與月之暗面的Kimi K3密切相關。在Qwen3.8 Max發布前一週,擁有1280億參數的Kimi K3開放權重模型剛以「有史以來能力最強的中國開放模型」之姿問世,在開發者社群掀起波瀾。而阿里巴巴發布的模型規模幾乎是Kimi K3的十九倍,立即將討論拉升到了另一個維度。

開放權重的承諾及其深遠影響

若阿里巴巴如期發布開放權重版本,對全球AI生態系統的影響將是深遠的。一個達到前沿水準、在寬鬆授權下開放的2.4兆參數MoE模型,對開源社群而言將是空前的饋贈——同時也可能讓那些每百萬token收費15至50美元的實驗室陷入困境。

此前已有先例。阿里巴巴在2024年底發布的Qwen 2.5家族(附帶開放權重)迅速成為開發者生態中Meta模型系列以外使用最廣泛的開源模型,在東南亞、中東和歐洲的數百個微調實驗和生產部署中廣泛出現。Qwen3.8 Max的發布大概率將遵循相似軌跡——研究實驗室和AI新創公司的早期採用者將在數週內迅速投入微調,打造專用版本。

在算力需求上,以BF16精度推斷單一Qwen3.8 Max模型副本,粗估需要約4,800 GB的VRAM,這遠超個人工作站的能力,屬於大型GPU叢集的範疇。不過,若採用4-bit或8-bit的量化版本,需求量將大幅下降,也將讓中小規模運營商得以部署。

競爭格局:一場沒有終點的競賽

Qwen3.8 Max進入了一個在2026年上半年發布大型模型數量超過過去三年總和的市場。OpenAI推出了擁有百萬token上下文視窗的GPT-5.6 Sol;Google在延遲數月後終於發布Gemini 3.5 Pro;Meta的Watermelon模型據報在內部評估中達到GPT-5.5同等水準;xAI的Grok 4.5則因在前沿模型的準確性取捨上存在爭議而備受討論。

在這個背景下,中國AI生態系統——曾被視為追隨者而非引領者——已真正成為不可忽視的競爭力量。DeepSeek的V4和R2系列證明了在國產硬體上訓練的更小、更高效模型可以在特定任務上媲美甚至超越西方旗艦;Moonshot的Kimi K3展示了中國開放權重模型能夠吸引全球開發者目光;而現在,Qwen3.8 Max正將戰線推進到任何開源實驗室從未踏足的領域。

目前最關鍵的保留意見,依然是缺乏獨立基準測試。在外部研究者能夠跨標準測試集(MMLU、HumanEval、MATH、GPQA及自主任務套件)進行系統性評估之前,阿里巴巴的前沿主張應視為目標而非既定事實。開放權重發布將提供最清晰的裁決,而開發者社群的評判速度向來迅速。

可以確定的是,大模型競賽的重心已然移動。北京的AI實驗室不再是從後方追趕前沿——它們正在正面競爭,爭奪這個前沿本身。

阿里巴巴 Qwen 大型語言模型 開放權重 混合專家模型 多模態AI WAIC 2026
分享

相關報導

習近平首次出席世界人工智慧大會 北京藉WAIC爭奪全球AI治理主導權

中國國家主席習近平將於7月17日在上海世界人工智慧大會(WAIC)發表主題演講,此為其首次親身出席該年度峰會。北京此舉被視為正式宣示爭奪全球AI治理主導地位的意圖,同期有逾300項產品全球首發,包括搭載8192顆昇騰NPU的華為Atlas 950運算叢集,以及全球首款AI Agent智慧型手機。

1 分鐘閱讀