跳至主要內容
FAQ

xAI的夏日閃電戰:Grok 4.6預計8月7日發布,4.7緊隨其後,三模型夏季挑戰AI競速格局

馬斯克於7月28日宣布,xAI將於8月7日左右推出搭載大幅改進後訓練技術的1.5兆參數Grok 4.6,數週後再接著發布2.1兆參數的Grok 4.7。短短45天三款模型的驚人節奏,是xAI用速度建立護城河、正面迎戰OpenAI與Anthropic的明確宣示。

1 分鐘閱讀

一個夏天,三款模型。這是xAI對OpenAI、Anthropic和Google DeepMind三強角逐的回答——而馬斯克得出的結論是:速度本身,就是最深的護城河。

7月28日,馬斯克在X平台宣布,Grok 4.6將於8月7日前後就緒,Grok 4.7則將在「數週後」跟進。而Grok 4.5才在20天前的7月8日正式上線。如果時程如期,xAI將在短短45天內推出三款不同的Grok版本——這在前沿模型供應商中,是近年來從未有過的發布節奏。

這兩項公告發布之際,AI產業最受關注的指標正在從基準測試成績轉向部署經濟學。OpenAI上週將GPT-5.6的價格砍了最多80%;Anthropic持續壓縮Claude定價並擴展上下文視窗;Google繼續在消費和企業產品線全面鋪開Gemini。面對這一競爭格局,xAI押注的是:更快的迭代節奏,再加上透過X Premium和xAI API構築的獨家分發護城河,能否切出一塊長期可守的差異化地盤。

Grok 4.6:後訓練大升級,底層架構不變

Grok 4.6沿用與Grok 4.5相同的基礎模型架構——xAI內部的V9基礎,1.5兆參數——但在後訓練流程上施加了大幅改進的監督微調(SFT)和強化學習(RL)。

這是一個有意義的技術區別。大型語言模型的原始能力——知識儲備、推理深度、處理模糊輸入的能力——形成於預訓練階段,即在海量數據集上以極大運算成本訓練模型的過程。後訓練則是將原始能力精煉為可用行為的過程:遵循指令、與人類偏好對齊、在特定任務類型上進步、減少不需要的行為。

在維持基礎模型不變的前提下大幅改進後訓練,反映了所有前沿實驗室現在都在權衡的一個現實考量。從頭預訓練一個1.5兆參數模型費用高昂——完整訓練一輪的成本估計達數億美元——在上一個模型發布後三週就重新訓練在經濟上根本不可行。相比之下,後訓練的成本和時間都要低得多,而且能在實際使用中最重要的任務上顯著提升用戶感知的表現:指令執行、程式碼輔助、多輪推理和創意輸出。

馬斯克表示,Grok 4.6的目標是挑戰Moonshot AI的Kimi K3(約2.8兆參數的模型)和Anthropic的Claude Opus 4.8。這些說法尚未獲得獨立基準測試的確認;Grok 4.5在7月上線時,初步的第三方評估顯示其推理能力出色,但在創意寫作和多語言能力上表現參差不齊。4.6的後訓練改進是否能縮小這些差距,在8月7日發布後將很快見分曉——AI基準測試社群通常在48至72小時內就能出具評估結果。

Grok 4.7:能力更強,速度稍慢

Grok 4.7是一種不同性質的發布。4.6是在固定基礎上進行後訓練升級,而4.7代表著真正的模型規模擴大,採用2.1兆參數架構——比支撐4.5和4.6的V9基礎增加了40%。

馬斯克的表述直截了當:「除了推理速度稍慢,4.7在每個維度上都會優於4.6,且具有更好的token效率。」

他所描述的取捨——更高能力以延遲為代價——是整個前沿AI產業隨著模型規模持續擴大都在面對的問題。運行延遲敏感型應用的用戶(即時客戶服務、實時程式碼輔助、互動式角色扮演)往往傾向於選擇更小、更快的模型,即使原始能力有所折衷。而運行深度研究、複雜程式碼生成或長篇幅分析的用戶,通常認為大型模型的質量提升值得等待更長時間。

2.1兆的參數量將使Grok 4.7躋身已公開參數量前沿模型的上層——低於xAI本身瞄準的基準Kimi K3,但遠大於大多數競爭對手的產品。自2024年以來,「參數量是否直接轉化為可衡量的現實性能差異」一直是基準測試社群爭議的話題;架構效率、數據品質和後訓練方法論,都被證明與原始規模同等重要。

戰略邏輯:發布速度作為護城河

xAI的夏季三模型攻勢不只是產品決策,更折射出一種對AI競賽的戰略姿態——與競爭對手存在實質差異。

OpenAI、Anthropic和Google DeepMind都已轉向發布頻率更低、測試更充分的主要模型迭代,配合全面安全評估、分階段推出和詳細技術報告。OpenAI的GPT-5.6系列——本身已是該公司歷史節奏上的一次顯著加速——從公告到可用之間仍然準備了數個月。Anthropic的Claude發布週期也基本穩定在每季度一次主要更新、期間推出小幅改進的節奏。

xAI在做不同的事:以更快的速度發貨,代價是版本之間的評估視窗縮短。這種不同的方式究竟反映了對未發現模型行為的較低風險容忍、還是對用戶能在部署中快速識別問題的不同哲學、還是純粹出於一家後來者的追趕急迫性,是馬斯克未公開詳述的問題。

分發策略在這裡同樣重要。Grok模型僅通過X Premium(馬斯克的社交平台,即推特改名後的版本)、xAI API和xAI企業合作夥伴關係提供。這創造了一個專有分發渠道,具有明顯優勢——深度嵌入X擁有6億用戶的社交圖譜,可以存取即時貼文數據作為grounding依據——也有明確局限。不像ChatGPT可在網頁、手機、API以及數千個第三方應用整合中使用,Grok的觸及範圍受限於已在X生態或明確基於xAI API開發的場景。

競爭格局

Grok 4.6和4.7的公告,是在一個自xAI今年稍早推出Grok 4以來已大幅演變的競爭環境中發布的。2026年的夏天見證了:

  • **OpenAI的GPT-5.6「Luna」**定價削減最多80%,使前沿級API存取成本大幅降低,消除了xAI潛在的定價優勢之一
  • Anthropic的Claude Opus 4.8被廣泛認為是專業和分析用途的領先模型,客戶群集中在企業知識工作者
  • Google DeepMind的Gemini 2.5 Ultra深度整合至Google Workspace,賦予其任何獨立AI公司都難以複製的嵌入式分發優勢
  • Moonshot AI的Kimi K3證明了前沿已不再是美國獨家——中國實驗室現在在基準測試上具有真正的競爭力,且API定價更低

面對這一格局,xAI的賭注本質上是:馬斯克的個人影響力、X的獨家分發優勢、以及發布速度的差異化。xAI迄今未發布任何Grok模型的詳細安全評估報告,這招致AI安全研究人員的批評,但對其目標用戶群的採用率似乎影響甚微。

Grok 4.6將在六天後上線。基準測試會說出故事的第一段;接下來幾週的用戶留存數據,則會說出其餘的部分。

xAI Grok 馬斯克 大型語言模型 AI競賽 後訓練 基礎模型
分享

相關報導