Grok 4.6 什麼時候發布?馬斯克預告 8 月 7 日上線,參數升至 1.5 萬億

約 18 分鐘閱讀 · MACCOME · 最後更新:2026 年 7 月 30 日

適用讀者:關注 xAI/Grok 系列升級的 AI 開發者、Agent 工程師與技術選型負責人。馬斯克 7 月 28 日在 X 回覆 Vercel CEO Guillermo Rauch 時透露,xAI 將於 8 月 7 日前後發布 1.5 萬億參數的 Grok 4.6,數週後還將推出 2.1 萬億參數的 Grok 4.7——距 Grok 4.5 發布僅一個月。你將獲得:完整時間線、核心數據對比表、SFT/RL 升級拆解、與 Kimi K3 / Fable 5.1 橫向對比、爭議點標註與六步落地 Runbook。結構:痛點 → 時間線 → 數據表 → 技術拆解 → 競品矩陣 → 爭議 → 8 月發布密度 → Runbook → FAQ → 收束轉化。與Grok 4.5 深度評測Kimi K3 全面開源互補。

warning

資訊可信度提示

目前 Grok 4.6/4.7 的規格與日期唯一資訊源是馬斯克 7 月 28 日的一則 X 回覆,xAI 官方部落格與產品頁尚未同步公告。文中「1.5 萬億參數」「SFT/RL 大幅升級」等均為廠商單方面說法,未有第三方獨立評測佐證。發布前請以 xAI 官方管道核實。

六大痛點:跟進 Grok 4.6 預告時最容易踩的坑

  1. 把推文當成官方發布:馬斯克在 X 的回覆並非 xAI 正式公告,與 Grok 4.5 發布時附帶的完整模型卡、15 項基準分數截然不同——目前 4.6 零基準、零定價、零模型卡。
  2. 忽視「Musk time」彈性:特斯拉、SpaceX、xAI 的歷史時間表常有數天到數週的延後,「大約 8 月 7 日」應視為目標而非承諾。
  3. 只看參數不看後訓練:馬斯克強調 4.6 升級重點是 SFT 與 RL,而非單純堆參數——這與 Grok 4.5 憑藉 Cursor 真實開發者會話資料在 Token 效率上領先的路徑一致。
  4. 忽略 Kimi K3 的競爭壓力:K3 在 7 月 26 日全面開源後 10 天,Grok 4.6 預告即出爐;K3 已在 Frontend Code Arena 以 1679 分登頂,成為首個超越所有閉源模型的開源模型。
  5. 在筆電上硬等模型切換:若你正用 Grok 4.5 + Cursor 做 Agent 開發,本機 Gateway 的睡眠中斷、API Key 散落與網路抖動會在模型換代窗口期放大為生產事故。
  6. 錯過 8 月選型窗口:傳聞中的 Claude Fable 5.1、已開源的 Kimi K3 與 Grok 4.6/4.7 可能在同月扎堆發布,上一代旗艦的有效貨架期可能只有數週。

時間線:從 Grok 4.5 到 4.6、4.7,節奏有多快

  • 2026 年 7 月 8 日:xAI 正式發布 Grok 4.5,定位為「專為程式設計與智慧體任務打造」的旗艦模型,與 Cursor 合作、使用真實開發者會話資料訓練,支援 50 萬 token 上下文,定價為每百萬 token 輸入 $2 / 輸出 $6。
  • 2026 年 7 月 16 日:競品月之暗面的 Kimi K3 以託管服務形式上線。
  • 2026 年 7 月 26 日:Kimi K3 提前一天放出完整開源權重——2.8 萬億參數、100 萬 token 上下文,把開源模型的規模和能力推上新高度。
  • 2026 年 7 月 28 日:馬斯克在回覆 Rauch 的貼文中首次公開 Grok 4.6 和 4.7 的路線圖與大致時間表;同一天,OpenAI、Anthropic 等 1200 餘名員工聯署「Pacing the Frontier」公開信,呼籲放緩前沿 AI 發展。
  • 約 2026 年 8 月 7 日(目標):Grok 4.6 計劃發布,1.5 萬億參數,重點在 SFT 與 RL 層面的升級。
  • 約 2026 年 8 月末至 9 月初(預估):Grok 4.7 計劃跟進,2.1 萬億參數,馬斯克稱其「除了推理速度稍慢外,其他方面全面優於 4.6,且 token 效率更高」。

這意味著 xAI 在今年夏天要連續推出三款前沿模型,距離上一代 Grok 4.5 發布僅一個月。業內常將馬斯克給出的彈性時間表稱為「Musk time」——實際發布日期比預告晚幾天到兩週並不罕見。

核心數據一覽:Grok 系列與預告型號

模型發布/目標時間參數規模定位重點狀態
Grok 4.3 Beta2026-04-17未公開上一代基線已發布
Grok 4.52026-07-08未公開(非 MoE 單一 SKU)程式設計與智慧體,與 Cursor 聯合訓練已發布
Grok 4.6約 2026-08-071.5 萬億SFT/RL 大幅升級官方預告,未發布
Grok 4.7約 8 月末–9 月初2.1 萬億全面優於 4.6,token 效率更高官方預告,未發布

註:參數規模、定價、基準分數均為廠商/馬斯克自述,Grok 4.6 與 4.7 目前均未有第三方獨立評測數據,表中「官方預告」資訊務必以正式發布為準。

深度拆解:這次升級的重點不是「更大」,而是「更會學」

SFT 和 RL 到底在解決什麼問題

監督微調(SFT)是用人工標註或精選的高品質樣本去糾正模型的輸出習慣;強化學習(RL)則是用獎勵訊號讓模型在真實任務鏈路中學會「怎麼做才對」,尤其是多步驟的智慧體任務。馬斯克特意強調 Grok 4.6 的升級重點在「SFT & RL」而非參數規模本身,這與 Grok 4.5 的打法是延續的——Grok 4.5 當時憑藉與 Cursor 合作獲取的真實開發者會話資料,在保持較小輸出 token 消耗的情況下拿到了 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 的成績,處理同類任務所用的輸出 token 數量遠低於 Claude Opus 4.8(約 1.9 萬 token 對 6.7 萬 token)。

為什麼 xAI 選擇「參數堆量 + 後訓練精修」兩條腿走路

Grok 4.6 的 1.5 萬億參數相比 Grok 4.5 是明顯的規模躍升,但馬斯克沒有迴避「參數不是唯一變數」——他隨後補充說 Grok 4.7 會更大(2.1 萬億)卻「推理稍慢」,暗示 xAI 內部很清楚參數規模和推理速度之間存在權衡,未來會用兩款不同定位的模型分別滿足「更強」和「更快」的需求。

與 Kimi K3 同期競爭帶來的現實壓力

Grok 4.6 的發布時間表恰好卡在 Kimi K3 全面開源引發行業震動之後的第 10 天左右。K3 在 Frontend Code Arena 程式設計榜單上以 1679 分登頂,Artificial Analysis 智慧指數綜合排名全球第三。馬斯克本人也在 K3 相關評測下留言稱「令人印象深刻」。業內普遍解讀,xAI 加快 Grok 4.6/4.7 發布節奏,與 OpenAI、Anthropic 及中國廠商的競爭烈度上升直接相關。

橫向對比:Grok 系列 vs 同期競品

模型廠商參數規模上下文視窗定價(輸入/輸出,每百萬 token)關鍵數據來源
Grok 4.5xAI未公開50 萬 token$2 / $6xAI 官方公告
Grok 4.6(預告)xAI1.5 萬億未公開未公開馬斯克 X 貼文(未經第三方驗證)
Kimi K3月之暗面2.8 萬億(MoE,啟用約 16/896 專家)100 萬 token$0.30(快取命中)/$3 輸入,$15 輸出Moonshot 官方 + Hugging Face
Claude Fable 5.1(傳聞)Anthropic未公開未公開傳聞維持 Fable 5 定價($10/$50)36kr、WinCentral 爆料,Anthropic 未確認
GPT-5.6 SolOpenAI未公開未公開未公開OpenAI 官方公告

表格中 Grok 4.6、Claude Fable 5.1 相關數據均為預告或傳聞,不構成正式基準對比,僅供參考發布節奏和大致定位。

爭議點與需要注意的細節

  • 時間表本身未經第三方驗證:目前唯一資訊源是馬斯克在 X 上的一則回覆貼文,xAI 官方部落格和產品頁尚未同步公告。
  • 基準分數與定價全部空白:與 Grok 4.5 發布時詳細的模型卡、基準表不同,Grok 4.6 目前沒有任何獨立測評或官方模型卡佐證其能力。
  • xAI 近期的內容安全爭議:7 月 xAI 對一名使用者提起訴訟,指控其利用 Grok 繞過安全限制生成 CSAM;今年 1 月 Common Sense Media 的報告曾將 Grok 評為「未成年人保護最差的 AI 產品之一」。
  • 與行業「減速」呼籲的錯位:7 月 28 日馬斯克發布路線圖同一天,OpenAI、Anthropic 等公司 1200 餘名員工聯署「Pacing the Frontier」公開信;xAI 並未出現在簽署名單中。

影響與背景:2026 年 8 月會是「扎堆發布月」

如果馬斯克的時間表成立,Grok 4.6、Grok 4.7 將與傳聞中的 Claude Fable 5.1(據 36kr、WinCentral 等多方爆料指向 8 月)在同一個月內相繼登場,疊加 7 月已經開源的 Kimi K3 帶來的衝擊,2026 年 8 月很可能成為大模型發布密度最高的月份之一。對開發者和企業使用者而言,token 效率與真實任務成本(而非單純的參數規模或跑分)會是更實際的決策依據——參考7 月 OpenRouter 分層路由分析

六步 Runbook:Grok 4.6 發布前的準備清單

  1. 建立資訊訂閱源:關注 xAI 官方部落格(x.ai/news)、馬斯克 X 帳號與 Grok Build 控制台公告;勿將第三方轉述當作正式規格。
  2. 盤點當前 Grok 4.5 依賴:列出 Cursor、OpenClaw、自建 Gateway 中所有呼叫 grok-4.5 的端點與 fallback 鏈;記錄當前 SWE-Bench Pro / Terminal-Bench 基線分數作為換代對比參照。
  3. 預設雙 SKU 路由策略:按馬斯克暗示的 4.6(更快)/ 4.7(更強但稍慢)分工,在 OpenRouter 或自建路由層預留 model alias 切換位,避免上線當日硬改生產設定。
  4. 對比 Kimi K3 與 Fable 5.1 傳聞規格:在同等程式設計任務上跑內部評測集,用真實 token 消耗與延遲(而非 leaderboard 跑分)建立成本曲線——K3 API 快取命中價 $0.30/M 已是重要參照。
  5. 加固 Agent Gateway 執行環境:將 OpenClaw / Cursor Agent 部署到專用節點,API Key 分環境管理,設定 429/逾時自動降級至 Grok 4.5 或 Kimi K3。
  6. 設發布日監控與回滾預案:新版本上線首週設日預算上限與錯誤率告警;若 4.6 基準不及預期,保留 4.5 路由權重至少 72 小時再全量切換。
bash
# xAI API 呼叫範例(Grok 4.5 目前可用;4.6 上線後替換 model 欄位即可)
curl https://api.x.ai/v1/chat/completions \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "messages": [{"role": "user", "content": "Refactor this Python function with type hints."}],
    "max_tokens": 4096
  }'

三條應寫進技術評審的硬核數據

  • Grok 4.5 Token 效率領先:SWE-Bench Pro 任務平均輸出約 15,954 token,Claude Opus 4.8 約 67,020 token——4.2 倍效率差,歸功於 Cursor 真實會話的後訓練資料。
  • 三代模型兩個月:從 Grok 4.5(7/8)到 4.6(目標 8/7)到 4.7(目標 8 月末),xAI 計劃在約 8 週內連推三款前沿模型——業界罕見的高密度迭代節奏。
  • Kimi K3 競爭參照:Frontend Code Arena 1679 分登頂、Artificial Analysis 智慧指數全球第 3——Grok 4.6 預告出爐時,開源陣營已有可核查的第三方基準作為對照尺。

本機 Gateway 等上線不現實時:為什麼需要專用節點

在 Grok 4.6 正式發布前,多數團隊仍依賴 Grok 4.5 + Cursor 或自建 OpenClaw Gateway 做 Agent 開發。筆電合蓋睡眠會中斷長會話推理鏈路,多模型 API Key 散落在各台開發機難以統一輪換,網路抖動還會在模型換代窗口期放大為生產事故——這些問題與 Grok 本身的能力無關,卻直接決定你能否把 4.5 的 Token 效率優勢穩定轉化為業務產出。

若在本機筆電上硬等 4.6 上線再切換,上述隱性成本會隨上下文視窗拉長而放大。對於更穩定、更適合 AI Agent 自動化的生產環境,MACCOME 的 Mac 雲端主機通常是更優解——真實 macOS、SSH 交接、環境隔離,讓 Grok API 路由與 Agent Gateway 在專用實例上 7×24 穩定運行。方案與定價見Mac mini 雲端租用價格

數據來源:xAI 官方部落格《Introducing Grok 4.5》及模型卡(media.x.ai)、馬斯克 2026 年 7 月 28 日 X 貼文(回覆 @rauchg)、Moonshot AI 官方發布及 GitHub 儲存庫 moonshotai/Kimi-K3、Emergent.sh / WinCentral / 36kr 關於 Claude Fable 5.1 傳聞、The Verge / TechTimes 關於「Pacing the Frontier」公開信、Ars Technica / TechCrunch 關於 xAI 安全爭議。以上資訊截至 2026 年 7 月 30 日,Grok 4.6/4.7 相關細節均為官方預告或行業傳聞,發布前請務必以 xAI 官方管道核實。

常見問題

Grok 4.6 具體是哪天發布?

馬斯克表示「大約 8 月 7 日」,但這是非正式表態,並非 xAI 官方確認的發布日期,實際時間可能提前或延後。建議關注 xAI 官方部落格與 Grok Build 控制台。

Grok 4.6 和 Grok 4.7 有什麼區別?

Grok 4.6 為 1.5 萬億參數,重點是 SFT 與 RL 後訓練升級;Grok 4.7 為 2.1 萬億參數,預計在 4.6 發布後「幾週」跟進,馬斯克稱其能力全面優於 4.6,但推理速度略慢,token 效率更高。詳見Grok 4.5 評測中的 Token 效率分析。

Grok 4.6 會比 Kimi K3 或 Claude Fable 5.1 更強嗎?

目前無法判斷。Grok 4.6 沒有任何公開基準分數,Kimi K3 已有實測數據且在部分程式設計榜單上表現突出,Claude Fable 5.1 本身尚未被 Anthropic 官方確認發布。K3 開源細節見Kimi K3 全面開源解讀

Grok 4.6 大概會怎麼定價?

官方未公布。可參考 Grok 4.5 的定價(輸入 $2/輸出 $6,每百萬 token)作為大致區間,但新一代模型定價可能調整,務必以正式發布資訊為準。

一般使用者屆時能在哪裡用上 Grok 4.6?

按 Grok 4.5 的分發路徑推測,大概率會先上線 Grok Build、xAI 官方 API 和控制台,隨後逐步接入 Cursor 等第三方平台,但具體入口以正式發布公告為準。

如何在 Grok 4.6 發布窗口期穩定運行 Agent 棧?

建議在專用 Mac 雲端主機部署 OpenClaw / Cursor Agent Gateway,配合多模型 fallback 鏈;避免筆電睡眠中斷長會話。查看MACCOME Mac 雲端租用方案取得節點設定與定價。