Grok 4.6什么时候发布?马斯克预告8月7日上线,参数升至1.5万亿

约 18 分钟阅读 · MACCOME · 最后更新:2026 年 7 月 30 日

适用读者:关注 xAI/Grok 系列升级的 AI 开发者、Agent 工程师与技术选型负责人。🚀 马斯克 7 月 28 日在 X 回复 Vercel CEO Guillermo Rauch 时透露,xAI 将于 8 月 7 日前后发布 1.5 万亿参数的 Grok 4.6,数周后还将推出 2.1 万亿参数的 Grok 4.7——距 Grok 4.5 发布仅一个月。你将获得:完整时间线、核心数据对比表、SFT/RL 升级拆解、与 Kimi K3 / Fable 5.1 横向对比、争议点标注与六步落地 Runbook。结构:痛点 → 时间线 → 数据表 → 技术拆解 → 竞品矩阵 → 争议 → 8 月发布密度 → Runbook → FAQ → 收束转化。与Grok 4.5 深度评测Kimi K3 全面开源互补。

warning

信息可信度提示

目前 Grok 4.6/4.7 的规格与日期唯一信息源是马斯克 7 月 28 日的一条 X 回复,xAI 官方博客与产品页尚未同步公告。文中「1.5 万亿参数」「SFT/RL 大幅升级」等均为厂商单方面说法,未有第三方独立评测佐证。发布前请以 xAI 官方渠道核实。

六大痛点:跟进 Grok 4.6 预告时最容易踩的坑

  1. 把推文当成官方发布:马斯克在 X 的回复并非 xAI 正式公告,与 Grok 4.5 发布时附带的完整模型卡、15 项基准分数截然不同——目前 4.6 零基准、零定价、零模型卡。
  2. 忽视「Musk time」弹性:特斯拉、SpaceX、xAI 的历史时间表常有数天到数周的延后,「大约 8 月 7 日」应视为目标而非承诺。
  3. 只看参数不看后训练:马斯克强调 4.6 升级重点是 SFT 与 RL,而非单纯堆参数——这与 Grok 4.5 凭借 Cursor 真实开发者会话数据在 Token 效率上领先的路径一致。
  4. 忽略 Kimi K3 的竞争压力:K3 在 7 月 26 日全面开源后 10 天,Grok 4.6 预告即出炉;K3 已在 Frontend Code Arena 以 1679 分登顶,成为首个超越所有闭源模型的开源模型。
  5. 在笔记本上硬等模型切换:若你正用 Grok 4.5 + Cursor 做 Agent 开发,本地 Gateway 的睡眠中断、API Key 散落与网络抖动会在模型换代窗口期放大为生产事故。
  6. 错过 8 月选型窗口:传闻中的 Claude Fable 5.1、已开源的 Kimi K3 与 Grok 4.6/4.7 可能在同月扎堆发布,上一代旗舰的有效货架期可能只有数周。

时间线:从 Grok 4.5 到 4.6、4.7,节奏有多快

  • 2026 年 7 月 8 日:xAI 正式发布 Grok 4.5,定位为「专为编程与智能体任务打造」的旗舰模型,与 Cursor 合作、使用真实开发者会话数据训练,支持 50 万 token 上下文,定价为每百万 token 输入 $2 / 输出 $6。
  • 2026 年 7 月 16 日:竞品 Moonshot AI(月之暗面)的 Kimi K3 以托管服务形式上线。
  • 2026 年 7 月 26 日:Kimi K3 提前一天放出完整开源权重——2.8 万亿参数、100 万 token 上下文,把开源模型的规模和能力推上新高度。
  • 2026 年 7 月 28 日:马斯克在回复 Rauch 的帖子中首次公开 Grok 4.6 和 4.7 的路线图与大致时间表;同一天,OpenAI、Anthropic 等 1200 余名员工联署「Pacing the Frontier」公开信,呼吁放缓前沿 AI 发展。
  • 约 2026 年 8 月 7 日(目标):Grok 4.6 计划发布,1.5 万亿参数,重点在 SFT 与 RL 层面的升级。
  • 约 2026 年 8 月末至 9 月初(预估):Grok 4.7 计划跟进,2.1 万亿参数,马斯克称其「除了推理速度稍慢外,其他方面全面优于 4.6,且 token 效率更高」。

这意味着 xAI 在今年夏天要连续推出三款前沿模型,距离上一代 Grok 4.5 发布仅一个月。业内常将马斯克给出的弹性时间表称为「Musk time」——实际发布日期比预告晚几天到两周并不罕见。

核心数据一览:Grok 系列与预告型号

模型发布/目标时间参数规模定位重点状态
Grok 4.3 Beta2026-04-17未公开上一代基线已发布
Grok 4.52026-07-08未公开(非 MoE 单一 SKU)编程与智能体,与 Cursor 联合训练已发布
Grok 4.6约 2026-08-071.5 万亿SFT/RL 大幅升级官方预告,未发布
Grok 4.7约 8 月末–9 月初2.1 万亿全面优于 4.6,token 效率更高官方预告,未发布

注:参数规模、定价、基准分数均为厂商/马斯克自述,Grok 4.6 与 4.7 目前均未有第三方独立评测数据,表中「官方预告」信息务必以正式发布为准。

深度拆解:这次升级的重点不是「更大」,而是「更会学」

SFT 和 RL 到底在解决什么问题

监督微调(SFT)是用人工标注或精选的高质量样本去纠正模型的输出习惯;强化学习(RL)则是用奖励信号让模型在真实任务链路中学会「怎么做才对」,尤其是多步骤的智能体任务。马斯克特意强调 Grok 4.6 的升级重点在「SFT & RL」而非参数规模本身,这与 Grok 4.5 的打法是延续的——Grok 4.5 当时凭借与 Cursor 合作获取的真实开发者会话数据,在保持较小输出 token 消耗的情况下拿到了 Terminal-Bench 2.1 83.3%、SWE-Bench Pro 64.7% 的成绩,处理同类任务所用的输出 token 数量远低于 Claude Opus 4.8(约 1.9 万 token 对 6.7 万 token)。

为什么 xAI 选择「参数堆量 + 后训练精修」两条腿走路

Grok 4.6 的 1.5 万亿参数相比 Grok 4.5 是明显的规模跃升,但马斯克没有回避「参数不是唯一变量」——他随后补充说 Grok 4.7 会更大(2.1 万亿)却「推理稍慢」,暗示 xAI 内部很清楚参数规模和推理速度之间存在权衡,未来会用两款不同定位的模型分别满足「更强」和「更快」的需求。

与 Kimi K3 同期竞争带来的现实压力

Grok 4.6 的发布时间表恰好卡在 Kimi K3 全面开源引发行业震动之后的第 10 天左右。K3 在 Frontend Code Arena 编程榜单上以 1679 分登顶,Artificial Analysis 智能指数综合排名全球第三。马斯克本人也在 K3 相关评测下留言称「令人印象深刻」。业内普遍解读,xAI 加快 Grok 4.6/4.7 发布节奏,与 OpenAI、Anthropic 及中国厂商的竞争烈度上升直接相关。

横向对比:Grok 系列 vs 同期竞品

模型厂商参数规模上下文窗口定价(输入/输出,每百万 token)关键数据来源
Grok 4.5xAI未公开50 万 token$2 / $6xAI 官方公告
Grok 4.6(预告)xAI1.5 万亿未公开未公开马斯克 X 帖子(未经第三方验证)
Kimi K3月之暗面2.8 万亿(MoE,激活约 16/896 专家)100 万 token$0.30(缓存命中)/$3 输入,$15 输出Moonshot 官方 + Hugging Face
Claude Fable 5.1(传闻)Anthropic未公开未公开传闻维持 Fable 5 定价($10/$50)36kr、WinCentral 爆料,Anthropic 未确认
GPT-5.6 SolOpenAI未公开未公开未公开OpenAI 官方公告

表格中 Grok 4.6、Claude Fable 5.1 相关数据均为预告或传闻,不构成正式基准对比,仅供参考发布节奏和大致定位。

争议点与需要注意的细节

  • 时间表本身未经第三方验证:目前唯一信息源是马斯克在 X 上的一条回复贴,xAI 官方博客和产品页尚未同步公告。
  • 基准分数与定价全部空白:与 Grok 4.5 发布时详细的模型卡、基准表不同,Grok 4.6 目前没有任何独立测评或官方模型卡佐证其能力。
  • xAI 近期的内容安全争议:7 月 xAI 对一名用户提起诉讼,指控其利用 Grok 绕过安全限制生成 CSAM;今年 1 月 Common Sense Media 的报告曾将 Grok 评为「未成年人保护最差的 AI 产品之一」。
  • 与行业「减速」呼吁的错位:7 月 28 日马斯克发布路线图同一天,OpenAI、Anthropic 等公司 1200 余名员工联署「Pacing the Frontier」公开信;xAI 并未出现在签署名单中。

影响与背景:2026 年 8 月会是「扎堆发布月」

如果马斯克的时间表成立,Grok 4.6、Grok 4.7 将与传闻中的 Claude Fable 5.1(据 36kr、WinCentral 等多方爆料指向 8 月)在同一个月内相继登场,叠加 7 月已经开源的 Kimi K3 带来的冲击,2026 年 8 月很可能成为大模型发布密度最高的月份之一。对开发者和企业用户而言,token 效率与真实任务成本(而非单纯的参数规模或跑分)会是更实际的决策依据——参考7 月 OpenRouter 分层路由分析

六步 Runbook:Grok 4.6 发布前的准备清单

  1. 建立信息订阅源:关注 xAI 官方博客(x.ai/news)、马斯克 X 账号与 Grok Build 控制台公告;勿将第三方转述当作正式规格。
  2. 盘点当前 Grok 4.5 依赖:列出 Cursor、OpenClaw、自建 Gateway 中所有调用 grok-4.5 的端点与 fallback 链;记录当前 SWE-Bench Pro / Terminal-Bench 基线分数作为换代对比参照。
  3. 预设双 SKU 路由策略:按马斯克暗示的 4.6(更快)/ 4.7(更强但稍慢)分工,在 OpenRouter 或自建路由层预留 model alias 切换位,避免上线当日硬改生产配置。
  4. 对比 Kimi K3 与 Fable 5.1 传闻规格:在同等编程任务上跑内部评测集,用真实 token 消耗与延迟(而非 leaderboard 跑分)建立成本曲线——K3 API 缓存命中价 $0.30/M 已是重要参照。
  5. 加固 Agent Gateway 运行环境:将 OpenClaw / Cursor Agent 部署到专用节点,API Key 分环境管理,配置 429/超时自动降级至 Grok 4.5 或 Kimi K3。
  6. 设发布日监控与回滚预案:新版本上线首周设日预算上限与错误率告警;若 4.6 基准不及预期,保留 4.5 路由权重至少 72 小时再全量切换。
bash
# xAI API 调用示例(Grok 4.5 当前可用;4.6 上线后替换 model 字段即可)
curl https://api.x.ai/v1/chat/completions \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "messages": [{"role": "user", "content": "Refactor this Python function with type hints."}],
    "max_tokens": 4096
  }'

三条应写进技术评审的硬核数据

  • Grok 4.5 Token 效率领先:SWE-Bench Pro 任务平均输出约 15,954 token,Claude Opus 4.8 约 67,020 token——4.2 倍效率差,归功于 Cursor 真实会话的后训练数据。
  • 三代模型两个月:从 Grok 4.5(7/8)到 4.6(目标 8/7)到 4.7(目标 8 月末),xAI 计划在约 8 周内连推三款前沿模型——行业罕见的高密度迭代节奏。
  • Kimi K3 竞争参照:Frontend Code Arena 1679 分登顶、Artificial Analysis 智能指数全球第 3——Grok 4.6 预告出炉时,开源阵营已有可核查的第三方基准作为对照尺。

本地 Gateway 等上线不现实时:为什么需要专用节点

在 Grok 4.6 正式发布前,多数团队仍依赖 Grok 4.5 + Cursor 或自建 OpenClaw Gateway 做 Agent 开发。笔记本合盖睡眠会中断长会话推理链路,多模型 API Key 散落在各台开发机难以统一轮换,网络抖动还会在模型换代窗口期放大为生产事故——这些问题与 Grok 本身的能力无关,却直接决定你能否把 4.5 的 Token 效率优势稳定转化为业务产出。

若在本地笔记本上硬等 4.6 上线再切换,上述隐性成本会随上下文窗口拉长而放大。对于更稳定、更适合 AI Agent 自动化的生产环境,MACCOME 的 Mac 云主机通常是更优解——真实 macOS、SSH 交接、环境隔离,让 Grok API 路由与 Agent Gateway 在专用实例上 7×24 稳定运行。方案与定价见Mac mini 云租用价格

数据来源:xAI 官方博客《Introducing Grok 4.5》及模型卡(media.x.ai)、马斯克 2026 年 7 月 28 日 X 帖子(回复 @rauchg)、Moonshot AI 官方发布及 GitHub 仓库 moonshotai/Kimi-K3、Emergent.sh / WinCentral / 36kr 关于 Claude Fable 5.1 传闻、The Verge / TechTimes 关于「Pacing the Frontier」公开信、Ars Technica / TechCrunch 关于 xAI 安全争议。以上信息截至 2026 年 7 月 30 日,Grok 4.6/4.7 相关细节均为官方预告或行业传闻,发布前请务必以 xAI 官方渠道核实。

常见问题

Grok 4.6 具体是哪天发布?

马斯克表示「大约 8 月 7 日」,但这是非正式表态,并非 xAI 官方确认的发布日期,实际时间可能提前或延后。建议关注 xAI 官方博客与 Grok Build 控制台。

Grok 4.6 和 Grok 4.7 有什么区别?

Grok 4.6 为 1.5 万亿参数,重点是 SFT 与 RL 后训练升级;Grok 4.7 为 2.1 万亿参数,预计在 4.6 发布后「几周」跟进,马斯克称其能力全面优于 4.6,但推理速度略慢,token 效率更高。详见Grok 4.5 评测中的 Token 效率分析。

Grok 4.6 会比 Kimi K3 或 Claude Fable 5.1 更强吗?

目前无法判断。Grok 4.6 没有任何公开基准分数,Kimi K3 已有实测数据且在部分编程榜单上表现突出,Claude Fable 5.1 本身尚未被 Anthropic 官方确认发布。K3 开源细节见Kimi K3 全面开源解读

Grok 4.6 大概会怎么定价?

官方未公布。可参考 Grok 4.5 的定价(输入 $2/输出 $6,每百万 token)作为大致区间,但新一代模型定价可能调整,务必以正式发布信息为准。

普通用户届时能在哪里用上 Grok 4.6?

按 Grok 4.5 的分发路径推测,大概率会先上线 Grok Build、xAI 官方 API 和控制台,随后逐步接入 Cursor 等第三方平台,但具体入口以正式发布公告为准。

如何在 Grok 4.6 发布窗口期稳定运行 Agent 栈?

推荐在专用 Mac 云主机部署 OpenClaw / Cursor Agent Gateway,配合多模型 fallback 链;避免笔记本睡眠中断长会话。查看MACCOME Mac 云租用方案获取节点配置与定价。