Grok 4.6 Release-Datum: Ist Musks 7.-August-Ziel realistisch?

Ca. 18 Min. Lesezeit · MACCOME · Zuletzt aktualisiert: 30. Juli 2026

Zielgruppe: AI-Entwickler, Agent-Engineers und Tech-Leads mit xAI/Grok im Stack. Kernereignis (28.07.2026): Musk antwortete Vercel-CEO Guillermo Rauch auf X: Grok 4.6 mit 1,5T Parametern und SFT/RL-Upgrade ca. 7. August, Grok 4.7 mit 2,1T Wochen spaeter — nur einen Monat nach Grok 4.5. Sie erhalten: Timeline, zwei Vergleichstabellen, SFT/RL-Mechanik, Wettbewerbsmatrix (Kimi K3, Fable 5.1), Kontroversen, 6-Schritte-Runbook und drei Review-Zahlen. Ergaenzt Grok-4.5-Review und Kimi-K3-Vollfreigabe.

warning

Verifizierungsstatus

Spezifikationen und Termine fuer Grok 4.6/4.7 stammen ausschliesslich aus Musks X-Antwort vom 28.07. xAI-Blog und Produktseite haben nichts bestaetigt. Keine Dritt-Benchmarks, keine Preise, kein Model Card. Vor Produktionsentscheidungen offizielle xAI-Kanaele pruefen.

Sechs Fehlannahmen beim Grok-4.6-Tracking

  1. X-Post als Release-Note behandeln: Grok 4.5 lieferte Model Card und 15 Benchmarks; 4.6 hat null oeffentliche Metriken.
  2. Musk time ignorieren: Tesla, SpaceX und xAI verschieben Termine regelmaessig um Tage bis Wochen — „ca. 7. August“ ist ein Ziel, kein SLA.
  3. Nur Parameter zaehlen: Musk betont SFT/RL, nicht reine Skalierung — analog zu Grok 4.5 mit Cursor-Entwicklersessions und hoher Token-Effizienz.
  4. Kimi-K3-Druck unterschaetzen: K3-Vollfreigabe (26.07.) mit Frontend Code Arena 1679 Punkten; Grok-4.6-Ankuendigung folgte ~10 Tage spaeter.
  5. Laptop-Gateway in der Migrationsphase: Sleep, verstreute API-Keys und Netz-Jitter vergroessern Ausfallrisiken beim Modellwechsel — unabhaengig von Grok-Qualitaet.
  6. August-Fenster verpassen: Fable 5.1 (Geruecht), K3 (live) und Grok 4.6/4.7 koennten die Shelf-Life des aktuellen Flaggschiffs auf Wochen druecken.

Timeline: Von Grok 4.5 zu 4.6 und 4.7

  • 08.07.2026: Grok 4.5 — Coding/Agent-Fokus, Cursor-Kooperation, 500K Kontext, 2 / 6 USD pro 1M Input/Output.
  • 16.07.2026: Kimi K3 als Managed API.
  • 26.07.2026: K3 Open Weights — 2,8T, 1M Kontext.
  • 28.07.2026: Musk kuendigt Grok 4.6/4.7; parallel „Pacing the Frontier“-Offener Brief (1200+ Mitarbeiter OpenAI/Anthropic u.a.).
  • ca. 07.08.2026 (Ziel): Grok 4.6 — 1,5T, SFT/RL-Upgrade.
  • ca. Ende Aug.–Anfang Sep. 2026: Grok 4.7 — 2,1T, laut Musk ueberlegen, etwas langsamer, token-effizienter.

Drei Frontier-Modelle in ~8 Wochen nach 4.5 — ungewoehnlich hohe Release-Dichte. „Musk time“ bleibt ein planerischer Puffer.

Kerndaten: Grok-Linie und angekuendigte SKUs

ModellRelease/ZielParameterSchwerpunktStatus
Grok 4.3 Beta2026-04-17nicht veroeffentlichtVorgaenger-Baselinelive
Grok 4.52026-07-08nicht veroeffentlichtCoding/Agent, Cursor-Traininglive
Grok 4.6ca. 2026-08-071,5TSFT/RL-UpgradeAnkuendigung
Grok 4.7ca. Ende Aug.–Sep.2,1Tstaerker, hoehere Token-EffizienzAnkuendigung

Parameter und Termine: Hersteller/Musk; keine unabhaengige Verifikation fuer 4.6/4.7.

Technik: SFT/RL statt reiner Skalierung

Was SFT und RL hier loesen

SFT korrigiert Ausgabemuster mit kuratierten Beispielen; RL optimiert mehrstufige Agent-Pfade per Reward-Signal. Grok 4.5 erreichte mit Cursor-Sessions Terminal-Bench 2.1 83,3 % und SWE-Bench Pro 64,7 % bei deutlich weniger Output-Tokens als Claude Opus 4.8 (~19K vs. ~67K pro Task).

Zwei-SKU-Strategie (4.6 vs. 4.7)

4.6 (1,5T) und 4.7 (2,1T, „etwas langsamer“) deuten auf bewussten Trade-off zwischen Latenz und Capability — aehnlich wie getrennte „fast“/„max“-Routen bei anderen Anbietern.

Wettbewerbsdruck durch Kimi K3

K3: Frontend Code Arena 1679, Artificial Analysis Index global #3. Musk kommentierte K3-Benchmarks positiv. xAI beschleunigt vermutlich wegen Open-Weight- und Frontier-Konkurrenz.

Wettbewerbsmatrix: Grok vs. K3 vs. Fable 5.1

ModellAnbieterParameterKontextPreis (Input/Output pro 1M)Datenquelle
Grok 4.5xAInicht veroeffentlicht500K2 / 6 USDxAI offiziell
Grok 4.6 (Ankuendigung)xAI1,5TunbekanntunbekanntMusk X (unverifiziert)
Kimi K3Moonshot2,8T MoE (16/896 aktiv)1M0,30 / 3 / 15 USDMoonshot + Hugging Face
Claude Fable 5.1 (Geruecht)Anthropicunbekanntunbekanntgeruecht 10 / 50 USD36kr, WinCentral — nicht bestaetigt
GPT-5.6 SolOpenAIunbekanntunbekanntunbekanntOpenAI offiziell

Kein belastbarer Benchmark-Vergleich fuer 4.6 oder Fable 5.1 — nur Release-Rhythmus und grobe Positionierung.

Kontroversen und regulatorischer Kontext

  • Einzelquelle: Nur Musks X-Thread; kein xAI-Blogpost.
  • Keine Model Card: Im Gegensatz zu 4.5 fehlen Benchmarks und Preise fuer 4.6.
  • xAI-Sicherheitsklage (Juli 2026): Klage gegen Nutzer wegen CSAM-Umgehung; Common Sense Media stufte Grok Anfang 2026 als schwach beim Minderjaehrenschutz ein.
  • Pacing the Frontier: 28.07. Offener Brief fuer langsameres Frontier-Tempo; xAI nicht unterzeichnend — waehrend 4.6/4.7 angekuendigt werden.
  • DSGVO: Bei EU-Prompts mit Personendaten vor Modellwechsel AVV, Subprocessor und Verarbeitungsort bei xAI-API pruefen — unabhaengig von Benchmark-Hype.

August 2026: Release-Dichte

Grok 4.6/4.7, Fable 5.1 (Geruecht, August) und live K3 machen August zu einem der dichtesten Modell-Monate. Entscheidend: Token-Effizienz und Task-Kosten, nicht Parameter allein — vgl. OpenRouter-Juli-Routing.

6-Schritte-Runbook vor Grok 4.6

  1. Informationsquellen: x.ai/news, Musk X, Grok Build — keine Dritt-Spekulation als Spec behandeln.
  2. 4.5-Abhaengigkeiten inventarisieren: Cursor, OpenClaw, Gateway — alle grok-4.5-Endpunkte und Fallback-Ketten dokumentieren.
  3. Dual-SKU-Routing vorbereiten: Alias fuer 4.6 (schneller) und 4.7 (staerker) in OpenRouter oder eigenem Router reservieren.
  4. Interne Benchmarks: K3 und Fable-Geruechte mit eigenen Coding-Tasks und realen Token-Kosten vergleichen.
  5. Gateway haerten: Dedizierter Host, API-Keys pro Umgebung, 429/Timeout-Fallback auf 4.5 oder K3.
  6. Release-Woche: Tagesbudget, Fehlerrate, 72h Rollback-Fenster auf 4.5 bei schwachen Metriken.
bash
# xAI API (aktuell grok-4.5; nach Release model-Feld anpassen)
curl https://api.x.ai/v1/chat/completions \
  -H "Authorization: Bearer $XAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "messages": [{"role": "user", "content": "Refactor this Python function with type hints."}],
    "max_tokens": 4096
  }'

Drei Zahlen fuer das Tech-Review

  • Token-Effizienz Grok 4.5: SWE-Bench Pro ~15.954 Output-Tokens vs. Claude Opus 4.8 ~67.020 — Faktor ~4,2.
  • Release-Takt: 4.5 (08.07.) → 4.6 (Ziel 07.08.) → 4.7 (Ende Aug.) in ~8 Wochen.
  • K3-Referenz: Frontend Code Arena 1679, AA Index #3 — messbarer Open-Weight-Massstab zum Ankuendigungszeitpunkt.

Dedizierter Knoten statt Laptop-Warten

Bis Grok 4.6 live ist, laufen die meisten Teams auf 4.5 + Cursor oder OpenClaw. Sleep unterbricht lange Agent-Sessions; verteilte Keys erschweren Rotation — besonders bei laengerem Kontext. Das ist ein Betriebs-, kein Modellproblem.

Fuer 7x24-Agent-Gateways mit Grok-API-Routing ist MACCOME Mac-Cloud oft die stabilere Option: echtes macOS, SSH-Uebergabe, Umgebungsisolation. Preise und Konfiguration: Mac-mini-Mietpreise.

Quellen: xAI „Introducing Grok 4.5“, Musk X (28.07., Antwort @rauchg), Moonshot/Kimi K3, Emergent.sh/WinCentral/36kr (Fable 5.1), The Verge/TechTimes (Pacing the Frontier), Ars Technica/TechCrunch (xAI-Sicherheit). Stand 30.07.2026 — 4.6/4.7 vor offiziellem Release verifizieren.

FAQ

Wann erscheint Grok 4.6 genau?

Musk nannte „ca. 7. August“ — informell, kein xAI-Termin. Mit Musk time Tage bis Wochen Verschiebung einplanen. xAI-Blog und Grok Build beobachten.

Grok 4.6 vs. Grok 4.7?

4.6: 1,5T, SFT/RL-Fokus. 4.7: 2,1T, laut Musk insgesamt staerker, etwas langsamere Inferenz, bessere Token-Effizienz. Details zu 4.5-Effizienz: Grok-4.5-Review.

Schlaegt Grok 4.6 Kimi K3 oder Fable 5.1?

Unbekannt. Keine oeffentlichen 4.6-Benchmarks; K3 hat Dritt-Daten; Fable 5.1 nicht von Anthropic bestaetigt. K3: Vollfreigabe-Analyse.

Wie wird Grok 4.6 preislich liegen?

Unbekannt. Orientierung: Grok 4.5 bei 2 / 6 USD pro 1M Input/Output — finale Preise erst mit Release.

Wo nutze ich Grok 4.6 voraussichtlich?

Wahrscheinlich zuerst Grok Build, xAI-API und Console; spaeter Cursor u.a. — wie bei 4.5, bis xAI bestaetigt.

Agent-Stack waehrend des Release-Fensters stabil halten?

OpenClaw/Cursor-Gateway auf dediziertem Mac-Host, Multi-Model-Fallback, kein Laptop-Sleep. MACCOME Mietpreise fuer M4/M4-Pro-Knoten.