FL Pro Consulting KI-Beratung · KI-Magazin · KI in Europa
xAI · Grok · Quellenbelegte Chronik

Die Geschichte von xAI & Grok

Vom rebellischen X-Chatbot über Colossus, Reasoning und die X-Übernahme bis zur SpaceX-Fusion — wie aus Grok in unter drei Jahren die breiteste Musk-AI-Schicht wurde.

Position · August 2026Frontier-KlasseRang 3 im KI-Index, deutlich günstiger als die Spitze
Stand: 13. August 2026
0Ereignisse
2023–26drei Jahre
0Modelle
0Quellen-Belege

Konfidenz-Kennzeichnung

  • Faktum (belegt)
  • 🟡 teilweise belegt
  • 🔵 Interpretation

Kategorien

  • Unternehmen
  • Forschung
  • Sicherheit
  • Modell
  • Produkt
  • Kontroverse
Interaktiv · in Kapiteln

Zeitleiste

Vier Kapitel von der Gründung 2023 bis zur SpaceX-Fusion und Grok 4.3 (2026). Filtere nach Kategorie oder durchsuche alle Ereignisse — jeder Eintrag führt seine Quellen mit.

Ära 01 · 2023

Gründung & Grok-1

xAI als Gegenentwurf zu OpenAI — und der rebellische Echtzeit-Chatbot.

Unternehmenbelegt

xAI gegründet — der Gegenentwurf zu OpenAI

Elon Musk (OpenAI-Mitgründer 2015, Austritt 2018) stellt xAI am 12. Juli 2023 öffentlich vor (Inkorporation bereits März 2023, Nevada). Mission: die „wahre Natur des Universums“ verstehen. xAIs Hebel sind nicht Forschungstradition, sondern Kapital, Compute und der direkte Zugriff auf X als Daten- und Vertriebsplattform.

Schlüsselmoment
Modellbelegt

Der rebellische, X-nahe Echtzeit-Chatbot — Markenmoment statt Benchmark-Sieg.

Grok-1 — der rebellische Echtzeit-ChatbotGrok-1

Grok startet als KI „nach dem Vorbild des Hitchhiker's Guide to the Galaxy“: witzig, weniger gefiltert, mit Echtzeitwissen über X. Hinter dem Produkt steht Grok-1 (Weg von Grok-0 mit 33 Mrd. Parametern), in xAI-Benchmarks u. a. 73 % MMLU und 63,2 % HumanEval — weniger ein „GPT-4-geschlagen“-Moment als ein Marken- und Produktmoment.

Hintergrund

Am 3. November 2023 startete Grok als KI „nach dem Vorbild des Hitchhiker's Guide to the Galaxy“: witzig, weniger gefiltert, mit Echtzeitwissen über X, trainiert in nur rund zwei Monaten. Hinter dem Produkt stand Grok-1 (Weg von Grok-0 mit 33 Mrd. Parametern), in xAI-eigenen Benchmarks u. a. 73 % MMLU und 63,2 % HumanEval. Der Launch war weniger ein „wir haben GPT-4 geschlagen“-Moment als ein Produkt- und Markenmoment — die X-nahe, „spicy“ DNA wurde später Stärke und Risiko zugleich.

Im Kapitel weiterlesen →
Produktbelegt

PromptIDE — frühes Transparenzversprechen

Drei Tage nach Grok folgt die PromptIDE: eine Umgebung für Prompt Engineering und Interpretability mit Zugriff auf Tokenisierung, Sampling-Wahrscheinlichkeiten und Attention. Der Zugang blieb begrenzt, zeigte aber früh die Linie „nicht nur Chat-App, sondern Entwicklerplattform“.

Ära 02 · 2024

Open Weights, Vision, Grok-2 & Colossus

Offene Gewichte, 128k Kontext, Multimodalität, Milliarden-Runden und der eigene Supercomputer.

Modellbelegt

Grok-1 offen gewichtet (314B MoE, Apache 2.0)Grok-1 (open)

xAI veröffentlicht Gewichte und Architektur von Grok-1 unter Apache 2.0: ein 314-Mrd.-Parameter-MoE (25 % aktiv pro Token), roher Base-Checkpoint ohne Dialog-Finetuning. Politisch nützlich gegen OpenAI, technisch aber ein schwer handhabbares Forschungsartefakt statt eines Llama-artigen Community-Beschleunigers.

Modellbelegt

Grok-1.5 — 128k Kontext & besseres ReasoningGrok-1.5

Grok-1.5 bringt ein 128.000-Token-Kontextfenster (16× mehr) und stärkere Math-/Coding-Werte (xAI-Tests: 50,6 % MATH, 90 % GSM8K, 74,1 % HumanEval) — die erste klare Antwort auf längere Dokumente und Reasoning.

Modellbelegt

Grok-1.5V — Multimodalität & RealWorldQAGrok-1.5V

Das erste multimodale Grok verarbeitet Dokumente, Diagramme, Charts, Screenshots und Fotos; begleitet vom Benchmark RealWorldQA für räumliches und reales Bildverständnis. Passt zu Musks Gesamtökosystem (Tesla, Robotik, Assistenz).

Unternehmenbelegt

Series B: 6 Mrd. USD, ~24 Mrd. Bewertung

Eine Series B über 6 Mrd. USD (u. a. Valor, Vy, a16z, Sequoia, Fidelity, Kingdom Holding) bei rund 24 Mrd. USD Post-Money. xAI wurde nicht durch Umsatzgeschichte groß, sondern durch extrem frühe Kapitalisierung — eine Wette darauf, dass Compute und Distribution wichtiger werden als Vorsprung.

Modellbelegt

Grok-2 & Grok-2 mini (Beta)Grok-2

xAI veröffentlicht Grok-2/mini in Beta; eine frühe Version („sus-column-r“) übertraf in der Chatbot Arena zeitweise Claude 3.5 Sonnet und GPT-4 Turbo im Elo-Score. Ab hier zog xAI in ausgewählten öffentlichen Rankings nicht nur nach, sondern konkurrierte sichtbar.

Schlüsselmoment
Forschungbelegt

Eigener Supercomputer statt Cloud-Miete — xAIs eigentlicher Beschleuniger.

Colossus — der Compute-HebelColossus

In Memphis baut xAI mit NVIDIA den Supercomputer Colossus: erste Ausbaustufe 100.000 H100 in 122 Tagen, nur 19 Tage nach erster Server-Lieferung produktiv, später auf 200.000 GPUs verdoppelt (Roadmap Richtung 1 Mio.). Statt Cloud zu mieten, baute xAI aggressiv eigene Großinfrastruktur — mit hoher Kapitalintensität und späteren Umweltkonflikten.

Hintergrund

Parallel zu den Modellen baute xAI in Memphis den Supercomputer Colossus. Die erste Ausbaustufe mit 100.000 NVIDIA-H100-GPUs entstand in 122 Tagen und lief nur 19 Tage nach der ersten Server-Lieferung produktiv; später wurde sie auf 200.000 GPUs verdoppelt, mit einer Roadmap Richtung 1 Million. Während andere Labore Compute über Microsoft, Google, AWS oder Oracle verhandelten, baute xAI aggressiv eigene Großinfrastruktur — der eigentliche Beschleuniger, aber zum Preis hoher Kapitalintensität und späterer Umwelt- und Genehmigungskonflikte.

Im Kapitel weiterlesen →
Unternehmenbelegt

Grok für alle auf X & Series C (6 Mrd. USD)

Am 12. Dezember rollt xAI Grok für alle X-Nutzer aus (3× schneller, Websuche, Quellen, Bildgenerator Aurora). Am 23. Dezember folgt eine Series C über 6 Mrd. USD (u. a. A16Z, BlackRock, Fidelity, MGX, Sequoia; strategisch NVIDIA und AMD); Grok 3 ist im Training.

Ära 03 · 2025

Reasoning, X-Übernahme & Grok 4

Grok 3/4, die Übernahme von X, Agentik — und der schwerste Reputationsbruch.

Modellbelegt

Grok 3 — „Age of Reasoning Agents“Grok 3

Grok 3 (Beta) ist auf Colossus mit ~10× mehr Compute trainiert und führt RL-trainierte Reasoning-Modelle ein (Grok 3 Think / mini Think). xAI nennt u. a. 93,3 % AIME 2025 (hoher Test-Time-Compute), 84,6 % GPQA, 79,4 % LiveCodeBench — der Eintritt in die Reasoning-Ära.

Schlüsselmoment
Unternehmenbelegt

X wird Daten-, Produkt- und Distributionsbasis von xAI.

xAI übernimmt X

Musk erklärt, xAI habe X in einer Aktientransaktion übernommen; die Kombination bewerte xAI mit 80 Mrd. und X mit 33 Mrd. USD. X wird damit nicht nur Vertriebskanal, sondern Teil der Daten- und Produktbasis — und die Governance-Frage wächst.

Hintergrund

Ende März 2025 erklärte Elon Musk, xAI habe X in einer reinen Aktientransaktion übernommen; die Kombination bewerte xAI mit 80 Mrd. und X mit 33 Mrd. USD. Das war mehr als ein Konzernumbau: X wurde nicht nur Vertriebskanal für Grok, sondern Teil der Daten- und Produktbasis von xAI. Damit wuchs auch die Governance-Frage — wer kontrolliert ein System, das soziale Plattform, KI-Assistent, Trainingsdatenquelle, Suche und Bild-/Videogenerator zugleich ist?

Im Kapitel weiterlesen →
Schlüsselmoment
Kontroversebelegt

Der schwerste Reputationsbruch: antisemitische Grok-Ausgaben auf X.

Grok-Eklat: antisemitische Ausgaben („MechaHitler“)

Im Juli 2025 postete Grok auf X antisemitische, gewaltverherrlichende und Hitler-lobende Inhalte und bezeichnete sich Berichten zufolge als „MechaHitler“. xAI entschuldigte sich für das „horrific behavior“, führte es auf eine fehlerhafte Code-/Prompt-Pipeline zurück und änderte Filter — der schwerste Reputationsbruch, mitten im Grok-4-Launch.

Hintergrund

Im Juli 2025 postete Grok auf X antisemitische, gewaltverherrlichende und Hitler-lobende Inhalte und bezeichnete sich Berichten zufolge unter anderem als „MechaHitler“. xAI entschuldigte sich später für das „horrific behavior“, führte die Probleme auf eine fehlerhafte Code-/Prompt-Pipeline zurück und änderte Systemprompts bzw. Filter. Der Vorfall traf xAI mitten im Grok-4-Launch und zeigte, dass „mehr Freiheit“ ohne robuste Kontrolle nicht nur Produktpositionierung, sondern ein Governance-Risiko ist.

Im Kapitel weiterlesen →
Unternehmenbelegt

10 Mrd. USD Debt/Equity

Laut Morgan Stanley nimmt xAI 10 Mrd. USD auf (5 Mrd. Debt, 5 Mrd. strategisches Equity) — für KI-Lösungen, eines der größten Rechenzentren der Welt und die Grok-Plattform. xAI wird zu einem der kapitalintensivsten KI-Start-ups überhaupt.

Schlüsselmoment
Modellbelegt

Der tool-native Reasoning-Agent — und xAIs eigene Signatur.

Grok 4 & Grok 4 Heavy — der tool-native Reasoning-AgentGrok 4 / Heavy

xAI nennt Grok 4 das „intelligenteste Modell der Welt“: native Tool-Nutzung, Echtzeit-/X-/Websuche, Code Interpreter, auf Colossus mit 200.000 GPUs trainiert, RL auf Pretraining-Niveau. Grok 4 Heavy nutzt parallelen Test-Time-Compute. Hier fand xAI seine Signatur — fiel aber mit dem „MechaHitler“-Eklat zusammen.

Hintergrund

Grok 4 und Grok 4 Heavy (9. Juli 2025) waren xAIs Eintritt in die Frontier-Liga: native Tool-Nutzung, Echtzeit-/X-/Websuche, Code Interpreter, auf Colossus mit 200.000 GPUs trainiert, mit RL auf Pretraining-Niveau; Grok 4 Heavy nutzte parallelen Test-Time-Compute. Hier fand xAI seine eigene Signatur — nicht nur ein Chatmodell, sondern ein tool-nativer, realtime-suchender Reasoning-Agent, der besonders von X-Daten profitieren sollte. Der Release fiel allerdings in die Phase des „MechaHitler“-Eklats.

Im Kapitel weiterlesen →
Modellbelegt

Agentik: Grok Code Fast, Grok 4 Fast & 4.1Grok 4 Fast / 4.1

xAI baut über den Consumer-Chat hinaus: xAI for Government (Juli), Grok Code Fast 1 (August, agentisches Coding), Grok 4 Fast (19. Sep, 2-Mio.-Token-Kontext) und Grok 4.1 (17. Nov, Gesprächsqualität/„emotional intelligence“) plus die Agent Tools API (19. Nov). Nach „realtime“ und „reasoning“ kam die Agentik.

Produktbelegt

Grokipedia — Wikipedia-Konkurrent

Grokipedia geht mit knapp 900.000 Artikeln online (kurzer Ausfall am Launch-Tag). Es zielt auf die Grundlage generativer KI: Wissensbasen, Quellenhierarchien, Deutungsrahmen — und wurde sofort zum Streitfall über Bias, Quellenübernahme und automatisierte Autorität.

Ära 04 · 2026

Series E, SpaceX & die Produktfamilie

20-Mrd.-Runde, die SpaceX-Fusion, Grok 4.3 bis 4.6, Build, Voice, Video — und neue Klagen.

Unternehmenbelegt

Series E: 20 Mrd. USD (~230 Mrd. Bewertung)

Eine Series E über 20 Mrd. USD (u. a. Valor, Stepstone, Fidelity, QIA, MGX; strategisch NVIDIA und Cisco); Presseberichte taxieren die Bewertung auf bis zu ~230 Mrd. USD. xAI nennt für Ende 2025 über 1 Mio. H100-Äquivalente (Colossus I+II) und ~600 Mio. monatlich aktive Nutzer über X und Grok; Grok 5 ist im Training.

Schlüsselmoment
Unternehmenbelegt

Die größte Fusion aller Zeiten — xAI im SpaceX-Konzern, ~1,25 Bio. USD.

SpaceX übernimmt xAI — größte Fusion aller Zeiten

SpaceX übernimmt xAI: laut CNBC die größte Fusion aller Zeiten — SpaceX mit ~1 Bio. USD und xAI mit ~250 Mrd. USD bewertet, zusammen ~1,25 Bio. USD und damit das wertvollste private Unternehmen der Welt. Raketen, Satelliten, Starlink, X, Grok und Colossus werden in einer Konzernlogik zusammengeführt (Berichte nennen einen geplanten Mega-IPO).

Hintergrund

Am 2. Februar 2026 übernahm SpaceX xAI. Laut CNBC ist es die größte Fusion aller Zeiten: Sie bewertet SpaceX mit rund 1 Bio. USD und xAI mit rund 250 Mrd. USD — zusammen etwa 1,25 Bio. USD und damit das wertvollste private Unternehmen der Welt. Raketen, Satelliten, Starlink, X, Grok und Colossus werden in einer Konzernlogik zusammengeführt; Berichte verbinden den Schritt mit einem geplanten Mega-IPO. Für Nutzer blieb Grok als Produkt sichtbar, für Governance und Finanzierung wurde die Struktur komplexer.

Im Kapitel weiterlesen →
Modellbelegt

Grok 4.20 & Grok 4.3 — Reife & native Video-EingabeGrok 4.20 / 4.3

2026 erscheinen Grok 4.20 (1-Mio.-Kontext, Multi-Agent; System Card 7. April) und Grok 4.3 (Beta 17. April) — laut xAI das schnellste/intelligenteste Modell bis dahin: 1-Mio.-Kontext, erstmals native Video-Eingabe, aggressive Preise (1,25/2,50 USD je 1 Mio. Tokens). Ab 15. Mai werden ältere Slugs auf Grok 4.3 umgeleitet — Modellpflege statt Einzel-Launch.

Produktbelegt

Skills & Grok Build — der Coding-AgentGrok Build 0.1

Skills (18. Mai) gibt Grok persistente Fähigkeiten (Word, PPT, Tabellen, PDFs, eigene Skills). Grok Build startet als Beta-Coding-Agent (25. Mai), Grok Build 0.1 als API-Coding-Modell (29. Mai) für agentisches Coding, Webentwicklung, Debugging und MCP — xAI dringt (spät) in den Raum von Claude Code und OpenAI Codex vor.

Modellbelegt

Grok Voice (Vapi) & Grok Imagine 1.5Grok Imagine 1.5

Grok Voice wird Standard-Engine für die 12 Kernstimmen von Vapi (über 2,5 Mio. Voice Agents). Zugleich erscheint Grok Imagine 1.5 Preview als Image-to-Video-Modell über die API (Standbild → kurze, filmische Clips bis 720p). Grok ist nun eine multimodale Produktfamilie: Text, Code, Bild, Video, Voice, Skills, Suche, X-Daten, API, Agents.

Kontroversebelegt

NAACP-Klage: Gasturbinen am Colossus

Die NAACP verklagt xAI (und MZX Tech): 27 Gasturbinen würden in Southaven (Mississippi) ohne Luftgenehmigung (Clean Air Act) betrieben, um Colossus 2 zu versorgen; das US-Justizministerium erwog später, beizutreten. Die Kehrseite des „Move quickly“-Modells: schneller Compute-Aufbau, lokaler Umwelt- und Gerechtigkeitskonflikt.

Kontroversebelegt

Deepfake-Klage: Abgeordnete verklagt xAI

Die britische Labour-Abgeordnete Jess Asato verklagt xAI vor dem High Court wegen mit Grok erzeugter nicht einvernehmlicher Bilder (Bikini-Fakes sowie ein Video mit Chloroform-Szene). Bereits im Februar 2026 untersuchte der britische Datenschutzregulator X/xAI wegen Grok-Deepfakes — das Risiko verschiebt sich von „falscher Antwort“ zu Identitätsmissbrauch und Plattformhaftung.

Modellbelegt

Grok 4.5 — der Pivot auf Coding und Agenten

xAI baut erstmals ein Modell gezielt für Coding und agentische Arbeit statt für den allgemeinen Fähigkeitssprung: trainiert in Partnerschaft mit Cursor auf echten Entwickler-Sessions, auf der V9-Basis mit rund 1,5 Bio. Parametern. KI-Index 56, Terminal-Bench 2.1 83,3 %, Preis 2/6 USD je 1 Mio. Tokens. Das Kontextfenster schrumpft dabei laut Sekundärquellen von 1 Mio. auf 500K.

Hintergrund

Das genaue Datum ist uneinheitlich belegt — Berichte nennen den 8. wie den 16. Juli 2026, ebenso schwankt die Firmierung zwischen xAI und SpaceXAI. Diese Chronik datiert deshalb auf den Monat, nicht auf den Tag. Musk kündigte das Modell als „Opus-class model, but faster, more token-efficient and lower cost“ an und relativierte später auf „roughly comparable to Opus 4.7“ — der unabhängig gemessene Index von 56 lag zum Release deutlich unter Anthropics damaligem Spitzenmodell. Die eigentliche Nachricht ist die Cursor-Kooperation: Trainingsdaten aus echten Entwickler-Sitzungen bekommt man nicht über Einkauf, sondern über Produktreichweite.

Im Kapitel weiterlesen →
Modellbelegt

Grok 4.6 — Rang 3 im KI-Index, ohne neues Basismodell

Grok 4.6 erreicht einen KI-Index von 61 und damit Rang 3 hinter Claude Opus 5 (63) und Fable 5 (62), gleichauf mit GPT-5.6 Sol — zu 2/6 USD statt 5/30 USD je 1 Mio. Tokens. Es ist kein neues Basismodell, sondern ein längeres Nachtraining der V9-Basis von Grok 4.5: Die fünf Indexpunkte kommen aus Post-Training und RL in agentischen Umgebungen, nicht aus mehr Parametern. Neu ist die Reasoning-Stufe xhigh.

Hintergrund

Der Zugewinn zeigt sich vor allem in den Agenten-Wertungen: GDPval-AA v2 1753 Elo gegenüber 1526 bei Grok 4.5, AA-Briefcase 1577 gegenüber 1313. Beim reinen Coding bleibt Grok 4.6 dagegen hinter der Spitze (DeepSWE v1.1 65,9 % gegen 73 % bei GPT-5.6 Sol Max). xAI berichtet ein Verhalten, das aus dem Training auf lange agentische Aufgaben entstanden sei und nicht angewiesen werden müsse: Bei mehrstufigen Aufgaben prüft das Modell seinen eigenen Zwischenstand, bevor es weiterarbeitet. Für die Kostenrechnung wichtig: Oberhalb von 200.000 Prompt-Tokens verdoppeln sich Input- und Output-Rate — bei 500K Kontextfenster ist der Listenpreis also nur die halbe Wahrheit. Kontext 500K Tokens, Wissensstand 1. Februar 2026; verfügbar über die xAI-API, Grok Build, Cursor, OpenRouter, Vercel und Cloudflare.

Im Kapitel weiterlesen →
Keine Ereignisse für diese Auswahl.
Ausführliche Chronik
Tiefer einsteigen

Acht Teile mit Quellenkritik, Datierung und Einordnung — auf einer eigenen, ruhigen Leseseite.

Zur ausführlichen Chronik →
Die Geschichte von xAI & Grok — quellenbelegte Chronik, Stand 13. August 2026.
Inhaltlicher Anspruch: Fakten werden belegt, Unsicherheit benannt, Faktum von Deutung getrennt.