Grok-Modelle im Vergleich: Von Grok 3 bis Grok 4.5 und der Ausblick auf Grok 5
Wer sich näher mit Grok beschäftigt, stößt schnell auf eine ganze Reihe von Modellnamen: Grok 3, Grok 4, Grok 4 Heavy, Grok 4.1 Fast, Grok 4.20, Grok 4.5 – und am Horizont wird bereits über Grok 5 gesprochen. Für Laien wirkt diese Vielzahl an Bezeichnungen oft verwirrender als bei anderen Anbietern. Dabei folgt die Namensgebung einer erkennbaren Logik: Es gibt ein Hauptmodell pro Generation, dazu schnellere und günstigere Varianten für einfache Aufgaben sowie besonders leistungsstarke Varianten für aufwendige, mehrstufige Aufgaben. Dieser Beitrag ordnet die wichtigsten Versionen ein und zeigt an konkreten Beispielen, wann sich welches Modell lohnt.
Die Grok-Modellfamilie im Überblick
Grok 3 – die vorherige Generation
Grok 3 war lange Zeit das Hauptmodell von xAI und bildet inzwischen die Basis für die kostenlose Stufe. Es beherrscht die grundlegenden Aufgaben eines Chatbots – Fragen beantworten, Texte formulieren, einfache Recherchen – bietet aber ein deutlich kleineres Kontextfenster und weniger Genauigkeit bei komplexen, mehrstufigen Aufgaben als die neueren Modelle.
Grok 4 und Grok 4 Heavy
Grok 4 war der nächste große Schritt und brachte deutlich bessere Ergebnisse bei logischem Denken und komplexeren Fragestellungen. Die Variante Grok 4 Heavy geht noch einen Schritt weiter: Sie nutzt bei schwierigen Aufgaben mehrere parallele Denkprozesse und vergleicht die Ergebnisse, bevor eine Antwort ausgegeben wird. Das macht Grok 4 Heavy langsamer und deutlich teurer, dafür aber auch verlässlicher bei kniffligen Aufgaben – etwa mathematischen Berechnungen oder mehrschrittigen Analysen.
Grok 4.1 Fast – schnell und günstig
Für Aufgaben, bei denen es vor allem auf Geschwindigkeit und niedrige Kosten ankommt – etwa das automatische Beantworten vieler kurzer Anfragen in einer App –, bietet xAI mit Grok 4.1 Fast eine abgespeckte, dafür aber sehr schnelle und günstige Variante an. Die inhaltliche Tiefe ist geringer, für einfache, sich wiederholende Aufgaben reicht das aber meist aus.
Grok 4.20 – riesiges Kontextfenster und Mehr-Agenten-Technik
Mit Grok 4.20 führte xAI Anfang 2026 ein Modell ein, das intern mit mehreren spezialisierten „Rollen“ arbeitet, die sich gegenseitig gegenprüfen, bevor eine Antwort ausgegeben wird – vereinfacht gesagt: Eine Rolle koordiniert, eine prüft Fakten, eine bewertet technische Details, eine liefert kreative Formulierungen. Für Nutzerinnen und Nutzer äußert sich das vor allem in verlässlicheren Antworten bei längeren, komplizierteren Anfragen. Dazu kommt ein sehr großes Kontextfenster von rund 2 Millionen Textbausteinen (Token) – das entspricht mehreren tausend Seiten Text, die das Modell gleichzeitig „im Kopf“ behalten kann, etwa für die Analyse längerer Vertragswerke oder umfangreicher Datensammlungen.
Grok 4.5 – der aktuelle Schwerpunkt auf komplexe und technische Aufgaben
Grok 4.5, veröffentlicht im Juli 2026, ist das derzeit anspruchsvollste verfügbare Modell von xAI. Es wurde gezielt für längere, anspruchsvolle Arbeitsabschnitte trainiert – ursprünglich vor allem für die Softwareentwicklung, mittlerweile aber auch für andere komplexe, mehrstufige Aufgaben wie umfassende Recherchen oder die Analyse größerer Datenmengen. Das Kontextfenster liegt bei rund 500.000 Token, also kleiner als bei Grok 4.20, dafür arbeitet das Modell bei schwierigen Denkaufgaben genauer. In der Programmierschnittstelle kostet Grok 4.5 rund 2 Euro pro Million eingehender und rund 6 Euro pro Million ausgehender Textbausteine.
Grok 5 – was bislang bekannt ist
Ein Nachfolgemodell mit dem Arbeitsnamen Grok 5 befindet sich laut xAI in der Trainingsphase auf einem erweiterten Colossus-Rechenzentrum. Ein offizielles Veröffentlichungsdatum gibt es bis August 2026 nicht, Gerüchten zufolge soll das Modell deutlich größer ausfallen als Grok 4 und noch später im Jahr 2026 vorgestellt werden. Bis zur offiziellen Ankündigung bleibt Grok 4.5 das leistungsstärkste allgemein verfügbare Modell.
Merksatz: Je höher die Versionsnummer, desto leistungsfähiger und meist auch teurer das Modell – aber nicht jede Aufgabe braucht das stärkste Modell. Für einfache Alltagsfragen reicht oft schon die schnelle, günstige Variante.
Vergleichstabelle der Grok-Versionen
| Modell | Schwerpunkt | Kontextfenster (ca.) | Geschwindigkeit | Typischer Einsatz |
|---|---|---|---|---|
| Grok 3 | Grundfunktionen | klein | mittel | Einfache Fragen, kostenlose Stufe |
| Grok 4 | Logisches Denken | mittel | mittel | Anspruchsvollere Alltagsfragen |
| Grok 4 Heavy | Höchste Genauigkeit | mittel-groß | langsam | Komplexe Berechnungen, Analysen |
| Grok 4.1 Fast | Geschwindigkeit, Kosten | klein | sehr schnell | Automatisierte Massenanfragen |
| Grok 4.20 | Langtext, Mehr-Rollen-Prüfung | ca. 2 Mio. Token | mittel | Lange Dokumente, mehrstufige Recherchen |
| Grok 4.5 | Komplexe technische Aufgaben | ca. 500.000 Token | mittel-langsam | Softwareentwicklung, tiefe Analysen |
| Grok 5 (angekündigt) | nächste Generation | noch offen | noch offen | noch nicht verfügbar |
Echtzeit-Datenzugriff über X
Ein Merkmal, das alle aktuellen Grok-Modelle verbindet, ist der direkte Zugriff auf öffentliche Beiträge der Plattform X. Dadurch kann Grok auf Ereignisse reagieren, die erst wenige Minuten alt sind – ein klarer Unterschied zu Modellen, deren Wissen auf einen bestimmten Trainingsstichtag begrenzt ist. Der Nachteil: Beiträge auf Social Media sind nicht automatisch geprüft oder verlässlich, weshalb Antworten, die sich auf aktuelle X-Beiträge stützen, immer mit einer gesunden Portion Vorsicht zu lesen sind, besonders bei strittigen oder unklaren Themen.
Bildgenerierung und Video mit Aurora und Grok Imagine
Für die Erzeugung von Bildern nutzt xAI ein eigenes System namens Aurora, das inzwischen unter dem Produktnamen Grok Imagine vermarktet wird. Es erzeugt aus Textbeschreibungen Bilder und inzwischen auch kurze Videos von wenigen Sekunden Länge in verschiedenen Formaten. In der bezahlten Stufe SuperGrok ist der volle Funktionsumfang von Grok Imagine enthalten; die kostenlose Stufe bietet nur eine eingeschränkte Basisversion. Für die Programmierschnittstelle wird die Videoerzeugung nach erzeugter Sekundenzahl abgerechnet, was sie für kurze Clips vergleichsweise günstig macht.
Anwendungsbeispiele aus Alltag und Business
Beispiel 1 – Alltag: Eine Nutzerin plant eine Reise und lässt sich von Grok anhand aktueller Beiträge auf X zusammenfassen, wie das Wetter und die Verkehrslage am Zielort aktuell aussehen – etwas, das ein Modell ohne Echtzeitzugriff nicht liefern kann.
Beispiel 2 – Kleinunternehmen: Ein Sachbearbeiter in einem kleinen Handwerksbetrieb nutzt Grok 4.1 Fast, um eingehende Kundenanfragen per E-Mail vorzusortieren und Antwortvorschläge zu formulieren, die anschließend von einem Menschen geprüft werden.
Beispiel 3 – Immobilien und Finanzen: Ein Immobilienbüro möchte einen ersten Eindruck von der aktuellen Stimmung rund um einen bestimmten Standort gewinnen – etwa, ob in den vergangenen Tagen vermehrt über steigende Mieten oder ein neues Bauprojekt in einer Stadt gesprochen wird. Grok kann dank des Zugriffs auf aktuelle X-Beiträge solche Diskussionen zusammenfassen und erste Anhaltspunkte liefern. Wichtig dabei: Eine solche Stimmungsanalyse ersetzt keine belastbare Marktanalyse auf Basis amtlicher Daten, sondern liefert lediglich einen schnellen, ergänzenden Eindruck.
Beispiel 4 – Langes Dokument prüfen: Eine Sachbearbeiterin lädt einen längeren Mietvertrag oder eine umfangreiche Ausschreibung in Grok 4.20 hoch und lässt sich zentrale Klauseln, Fristen und Zahlen zusammenfassen – dank des großen Kontextfensters kann das Modell den gesamten Text auf einmal berücksichtigen, statt ihn in Abschnitte zerlegen zu müssen.
Beispiel 5 – Technische Aufgabe: Ein Entwickler nutzt Grok 4.5, um eine bestehende Softwareanwendung über mehrere Dateien hinweg zu analysieren und Verbesserungsvorschläge für den Programmcode zu erhalten – eine Aufgabe, für die das Modell gezielt trainiert wurde.
Merksatz: Je länger und verzweigter die Aufgabe, desto wichtiger wird das Kontextfenster – bei kurzen Alltagsfragen spielt es dagegen kaum eine Rolle.
Praxisbeispiel: Kosten für die Programmierschnittstelle abschätzen
Ein Immobilienbüro möchte pro Monat automatisiert rund 50 Objektbeschreibungen mit Grok 4.5 vorformulieren lassen. Für jede Beschreibung werden geschätzt 1.000 Token an Eingabe (Objektdaten, Rahmenbedingungen) und 1.500 Token an Ausgabe (fertiger Text) benötigt.
- Eingabe: 50 x 1.000 = 50.000 Token, bei 2 Euro pro Million Token ergibt das rund 0,10 Euro
- Ausgabe: 50 x 1.500 = 75.000 Token, bei 6 Euro pro Million Token ergibt das rund 0,45 Euro
- Gesamtkosten pro Monat: rund 0,55 Euro
Das Rechenbeispiel zeigt: Die reinen Textkosten über die Programmierschnittstelle sind bei überschaubaren Textmengen sehr gering – die eigentlichen Kosten entstehen meist durch die Entwicklung und Pflege der Anbindung, nicht durch die einzelnen Anfragen selbst.
Häufig gestellte Fragen (FAQ)
Welches Grok-Modell sollte ich als Einsteiger nutzen?
Für den Einstieg reicht in der Regel das Standardmodell in der kostenlosen oder der günstigsten bezahlten Stufe. Ein Umstieg auf leistungsstärkere Modelle lohnt sich erst, wenn man an Grenzen bei komplexen oder langen Aufgaben stößt.
Was bedeutet „Kontextfenster“ in einfachen Worten?
Das Kontextfenster beschreibt, wie viel Text ein Modell gleichzeitig „im Kopf“ behalten kann. Ein großes Kontextfenster ist wichtig, wenn man lange Dokumente auf einmal analysieren lassen möchte, spielt bei kurzen Fragen aber kaum eine Rolle.
Ist Grok 4.20 dasselbe wie Grok 4?
Nein. Grok 4.20 ist eine eigenständige, spätere Modellgeneration mit deutlich größerem Kontextfenster und einer internen Mehr-Rollen-Prüfung, die bei Grok 4 noch nicht vorhanden war.
Wann kommt Grok 5?
Ein offizielles Datum gibt es bis August 2026 nicht. xAI hat bestätigt, dass ein Nachfolgemodell in Arbeit ist, ohne einen genauen Termin zu nennen.
Kann ich mit Grok verlässliche Marktdaten für Immobilienentscheidungen bekommen?
Grok kann aktuelle Diskussionen und Stimmungen zusammenfassen, ersetzt aber keine geprüften amtlichen Daten oder eine fachliche Marktanalyse. Es eignet sich am besten als schnelle Ergänzung, nicht als alleinige Entscheidungsgrundlage.
Einen Überblick über das Unternehmen xAI selbst, die Preisstufen und die Datenschutz-Einordnung gibt es auf unserer xAI-Anbieterseite. Wer stattdessen die anderen großen KI-Anbieter im Vergleich sehen möchte, findet die Übersicht auf der KI-Modelle-Vergleichsseite.



















