Grok 4.6 bringt 500K Kontext, doch ab 200.000 Token kostet die komplette Anfrage das Doppelte
xAI hat Grok 4.6 mit dem gleichen Listenpreis wie den Vorgänger gestartet. Die entscheidende Zahl steht nicht im Ankündigungspost, sondern in der Preistabelle.

xAI hat am 12. August Grok 4.6 veröffentlicht, und die Ankündigung liest sich zunächst wie ein Geschenk: 500.000 Token Kontext, dazu derselbe Listenpreis wie beim Vorgänger, nämlich 2 Dollar je Million Eingabe-Token und 6 Dollar je Million Ausgabe-Token. Wer die Preistabelle daneben legt, findet allerdings eine Klausel, die in keinem Werbesatz auftaucht.
Die Schwelle liegt bei 200.000 Token
Sobald ein Prompt die Marke von 200.000 Token erreicht, rechnet xAI die gesamte Anfrage zum Langkontext-Tarif ab: 4 Dollar Eingabe, 12 Dollar Ausgabe je Million. Nicht nur die Token oberhalb der Grenze, sondern alles, inklusive der zwischengespeicherten Anteile und der kompletten Antwort. Die Schwelle liegt damit bei rund 40 Prozent des beworbenen Kontextfensters.
Praktisch heißt das: Ein Agent, der sich durch eine mittelgroße Codebasis liest, überschreitet die Grenze beiläufig. Der Sprung passiert nicht sanft, sondern als Kante. Eine Anfrage mit 199.000 Token kostet die Hälfte einer Anfrage mit 201.000 Token, obwohl der Unterschied im Inhalt kaum messbar ist.
Leiser wurde eine zweite Anpassung eingezogen: Der Preis für zwischengespeicherte Eingaben stieg um 67 Prozent, von 0,30 auf 0,50 Dollar je Million im Standardtarif und von 0,60 auf 1,00 Dollar im Langkontext-Tarif. Gerade Agenten, die denselben Projektkontext immer wieder mitschicken, leben von diesem Cache.
Was das Modell besser kann
Die Verbesserungen stammen laut xAI überwiegend aus dem Nachtraining, nicht aus einem größeren Basismodell. In der veröffentlichten Vergleichstabelle erreicht Grok 4.6 einen Wert von 61 im Artificial Analysis Intelligence Index und liegt damit gleichauf mit GPT-5.6 Sol Max. Dazu kommen 65,9 Prozent bei DeepSWE v1.1, 57,5 Prozent bei APEX-Agents und 26,0 Prozent bei Terminal-Bench v3.0. Alle Werte stammen aus der Tabelle des Anbieters, eine unabhängige Nachmessung steht aus.
Verfügbar ist das Modell vom ersten Tag an in Cursor und in xAIs eigener Coding-Umgebung Grok Build, dazu über die API und die üblichen Marktplätze.
Die offene Frage für Europa
Ob Grok 4.6 in der EU von Anfang an nutzbar ist, lässt sich derzeit nicht belegen. Der Vorgänger liefert allerdings einen Anhaltspunkt: Grok 4.5 startete am 8. Juli in 47 Ländern und blieb in allen 27 EU-Staaten zunächst gesperrt, weil der AI Act das Modell als besonders leistungsfähig einstuft und dafür Sicherheitsprüfungen verlangt. Erst rund neun Tage später kam der Zugang über die API-Konsole. Wer produktiv plant, sollte die Verfügbarkeit für den eigenen Standort also prüfen, bevor er ein Angebot darauf aufbaut.
Was das für Webdesigner bedeutet
Für Agenturen, die KI-Assistenten in ihren Alltag holen, ist die Nachricht weniger das Modell als die Rechnung. Drei Punkte lohnen einen Blick:
- Kontext bewusst schneiden. Wer Repositories oder lange Dokumente in einem Rutsch übergibt, zahlt schnell den doppelten Tarif. Kleinere, gezielte Anfragen bleiben unter der Schwelle und liefern oft ohnehin präzisere Antworten.
- Nicht auf den Listenpreis kalkulieren. Zwei und sechs Dollar sind der Startwert, nicht der Durchschnitt. Für eine belastbare Kalkulation zählt der Tarif, in dem die eigenen typischen Anfragen tatsächlich landen.
- Standort prüfen, bevor du zusagst. Solange die EU-Verfügbarkeit ungeklärt ist, gehört sie nicht in ein Kundenangebot.
Der breitere Trend bleibt derselbe: Die Modelle rücken bei der Leistung enger zusammen, der Unterschied entsteht zunehmend im Preismodell und in der Frage, wo ein Anbieter überhaupt liefern darf. Wer seine Akquise unabhängig von einzelnen Werkzeugen aufstellt, ist davon weniger betroffen, mehr dazu im Leitfaden zu Webdesign-Leads.
Das Fazit
Grok 4.6 ist ein solider Zwischenschritt: gleiche Grundlage, besseres Nachtraining, gleichauf mit der Spitze in einem verbreiteten Index. Der eigentliche Nachrichtenwert steckt aber in der Preisstruktur. Ein Anbieter, der ein 500.000-Token-Fenster bewirbt und den Tarif bei 200.000 Token verdoppelt, verkauft ein Versprechen, dessen zweite Hälfte spürbar teurer ist. Für die Praxis heißt das: Die Frage lautet künftig nicht mehr nur, welches Modell das beste ist, sondern bei welcher Prompt-Größe die eigene Rechnung kippt.