Das härteste Urteil über Grok 4.7 kam von der Person, die einer Frage am wenigsten ausweichen würde. Am 27. September gab xAI-Gründer Elon Musk in einem Interview mit der China Media Group (CMG) zu, dass Grok 4.7 nicht so gut ist wie Anthropics frisch veröffentlichtes Opus 5.5 – seine exakten Worte: "a solid workhorse of a model", aber "not as good as, say, Opus 5.5 that just got released". In dem Interview, das in Teslas globaler Engineering-Zentrale stattfand, quantifizierte Musk den Rückstand von xAI ungewöhnlich offen: xAI arbeite seit etwa drei Jahren ernsthaft an KI, Anthropic seit etwa sechs Jahren, und er erwarte, "irgendwann nächstes Jahr" die Spitze einzuholen.
Was er konkret sagte
Über das Eingeständnis hinaus nannte Musk mehrere Geschäftssignale, die bisher nicht öffentlich waren:
- Grok Bot wächst rasant: xAIs persönlicher digitaler Assistent Grok Bot "wächst etwa 100 % pro Monat" – eine der am schnellsten wachsenden Produktlinien, die er namentlich hervorhob.
- Datenstrategie schwenkt auf die reale Welt: xAI hat bislang "nur einen kleinen Teil" der Trainingsdaten von SpaceX genutzt und plant, künftig auch Teslas Trainingsdaten einzubeziehen. Ziel ist es, KI gut in "real world engineering" zu machen – während Anthropics Stärke aus seiner Sicht darin liegt, KI gut in Software-Engineering zu machen.
- Lob für chinesische Modelle: Er bezeichnete chinesische KI-Modelle als exzellent, mit der weltweit besten Leistung pro Recheneinheit, und prognostizierte, dass China seine Lithografie- und Chip-Rechenengpässe in zwei bis drei Jahren lösen werde.
Das Interview streifte auch den kommerziellen Betrieb des Cybercab in Texas, die Prognose von mehr als einer Milliarde humanoider Roboter binnen zehn Jahren sowie "universal high income" – klassische Musk-Fernvisionen mit weniger konkretem Informationsgehalt als die drei Punkte oben.
Was sich an seinem Ton geändert hat
Bisher sprach Musk über Grok meist in voll offensivem Tonfall. Öffentlich einzuräumen, dass es hinter Opus 5.5 zurückbleibt, und das Aufholen auf "nächstes Jahr" festzulegen, ist im Kern Erwartungsmanagement: erst den kurzfristigen Rückstand offen auf den Tisch legen, dann die Erzählung auf xAIs proprietären Datengraben lenken.
Auch die Zeitleiste ist bemerkenswert. Opus 5.5 erschien am 22. September und setzte sich sofort an die Spitze der Text Arena (siehe das KI-Briefing vom 27. September dieser Rubrik); Grok 4.7 ist das Flaggschiff des beschleunigten Release-Zyklus seit Ende Juli, und eine frühere Auswertung zeigte, dass es im agentischen Coding unter die Top vier vordringen kann – zum Preis von rund 80.000 Tokens pro Aufgabe. Musks Etikett "solid workhorse" passt zu diesem Profil: leistungsfähig und verlässlich, aber nicht das stärkste.
Drei Signale hinter dem Eingeständnis
Erstens verlagert sich der Wettbewerbsschwerpunkt von "wessen Modell ist klüger" zu "wessen Daten niemand sonst bekommt". Anthropic macht KI zum Software-Engineering-Spezialisten; xAI will die realen physikalischen Daten aus Raketen, Fabriken und autonomem Fahren zum Burggraben machen. Der Haken, wie Musk selbst zugab: Von SpaceX' Daten wurde "bislang nur ein kleiner Teil" genutzt – die Erzählung steckt noch im Blaupausenstadium, und die Wette, die mit Grok 4.5s privaten Tests bei SpaceX und Tesla platziert wurde, braucht weitere Investitionen, um aufzugehen.
Zweitens zeigt Grok Bots 100-%-Wachstum pro Monat, dass sich xAIs Schwerpunkt zu Verbraucher-Assistenten verlagert. Alle Frontier-Labore suchen Wachstumskurven jenseits des Modells selbst: Auch Meta koppelt zuletzt Hardware an seinen persönlichen Agenten. Für normale Nutzer dürften Groks künftige Erfahrungsgewinne eher aus Produktformen wie dem Bot kommen als aus dem Basismodell.
Drittens ist die Botschaft für Entwickler bei der Modellauswahl eindeutig. Für Aufgaben, die Frontier-Niveau verlangen, bleibt Opus 5.5 vorerst die sicherere Wahl; Grok 4.7 ist als "verlässliches Arbeitstier" positioniert – geeignet für kosten- und stabilitätssensible Szenarien ohne Extremanforderungen. Erst wenn xAI reale Engineering-Daten tatsächlich nutzt, könnte sich dieses Urteil ändern.