Le verdict le plus sévère sur Grok 4.7 est venu de la personne la moins susceptible d'esquiver la question. Le 27 septembre, le fondateur de xAI Elon Musk a admis, dans un entretien avec China Media Group (CMG), que Grok 4.7 n'est pas aussi bon que le tout nouveau Opus 5.5 d'Anthropic – ses mots exacts : « a solid workhorse of a model », mais « not as good as, say, Opus 5.5 that just got released ». Dans cet entretien, réalisé au siège mondial de l'ingénierie de Tesla, Musk a quantifié avec une franchise inhabituelle l'écart de xAI : xAI travaille sérieusement sur l'IA depuis environ trois ans, Anthropic depuis environ six ans, et il s'attend à « rattraper la frontière courant de l'année prochaine, très probablement ».
Ce qu'il a dit concrètement
Au-delà de cet aveu, Musk a dévoilé plusieurs signaux d'activité jusque-là non publics :
- Grok Bot croît très vite : l'assistant numérique personnel de xAI, Grok Bot, « croît d'environ 100 % par mois » – l'une des lignes de produits à la croissance la plus rapide qu'il a tenu à citer.
- Pivot de la stratégie de données vers le monde réel : xAI n'a jusqu'ici utilisé « qu'une petite partie » des données d'entraînement de SpaceX et prévoit d'y ajouter celles de Tesla. L'objectif : rendre l'IA douée pour la « real world engineering » (l'ingénierie du monde réel) – là où la force d'Anthropic, selon lui, est de rendre l'IA douée pour le génie logiciel.
- Éloge des modèles chinois : il a qualifié les modèles d'IA chinois d'excellents, avec la meilleure performance par unité de calcul au monde, et prédit que la Chine résoudra ses contraintes de lithographie et de calcul sur puces d'ici deux à trois ans.
L'entretien a aussi évoqué l'exploitation commerciale du Cybercab au Texas, la prédiction de plus d'un milliard de robots humanoïdes en dix ans et le « universal high income » (revenu élevé universel) – visions lointaines typiques de Musk, moins riches en informations concrètes que les trois points ci-dessus.
En quoi cela diffère de son ton habituel
Jusqu'ici, Musk parlait de Grok sur un ton d'offensive totale. Admettre publiquement qu'il est derrière Opus 5.5, et fixer le rattrapage à « l'année prochaine », relève pour l'essentiel de la gestion des attentes : mettre d'abord le retard à court terme sur la table, puis réorienter le récit vers le fossé de données propriétaire de xAI.
La chronologie mérite aussi l'attention. Opus 5.5 est sorti le 22 septembre et s'est immédiatement hissé en tête du classement Text Arena (voir le briefing IA du 27 septembre de cette rubrique) ; Grok 4.7 est le fer de lance du cycle de sorties accéléré lancé fin juillet, et une évaluation antérieure a montré qu'il pouvait entrer dans le top 4 du codage agentique – au prix d'environ 80 000 tokens par tâche. L'étiquette « solid workhorse » de Musk correspond bien à ce profil : capable et fiable, mais pas le plus fort.
Trois signaux derrière cet aveu
Premièrement, le centre de gravité de la concurrence se déplace de « quel modèle est le plus intelligent » vers « quelles données personne d'autre ne peut obtenir ». Anthropic fait de l'IA une spécialiste du génie logiciel ; xAI veut transformer les données physiques réelles accumulées par les fusées, les usines et la conduite autonome en fossé défensif. Le bémol, reconnu par Musk lui-même : « seule une petite partie » des données de SpaceX a été exploitée jusqu'ici – le récit en est encore au stade du plan, et le pari placé quand Grok 4.5 est entré en test privé chez SpaceX et Tesla exigera des investissements suivis pour porter ses fruits.
Deuxièmement, la croissance de 100 % par mois de Grok Bot montre que xAI bascule vers les assistants personnels grand public. Tous les laboratoires de pointe cherchent des courbes de croissance au-delà du modèle lui-même : Meta associe lui aussi du matériel à son agent personnel. Pour l'utilisateur ordinaire, les futurs gains d'expérience de Grok viendront probablement davantage de formes de produits comme le Bot que du modèle de base.
Troisièmement, le message pour les développeurs qui choisissent un modèle est direct. Pour les tâches exigeant le niveau de pointe, Opus 5.5 reste pour l'instant le choix le plus sûr ; Grok 4.7 se positionne comme la « bête de somme fiable », adaptée aux scénarios sensibles au coût et à la stabilité, sans exigence extrême. Ce n'est que lorsque xAI exploitera réellement les données d'ingénierie du monde réel que ce jugement pourra changer.