Grok 4.7 a été officiellement publié. SpaceXAI l’a positionné comme le dernier modèle phare pour la programmation et le travail de connaissance, et a fourni une logique de mise à jour simple : comparé à Grok 4.6, tout en conservant le prix standard de l’API et la vitesse de service inchangés, les capacités pour les tâches longues, la programmation d’agents et le travail professionnel de connaissance se sont toutes améliorées.
Les mises à niveau au même prix ont creusé l’écart de performance
Le prix standard de l’API pour Grok 4.7 reste 2 $ par million de jetons d’entrée et 6 $ par token de sortie, identique à Grok 4.6. La société officielle propose également une version rapide avec double vitesse, correspondant au double du prix.
Les gains de performance sont concentrés sur des tâches complexes. CursorBench 4.0 est passé de 40,4 % dans Grok 4,6 à 46,3 % ; Terminal-Bench 4.0 est passé de 20,3 % à 38,0 %, doublant presque. Les scores AA Briefcase sont également passés de 1546 à 1657.
Grok 4.7 ne consiste pas seulement à modifier les paramètres du modèle
SpaceXAI a indiqué que Grok 4.7 utilise un modèle fondamental plus large que Grok 4.6 et suit un entraînement par renforcement plus long. Les tâches d’entraînement se concentrent davantage sur des problèmes qui prennent des heures à être résolus, tout en renforçant les capacités d’auto-vérification, de gestion de contexte long et d’exécution continue du modèle.
Cela a fait évoluer l’objectif de Grok 4.7, passant de « répondre à des questions plus intelligentes » à « accomplir des tâches complexes ». L’accent officiel est particulièrement mis sur les scénarios professionnels tels que les documents, les présentations, le droit, le génie électrique et les opérations terminologiques à long terme, avec l’adaptation native du Grok Bot incluse dans la formation.
La concurrence IA a commencé à calculer les coûts des tâches
La clé de Grok 4.7 n’est pas de dépasser un seul benchmark, mais d’améliorer les taux d’accomplissement effectifs des tâches tout en maintenant le système de prix de Grok 4.6. Pour les agents de codage, le prix unitaire du jeton, la vitesse d’inférence et la probabilité d’accomplir une tâche deviennent plus importants que les simples scores de modèle.
Les données issues de l’analyse artificielle tierce montrent que Grok 4.7 xhigh a un QI de 46 et une vitesse de sortie d’environ 38,8 jetons/s. Il ne domine pas tous les indicateurs globaux, mais a établi une forte densité de performance dans une fourchette de prix similaire.
Grok 4.7 est entré dans des environnements de développement tels que Grok API, Cursor, Grok Build et GitHub Copilot. La grande course aux modèles est en train de passer de « qui est le plus intelligent » à « qui peut réaliser des travaux plus longs et plus réalistes à moindre coût », ce qui pourrait être le changement le plus notable pour cette génération de Grok.