Moteur plus gros, même vitesse ?
Grok 4.7 est arrivé avec un bruit sourd plutôt qu'avec fracas. Malgré le battage médiatique important d'Elon Musk avant sa sortie, la communauté a largement considéré le dernier modèle de xAI comme une amélioration marginale par rapport à Grok 4.6, ne parvenant pas à offrir un saut significatif dans les capacités de raisonnement globales. De nombreux utilisateurs ont trouvé le modèle « décevant », citant des expériences frustrantes comme des capacités frontend « inacceptablement mauvaises », des capacités 3D inexistantes et le fait de rester « coincé dans des boucles aléatoires de style Gemini ». Il ne ressemblait tout simplement pas à un modèle de pointe face à des concurrents comme GPT-5.6 Sol (max) ou Claude Claude Opus.
Sous le capot, cependant, Grok 4.7 représente un saut architectural substantiel. Il bénéficie d'un nouveau modèle de base de 2,1 billions de paramètres, soit une augmentation massive de 40 % par rapport aux 1,5 billion de paramètres de Grok 4.6. Cette base plus large a fait l'objet d'un cycle d'entraînement par apprentissage par renforcement plus long et plus difficile, ciblant spécifiquement les tâches de plusieurs heures et une auto-vérification améliorée. Il intègre également une toute nouvelle pile de protection plus solide et améliore les capacités pour le « Grok Bot harness ».
Ce décalage flagrant entre des spécifications sous-jacentes impressionnantes et les performances perçues met en évidence une tendance critique : l'intelligence irrégulière. Bien que Grok 4.7 montre des gains significatifs dans des domaines spécifiques, tels que les performances des agents de codage (obtenant 56 sur l'Artificial Analysis Coding Agent Index, contre 47 pour Grok 4.6) et le travail intellectuel agentique à long terme, ces améliorations ne se traduisent pas par une expérience utilisateur universellement plus intelligente et plus cohérente. En fait, certains tests indiquent que Grok 4.7 raisonne moins que Grok 4.6 dans certains domaines. De plus, ses gains ont un coût plus élevé, utilisant plus du double des jetons de sortie pour certaines tâches par rapport à son prédécesseur.
La nouvelle arme secrète du codeur
Grok 4.7 peut décevoir les utilisateurs généraux, mais les codeurs devraient y prêter attention. Malgré des impressions initiales mitigées, le dernier modèle de xAI excelle dans le travail intellectuel agentique et les tâches de codage qui exigent une cohérence soutenue. Il a progressé sur l'Artificial Analysis Coding Agent Index, passant de 47 à 56, un bond significatif par rapport aux performances de son prédécesseur.
Les données de référence confirment ces gains ciblés, montrant où Grok 4.7 brille vraiment. Il a réalisé des gains majeurs sur Terminal-Bench 4.0, obtenant 38,0 % contre 20,3 % pour Grok 4.6. De plus, il a devancé des concurrents redoutables comme Claude Fable 5.1 Max sur le benchmark complexe DeepSWE v1.1, atteignant 71,0 % contre 65,2 %. Ce ne sont pas des augmentations marginales.
La stratégie de xAI est claire : positionner Grok 4.7 comme un outil de travail spécialisé pour les développeurs. Ils pilotent des intégrations profondes et immédiates dans les outils où les codeurs apprécieront le plus ses compétences spécialisées et remarqueront ses améliorations ciblées. Vous pouvez trouver Grok 4.7 en cours de déploiement dans :
- Cursor
- Grok Build
- GitHub Copilot
Cette intégration directe cible les utilisateurs qui tireront parti de ses nouvelles forces, ce qui en fait une mise à jour précieuse, bien que de niche, pour les environnements de développement professionnels.
Le coût caché de la puissance de Grok
Sur le papier, Grok 4.7 ressemble initialement à une offre compétitive en termes de valeur. xAI a maintenu la tarification standard de l'API identique à celle de son prédécesseur, Grok 4.6 : 2 $ par million de jetons d'entrée et 6 $ par million de jetons de sortie. Cela correspond à la tarification de modèles comme Claude Claude Opus, semblant offrir des capacités de pointe sans coût supplémentaire.
Voici le piège, et il est de taille pour votre portefeuille : les gains de Grok 4.7 ont un prix élevé en consommation de jetons. Son paramètre 'xhigh', qui débloque les performances supérieures discutées précédemment, consomme plus du double de jetons que Grok 4.6 pour des tâches identiques. Plus précisément, Grok 4.7 (xhigh) consomme environ 81 000 jetons de sortie par tâche de l'Artificial Analysis Intelligence Index, tandis que Grok 4.6 (xhigh) n'en utilisait que 38 000.
Cet appétit massif en jetons signifie que Grok 4.7 n'est pas réellement un leader en termes de coûts. En usage réel, ses dépenses opérationnelles dépassent souvent même celles de GPT-6 Astra, ce qui le rend nettement plus coûteux que son prédécesseur. Pour plus de détails sur ses spécifications techniques et sa gestion des jetons, consultez la documentation Grok 4.7 | SpaceXAI.
Par conséquent, Grok 4.7 ne se positionne pas comme une bonne affaire au quotidien, mais comme un outil premium pour des flux de travail spécifiques et exigeants. Si vous avez besoin de ses capacités exceptionnelles en travail intellectuel agentique et en programmation, en particulier pour des tâches complexes à long terme, le coût plus élevé pourrait être justifié. Sinon, vous payez beaucoup plus cher pour des améliorations générales marginales.
Cet article vous plaît ? Recevez-en un comme celui-ci chaque matin.
un e-mail par jour · désinscription en deux clics · aucun traqueur tiers
La place de Grok dans la course aux armements de l'IA
Grok 4.7 est clairement à la traîne par rapport aux modèles d'IA de pointe actuels. GPT-6 Astra et Claude Fable 5.1 détiennent une avance dominante sur les benchmarks d'intelligence générale, obtenant respectivement 53 et 51 sur l'Artificial Analysis Intelligence Index. Grok 4.7, en revanche, n'atteint que 46, soulignant sa position actuelle en dehors du groupe de tête des modèles généralistes.
La manière dont Elon Musk a récemment présenté Grok 4.7, le situant à peu près au même niveau que l'ancien Claude Claude Opus 5.0 d'Anthropic, signale un changement stratégique important pour xAI. Cette position plus conservatrice s'éloigne des affirmations hyperboliques précédentes. Elle adopte une stratégie réaliste d'amélioration constante et ciblée, visant spécifiquement le travail intellectuel agentique et la programmation.
En fin de compte, Grok 4.7 n'est pas la révolution que beaucoup attendaient, et il ne remet pas en cause l'intelligence générale de ses concurrents de premier plan. Il représente une mise à niveau stratégiquement cruciale, consolidant la position de xAI en tant qu'acteur de niche puissant dans l'espace des développeurs et de la programmation. Ses gains substantiels sur l'Artificial Analysis Coding Agent Index, passant de 47 à 56, prouvent sa valeur pour des applications ciblées, même s'il n'a pas réussi à percer dans le haut du panier des modèles généralistes.
Foire aux questions
Grok 4.7 est-il nettement meilleur que Grok 4.6 ?
Grok 4.7 offre des améliorations ciblées, notamment pour la programmation et les tâches agentiques, mais il ne s'agit pas d'un saut révolutionnaire en matière de raisonnement général. Pour de nombreux utilisateurs, le gain de performance peut sembler progressif malgré son modèle de base plus large.
Comment Grok 4.7 se compare-t-il à GPT-6 Astra et Claude Fable 5.1 ?
Grok 4.7 est à la traîne par rapport à GPT-6 Astra et Claude Fable 5.1 sur les benchmarks généraux d'intelligence et de raisonnement. Cependant, il peut les surpasser sur des benchmarks de programmation spécifiques, ce qui le positionne comme un outil spécialisé plutôt que comme un généraliste de premier plan.
Grok 4.7 est-il plus rentable que ses concurrents ?
Bien que sa tarification par jeton soit compétitive, Grok 4.7 utilise beaucoup plus de jetons par tâche que son prédécesseur et ses concurrents comme GPT-6 Astra. Cela peut entraîner des coûts réels plus élevés, annulant la valeur apparente.
Quels sont les principaux points forts de Grok 4.7 ?
Ses principaux points forts résident dans les performances de programmation agentique, montrant des gains notables sur des benchmarks comme l'Artificial Analysis Coding Agent Index et DeepSWE. Il est également immédiatement intégré dans des outils de développement tels que Cursor et GitHub Copilot.

