xAI lance Grok 4.5, son modèle le plus puissant, avec une fenêtre de contexte de 500 000 tokens

xAI a publié Grok 4.5 le 8 juillet, le qualifiant de modèle le plus puissant de la société à ce jour. Entraîné sur des dizaines de milliers de GPU Nvidia GB300 et construit sur un nouveau modèle fondamental de 1,5 billion de paramètres que xAI appelle V9, le modèle est désormais disponible dans Grok Build, sur tous les forfaits Cursor et via la console API xAI.
Ce que le modèle peut faire
Grok 4.5 prend en charge une fenêtre de contexte de 500 000 tokens, ainsi que l'entrée de texte et d'image, l'appel de fonctions, les sorties structurées, la recherche Web et X, l'exécution de code et une profondeur de raisonnement configurable. xAI le sert à environ 80 tokens par seconde, et la société affirme qu'il offre le double de l'efficacité des tokens par rapport aux modèles de frontière concurrents sur des tâches comparables — ce qui signifie qu'il peut produire des résultats équivalents tout en consommant moins de tokens, réduisant ainsi le coût effectif d'une tâche donnée avant même de prendre en compte le prix affiché.
Les prix sont fixés à 2 $ par million de tokens d'entrée et 6 $ par million de tokens de sortie, avec un tarif réduit de 0,50 $ par million pour l'entrée en cache et des tarifs plus élevés une fois qu'une requête dépasse 200 000 tokens.
Résultats des benchmarks, avec quelques réserves
xAI positionne Grok 4.5 principalement comme un modèle de codage et de travail agentique. Sur le benchmark SWE Marathon — un test de tâches d'ingénierie logicielle soutenues en plusieurs étapes — Grok 4.5 a obtenu un taux de résolution pass@1 de 29,0 %, devant Opus 4.8 d'Anthropic à 26,0 % et le précédent modèle Fable de xAI à 24,0 %. Le modèle domine également sur DeepSWE 1.0 (62,0 %) et Terminal-Bench 2.1 (83,3 %).
Cette domination n'est cependant pas universelle. Parmi les quatre benchmarks que xAI a choisi de publier parallèlement au lancement, Grok 4.5 en gagne deux et en perd deux face à Opus 4.8 — une répartition qui suggère que le modèle constitue une réelle avancée dans des workflows de codage spécifiques plutôt qu'une amélioration globale sur tous les rivaux pour toutes les tâches.
Écart de disponibilité dans l'UE
Grok 4.5 n'est pas encore disponible pour les utilisateurs européens, ni via les produits propres de xAI ni via sa console API. xAI indique que l'accès dans l'UE est attendu pour la mi-juillet, sans donner de date ferme. Ce retard place Grok 4.5 dans un schéma de déploiement de modèles d'IA en 2026 où l'examen réglementaire — qu'il s'agisse de contrôles de conformité à l'AI Act de l'UE ou de processus similaires — a séparé la date de lancement initiale d'un modèle de sa disponibilité en Europe de quelques jours à quelques semaines.
Contexte concurrentiel
Cette sortie intervient la même semaine où OpenAI achève le déploiement progressif de sa famille GPT-5.6 (Sol, Terra et Luna) et met la pression sur Anthropic, dont Opus 4.8 reste compétitif sur deux des quatre benchmarks sélectionnés par xAI. Pour les développeurs qui choisissent entre les modèles de codage de frontière, le message pratique est qu'aucun modèle unique ne domine actuellement tous les tableaux : les résultats de Grok 4.5 sur SWE Marathon et Terminal-Bench en font un choix solide pour certaines tâches de codage agentiques, tandis qu'Opus 4.8 reste en tête sur les benchmarks que xAI n'a pas remportés.
Originally reported by xAI. Read the original article for additional details.
View original source