- xAI a lancé Grok 4.5, entraîné sur des dizaines de milliers de GPU Nvidia GB300, ciblant la programmation, les agents et les tâches cognitives.
- Sur Terminal Bench 2.1, Grok 4.5 obtient 83,3 %, se classant presque à égalité avec GPT 5.5 (83,4 %) et juste en dessous de Fable 5 (84,3 %).
- Sur DeepSWE 1.1, Grok 4.5 affiche un score de 53 %, s’avérant moins performant que GPT 5.5 (67 %) et Fable 5 (70 %) dans la résolution de bugs réels sur GitHub.
- Sur SWE Bench Pro, Grok 4.5 atteint 64,7 %, devançant GLM 5.2 (62,1 %) mais restant en deçà d’Opus 4.8 (69,2 %) et de Fable 5 (80,4 %).
- xAI précise que le modèle a été entraîné à l’aide d’un processus rigoureux de filtrage des données, éliminant les doublons et sélectionnant des données sectorielles pour en optimiser la qualité.
- La phase d’apprentissage par renforcement a mobilisé des centaines de milliers de tâches, principalement axées sur le génie logiciel, avec un système de notation automatisé et une infrastructure d’entraînement asynchrone pour des agents s’exécutant sur plusieurs heures.
- Le tarif de Grok 4.5 est fixé à 2 USD par million de tokens d’entrée et 6 USD par million de tokens de sortie, le positionnant comme le moins cher de la catégorie des modèles de haute performance.
- À titre de comparaison, Opus 4.8 s’élève à 5 USD et 25 USD, GPT 5.5 et GPT 5.6 s’affichent à 5 USD and 30 USD, tandis que Fable 5 grimpe jusqu’à 10 USD et 50 USD par million de tokens d’entrée et de sortie.
- xAI affirme que Grok 4.5 consomme environ 4,2 fois moins de tokens qu’Opus 4.8 lors des tests SWE Bench Pro, pour une vitesse d’environ 80 tokens par seconde.
- La stratégie de xAI s’apparente à celle de firmes chinoises telles que Zhipu ou DeepSeek : réduire l’écart de performance puis mener une guerre des prix à la baisse.
- Grok 4.5 est déjà accessible sur Grok Build, Cursor et la plateforme xAI Console, tout en prenant en charge des extensions pour Word, PowerPoint et Excel.
- Le modèle n’est pas encore distribué au sein de l’Union européenne, avec un lancement attendu pour la mi-juillet ; son développement se fait en parallèle avec l’éditeur de code Cursor depuis le rachat de cette entreprise par SpaceX dans le cadre d’une transaction entièrement en actions évaluée à 60 milliards de dollars USD.
- 📌 Conclusion : Grok 4.5 ne trône pas en tête de tous les classements de benchmarks, mais exerce une immense pression concurrentielle grâce à sa politique de prix très agressiva. Son coût, qui ne représente que 20 % environ de celui de Fable 5 et s’avère nettement inférieur à celui de GPT 5.5, combiné à une moindre consommation de tokens, permet de réduire drastiquement les coûts d’exploitation. Si son efficacité réelle s’aligne sur les promesses, Grok 4.5 pourrait s’imposer comme un choix incontournable pour les entreprises soucieuses d’équilibrer performances et dépenses, plutôt que de courir après le modèle affichant le score de benchmark le plus élevé.
Grok 4.5 choque avec des prix plusieurs fois inférieurs à ceux de GPT 5.5 et Fable 5 ; l’écart de score a-t-il encore de l’importance ?
Related Posts
Contact
E-mail: info@vietmetric.vn
Adresse : N° 34, Allée 91, Rue Tran Duy Hung, Quartier Yen Hoa, Ville de Hanoï
© 2026 Vietmetric
