SpaceXAI a publié Grok 4.5 en mettant l'accent sur le prix et la vitesse

SpaceXAI a publié Grok 4.5 en mettant l'accent sur le prix et la vitesse

SpaceXAI a présenté Grok 4.5, un nouveau modèle de programmation, de tâches basées sur des agents et de travail intelligent. L'entreprise l'a appelé son système le plus solide.

Modèle disponible via APIdans Grok Build et Cursor sur tous les tarifs. Il n'est pas encore possible d'utiliser Grok 4.5 dans l'Union européenne – le lancement est prévu pour la mi-juillet.

L'accent principal de la version est le coût et la rapidité. Grok 4.5 coûte 2 $ pour 1 million de jetons d'entrée et 6 $ pour 1 million de jetons de sortie. A titre de comparaison : Claude Opus 4.8 d'Anthropic coûtera respectivement 5 $ et 25 $, Claude Fable 5 coûtera 10 $ et 50 $, et GPT-5.6 Sol d'OpenAI coûtera 5 $ et 30 $.

GPT-5.6 est encore en version préliminaire limitée : OpenAI a ouvert la famille de modèles à un petit groupe de partenaires de confiance et prévoit de rendre Sol, Terra et Luna généralement disponibles dans les semaines à venir. Dans la même gamme, Luna a un prix inférieur : 1 $ pour 1 million de jetons d'entrée et 6 $ pour 1 million de jetons de sortie.

Selon Elon Musk, Grok 4.5 est un « modèle de classe Opus, mais plus rapide, moins cher et plus efficace en termes de jetons ». Il a ensuite précisé que, selon l'évaluation interne de SpaceXAI, le système est « à peu près comparable à Opus 4.7mais beaucoup plus vite. »

Ce que les tests ont montré

Dans les résultats publiés par SpaceXAI, Grok 4.5 semble ambigu : le modèle n'est pas devenu leader dans tous les tests, mais il n'était certainement pas en retard sur ses concurrents.

Sur DeepSWE 1,0 Grok 4,5 a obtenu un score de 62 %. Il est derrière Fable avec 66,1% et GPT-5,5 avec 64,31%, mais devant Claude Opus 4.8 avec 55,75% et Opus 4.7 avec 40,12%.

Capture d'écran - 09/07/2026 au 21/10/02Capture d'écran - 09/07/2026 au 21/10/02
Source : SpaceXAI

Sur DeepSWE 1.1 le résultat est inférieur : Grok 4.5 a reçu 53% contre 59% pour Opus 4.8, 67% pour GPT-5.5 et 70% pour Fable. Sur SWE Banc Pro le modèle a montré 64,7%. C'est supérieur à GPT-5.5 avec 58,6 % et presque à égalité avec Opus 4.7 avec 64,3 %, mais inférieur à Opus 4.8 avec 69,2 % et Fable avec 80,4 %.

Sur Banc de terminaux 2.1 Grok 4.5 a obtenu un score de 83,3 % – presque à égalité avec GPT-5.5 avec 83,4 %, mais en dessous de Fable avec 84,3 %. Sur Marathon SUE il arrive en première position avec 29% contre 26% pour l'Opus 4.8 et 24% pour Fable. La société a également annoncé le leadership de Grok 4.5 sur Référence des agents juridiques de Harvey's.

Où fonctionne l’argument SpaceXAI ?

L’argument le plus important en faveur de cette libération n’est pas lié au résultat maximum aux tests, mais à l’économie. Selon SpaceXAI, sur les tâches SWE Bench Pro, Grok 4.5 a utilisé en moyenne 15 954 jetons de sortie par tâche. Claude Opus 4.8 comptait 67 020 jetons, soit 4,2 fois plus.

Capture d'écran - 09/07/2026 au 36/10/2Capture d'écran - 09/07/2026 au 36/10/2
Source : SpaceXAI

Pour les équipes qui exécutent l’IA sur un grand nombre de tâches, cela affecte le coût final du travail. Avec un coût par jeton de sortie inférieur, Grok 4.5 peut être plus rentable dans des scénarios comportant un grand nombre d'itérations : corrections de bugs, génération de révisions, révisions de code et boucles d'agents.

SpaceXAI a également indiqué un taux de génération d'environ 80 jetons par seconde et une fenêtre contextuelle pour 500 000 jetons. L'entreprise positionne le modèle comme un compromis entre qualité, rapidité et coût.

Connexion avec le curseur

La version SpaceXAI indique que Grok 4.5 a été formé avec le service Cursor AI. La société n'a pas divulgué la composition complète des données, mais a indiqué que le modèle avait été créé pour des tâches de programmation, le travail basé sur des agents avec des outils, la science, l'ingénierie et les mathématiques.

Selon Decrypt, la formation a utilisé les données des sessions de développement Cursor, y compris les traces de débogage et les modifications de code réelles, et pas seulement des référentiels statiques.

En juin, SpaceX a conclu un accord pour acheter le service d'IA d'une valeur de 60 milliards de dollars. L'opération portera sur des actions de classe A de SpaceX et la clôture est attendue au troisième trimestre 2026, sous réserve des approbations réglementaires.

Grok 4.5 est devenu l'un des premiers modèles majeurs après la fusion de la direction IA de Musk avec SpaceX. Pour sa formation, l'entreprise a utilisé des dizaines de milliers GPU Nvidia GB300.

Rappelons qu'en février, les médias ont rapporté les projets de SpaceX et xAI, alors séparés, de créer un logiciel pour les armes autonomes du Pentagone.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE



Voir l’article original en russe