Grok 4.7 correspond au paramètre le moins cher de GPT-6 Astra et coûte 2,73 $ par tâche contre 0,82 $

L’article ne peut pas être activé avec JavaScript. Vous pouvez également activer JavaScript dans votre navigateur et sur la nouvelle page.

Le nouveau Grok 4.7 de SpaceXAI obtient un score de 46 sur l’indice d’intelligence d’analyse artificielle, la même note que le classement donne à GPT-6 Astra à son réglage d’effort le plus faible. L’exécution du même ensemble de tests coûte 2,73 $ avec Grok 4.7 et 0,82 $ avec Astra, de sorte que le modèle SpaceXAI se vend à 2 $ par million de jetons d’entrée, ce qui représente plus de trois fois la facture.

Grok 4.7 est arrivé le 21 septembre à 2 $ par million de jetons d’entrée et 6 $ par million de jetons de sortie, contre 4 $ et 20 $ pour GPT-5.6 Sol et 10 $ et 50 $ pour Claude Fable 5.1 dans la propre comparaison de l’entreprise. SpaceXAI affirme que le modèle est « servi au même prix et à la même vitesse que Grok 4.6 », et vend une variante rapide à deux fois la vitesse de sortie pour deux fois le prix.

Les jetons bon marché ne constituent pas une tâche bon marché

Le coût par tâche correspond à ce que l’analyse artificielle dépense pour exécuter son propre ensemble de tests, de sorte que le taux par million ne représente qu’une partie de la facture. Un modèle qui réfléchit plus longtemps ou prend plus de mesures peut générer un total plus important à partir d’un taux inférieur.

Poussez Grok 4.7 sur son réglage xhigh et le score reste à 46 tandis que le coût par tâche s’élève à 3,74 $. GPT-6 Astra à effort maximum atteint 53 pour 3,26 $, et Claude Fable 5.1 atteint 53 pour 5,98 $. Le même classement répertorie Grok 4.7 avec une fenêtre contextuelle de 500 000, où les deux autres sont sur 1 M.

Terminal-Bench 4.0 le classe 17ème

Le propre classement de Terminal-Bench a Grok 4.7 avec un effort xélevé, fonctionnant dans Grok Build, résolvant 37,6 % des tâches avec une marge de 3,5 points. Il s’agit du 17e rang sur 27 entrées, avec le GLM-5.3 de Z.ai une place au-dessus avec 41,8 % et le GPT-6 Astra sur Codex en tête avec 58,2 %.

SpaceXAI publie 38,0 % pour le même benchmark, qui se situe dans la marge du classement, donc les deux chiffres concordent. Terminal-Bench évalue également chaque exécution et a dépensé 3 683 $ sur Grok 4.7, sur 324 des 330 essais, contre 3,3 000 $ sur GPT-6 Astra à effort maximum et 2,3 000 $ sur le même modèle à effort élevé, qui a quand même obtenu un score de 57,9 %.

Le tableau de comparaison de la société compare Grok 4.7 avec Grok 4.6, GPT-5.6 Sol et Claude Fable 5.1 plutôt que GPT-6 Astra, qui a déchiffré un message Enigma de 1941 en septembre. Par rapport à cet ensemble, SpaceXAI rapporte 46,3 % sur CursorBench 4.0, 71,0 % sur DeepSWE v1.1 à effort élevé, 64,0 % sur EEBench, 19,6 % sur Harvey Legal Agent Benchmark et 56,7 % sur HealthBench Professional.

Astra apparaît dans un graphique SpaceXAI. Sur GDPval, la société place Grok 4,7 à xhigh sur 1 695 Elo contre 1 542 pour GPT-6 Astra à effort maximum, avec Claude Fable 5,1 devant les deux sur 1 735.

SpaceXAI affirme que les garanties sont les meilleures à ce jour

SpaceXAI affirme que Grok 4.7 « est le modèle le plus puissant que nous ayons testé en termes de refus et de résistance au jailbreak », et qu’il dépasse la référence de biosécurité de LatchBio à 62,4 %. Sur HackerBench v0.3, le propre test de l’entreprise pour les cybertâches risquées et malveillantes, il indique que le modèle laisse passer 3,3 % des invites à double usage risquées tout en bloquant rarement les travaux de sécurité légitimes.

Les deux chiffres proviennent de SpaceXAI et HackerBench est la propre référence de SpaceXAI. La société affirme avoir commencé à accorder à certains partenaires de cybersécurité un accès sur invitation uniquement aux capacités de l’équipe rouge du modèle pour la recherche en matière de défense.

Où vous pouvez l’exécuter

Grok 4.7 est disponible dans Cursor et dans Grok Build, et SpaceXAI indique qu’il fonctionne également via l’API Grok, des harnais de codage tiers, des routeurs modèles et des plates-formes cloud. La société le décrit comme un modèle de base plus large que Grok 4.6, formé avec un apprentissage par renforcement plus long sur un mélange de tâches plus difficiles, axé sur des problèmes qui prennent plusieurs heures.

Le prix d’entrée de 2 $ est la chose la plus claire que Grok 4.7 détient par rapport à GPT-6 Astra. Le propre projet de loi d’Artificial Analysis suggère qu’il ne survit pas toujours à la tâche.