Retour
Menu des articles36

News · Logiciel

Grok 4.6 sur CursorBench 4.0 : 41,4 %, loin de Fable 5.1

Au 20 septembre 2026, Grok 4.6 Extra High tient 41,4 % sur CursorBench 4.0, à 6,10 $ la tâche. GPT-5.6 Sol Max est à 41,7 %. Fable 5.1 Max reste à 51,8 %. Grok 4.7 n’a toujours pas de fiche xAI.

Par 20 septembre 20264 min de lecture0 vues
Grok 4.6 sur CursorBench 4.0 : 41,4 %, loin de Fable 5.1

Au 20 septembre 2026, le modèle xAI en rayon, c’est encore Grok 4.6. Sur CursorBench 4.0 (ouvre cursor.com dans un nouvel onglet), sa meilleure config publiée — Extra High — tient 41,4 %, à 6,10 $ la tâche. GPT-5.6 Sol Max est à 41,7 % pour 8,23 $. Fable 5.1 Max reste à 51,8 % pour 17,28 $.

Grok 4.7 n’a toujours pas de fiche, pas d’identifiant d’API, pas de ligne dans le catalogue développeur (ouvre docs.x.ai dans un nouvel onglet). Le 14 septembre, Musk a écrit que 4.7 serait « roughly on par with Opus 5.0, not 5.1 ». C’est un message X, pas une page xAI. Le report du 11, on l’a déjà déroulé.

Info

Contrôle du 20 septembre 2026. Banc : CursorBench 4.0 (ouvre cursor.com dans un nouvel onglet), tâches longues du 10 septembre, page relue le 20. Annonce 4.6 : 12 août (ouvre x.ai dans un nouvel onglet). Docs : Models (ouvre docs.x.ai dans un nouvel onglet), dernière mise à jour le 21 août, Grok 4.6 en flagship. 4.0 n’est pas comparable à CursorBench 3.2.

Le banc live, pas le 3.2 d’août

Le 10 septembre, Cursor a remplacé le jeu 3.2. Tous les scores baissent. On ne compare pas les 69,9 % de Grok 4.6 High sur 3.2 (annonce xAI du 12 août) aux 41,4 % Extra High sur 4.0.

Page officielle, 20 septembre :

ConfigScore 4.0Coût moyen / tâcheTokens / tâche
Grok 4.6 Extra High41,4 %6,10 $49 814
Grok 4.6 High (défaut)40,4 %5,20 $41 387
Grok 4.6 Medium36,1 %3,48 $24 893
Grok 4.6 Low33,4 %2,25 $16 307
GPT-5.6 Sol Max41,7 %8,23 $42 944
Muse Spark 1.3 Max41,6 %2,64 $52 005
Fable 5.1 Max51,8 %17,28 $117 236
Composer 2.527,7 %0,68 $17 347

Extra High colle Sol Max à 0,3 point, pour environ 2 $ de moins par tâche. Fable 5.1 Extra High tient 51,6 % à 13,01 $. L’écart avec Grok n’est pas une erreur de lecture : c’est dix points.

Grok Extra High fait 56 étapes par tâche, Sol Max 99, Fable Max 128. Moins de tours, moins cher, pas plus haut.

4.6 est dans Cursor. 4.7 n’est nulle part

Le 12 août, xAI a poussé 4.6 dans Cursor et Grok Build, avec une semaine à 2× d’usage inclus — déjà close. La fiche Cursor (ouvre cursor.com dans un nouvel onglet) le met dans le pool « Cursor Models », avec 4.5 et Composer 2.5. Efforts : low, medium, high (défaut), xhigh.

Les docs xAI, relues le 20 septembre : « For everything else, including code, use Grok 4.6. It is the most intelligent and fastest model we’ve built. » Pas de 4.7 dans le tableau.

Le 14 septembre à 13 h 19, heure de Paris, Musk a abaissé la barre : 4.7 ≈ Opus 5.0, pas 5.1 ; 4.8 « noticeable » ; 4.9 « probably Astra/Fable class » ; Grok 5 « maybe better than anything ». On ne transforme pas ça en fiche. Les rumeurs de taille et de date, c’était le 8 septembre.

Visuel officiel xAI, annonce Grok 4.6 du 12 août 2026.

Crédit : SpaceXAI, visuel Open Graph de l’annonce Grok 4.6 (ouvre x.ai dans un nouvel onglet), 12 août 2026.

Attention

CursorBench 4.0 est un banc Cursor, tâches privées. Extra High n’est pas le défaut (high l’est). Astra n’est pas dans ce snapshot. Un message Musk n’est pas un changelog xAI. Le comparatif des surfaces, c’est ici.

Le modèle qu’on peut coller dans un agent Cursor aujourd’hui, c’est 4.6. Le suivant, tant qu’il n’a pas de ligne dans les docs, reste une promesse.

Sources

Laisser un avis

Ta note :

Anti-robots : recopie le code

Avis des lecteurs

Pas encore de note. La première est pour toi.

Aucun avis publié pour le moment.

À lire aussi