News · Logiciel
Grok 4.6 sur CursorBench 4.0 : 41,4 %, loin de Fable 5.1
Au 20 septembre 2026, Grok 4.6 Extra High tient 41,4 % sur CursorBench 4.0, à 6,10 $ la tâche. GPT-5.6 Sol Max est à 41,7 %. Fable 5.1 Max reste à 51,8 %. Grok 4.7 n’a toujours pas de fiche xAI.

Au 20 septembre 2026, le modèle xAI en rayon, c’est encore Grok 4.6. Sur CursorBench 4.0 (ouvre cursor.com dans un nouvel onglet), sa meilleure config publiée — Extra High — tient 41,4 %, à 6,10 $ la tâche. GPT-5.6 Sol Max est à 41,7 % pour 8,23 $. Fable 5.1 Max reste à 51,8 % pour 17,28 $.
Grok 4.7 n’a toujours pas de fiche, pas d’identifiant d’API, pas de ligne dans le catalogue développeur (ouvre docs.x.ai dans un nouvel onglet). Le 14 septembre, Musk a écrit que 4.7 serait « roughly on par with Opus 5.0, not 5.1 ». C’est un message X, pas une page xAI. Le report du 11, on l’a déjà déroulé.
Info
Contrôle du 20 septembre 2026. Banc : CursorBench 4.0 (ouvre cursor.com dans un nouvel onglet), tâches longues du 10 septembre, page relue le 20. Annonce 4.6 : 12 août (ouvre x.ai dans un nouvel onglet). Docs : Models (ouvre docs.x.ai dans un nouvel onglet), dernière mise à jour le 21 août, Grok 4.6 en flagship. 4.0 n’est pas comparable à CursorBench 3.2.
Le banc live, pas le 3.2 d’août
Le 10 septembre, Cursor a remplacé le jeu 3.2. Tous les scores baissent. On ne compare pas les 69,9 % de Grok 4.6 High sur 3.2 (annonce xAI du 12 août) aux 41,4 % Extra High sur 4.0.
Page officielle, 20 septembre :
| Config | Score 4.0 | Coût moyen / tâche | Tokens / tâche |
|---|---|---|---|
| Grok 4.6 Extra High | 41,4 % | 6,10 $ | 49 814 |
| Grok 4.6 High (défaut) | 40,4 % | 5,20 $ | 41 387 |
| Grok 4.6 Medium | 36,1 % | 3,48 $ | 24 893 |
| Grok 4.6 Low | 33,4 % | 2,25 $ | 16 307 |
| GPT-5.6 Sol Max | 41,7 % | 8,23 $ | 42 944 |
| Muse Spark 1.3 Max | 41,6 % | 2,64 $ | 52 005 |
| Fable 5.1 Max | 51,8 % | 17,28 $ | 117 236 |
| Composer 2.5 | 27,7 % | 0,68 $ | 17 347 |
Extra High colle Sol Max à 0,3 point, pour environ 2 $ de moins par tâche. Fable 5.1 Extra High tient 51,6 % à 13,01 $. L’écart avec Grok n’est pas une erreur de lecture : c’est dix points.
Grok Extra High fait 56 étapes par tâche, Sol Max 99, Fable Max 128. Moins de tours, moins cher, pas plus haut.
4.6 est dans Cursor. 4.7 n’est nulle part
Le 12 août, xAI a poussé 4.6 dans Cursor et Grok Build, avec une semaine à 2× d’usage inclus — déjà close. La fiche Cursor (ouvre cursor.com dans un nouvel onglet) le met dans le pool « Cursor Models », avec 4.5 et Composer 2.5. Efforts : low, medium, high (défaut), xhigh.
Les docs xAI, relues le 20 septembre : « For everything else, including code, use Grok 4.6. It is the most intelligent and fastest model we’ve built. » Pas de 4.7 dans le tableau.
Le 14 septembre à 13 h 19, heure de Paris, Musk a abaissé la barre : 4.7 ≈ Opus 5.0, pas 5.1 ; 4.8 « noticeable » ; 4.9 « probably Astra/Fable class » ; Grok 5 « maybe better than anything ». On ne transforme pas ça en fiche. Les rumeurs de taille et de date, c’était le 8 septembre.

Crédit : SpaceXAI, visuel Open Graph de l’annonce Grok 4.6 (ouvre x.ai dans un nouvel onglet), 12 août 2026.
Attention
CursorBench 4.0 est un banc Cursor, tâches privées. Extra High n’est pas le défaut (high l’est). Astra n’est pas dans ce snapshot. Un message Musk n’est pas un changelog xAI. Le comparatif des surfaces, c’est ici.
Le modèle qu’on peut coller dans un agent Cursor aujourd’hui, c’est 4.6. Le suivant, tant qu’il n’a pas de ligne dans les docs, reste une promesse.
Sources
- Cursor, CursorBench 4.0 (ouvre cursor.com dans un nouvel onglet)
- xAI, Introducing Grok 4.6, 12 août 2026 (ouvre x.ai dans un nouvel onglet)
- SpaceXAI Docs, Models (ouvre docs.x.ai dans un nouvel onglet)
- SpaceXAI Docs, Grok 4.6 (ouvre docs.x.ai dans un nouvel onglet)
- Cursor, Grok 4.6 (ouvre cursor.com dans un nouvel onglet)
- Cursor, page produit Grok 4.6 (ouvre cursor.com dans un nouvel onglet)
- Elon Musk, 14 septembre 2026 (ouvre x.com dans un nouvel onglet)
Laisser un avis
Avis des lecteurs
Aucun avis publié pour le moment.
À lire aussi
- Agents API : le harnais Codex, facturé au tokenLe 10 septembre 2026, OpenAI ouvre l’Agents API en beta. C’est le harnais Codex, en API. Pas de frais séparés : tokens, outils, et 0,03–1,92 $ / 20 min de sandbox. Résidence US only, pas de ZDR.
- Codex : le quota 20× n’est pas un contratLe 20 septembre 2026, OpenAI dit encore que les messages Codex / 5 h « ne sont pas des plafonds fixes ». Pro 20× : Astra 100–900. Les nouvelles souscriptions à 200 $ sont en pause depuis le 10. Le compteur saute ; les resets de Tibo tiennent le forfait. L’API et les plans chinois facturent au token.
- Grok 4.6 à 2 $ / 6 $ le million : le cache à 0,50 $ et le palier 200kSur l’API xAI, Grok 4.6 reste à 2 $ / 6 $ le million sous 200k jetons de prompt. Le cache lu passe à 0,50 $, contre 0,30 $ sur 4.5. Au palier 200k, toute la requête double. Fable 5.1 : 10 $ / 50 $, cache 0,25 $.