Retour
Menu des articles61

News · Logiciel

Gemini 4 Argon : le nouveau modèle de Google bat Astra et Opus 5.5… mais reste fermé

Argon n'est plus un nom de code : Gemini 4 Argon est sorti le 30 septembre 2026. Google le place devant GPT-6 Astra et Claude Opus 5.5 sur 14 tests sur 19, à 2 $ / 10 $ le million de tokens. Mais seuls des défenseurs cyber du programme Fairwind y ont accès.

Par 1 octobre 202610 min de lecture0 vues
Gemini 4 Argon : le nouveau modèle de Google bat Astra et Opus 5.5… mais reste fermé

« Argon » n'est pas une rumeur ni un simple nom de code. Depuis le 30 septembre 2026, c'est le nom officiel du nouveau modèle de pointe de Google : Gemini 4 Argon. Google l'a présenté sur son blog (ouvre blog.google dans un nouvel onglet) sous la signature de Koray Kavukcuoglu, patron de Google DeepMind, et sur son compte X (ouvre x.com dans un nouvel onglet).

Il y a pourtant un gros « mais » : presque personne ne peut s'en servir. Argon est d'abord réservé à une poignée de défenseurs en cybersécurité triés sur le volet. Pas d'API ouverte, pas d'abonnement Google AI Ultra, pas d'accès gratuit dans l'application Gemini. Google publie un prix et des scores, mais pas de date pour le grand public.

Info

Contrôle du 1er octobre 2026. Sources primaires lues : le billet Gemini 4 Argon: our next era of frontier intelligence (ouvre blog.google dans un nouvel onglet) (Google, 30 septembre), le document d'évaluation PDF (ouvre storage.googleapis.com dans un nouvel onglet) de Google DeepMind, le message de @Google sur X (ouvre x.com dans un nouvel onglet) et le billet de lancement du programme Fairwind (ouvre blog.google dans un nouvel onglet) (2 septembre). Recoupements : TechCrunch (ouvre techcrunch.com dans un nouvel onglet), SecurityWeek (ouvre securityweek.com dans un nouvel onglet). Tous les scores cités viennent de Google : aucune mesure indépendante d'Argon n'était publiée à cette date.

Argon : nom de code devenu nom officiel

Avant l'annonce, « Argon » circulait comme un nom de code. Plusieurs sites, dont Trending Topics (ouvre trendingtopics.eu dans un nouvel onglet), ont relayé mi-septembre qu'un modèle déguisé en « gemini-3.8-flash » tournait en test à l'aveugle sur LMArena, et l'ont présenté comme un « Gemini 4 Pro ». Google n'a jamais confirmé ce test, et nous n'avons pas pu le vérifier.

Ce qui est sûr, c'est le nom final. Ce n'est pas « Gemini 4 Pro », mais Gemini 4 Argon. Google garde donc le nom de code dans le nom commercial, un peu comme OpenAI avec Astra, Sol et Luna. Les fuites annonçaient aussi une sortie de 256 000 tokens. Elles se trompaient : la réalité est bien plus haute.

Ce que Google annonce

Argon est présenté comme un modèle pour les tâches longues : il doit raisonner sur la durée et enchaîner des dizaines d'étapes sans se perdre. Google vise trois terrains :

  • le développement logiciel réel, sur de gros dépôts ;
  • le travail de bureau spécialisé : finance, juridique, fiscalité ;
  • la cyberdéfense : trouver, vérifier et corriger des failles de sécurité.

Le chiffre le plus frappant est la limite de sortie : 1 million de tokens en une seule réponse, contre 64 000 pour la génération précédente. C'est seize fois plus. Pour comparer, Claude Opus 5.5 et GPT-6 Astra plafonnent à 128 000 tokens de sortie (voir notre comparatif Opus 5.5 / Astra). Google n'indique pas, en revanche, la taille de la fenêtre de contexte d'Argon.

Google donne aussi des exemples d'usage interne. Ils sont invérifiables de l'extérieur, mais précis :

  • des agents Argon ont repéré des optimisations mémoire dans les centres de données, avec plus de 300 Tio libérés une fois déployées ;
  • un décodeur vidéo open source, libgav1, a été réécrit en Rust sûr : 2,7 fois plus rapide que le portage Rust de départ, selon Google ;
  • des migrations de C/C++ vers Rust sont en cours, jusqu'à plus de 800 000 lignes pour le noyau Zircon de Fuchsia. Google précise que ces réécritures sont encore en audit.

Les scores : Argon devant Astra et Opus 5.5… sur la majorité des tests

Google publie un tableau de 19 lignes face à GPT-6 Astra, Claude Fable 5.1 et Claude Opus 5.5. Argon est en tête sur 14 d'entre elles, dont une à égalité. Il est battu sur les 5 autres. Voici les plus parlantes :

TestGemini 4 ArgonGPT-6 AstraClaude Opus 5.5Claude Fable 5.1
Vals Index (travail de bureau)68,9 %63,1 %67,0 %65,8 %
AutomationBench (Zapier)51,3 %41,4 %42,5 %31,4 %
Vals Finance Agent v265,4 %53,5 %58,6 %58,9 %
Harvey Legal Agent (juridique)19,6 %5,4 %3,8 %6,7 %
DeepSWE v1.1 (code, tâches longues)77,9 %74,1 %74,2 %67,4 %
FrontierSWE v255,0 %65,5 %62,3 %56,3 %
Terminal-Bench 4.057,4 %58,2 %66,4 %57,9 %
PostTrainBench45,3 %44,3 %49,3 %40,2 %
Terminal-Bench Science 0.157,6 %68,1 %63,3 %52,6 %
OSWorld 2.0 (usage d'un ordinateur)69,2 %72,6 %——
LVBench (longues vidéos)91,7 %87,5 %83,7 %79,7 %
CWE-bench v1 (correction de failles)68,0 %68,0 %67,0 %58,0 %

Source : document d'évaluation Google DeepMind (ouvre storage.googleapis.com dans un nouvel onglet), chiffres d'octobre 2026.

La lecture est claire : Argon domine le travail de bureau et la vidéo. Sur le code en terminal, en revanche, Claude Opus 5.5 garde l'avantage (66,4 % contre 57,4 % sur Terminal-Bench 4.0). GPT-6 Astra reste devant sur FrontierSWE et OSWorld. Dire qu'Argon bat tout le monde partout serait donc exagéré.

Il faut aussi lire les notes de bas de page. Plusieurs scores d'Argon sont calculés par Google lui-même (DeepSWE, Terminal-Bench, OSWorld), alors que ceux des concurrents viennent souvent de classements publics ou de leurs propres fiches. Ce n'est pas tricher, c'est l'usage dans le secteur. Mais ce n'est pas une mesure indépendante. Les vrais tests viendront quand le modèle sera accessible.

Et Grok ?

Grok 4.7, sorti le 21 septembre selon MarkTechPost (ouvre marktechpost.com dans un nouvel onglet), n'apparaît pas dans le grand tableau de Google. On le retrouve seulement sur le graphique de cybersécurité, où il fait jeu égal :

Graphique Google « CWE-bench v1 leaderboard » : Grok 4.7, Gemini 4 Argon et GPT-6 Astra à 68 %, Claude Opus 5.5 à 67 %, Claude Fable 5.1 à 58 %.

Crédit : Google (ouvre blog.google dans un nouvel onglet), graphique publié le 30 septembre 2026. Scores tirés du classement public CWE-bench.

Trois modèles à 68 %, Opus 5.5 juste derrière à 67 %. Sur ce test, Argon « partage la première place », comme le dit Google lui-même. Ce n'est pas une victoire nette. On remarque aussi que chaque modèle tourne dans son propre outil : Argon dans Antigravity, Astra dans Codex, Opus dans Claude Code, Grok dans opencode.

Google met en avant un autre point fort : la résistance aux injections de prompt (des instructions cachées dans une page ou un document pour détourner un agent). Sur le test de Gray Swan, une attaque réussit dans 0,7 % des cas sur Argon après 15 essais, contre 1,0 % pour Opus 5.5, 8,5 % pour GPT-6 Astra et 51,8 % pour Grok 4.6. Ici, l'écart avec Astra et Grok est réel. Avec Claude, il est minime.

Prix : moins cher qu'Opus 5.5… pour l'instant

Google annonce déjà le tarif API, alors que l'API n'est pas ouverte :

ModèleEntrée (1 M tokens)Sortie (1 M tokens)
Gemini 4 Argon (prix de lancement)2 $10 $
Gemini 4 Argon (prix normal ensuite)4 $20 $
Claude Opus 5.54 $20 $
GPT-6 Astra10 $50 $
Grok 4.72 $6 $

Les jetons d'entrée mis en cache sont facturés 95 % moins cher. Le prix de lancement est temporaire : une note du billet indique qu'après la « période d'introduction », Argon passera à 4 $ et 20 $, soit exactement le tarif d'Opus 5.5. La durée de cette période n'est pas précisée.

Au prix de lancement, Argon coûte donc cinq fois moins cher qu'Astra par token. Le prix de Grok 4.7 vient des fiches de presse citées plus haut, pas d'une vérification directe chez xAI.

Qui peut l'utiliser aujourd'hui ?

Très peu de monde. Argon est d'abord déployé via le programme Fairwind, lancé par Google le 2 septembre (ouvre blog.google dans un nouvel onglet). C'est un accès restreint pour des gouvernements, des opérateurs d'infrastructures critiques et des partenaires de sécurité. Jusqu'ici, il donnait accès à Gemini 3.8 Flash Cyber et à l'outil CodeMender.

Le point le plus discuté est celui-ci : pour ces défenseurs vérifiés et pour ses équipes internes, Google publie Argon sans garde-fous cyber. Le modèle peut donc aider à exploiter des failles, pas seulement à les trouver. Google justifie ce choix par la défense : donner une longueur d'avance aux équipes de sécurité avant que des attaquants n'aient des outils comparables. SecurityWeek (ouvre securityweek.com dans un nouvel onglet) résume bien le changement : la sécurité ne repose plus sur ce que le modèle refuse, mais sur qui y a accès.

Pour les autres, le calendrier est flou. Google dit vouloir ouvrir Argon « dès que possible », d'abord aux clients payants de l'API et aux abonnés Google AI Ultra, puis aux entreprises et au grand public. Google indique aussi participer au processus volontaire du gouvernement américain d'accès aux modèles avant leur sortie.

  • API Gemini : non ouverte au 1er octobre.
  • Google AI Ultra : pas encore.
  • Accès gratuit (application Gemini, AI Studio) : rien d'annoncé.

Ce qu'il faut retenir

  • Argon est réel et officiel : Gemini 4 Argon, annoncé le 30 septembre 2026. Le nom de code est devenu le nom commercial.
  • Sur le papier, c'est le modèle le plus fort de Google et il est premier sur 14 des 19 tests publiés face à GPT-6 Astra et Claude Opus 5.5, surtout en travail de bureau, en finance et en vidéo.
  • Il ne gagne pas partout : Opus 5.5 reste devant en code dans le terminal, Astra sur FrontierSWE et OSWorld. En cyber, c'est une égalité à trois avec Astra et Grok 4.7.
  • Le prix de lancement est agressif (2 $ / 10 $), mais provisoire. Ensuite, Argon coûtera le même prix qu'Opus 5.5.
  • Personne ou presque ne peut l'essayer : pas d'API publique, pas d'Ultra, pas de version gratuite.

Ce qu'on ne sait pas encore

  • La date d'ouverture de l'API et de Google AI Ultra.
  • La durée du prix de lancement.
  • La fenêtre de contexte d'Argon et ses limites d'usage.
  • Les mesures indépendantes : Artificial Analysis, LMArena et les autres n'ont encore rien publié, faute d'accès.
  • Le contenu exact de la « version publique » : Google promet des garde-fous cyber renforcés, donc un modèle peut-être moins permissif que celui des testeurs Fairwind.

On refera le point dès qu'Argon arrivera dans l'API. D'ici là, les chiffres de ce tableau restent ceux de Google.

Laisser un avis

Ta note :

Anti-robots : recopie le code

Avis des lecteurs

Pas encore de note. La première est pour toi.

Aucun avis publié pour le moment.

À lire aussi