Gemini 4 Argon : ce que le nouveau modèle de Google promet aux professionnels
Google a présenté Gemini 4 Argon le mercredi 30 septembre 2026, d’abord par un message de Sundar Pichai sur X, puis dans un billet signé Koray Kavukcuoglu, vice-président senior de Google DeepMind. Ce modèle de frontière cible les tâches longues en code, cyberdéfense, droit et finance. Il reste réservé au programme Fairwind, sans date d’ouverture au public.
En Bref
- Limite de sortie portée de 64 000 à 1 million de tokens par réponse, raisonnement compris.
- 77,9 % sur DeepSWE v1.1 selon Google, contre 74,2 % pour Claude Opus 5.5 et 74,1 % pour GPT-6 Astra.
- Accès limité au programme Fairwind ; clients API payants et abonnés Google AI Ultra ensuite, sans date.
- Prix de lancement autour de 1,70 € en entrée et 8,50 € en sortie par million de tokens, appelé à doubler.
Un modèle pensé pour le code, la cyberdéfense, le droit et la finance
Google vise quatre métiers où une même mission s’étale sur des dizaines d’étapes : l’ingénierie logicielle, la cyberdéfense, la recherche financière et la rédaction juridique. Le changement le plus concret porte sur la limite de sortie, relevée de 64 000 à 1 million de tokens par réponse. Ce plafond inclut les tokens de raisonnement, qui puisent dans le même budget que le texte livré.
Avec 64 000 tokens, une migration de bibliothèque ou un avis juridique nourri de dizaines de sources devait être découpé en plusieurs appels. Chaque découpe expose à des pertes de cohérence entre les morceaux. Sur le volet cyber, Google affirme avoir entraîné Argon à repérer, vérifier et corriger seul des vulnérabilités logicielles. Les membres de Fairwind et les équipes internes de Google l’utilisent sans les garde-fous cyber qui filtrent d’ordinaire les requêtes sur les exploits.
Des scores en tête, mais mesurés par Google lui-même
Argon arrive premier sur une majorité des tests publiés par Google, face à GPT-6 Astra, Claude Opus 5.5 et Claude Fable 5.1. L’écart le plus net concerne le test juridique conçu par Harvey, éditeur américain d’outils pour cabinets d’avocats : 19,6 % pour Argon, quand ses rivaux oscillent entre 3,8 et 6,7 %.
| Benchmark | Argon | Opus 5.5 | GPT-6 Astra | Fable 5.1 |
|---|---|---|---|---|
| DeepSWE v1.1 (%) | 77,9 | 74,2 | 74,1 | 67,4 |
| AutomationBench (%) | 51,3 | 40 | 41,4 | 31,4 |
Le tableau comporte aussi des revers. Sur Terminal-Bench 4.0, qui mesure l’autonomie d’un agent en ligne de commande, Argon plafonne à 57,4 %, le score le plus faible des quatre modèles comparés. Selon Pasquale Pillitteri, GPT-6 Astra le devance d’une dizaine de points sur FrontierSWE v2.
Tous ces chiffres proviennent de Google, qui a choisi les épreuves et publié sa méthodologie sur le site de DeepMind. Aucune vérification indépendante n’a encore eu lieu. J’ai suivi les lancements de Gemini 2.5 Pro puis de Gemini 3 Pro, déjà en tête des classements maison : leur accueil par les développeurs n’a pas toujours suivi les scores.
Un prix d’appel, pour un accès encore réservé à quelques-uns
Pour l’instant, seul le programme Fairwind donne accès au modèle. Ce canal de Google DeepMind s’adresse aux autorités publiques, aux opérateurs d’infrastructures critiques et aux mainteneurs de logiciels ; il compterait plus de 650 partenaires selon Pasquale Pillitteri. Google participe aussi au processus volontaire du gouvernement américain, qui teste les modèles avant leur sortie. Avant d’élargir ce déploiement par étapes, l’entreprise dit renforcer quatre protections :
- refus des demandes liées aux attaques cyber et NRBC, avec surveillance des activations internes ;
- résistance aux injections de prompt indirectes par entraînement adversarial ;
- contrôle de la chaîne de pensée, avec possibilité d’interrompre une action ;
- environnements sandbox isolés pour les évaluations à haut risque.
Les clients API payants et les abonnés Google AI Ultra passeront ensuite, sans date annoncée. Converti depuis le tarif officiel en dollars, le prix de lancement tourne autour de 1,70 € par million de tokens en entrée et 8,50 € en sortie. La remise atteint 95 % sur les tokens d’entrée mis en cache. Ce tarif est deux fois inférieur à celui de Claude Opus 5.5 et cinq fois inférieur à ceux de GPT-6 Astra et Claude Fable 5.1. Il doublera, vers 3,40 € et 17 €, après une période dont Google ne précise pas la durée.
On en dit Quoi ?
La sortie à 1 million de tokens répond à une contrainte réelle pour les agents de code et les dossiers juridiques volumineux. Le tarif d’introduction place Argon au niveau d’un modèle intermédiaire. Ses faiblesses en ligne de commande, son accès restreint et des scores encore invérifiés limitent pour l’instant sa portée aux équipes de cyberdéfense admises dans Fairwind.
Après l’échec de Gemini 3.5 Pro, Google doit encore tenir le calendrier
Gemini 3.5 Pro, présenté le 19 mai lors de la Google I/O, n’est jamais sorti. Google s’est depuis contenté de modèles Flash, jusqu’à Gemini 3.8 Flash. Pour crédibiliser Argon, l’entreprise met en avant ses usages internes : des agents auraient libéré plus de 300 Tio de mémoire dans ses datacenters selon Clubic, quand Numerama évoque une fourchette de 500 Tio à 1 Pio. D’autres agents travailleraient à convertir du C/C++ en Rust, jusqu’aux plus de 800 000 lignes du noyau Zircon de Fuchsia, d’après Clubic.
La concurrence n’attend pas. Claude Sonnet 5.5 et GPT-6.1 Sol, absents du comparatif de Google, affichent les mêmes tarifs d’entrée et de sortie et sont déjà disponibles.
Les prochains repères à suivre : la date d’ouverture aux clients API et aux abonnés Google AI Ultra, la durée réelle du prix de lancement et les premiers benchmarks indépendants. Si vous devez choisir un modèle à ce tarif dès maintenant, Claude Sonnet 5.5 et GPT-6.1 Sol restent les seuls que vous pouvez tester sur vos propres dépôts.


