Gemini 4 Argon : Nouveautés, Benchmarks et Tarifs
Le nouveau modèle frontier de Google est conçu pour des tâches longues et multi-étapes dans les domaines du code, du juridique, de la finance et de la cyberdéfense — voici ce qui a vraiment changé.

Google vient d'annoncer Gemini 4 Argon, son nouveau modèle frontier conçu pour maintenir un raisonnement approfondi sur des flux de travail longs et multi-étapes. La promesse : des performances de niveau frontier sur l'ingénierie logicielle réelle, les tâches de connaissance en entreprise comme le juridique et la finance, ainsi que la cyberdéfense — le type de tâches qui demandent à un agent de nombreuses étapes, et non une seule invite. Ce guide couvre les nouveautés, les benchmarks publiés par Google, les tarifs, le passage à une limite de 1M tokens en sortie, et qui obtient l'accès en premier.
Qu'est-ce que Gemini 4 Argon ?
Gemini 4 Argon est le dernier modèle frontier de Google, positionné comme sa « prochaine ère d'intelligence frontier ». Google le décrit comme conçu pour maintenir un raisonnement approfondi sur des flux de travail complexes et longue durée, offrant des performances frontier dans l'ingénierie logicielle réelle, les tâches de connaissance en entreprise comme le juridique et la finance, ainsi que la cyberdéfense (Google).
Il a été annoncé le 30 septembre 2026. Contrairement à un lancement de modèle classique, Argon n'est pas disponible pour tous dès le premier jour — Google le déploie d'abord auprès d'un groupe de cyberdéfenseurs de confiance via son programme Fairwind, avant de l'étendre aux développeurs, aux entreprises et aux consommateurs au fur et à mesure du renforcement des garde-fous (Google).
Les nouveautés de Gemini 4 Argon
Le changement principal pour les développeurs est la capacité à raisonner plus longtemps en une seule passe.
- Limite de 1M tokens en sortie. Google a considérablement étendu la limite de tokens en sortie du modèle à 1M tokens, un record dans l'industrie, contre 64K auparavant. L'argument avancé est que lorsque le modèle dispose de la marge nécessaire pour générer des centaines de milliers de tokens en une seule trajectoire, il peut atteindre un nouveau niveau de profondeur dans le raisonnement et résoudre des problèmes complexes en une seule fois (Google).
- Orientation longue durée. Argon est optimisé pour les tâches qui nécessitent de la planification, l'utilisation d'outils et le maintien de l'objectif sur de nombreuses étapes — du débogage quotidien aux migrations de bases de code à grande échelle.
- Travail de connaissance multimodal. Google met en avant la robustesse du modèle lorsque la tâche nécessite une compréhension visuelle — analyse de graphiques professionnels, extraction de détails depuis de longues vidéos, et traitement d'une série de documents.
Pour replacer cela dans son contexte, il s'agit d'une version plus importante que la récente mise à jour Gemini 3.8 Flash : Argon est un modèle de niveau frontier destiné aux tâches les plus difficiles et les plus longues, plutôt qu'aux travaux à volume élevé et à faible coût.
Benchmarks de Gemini 4 Argon
Tous les chiffres ci-dessous proviennent des documents de lancement de Google ; ils doivent donc être interprétés comme des benchmarks déclarés par le fournisseur et non comme des tests indépendants (Google).
- DeepSWE v1.1 (ingénierie logicielle longue durée) : 77,9 %, que Google qualifie de nouvel état de l'art pour les tâches d'ingénierie réelles et longue durée.
- Vals Index : Argon est le modèle leader sur cet indice, qui mesure l'impact économique dans les domaines de la finance, du code, du juridique et de la fiscalité, pondéré par la contribution de chaque secteur au PIB américain.
- AutomationBench (Zapier) : classé n°1 avec un score de 51,3 %, mesurant l'exécution de bout en bout des principales fonctions métier.
- LVBench (compréhension de vidéos longues) : 91,7 %, que Google cite comme état de l'art.
- CWE-bench v1 (remédiation de vulnérabilités) : ex æquo en première place avec un score maximum de 68 %.
Google a également partagé des résultats internes : il affirme qu'Argon a aidé des chercheurs en informatique quantique à dépasser une référence publiée de 40 % en quelques minutes, et que les agents Argon ont produit un décodeur vidéo Rust (pour libgav1) fonctionnant 2,7 fois plus vite qu'un portage Rust existant avec une sortie identique. Ces exemples sont à considérer comme des illustrations internes, et non comme des benchmarks reproductibles.
Tarifs de Gemini 4 Argon
Google a fixé un prix de lancement :
- 2 $ par million de tokens en entrée
- 10 $ par million de tokens en sortie
- Tokens d'entrée mis en cache au prix de 95 % de réduction sur le prix des tokens en entrée
Après la période de lancement, le tarif standard passe à 4 $ par million de tokens en entrée et 20 $ par million de tokens en sortie (Google). Si vous planifiez autour d'Argon, notez que le plafond de 1M tokens en sortie combiné aux tarifs frontier en sortie peut rendre les trajectoires longues et gourmandes en tokens rapidement coûteuses — prévoyez un budget pour la sortie, pas seulement pour l'entrée.
Leader en cyberdéfense
La cybersécurité est au cœur de ce lancement. Google a entraîné Argon pour être très performant en défense : il peut de manière autonome trouver, valider et corriger des vulnérabilités logicielles critiques. Pour les défenseurs de confiance et les équipes internes de Google, Google indique qu'il publiera Argon sans garde-fous cyber afin qu'ils puissent exploiter pleinement ses capacités défensives de niveau frontier (Google).
Un exemple précoce cité par Google : le fournisseur de sécurité Wiz, utilisant Argon via son initiative Scan for Good, a découvert une vulnérabilité critique exposant des informations personnelles sensibles dans des logiciels de santé utilisés par des hôpitaux dans le monde entier — un risque grave que Google affirme que les précédents modèles frontier avaient manqué.
Cela s'appuie sur la direction cyber que Google avait amorcée avec sa variante Gemini 3.8 Flash Cyber, en étendant la découverte et la correction autonomes de vulnérabilités à un modèle de niveau frontier.
Sécurité et déploiement progressif
Parce qu'Argon embarque des capacités de niveau frontier — y compris en cybersécurité — Google le restreint et renforce les garde-fous avant une diffusion large. L'entreprise déclare :
- Participer au processus volontaire du gouvernement américain pour l'accès aux modèles avant leur publication.
- Refuser les demandes nuisibles en matière de cybersécurité et de CBRN (chimique, biologique, radiologique et nucléaire) conformément à son Frontier Safety Framework, tout en préservant la recherche légitime à double usage.
- Renforcer la résistance aux injections de prompt indirectes (indirect prompt injection), où des instructions malveillantes cachées dans le contexte tentent de détourner le modèle — Google revendique une robustesse de premier plan sur le benchmark Gray Swan's Indirect Prompt Injection.
- Surveiller la chaîne de pensée et les actions d'Argon pour détecter les désalignements et interrompre l'exécution si nécessaire (Google).
Qui obtient Gemini 4 Argon, et quand
L'accès est progressif :
- Maintenant : les cyberdéfenseurs de confiance via le programme Fairwind, ainsi que les équipes internes de Google.
- Ensuite : les développeurs, les entreprises et les consommateurs, en commençant par les clients API payants et les abonnés Google AI Ultra.
En résumé, Argon n'est pas encore disponible en accès général. Si vous développez des agents, la conclusion pratique est de planifier son utilisation plutôt que de prototyper dessus aujourd'hui — et de surveiller l'ouverture de l'API payante.
Faut-il s'y intéresser si vous développez des agents ?
La conception d'Argon — longues trajectoires, utilisation intensive d'outils et plafond de 1M tokens en sortie — correspond directement aux charges de travail agentiques : migrations de bases de code, recherches financières ou juridiques multi-étapes, et remédiation de sécurité couvrant de nombreux fichiers. Les questions ouvertes sont le coût aux tarifs frontier en sortie et le moment où vous pourrez réellement l'appeler en dehors de Fairwind. En attendant, le récent Gemini 3.8 Flash reste l'option accessible pour les boucles d'agents à volume élevé.
Faites-le avec votre propre équipe IA
Les modèles frontier comme Gemini 4 Argon ne sont utiles que si quelque chose les orchestre dans un vrai travail multi-étapes — planification, appel d'outils et accomplissement d'une tâche de bout en bout. Eigent est une application de bureau « Cowork » open source : une équipe multi-agents qui s'exécute localement, vous permettant de diriger des modèles performants vers des flux de travail de code, de recherche et de documents tout en conservant vos données sur votre machine. Découvrez comment une équipe d'agents gère la révision de PR GitHub, ou lisez notre analyse de Gemini 3.8 Flash pour le code et les agents. Téléchargez Eigent pour créer votre propre équipe.
Recent Posts

Eigent Release Notes v1.0.5: Session Recovery, Task Queues & Better Previews
Eigent v1.0.5 improves Session recovery, task queues, process and file previews, Space settings, and model support.

Claude Opus 5.5 : Nouveautés, Benchmarks et Tarifs
Claude Opus 5.5 expliqué : le premier modèle Claude 5.5, 40 % moins cher qu'Opus 5, 30 % plus rapide en sortie, nouveaux benchmarks de codage agentique, tarifs et sécurité.

GPT-6 Sol et Luna : les modèles OpenAI moins chers pour le code et l'agentique
GPT-6 Sol et Luna étendent la famille GPT-6 d'OpenAI en dessous d'Astra avec des réductions de prix importantes et de meilleures capacités de codage. Voici ce qui a changé, les benchmarks et quand utiliser chacun.