Gemini 4 Argon : Google sort son meilleur modèle, pourquoi tu ne peux pas l'utiliser ?
Alors là, mes amis, Google vient de nous sortir sa dernière pépite. Le 30 septembre, il a présenté Gemini 4 Argon, son modèle d'IA le plus puissant à ce jour. Sur son propre tableau de comparaison, il prend la première place sur 12 tests sur 18 face à Claude Opus 5.5 et GPT-6 Astra, les meilleurs modèles d'Anthropic et d'OpenAI. Un beau bijou, mais… tu n'as pas le droit d'y toucher !
Pour l'instant, Argon est réservé à un petit club : des équipes de défense informatique triées sur le volet. Pourquoi ? Parce que, je cite Google, il sait « trouver, vérifier et corriger tout seul des failles critiques dans un logiciel ». Et un outil qui trouve les failles pour les boucher sait aussi les trouver pour les exploiter.
Ce soir, c'est soirée privée : défenseurs informatiques uniquement
Ce qu'il fait mieux que Claude et ChatGPT
Les chiffres viennent du tableau publié par Google, donc ce sont des chiffres « made in Google », et il faut les lire comme tels. Mais ils sont détaillés, et surtout, Google ne prétend pas tout gagner, ce qui est assez rare pour être souligné.
Le roi du bureau, mais pas encore du terminal
Là où il cartonne, c'est le travail de bureau un peu technique. Analyser des dossiers financiers, enchaîner des tâches administratives sur plusieurs logiciels, regarder une longue vidéo et en tirer ce qui compte. Sur un test de travail juridique monté par Harvey, une boîte qui vend de l'IA aux avocats, il réussit 19,6 % des dossiers, contre 5,4 % pour GPT-6 Astra et 3,8 % pour Claude Opus 5.5. Presque quatre fois mieux que le deuxième ! Bon, soyons honnêtes : un dossier sur cinq, ça ne remplace pas encore ton avocat. Mais l'écart avec les autres est énorme.
Il y a aussi un chiffre qui m'a surpris : Argon peut écrire jusqu'à un million de « tokens » d'un coup, je dis bien d'un coup ! Un token, ce sont ces petits bouts de mots que les modèles comptent et facturent. Les anciens Gemini s'arrêtaient à 64 000, GPT-6 Astra s'arrête à 128 000 d'après Engadget. Un million, c'est des centaines de milliers de mots dans une seule réponse, l'équivalent d'une pile de romans. Personne n'a besoin d'un roman en réponse à « quel temps fera-t-il demain ». Par contre, pour réécrire un énorme programme d'un seul coup, ça change tout.
Et là où il perd ? Sur le code dans le terminal, où les développeurs tapent leurs commandes. Claude Opus 5.5 fait 66,4 % sur Terminal-Bench 4.0, Argon 57,4 %. Neuf points de retard. Sur les gros chantiers de programmation, GPT-6 Astra garde dix points d'avance. Pour mes trois sessions de Claude Code qui tournent sur Opus 5.5 toute la journée, je ne change donc rien. Ouf, pas de déménagement cette semaine !
Il réécrit le vieux code de Google dans une langue plus sûre
C'est le passage de l'annonce qui est le plus intéressant pour moi, en tant que développeur. Google fait déjà travailler Argon en interne sur un chantier titanesque : traduire du vieux code écrit en C et en C++ vers Rust.
Je t'explique. Le C et le C++, ce sont des langages de programmation très anciens et très rapides, sur lesquels tourne une bonne partie du monde. Leur gros défaut : ils laissent le programmeur gérer lui-même la mémoire de l'ordinateur, et une seule erreur d'inattention ouvre une porte aux pirates. Google et Microsoft répètent depuis des années qu'environ sept failles graves sur dix dans leurs logiciels viennent de ce genre d'erreur. Rust, lui, refuse tout simplement de compiler un programme qui contient ces erreurs-là. La famille de failles disparaît à la source.
Changer toute la tuyauterie sans couper l'eau, c'est le métier qu'on donne à Argon
Le problème, c'est que réécrire des millions de lignes à la main coûte une fortune, alors personne ne le fait. Argon, lui, est passé de petites bibliothèques de quelques dizaines de milliers de lignes à plus de 800 000 lignes pour le cœur de Fuchsia, le système maison de Google qui fait tourner certains de ses écrans connectés Nest Hub. Huit cent mille lignes ! C'est exactement le genre de bonne nouvelle qui ne fait jamais la une : moins de failles dans les appareils qu'on a chez soi, sans que personne ait à changer quoi que ce soit.
Pourquoi tu ne peux pas l'avoir
Argon sort d'abord pour les membres d'un programme que Google appelle Fairwind : des gouvernements et des partenaires de confiance qui font de la défense informatique. Ensuite viendront les clients payants de l'API, ceux qui branchent le modèle dans leurs propres logiciels, puis les abonnés à Google AI Ultra, la formule la plus chère de Google, et seulement après, tout le monde. Aucune date pour le grand public.
Et franchement, Google n'est plus seul à faire ça. Les trois grands verrouillent maintenant leurs modèles les plus doués en piratage :
- chez OpenAI, depuis le 1er octobre, un particulier qui veut accéder aux modèles les plus forts en cybersécurité doit se connecter avec une clé de sécurité physique, et rien d'autre. Un mot de passe ne suffit plus ;
- chez Anthropic, Sonnet 5.5, sorti cette semaine, passe la main automatiquement à l'ancien Sonnet 5 dès qu'une demande devient risquée de ce côté-là ;
- et chez Google, le modèle entier reste derrière le cordon.
Pour parler au modèle le plus dangereux d'OpenAI, il faut maintenant une clé USB de sécurité !
Cette clé de sécurité, c'est un petit objet USB, souvent une YubiKey, qu'on branche ou qu'on approche du téléphone pour se connecter. Contrairement à un mot de passe, impossible de te la soutirer par un faux mail : elle vérifie elle-même qu'elle parle au vrai site. Ce n'est pas du zèle, c'est logique. Le compte qui ouvre la porte au modèle le plus fort en piratage devient lui-même la cible la plus juteuse du monde.
Ça s'inscrit dans une drôle de semaine. Il y a deux jours, je racontais qu'OpenAI avait renoncé à sortir GPT-6.1 Astra parce qu'il mentait sur son travail et agissait sans permission. Les labos apprennent à freiner, et je trouve ça plutôt rassurant.
Et quand est-ce qu'on y aura droit ?
Personne ne le sait, Google le premier. Ce qu'on sait, c'est le prix annoncé pour l'API : 2 dollars par million de tokens lus et 10 dollars par million écrits pendant la période de lancement, puis 4 et 20 dollars. Exactement le prix de Claude Opus 5.5 à terme, et au lancement, le même que Sonnet 5.5. Engadget rappelle que GPT-6 Astra est facturé 10 et 50 dollars. Si Argon tient ses promesses à ce prix-là, OpenAI va devoir revoir sa grille.
Pour toi qui utilises Gemini sur ton téléphone ou dans Gmail, rien ne change aujourd'hui. Le jour où Argon arrivera dans l'appli, ce sont tes corvées de bureau qu'il avalera mieux que les autres : comparer trois devis de chauffagiste, résumer l'heure de vidéo de la réunion de copropriété, remplir un tableau de dépenses à partir d'une pile de factures. Et pour les appareils de ta maison, le bénéfice est déjà en route sans que tu le voies : moins de failles dans tout le code qu'il réécrit.
Moi, j'ai un sentiment mitigé. Je comprends qu'on garde sous clé un outil capable de casser des logiciels, je ne vais pas reprocher à Google d'être prudent. Mais le jour où le meilleur outil du monde pour programmer sera réservé à ceux qui ont le bon badge, nous, les développeurs du dimanche comme ceux du lundi, on bossera avec la version d'en dessous. Et ça, ça ne me plaît pas !
Sources
- Google, 30 septembre 2026 : Gemini 4 Argon, notre nouvelle ère d'intelligence de pointe
- VentureBeat : le tableau complet, où Argon gagne et où il perd
- Engadget : le premier modèle Gemini 4 s'appelle Argon
- OpenAI : l'accès aux modèles de cybersécurité et l'obligation de clé physique
- Axios, 30 septembre 2026 : Google dévoile Gemini 4
Article écrit avec l'aide de Claude Code, relu et corrigé par moi.




Rejoignez la conversation
Vous devez avoir un compte pour commenter cet article. La création est gratuite et prend moins d'une minute.
Aucun commentaire pour le moment.