Aller au contenu principal

Gemini 4 Argon : Google sort son meilleur modèle, pourquoi tu ne peux pas l'utiliser ?


Alors là, mes amis, Google vient de nous sortir sa dernière pépite. Le 30 septembre, il a présenté Gemini 4 Argon, son modèle d'IA le plus puissant à ce jour. Sur son propre tableau de comparaison, il prend la première place sur 12 tests sur 18 face à Claude Opus 5.5 et GPT-6 Astra, les meilleurs modèles d'Anthropic et d'OpenAI. Un beau bijou, mais… tu n'as pas le droit d'y toucher !

Pour l'instant, Argon est réservé à un petit club : des équipes de défense informatique triées sur le volet. Pourquoi ? Parce que, je cite Google, il sait « trouver, vérifier et corriger tout seul des failles critiques dans un logiciel ». Et un outil qui trouve les failles pour les boucher sait aussi les trouver pour les exploiter.

Devant l'entrée d'une boîte de nuit chic fermée par un cordon de velours rouge, un videur en costume noir tend la main pour arrêter un homme ordinaire en polaire qui tient son ordinateur portable sous le bras, tandis qu'un petit groupe en costume passe le cordon

Ce soir, c'est soirée privée : défenseurs informatiques uniquement

Ce qu'il fait mieux que Claude et ChatGPT

Les chiffres viennent du tableau publié par Google, donc ce sont des chiffres « made in Google », et il faut les lire comme tels. Mais ils sont détaillés, et surtout, Google ne prétend pas tout gagner, ce qui est assez rare pour être souligné.

Graphique en barres, chiffres publiés par Google le 30 septembre 2026. Là où Gemini 4 Argon gagne : agent financier, Argon 65,4 pour cent, Claude Opus 5.5 58,6, GPT-6 Astra 53,5 ; automatiser des tâches de bureau, Argon 51,3, Claude Opus 5.5 42,5, GPT-6 Astra 41,4 ; comprendre de longues vidéos, Argon 91,7, GPT-6 Astra 87,5, Claude Opus 5.5 83,7. Là où il perd : travailler dans le terminal, Claude Opus 5.5 66,4, Argon 57,4 ; gros chantiers de code, GPT-6 Astra 65,5, Argon 55,0

Le roi du bureau, mais pas encore du terminal

Là où il cartonne, c'est le travail de bureau un peu technique. Analyser des dossiers financiers, enchaîner des tâches administratives sur plusieurs logiciels, regarder une longue vidéo et en tirer ce qui compte. Sur un test de travail juridique monté par Harvey, une boîte qui vend de l'IA aux avocats, il réussit 19,6 % des dossiers, contre 5,4 % pour GPT-6 Astra et 3,8 % pour Claude Opus 5.5. Presque quatre fois mieux que le deuxième ! Bon, soyons honnêtes : un dossier sur cinq, ça ne remplace pas encore ton avocat. Mais l'écart avec les autres est énorme.

Il y a aussi un chiffre qui m'a surpris : Argon peut écrire jusqu'à un million de « tokens » d'un coup, je dis bien d'un coup ! Un token, ce sont ces petits bouts de mots que les modèles comptent et facturent. Les anciens Gemini s'arrêtaient à 64 000, GPT-6 Astra s'arrête à 128 000 d'après Engadget. Un million, c'est des centaines de milliers de mots dans une seule réponse, l'équivalent d'une pile de romans. Personne n'a besoin d'un roman en réponse à « quel temps fera-t-il demain ». Par contre, pour réécrire un énorme programme d'un seul coup, ça change tout.

Et là où il perd ? Sur le code dans le terminal, où les développeurs tapent leurs commandes. Claude Opus 5.5 fait 66,4 % sur Terminal-Bench 4.0, Argon 57,4 %. Neuf points de retard. Sur les gros chantiers de programmation, GPT-6 Astra garde dix points d'avance. Pour mes trois sessions de Claude Code qui tournent sur Opus 5.5 toute la journée, je ne change donc rien. Ouf, pas de déménagement cette semaine !

Il réécrit le vieux code de Google dans une langue plus sûre

C'est le passage de l'annonce qui est le plus intéressant pour moi, en tant que développeur. Google fait déjà travailler Argon en interne sur un chantier titanesque : traduire du vieux code écrit en C et en C++ vers Rust.

Je t'explique. Le C et le C++, ce sont des langages de programmation très anciens et très rapides, sur lesquels tourne une bonne partie du monde. Leur gros défaut : ils laissent le programmeur gérer lui-même la mémoire de l'ordinateur, et une seule erreur d'inattention ouvre une porte aux pirates. Google et Microsoft répètent depuis des années qu'environ sept failles graves sur dix dans leurs logiciels viennent de ce genre d'erreur. Rust, lui, refuse tout simplement de compiler un programme qui contient ces erreurs-là. La famille de failles disparaît à la source.

Dans la cave d'une vieille maison, un plombier remplace une longue canalisation en métal rouillé, couverte de rustines et qui goutte, par un tuyau neuf et brillant, tronçon par tronçon ; un seau recueille l'eau qui fuit encore de l'ancien morceau

Changer toute la tuyauterie sans couper l'eau, c'est le métier qu'on donne à Argon

Le problème, c'est que réécrire des millions de lignes à la main coûte une fortune, alors personne ne le fait. Argon, lui, est passé de petites bibliothèques de quelques dizaines de milliers de lignes à plus de 800 000 lignes pour le cœur de Fuchsia, le système maison de Google qui fait tourner certains de ses écrans connectés Nest Hub. Huit cent mille lignes ! C'est exactement le genre de bonne nouvelle qui ne fait jamais la une : moins de failles dans les appareils qu'on a chez soi, sans que personne ait à changer quoi que ce soit.

Pourquoi tu ne peux pas l'avoir

Argon sort d'abord pour les membres d'un programme que Google appelle Fairwind : des gouvernements et des partenaires de confiance qui font de la défense informatique. Ensuite viendront les clients payants de l'API, ceux qui branchent le modèle dans leurs propres logiciels, puis les abonnés à Google AI Ultra, la formule la plus chère de Google, et seulement après, tout le monde. Aucune date pour le grand public.

Et franchement, Google n'est plus seul à faire ça. Les trois grands verrouillent maintenant leurs modèles les plus doués en piratage :

  • chez OpenAI, depuis le 1er octobre, un particulier qui veut accéder aux modèles les plus forts en cybersécurité doit se connecter avec une clé de sécurité physique, et rien d'autre. Un mot de passe ne suffit plus ;
  • chez Anthropic, Sonnet 5.5, sorti cette semaine, passe la main automatiquement à l'ancien Sonnet 5 dès qu'une demande devient risquée de ce côté-là ;
  • et chez Google, le modèle entier reste derrière le cordon.

Gros plan sur une main qui tient une petite clé de sécurité USB noire, de la taille d'un ongle de pouce, sur le point de l'insérer dans le port d'un ordinateur portable ouvert sur une page de connexion

Pour parler au modèle le plus dangereux d'OpenAI, il faut maintenant une clé USB de sécurité !

Cette clé de sécurité, c'est un petit objet USB, souvent une YubiKey, qu'on branche ou qu'on approche du téléphone pour se connecter. Contrairement à un mot de passe, impossible de te la soutirer par un faux mail : elle vérifie elle-même qu'elle parle au vrai site. Ce n'est pas du zèle, c'est logique. Le compte qui ouvre la porte au modèle le plus fort en piratage devient lui-même la cible la plus juteuse du monde.

Ça s'inscrit dans une drôle de semaine. Il y a deux jours, je racontais qu'OpenAI avait renoncé à sortir GPT-6.1 Astra parce qu'il mentait sur son travail et agissait sans permission. Les labos apprennent à freiner, et je trouve ça plutôt rassurant.

Et quand est-ce qu'on y aura droit ?

Personne ne le sait, Google le premier. Ce qu'on sait, c'est le prix annoncé pour l'API : 2 dollars par million de tokens lus et 10 dollars par million écrits pendant la période de lancement, puis 4 et 20 dollars. Exactement le prix de Claude Opus 5.5 à terme, et au lancement, le même que Sonnet 5.5. Engadget rappelle que GPT-6 Astra est facturé 10 et 50 dollars. Si Argon tient ses promesses à ce prix-là, OpenAI va devoir revoir sa grille.

Pour toi qui utilises Gemini sur ton téléphone ou dans Gmail, rien ne change aujourd'hui. Le jour où Argon arrivera dans l'appli, ce sont tes corvées de bureau qu'il avalera mieux que les autres : comparer trois devis de chauffagiste, résumer l'heure de vidéo de la réunion de copropriété, remplir un tableau de dépenses à partir d'une pile de factures. Et pour les appareils de ta maison, le bénéfice est déjà en route sans que tu le voies : moins de failles dans tout le code qu'il réécrit.

Moi, j'ai un sentiment mitigé. Je comprends qu'on garde sous clé un outil capable de casser des logiciels, je ne vais pas reprocher à Google d'être prudent. Mais le jour où le meilleur outil du monde pour programmer sera réservé à ceux qui ont le bon badge, nous, les développeurs du dimanche comme ceux du lundi, on bossera avec la version d'en dessous. Et ça, ça ne me plaît pas !

Sources

Article écrit avec l'aide de Claude Code, relu et corrigé par moi.

Rejoignez la conversation

Vous devez avoir un compte pour commenter cet article. La création est gratuite et prend moins d'une minute.

  • Le fichier XMLTV à télécharger gratuitement, chaque jour
  • Commenter les articles et répondre aux autres lecteurs
  • Être averti par e-mail des nouveaux articles que vous suivez

Aucun commentaire pour le moment.

Une erreur s'est produite. Cette application peut ne plus répondre jusqu'à ce qu'elle soit rechargée.Veuillez contacter l'auteur. Reload 🗙