Technologie

Gemini 4 Argon, le modèle du retour de Google que presque personne ne peut encore utiliser

Le nouveau modèle de Google DeepMind écrit jusqu’à 1 million de tokens, mais il est d’abord réservé à des cyberdéfenseurs triés sur le volet
Adrian Kessler
Ajoutez-nous sur Google

Pendant la majeure partie de l’année écoulée, l’histoire de Google en matière d’intelligence artificielle tenait à ce qu’il n’avait pas lancé. Gemini 4 Argon est la réponse, et ce qu’il révèle de plus parlant n’est pas un score de benchmark. C’est la liste des invités. Le nouveau modèle de pointe de Google DeepMind est d’abord confié à un petit groupe de défenseurs en cybersécurité triés sur le volet, via le programme Fairwind de l’entreprise, et à personne d’autre.

Argon est conçu pour le travail de longue haleine : ingénierie logicielle, recherche juridique et financière, cyberdéfense. Le changement mécanique clé tient à la longueur de sortie : le modèle peut désormais raisonner et écrire des centaines de milliers de tokens en une seule passe, assez pour mener une grande migration de code jusqu’au bout au lieu de la recoudre à partir de fragments.

Google affirme que des milliers de ses ingénieurs l’utilisent déjà. Dans son annonce, l’entreprise décrit des agents Argon qui ont libéré plus de 300 TiB de mémoire dans ses centres de données et qui portent du code C et C++ vers Rust, un langage sûr pour la mémoire, jusqu’aux plus de 800 000 lignes du noyau Fuchsia Zircon. Sur libgav1, le décodeur vidéo open source de Google, Argon a réécrit 32 000 lignes de code SIMD optimisé à la main en Rust sûr, qui s’exécute 2,7 fois plus vite que le précédent portage en Rust.

Bar chart comparing Gemini 4 Argon and Gemini 3.8 Flash Cyber on vulnerability discovery and the Wiz penetration test benchmark
Image: Google

Le plafond de sortie passe à 1 million de tokens, contre 64 000 auparavant. Les chiffres de benchmark sont ceux de Google : 77,9 % sur DeepSWE v1.1, la première place sur le Vals Index, qui mesure le travail intellectuel pondéré par sa valeur économique, et 91,7 % sur LVBench pour la compréhension des vidéos longues. Selon un décompte de VentureBeat, Argon arrive nettement en tête sur 12 des 18 benchmarks publiés, tandis que GPT-6 Astra d’OpenAI le devance encore de plus de dix points sur FrontierSWE v2. Tant que des testeurs externes ne pourront pas faire tourner le modèle, ce sont des affirmations, pas des verdicts.

Le prisme de la cybersécurité explique ce filtrage. Google a entraîné Argon à trouver, valider et corriger des vulnérabilités de manière autonome, et fournira aux défenseurs de confiance une version dont les garde-fous cyber ont été retirés. Dans le cadre de l’initiative Scan for Good de Wiz, le modèle a signalé dans un logiciel hospitalier une faille critique exposant des données personnelles, que les modèles précédents n’avaient pas repérée. Le mécanisme dérangeant, c’est qu’un modèle aussi doué pour colmater les brèches l’est, par définition, pour les trouver.

Les garde-fous sont donc le vrai sujet. Google affirme qu’Argon refuse d’aider aux attaques informatiques comme aux attaques chimiques, biologiques, radiologiques ou nucléaires, qu’il s’agit de son modèle le plus résistant à ce jour à l’injection de prompts, et qu’il fonctionne sous un moniteur qui surveille sa chaîne de raisonnement et interrompt l’exécution lorsqu’il outrepasse l’intention de l’utilisateur. Google participe également au processus volontaire d’accès aux modèles avant leur sortie mis en place par le gouvernement américain.

Qui peut utiliser Gemini 4 Argon aujourd’hui ? Seulement la cohorte Fairwind et les équipes internes de Google. Aucune date n’est fixée pour les développeurs, les entreprises ou le grand public ; l’accès commencera par les clients payants de l’API et les abonnés à Google AI Ultra. Le prix de lancement est de 2 $ par million de tokens en entrée et de 10 $ par million de tokens en sortie, avant de passer à 4 $ et 20 $.

Le modèle a été annoncé le 30 septembre par Koray Kavukcuoglu, qui a pris la tête de Google DeepMind après que Demis Hassabis a quitté son poste de directeur général en août. C’est le premier nouveau modèle phare de Google depuis Gemini 3 en novembre 2025, et sa véritable épreuve n’est pas un classement, mais la question de savoir si un modèle diffusé sans garde-fous restera entre les mains auxquelles il était destiné.

Étiquettes: , , , , ,

Ajoutez-nous sur Google

Discussion

Il y a 0 commentaire.