Google lance un LLM conçu pour les tâches longues et la cyberdéfense
Google dévoile Gemini 4 Argon, un modèle d'IA destiné aux tâches longues en programmation, cybersécurité et travail intellectuel. Il peut produire jusqu’à un million de tokens au cours d’une même tâche et sera d’abord accessible à des spécialistes de la cyberdéfense.
Google lance Gemini 4 Argon, un LLM conçu pour maintenir des raisonnements et des séquences d’actions sur des tâches longues. Sa principale évolution tient à la longueur de sortie, portée à un million de tokens au cours d’une même tâche, contre 64'000 auparavant. Selon Google, cette capacité permet de poursuivre des workflows comportant de nombreuses étapes sans devoir les fractionner.
L’entreprise utilise déjà Argon dans plusieurs projets internes. Des agents basés sur le modèle participent notamment à la migration de bases de code C et C++ vers Rust, depuis des bibliothèques de plusieurs dizaines de milliers de lignes jusqu’au noyau Zircon de Fuchsia, qui dépasse 800'000 lignes. Ces travaux font l’objet d’audits, de tests d’émulation et de revues avant leur mise en production. Dans un autre projet, des agents ont analysé la télémétrie des centres de données afin d’identifier et d’appliquer des optimisations de mémoire. Google affirme que leur déploiement a permis de libérer plus de 300 TiB, avec un potentiel estimé entre 500 TiB et 1 PiB.
Un premier déploiement centré sur la cyberdéfense
La cybersécurité constitue l’un des premiers terrains de déploiement d’Argon. Selon Google, le modèle peut rechercher, valider et corriger de manière autonome des vulnérabilités logicielles. Il obtient 68% sur CWE-bench v1, consacré à la correction de failles. Wiz l’utilise également dans son initiative Scan for Good, qui vise à identifier et corriger des risques touchant des infrastructures publiques critiques.
Compte tenu de ces capacités cyber, Google opte pour un accès progressif. Gemini 4 Argon est d’abord proposé à des spécialistes de la cyberdéfense participant au programme Fairwind. Certains défenseurs de confiance et des équipes internes de Google disposent d’une version sans restrictions cyber, tandis que la version destinée à une diffusion plus large intégrera des mécanismes visant à refuser les requêtes malveillantes dans les domaines cyber ainsi que chimiques, biologiques, radiologiques et nucléaires.
Google indique également avoir renforcé la résistance du modèle aux injections indirectes de prompts. Des mécanismes de surveillance du raisonnement et des actions sont prévus pour interrompre son exécution lorsqu’il s’écarte des intentions de l’utilisateur. Ces dispositifs ont fait l’objet de tests internes et externes au moyen de red teaming automatisé et manuel.
L’actualité IT en Suisse et à l’international, avec un focus sur la Suisse romande, directement dans votre boîte mail > Inscrivez-vous à la newsletter d’ICTjournal, envoyée du lundi au vendredi!