Google LLC a commencé aujourd'hui à déployer Gemini 4 Argon, un modèle d'intelligence artificielle révolutionnaire qui bat les modèles concurrents d'Anthropic PBC et d'OpenAI Group PBC sur la plupart des benchmarks de Google, auprès des défenseurs de la cybersécurité approuvés.
En dehors des équipes de Google, seuls les membres de son programme Fairwind peuvent pour l'instant utiliser Argon. Le programme a débuté le 3 septembre avec le plus petit modèle Gemini 3.8 Flash Cyber et a depuis inscrit plus de 650 organisations, dont CrowdStrike Holdings Inc. et Palo Alto Networks Inc.
Koray Kavukcuoglu, architecte en chef de l'IA chez Google, a écrit dans l'annonce que la publication de capacités à ce niveau « nécessite une approche progressive ». Google participe au processus volontaire du gouvernement américain pour l'accès aux versions préliminaires des modèles et affirme qu'il continue de renforcer les garanties contre toute utilisation abusive à des fins de cyberattaques ou de développement d'armes.
Selon Google, Argon résiste mieux à l'injection indirecte que n'importe quel modèle qu'il a livré. Des moniteurs séparés surveillent la chaîne de pensée et d'actions du modèle et peuvent l'arrêter si elle va au-delà de ce que l'utilisateur voulait.
Google a construit Argon pour le type de travail à long terme mesuré par DeepSWE, et a fixé la limite de sortie du modèle à 1 million de jetons pour correspondre. Les modèles Gemini précédents culminaient à 64 000.
Des milliers d'employés de Google utilisent déjà Argon et les équipes de l'entreprise ont affecté leurs agents à de gros travaux d'ingénierie. La première consiste à déplacer le code C et C++ vers Rust, dans des projets allant des bibliothèques principales de dizaines de milliers de lignes au noyau Zircon de plus de 800 000 lignes dans le système d'exploitation Fuchsia de Google. Sur libgav1, le décodeur vidéo open source de Google, les agents sont partis d'un port Rust existant et ont réécrit 32 000 lignes de son code critique en termes de vitesse, comme Rust sûr que le compilateur pouvait optimiser lui-même. Le décodeur fonctionne désormais 2,7 fois plus vite que le port précédent, sans modification de sa sortie vidéo.
Les ingénieurs de Google utilisent également des agents Argon pour rechercher la mémoire gaspillée, et une analyse de données de profilage à l'échelle de la flotte a jusqu'à présent libéré plus de 300 tébioctets dans les centres de données de l'entreprise.
Les membres de Fairwind et les équipes internes de Google obtiennent une version d'Argon sans les cyber-garde-fous supprimés. Le modèle peut trouver et corriger les vulnérabilités logicielles par lui-même, et sur CWE-bench v1, un test de correction, il a égalé GPT-6 Astra à 68 %.
Wiz Inc., la société de sécurité cloud appartenant à Google, a utilisé Argon dans son programme gratuit Scan for Good, qui recherche les expositions dans les infrastructures publiques essentielles. Google a déclaré que le modèle avait découvert une faille critique exposant des informations personnelles dans les logiciels de soins de santé utilisés par les hôpitaux du monde entier. Les modèles pionniers antérieurs ne l’avaient pas compris.
Google n'a pas donné de date pour les développeurs payants et les abonnés Google AI Ultra, qui sont les prochains sur la liste. Argon coûtera 2 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie au lancement, et le prix des entrées mises en cache est 95 % inférieur. Anthropic facture 4 $ et 20 $ pour l'Opus 5.5, et Argon passe à ces tarifs à la fin du prix de lancement.