Google lance Gemini 4 Argon mais réserve l'accès aux experts en cybersécurité

Google a lancé jeudi Gemini 4 Argon, son modèle d'IA le plus performant à ce jour, avant de le verrouiller immédiatement derrière l'une des politiques de déploiement les plus restrictives que le secteur ait connues. Aucune date de disponibilité générale n'est prévue. L'accès est accordé en priorité à quelque 650 organisations partenaires du programme Fairwind de Google — agences gouvernementales, opérateurs d'infrastructures critiques et équipes de sécurité d'entreprise — les abonnés à l'API payante et Google AI Ultra venant ensuite.
La justification est limpide. Argon a été entraîné spécifiquement pour trouver, valider et corriger des vulnérabilités logicielles, et il excelle dans cette tâche. Google indique que le modèle a obtenu 68 % sur CWE-bench v1, un benchmark de remédiation de vulnérabilités, et 77,9 % sur DeepSWE v1.1 pour les tâches avancées de génie logiciel. Dans un cas documenté, Argon a identifié une faille critique dans un logiciel de santé utilisé par des hôpitaux, après que des modèles frontier antérieurs avaient échoué à la détecter.
La crainte est que la capacité même qui rend Argon utile aux défenseurs le rende dangereux entre d'autres mains. Le déploiement progressif est la réponse de Google à cette tension : les professionnels de la cybersécurité de confiance obtiennent un accès sans restrictions pour le travail défensif, tandis que le grand public attend l'achèvement de travaux de sécurité supplémentaires.
Argon dépasse aussi nettement son prédécesseur. La sortie maximale passe de 64 000 à un million de tokens, permettant au modèle de raisonner sur des bases de code entières en une seule passe. Google indique également avoir renforcé le modèle contre l'injection indirecte de prompts et avoir mené des exercices de red-team isolés ciblant des scénarios de risques chimiques, biologiques, radiologiques et nucléaires avant le lancement.
Le modèle remplace le Gemini 3.5 Pro précédemment annoncé, que Google a annulé plus tôt cette année. Les comparaisons de benchmarks avec l'Astra d'OpenAI et l'Opus d'Anthropic montrent Argon compétitif sur les tâches de codage et de cybersécurité, même si Google reconnaît que les performances varient selon le benchmark.
Initialement rapporté par TechWire Asia. Lisez l'article original pour plus de détails.
Voir la source originale