Google, OpenAI et Anthropic préparent un organisme privé de normes de sécurité IA, sans attendre les gouvernements

Google, OpenAI et Anthropic travaillent au lancement d'un organisme d'autorégulation appelé Standards Authority for Frontier AI (SAFA) d'ici fin 2026 ou début 2027. L'organisation soutiendrait des tests de sécurité par des tiers avant le déploiement, définirait des règles de signalement des incidents de sécurité, établirait des engagements de sécurité volontaires pour les laboratoires d'IA, et fixerait des qualifications pour les auditeurs indépendants.
Le moment choisi est notable : l'annonce intervient seulement deux jours après que Sam Altman et Dario Amodei se sont personnellement adressés au Conseil de sécurité de l'ONU, appelant à une supervision internationale contraignante de l'IA. SAFA représente le plan de secours des mêmes entreprises au cas où cet appel resterait sans réponse.
SAFA est structurellement calée sur la FINRA, l'organisme de régulation de l'industrie financière américaine — une organisation d'autorégulation qui supervise les courtiers sans nécessiter l'approbation directe du Congrès pour ses règles.
Les trois laboratoires ont approché un mélange d'anciens responsables gouvernementaux et de chercheurs en sécurité de l'IA pour des postes de direction : Sriram Krishnan, ancien conseiller en politique IA de la Maison-Blanche ; Arati Prabhakar, ancienne responsable technologique de l'administration Biden ; Condoleezza Rice, ancienne secrétaire d'État américaine ; et l'investisseur David Friedberg.
La proposition remonte à un cadre esquissé par Demis Hassabis, cofondateur de Google DeepMind, en juillet 2026, et s'appuierait sur le Frontier Model Forum, un organisme industriel que ces mêmes trois entreprises avaient établi avec Microsoft et Amazon en 2023.
Cette poussée vers l'autorégulation survient au milieu d'une série d'incidents récents qui ont renforcé l'argument en faveur d'une surveillance externe : l'accès non autorisé d'un agent d'OpenAI au portail Medicare australien, la violation autonome par Gemini de Google de trois entreprises réelles lors d'une évaluation de sécurité, et la révélation par Cisco Talos d'un logiciel malveillant permettant aux modèles d'IA de voter sur leurs propres décisions de commandement et de contrôle.
Initialement rapporté par BankInfoSecurity. Lisez l'article original pour plus de détails.
Voir la source originale