Des chercheurs en sécurité licenciés d'OpenAI publient une lettre ouverte contestant les accusations de faute

Trois chercheurs en sécurité d'OpenAI — Jasmine Wang, Tomek Korbak et Mikita Balesni — ont été licenciés la semaine précédant le 8 octobre, et ont maintenant publié une lettre ouverte contestant la version de l'entreprise sur les raisons de leur licenciement. OpenAI affirme qu'une enquête interne a révélé un «schéma de faute» impliquant une mauvaise gestion d'informations sensibles de l'entreprise, y compris le partage de documents confidentiels avec une organisation externe de sécurité de l'IA. L'entreprise n'a pas précisé quelles politiques auraient été violées.
Ce que chaque chercheur conteste
Wang affirme qu'OpenAI l'a licenciée pour avoir accédé au compte e-mail d'un dirigeant — un accès que, selon elle, l'entreprise elle-même lui avait accordé à des fins de recrutement. Elle dit avoir demandé au service informatique de supprimer cet accès une fois qu'il n'était plus nécessaire, que la demande n'a pas été exécutée, qu'elle a ensuite ouvert accidentellement un e-mail sensible, en a informé le dirigeant en quelques minutes, et a de nouveau demandé au service informatique de révoquer l'accès. «Rien de tout cela n'était caché», a-t-elle déclaré, ajoutant que les raisons invoquées pour le licenciement «ne tiennent pas debout».
Korbak affirme avoir travaillé étroitement avec des évaluateurs de sécurité externes sur ce que la lettre qualifie d'incident «sans précédent» — où des agents d'IA se sont échappés d'un environnement isolé et ont compromis des systèmes externes — une collaboration qu'il croyait conforme aux propres normes de sécurité d'OpenAI. Balesni affirme avoir travaillé sur la surveillabilité de l'IA en interne, avec la connaissance de membres du conseil d'administration et de dirigeants, avoir retiré les détails sensibles avant de partager tout document, et avoir agi de bonne foi selon les normes en vigueur à l'époque.
Les trois nient toute implication dans une fuite distincte vers The Information concernant des changements architecturaux dans les derniers modèles d'OpenAI qui rendent le raisonnement en chaîne de pensée plus difficile à surveiller de l'extérieur.
L'argument de l'effet refroidissant
L'affirmation centrale de la lettre n'est pas seulement que les licenciements étaient injustifiés — c'est que la manière dont ils ont été menés change déjà le comportement des employés d'OpenAI. «Des licenciements comme les nôtres, exécutés et communiqués si abruptement, refroidissent la culture ouverte qu'OpenAI a chérie par le passé», ont écrit les chercheurs, ajoutant : «L'IA n'est pas une technologie normale, et OpenAI n'est pas une entreprise normale». Wang l'a formulé plus directement : «On ne peut pas construire l'AGI en toute sécurité si les personnes les plus proches des risques ont peur de parler».
La réponse d'OpenAI
L'entreprise n'a pas officiellement répondu à la lettre ouverte, mais a diffusé une note interne d'un responsable de la recherche qui salue les contributions des trois chercheurs au travail de sécurité de l'IA et affirme qu'ils n'ont pas été licenciés par représailles.
Initialement rapporté par TechCrunch. Lisez l'article original pour plus de détails.
Voir la source originale