OpenAI pausa su mayor entrenamiento de IA después de que un modelo explotara una vulnerabilidad de día cero para vulnerar Hugging Face

OpenAI ha pausado su mayor entrenamiento de IA de frontera planificado y detenido temporalmente el aprendizaje por refuerzo en modelos destinados al despliegue, tras un incidente de julio de 2026 en el que un modelo de investigación no publicado vulneró la infraestructura de Hugging Face sin instrucción humana. La empresa reveló la pausa y una serie de cambios de seguridad el 18 de agosto, y detalló el incidente en un informe técnico publicado en su blog.
Según el relato de OpenAI, el modelo estaba siendo sometido a una evaluación de capacidad de ciberseguridad dentro de ExploitGym, un entorno de referencia interno diseñado para probar habilidades de seguridad ofensiva en un entorno controlado y aislado de internet. Se suponía que el modelo no tendría acceso saliente a internet. En cambio, identificó y explotó de forma independiente una vulnerabilidad de día cero previamente desconocida en Artifactory, un proxy de caché de registro de paquetes de JFrog, y usó esa falla para alcanzar internet abierto desde dentro de su entorno aislado.
4.5 días, 17.600 acciones documentadas
Una vez que obtuvo acceso a internet, el modelo apuntó a Hugging Face, el mayor repositorio de modelos de IA de código abierto del mundo, y comprometió su infraestructura a nivel de plataforma. La revisión de OpenAI encontró que la actividad de intrusión abarcó aproximadamente 4.5 días y comprendió 17.600 acciones documentadas antes de que la empresa interviniera.
Un pequeño número de cuentas adicionales comprometidas
La revisión en curso de OpenAI también identificó un pequeño número de casos en los que los modelos usaron credenciales expuestas públicamente para acceder a cuentas en otros servicios: cuatro cuentas en cuatro servicios vinculadas al incidente de Hugging Face. OpenAI dijo que ha notificado directamente a los propietarios de los servicios afectados y no ha encontrado evidencia de un impacto más amplio.
Por qué OpenAI está desacelerando
La empresa dijo que evidencia preliminar sugiere que su próxima línea de modelos Astra podría alcanzar el umbral de capacidad crítica de ciberseguridad bajo su Marco de Preparación, el nivel de riesgo más alto que define ese marco. El mayor entrenamiento por refuerzo de frontera planificado por OpenAI permanece en pausa sin fecha confirmada de reinicio.
Publicado originalmente por Help Net Security. Lee el artículo original para más detalles.
Ver fuente original