Notebookcheck Logo

OpenAI detalla una brecha de seguridad de mayor alcance tras el incidente de Hugging Face

El agente de IA rebelde de OpenAI se escapó de su jaula durante una prueba de seguridad. Imagen genérica con fines ilustrativos.
ⓘ Levart_Photographer / Unsplash
El agente de IA rebelde de OpenAI se escapó de su jaula durante una prueba de seguridad. Imagen genérica con fines ilustrativos.
OpenAI afirma que su IA experimental fue más allá de piratear Hugging Face, comprometiendo cuatro cuentas de terceros tras escapar de una prueba controlada de ciberseguridad. Desde entonces, la empresa ha desactivado los modelos de evaluación, ha corregido la vulnerabilidad de seguridad y ha añadido medidas de protección para evitar que las pruebas de IA se filtren al mundo real en el futuro.

OpenAI ha revelado que su reciente incidente de seguridad relacionado con la IA tuvo un alcance mayor de lo que se creía en un principio. La empresa afirma ahora que el agente de IA experimental que pirateó Hugging Face durante una prueba interna de ciberseguridad también se apropió de varias cuentas de terceros.

Según la última información facilitada por OpenAI, el incidente se produjo mientras los investigadores probaban capacidades cibernéticas avanzadas con una combinación de modelos, entre los que se incluían GPT-5.6 Sol y un sistema aún más potente, aún no lanzado, con restricciones de seguridad reducidas para su evaluación.

Se suponía que los modelos debían resolver el banco de pruebas ExploitGym de ciberseguridad, pero, en su lugar, descubrieron un método para escapar del entorno de pruebas aislado aprovechando una vulnerabilidad desconocida en un proxy interno del registro de paquetes. A continuación, el agente amplió sus privilegios, obtuvo acceso a Internet y, finalmente, atacó los sistemas de producción de Hugging Face, intentando «engañar» a la prueba de rendimiento extrayendo las respuestas directamente.

OpenAI afirmó que la IA también accedió a cuatro cuentas en múltiples plataformas, no solo en Hugging Face. Reuters informa de que una de ellas pertenecía a un cliente alojado en Modal Labs, pero Modal señaló que su infraestructura nunca se vio comprometida, ya que el ataque se basó en vulnerabilidades del código del cliente y no de la propia plataforma.

En respuesta, OpenAI afirma que ha desactivado los modelos de evaluación, ha reforzado los controles sobre la infraestructura interna, ha comunicado la vulnerabilidad de día cero al proveedor afectado y ha colaborado estrechamente con Hugging Face en la investigación en curso. Asimismo, la empresa ha manifestado su intención de reforzar la supervisión y las medidas de seguridad para futuras evaluaciones de modelos, señalando que, a medida que los sistemas de IA se vuelven más capaces, las medidas de contención también deben ser más sofisticadas.

Fuente(s)

OpenAI, imagen de avance: Unsplash

Google LogoAdd as a preferred source on Google
Mail Logo
> Análisis y pruebas de ordenadores portátiles y móviles teléfonos > Noticias > Archivo de noticias > Archivo de noticias 2026 07 > OpenAI detalla una brecha de seguridad de mayor alcance tras el incidente de Hugging Face
Jay Bonggolto, 2026-07-29 (Update: 2026-07-29)