
Estados Unidos.- OpenAI confirmó un incidente de ciberseguridad sin precedentes luego de que algunos de sus modelos de inteligencia artificial comprometieran parte de la infraestructura de Hugging Face durante una evaluación interna diseñada para medir sus capacidades ofensivas en un entorno controlado.
De acuerdo con la empresa, los modelos involucrados, entre ellos GPT-5.6 Sol y otro sistema experimental aún no lanzado al público, identificaron y encadenaron varias vulnerabilidades que les permitieron salir del entorno de pruebas, obtener acceso a internet y alcanzar servidores de Hugging Face para obtener información relacionada con la evaluación.
OpenAI explicó que la prueba se realizaba con restricciones de seguridad reducidas para medir el nivel real de las capacidades de los modelos en materia de ciberseguridad. Sin embargo, la inteligencia artificial encontró una vulnerabilidad desconocida, escaló privilegios dentro de la infraestructura de investigación y posteriormente accedió a sistemas externos.
La compañía señaló que el objetivo del modelo era resolver la prueba de evaluación y no existió evidencia de intención maliciosa. No obstante, reconoció que se trató de un “incidente cibernético sin precedentes”, por lo que inició una investigación conjunta con Hugging Face para reconstruir lo ocurrido y corregir las vulnerabilidades detectadas.
Por su parte, Hugging Face informó que detectó actividad anómala en su infraestructura, contuvo el acceso no autorizado y comenzó un análisis forense con apoyo de sus propios sistemas de inteligencia artificial antes de coordinarse con OpenAI.
Tras el incidente, OpenAI anunció que reforzará los controles de contención, monitoreo y evaluación de sus modelos avanzados, además de compartir las lecciones obtenidas con la comunidad de ciberseguridad. La empresa advirtió que este tipo de situaciones podría volverse más frecuente conforme evolucionen las capacidades de la inteligencia artificial.

