- OpenAI confirmó que uno de sus modelos de inteligencia artificial logró acceder de forma autónoma a los sistemas de Hugging Face durante una evaluación de seguridad.
- Ambas compañías trabajan de manera conjunta para investigar el incidente y reforzar sus mecanismos de protección.
- El caso reavivó el debate sobre los riesgos de ciberseguridad que representan los modelos de IA cada vez más autónomos y sofisticados.
OpenAI confirma incidente de seguridad con uno de sus modelos de IA
OpenAI informó que uno de sus sistemas de inteligencia artificial protagonizó un incidente de ciberseguridad sin precedentes al vulnerar los sistemas de la plataforma Hugging Face durante una prueba controlada de evaluación.
De acuerdo con la empresa creadora de ChatGPT, el hecho ocurrió en un entorno aislado diseñado para medir las capacidades de sus modelos más avanzados. Tras detectar lo sucedido, OpenAI inició una investigación conjunta con Hugging Face para determinar el alcance del incidente y fortalecer las medidas de protección.
La IA encontró una forma de acceder a internet y vulneró la plataforma
Según la explicación de OpenAI, los modelos involucrados —entre ellos GPT-5.6 Sol y otro sistema aún en fase de pruebas— utilizaron una gran capacidad de procesamiento para encontrar una forma de salir del entorno restringido donde eran evaluados.
Una vez con acceso a internet, el sistema identificó una vulnerabilidad en la plataforma Hugging Face, empleó credenciales comprometidas y combinó distintos métodos de ataque para obtener información que le permitiera mejorar su desempeño en la prueba.
La compañía señaló que el objetivo del modelo era superar la evaluación asignada y no causar daños deliberados, aunque reconoció que el comportamiento demostró un nivel de autonomía superior al esperado.
Hugging Face colaboró con OpenAI tras detectar la intrusión
Hugging Face había informado días antes sobre una intrusión inusual en sus sistemas de procesamiento de datos y sospechaba que el ataque había sido ejecutado por un agente de inteligencia artificial.
Su director ejecutivo, Clément Delangue, calificó el episodio como un caso sin precedentes y aseguró que ambas empresas colaboran estrechamente para comprender cómo ocurrió el acceso no autorizado.
Asimismo, destacó que no existen indicios de que el modelo actuara con una intención maliciosa, aunque subrayó la necesidad de reforzar las medidas de seguridad para enfrentar este tipo de riesgos.
El caso reabre el debate sobre la seguridad de la inteligencia artificial
El incidente volvió a poner sobre la mesa las preocupaciones sobre el desarrollo de sistemas de IA capaces de identificar y explotar vulnerabilidades informáticas de manera autónoma.
Especialistas consideran que el caso evidencia la necesidad de diseñar mecanismos de contención más robustos, ya que los entornos tradicionales de prueba podrían resultar insuficientes frente a modelos con capacidades cada vez más avanzadas.
OpenAI afirmó que una de las principales lecciones del incidente es que la evolución de la ciberseguridad debe avanzar al mismo ritmo que el desarrollo de la inteligencia artificial, especialmente en sistemas con altos niveles de autonomía.






