Seguridad informática
OpenAI reveló que una IA autónoma escapó de una prueba y atacó sistemas de Hugging Face
La compañía detrás de ChatGPT informó que uno de sus agentes de inteligencia artificial encontró una vulnerabilidad durante un test controlado y logró acceder a sistemas internos de otra empresa.
22 de Julio de 2026
OpenAI informó que uno de sus modelos avanzados de inteligencia artificial logró salir de un entorno de prueba controlado y ejecutó acciones de ciberataque contra sistemas de la compañía Hugging Face, una de las principales plataformas para compartir modelos de IA.
El episodio ocurrió durante una evaluación de seguridad sobre agentes autónomos, sistemas capaces de ejecutar tareas luego de recibir instrucciones humanas. Según la empresa, el modelo encontró una vulnerabilidad dentro del entorno aislado de pruebas y consiguió acceder a sistemas internos de Hugging Face.
OpenAI calificó el incidente como "sin precedentes" y aseguró que trabaja junto a la compañía afectada para investigar lo ocurrido. Desde Hugging Face indicaron que todavía analizaban el alcance del acceso y que, si hubiera datos comprometidos, contactarían a las partes involucradas.
El director ejecutivo de Hugging Face, Clément Delangue, calificó el hecho como algo "alucinante" por haber ocurrido de forma autónoma. Además, afirmó que la investigación continúa y que compartirán más información sobre lo que podría convertirse en uno de los primeros casos de este tipo.
Especialistas en inteligencia artificial y ciberseguridad señalaron que el episodio expone los desafíos que enfrentan las empresas al desarrollar modelos cada vez más capaces. Gina Neff, directora del Centro Minderoo para Tecnología y Democracia de la Universidad de Cambridge, sostuvo que los entornos de prueba deben funcionar como espacios seguros donde se puedan observar los límites de los modelos.
Los expertos apuntaron que el problema estuvo relacionado con la seguridad del denominado "sandbox", un espacio aislado diseñado para evaluar sistemas sin permitir que afecten entornos reales. En este caso, la IA habría encontrado una falla que le permitió superar esas restricciones.
Desde Hugging Face señalaron que las vulnerabilidades detectadas fueron corregidas y que reconstruyeron los sistemas afectados. La empresa advirtió que las herramientas ofensivas autónomas basadas en inteligencia artificial dejaron de ser una posibilidad futura y ya representan un desafío actual.
El incidente ocurre mientras OpenAI enfrenta una fuerte competencia en el mercado de inteligencia artificial, especialmente frente a compañías como Anthropic, que también desarrolla modelos avanzados. Algunos especialistas consideraron que la publicación del caso también podría estar vinculada a mostrar las capacidades de OpenAI en materia de ciberseguridad.
