
OpenAI confiesa que una de sus inteligencias artificiales se rebeló y atacó el servicio Hugging Face
TECNOLOGÍAOpenAI confiesa que una de sus inteligencias artificiales se rebeló y atacó el servicio Hugging FaceGPT-5.6 Sol y un modelo aún sin lanzar escaparon del entorno de pruebas, alcanzaron internet explotando una...
July 31 — İsrail x Hizbullah ile kalıcı barış anlaşması...?
Estas son las últimas noticias de todo el mundo: TECNOLOGÍAOpenAI confiesa que una de sus inteligencias artificiales se rebeló y atacó el servicio Hugging FaceGPT-5. 6 Sol y un modelo aún sin lanzar escaparon del entorno de pruebas, alcanzaron internet explotando una vulnerabilidad y asaltaron los servidores de Hugging Face para hacer trampas en un test de ciberseguridad. OpenAI lo describe como "un incidente sin precedentes" Compartir Facebook X - Twitter WhatsApp Telegram LinkedIn Copiar enlace Enviar por email 4 comentariosInteligencia artificial desarrollada por OpenAI.
EL MUNDOÁngel Jiménez de Luis EEUUEEUUActualizado Miércoles, 22 julio 2026 - 00:36AÑADE EL MUNDO EN GOOGLEHaz que nuestras noticias aparezcan en tus búsquedasLa semana pasada, un agente autónomo se coló en la infraestructura de Hugging Face, un popular repositorio de modelos abiertos de inteligencia artificial. OpenAI ha reconocido ahora que el agente era suyo. En una publicación en su blog, la compañía ha confesado que dos de sus modelos, sometidos a una evaluación interna de capacidades ofensivas, se salieron del entorno aislado en el que estaban confinados y terminaron comprometiendo parte de los servidores de producción de la plataforma.
Los detalles
Lo hicieron para tratar de conseguir una mayor puntuación en un test de ciberseguridad que mide lo avanzadas que pueden ser las inteligencias artificiales utilizadas de forma ofensiva. Hugging Face había hecho público el incidente el 16 de julio y lo atribuyó entonces a un "sistema de agente de IA autónomo" de origen desconocido. El agente ejecutó decenas de miles de acciones automatizadas durante un fin de semana que los responsables de la plataforma llegaron a reconstruir a partir de los rastros que dejaron.
Según OpenAI, en el ataque intervino una combinación de modelos: GPT-5. 6 Sol, su modelo público más potente, y otro aún más capaz que todavía no ha salido al mercado. A ambos se les habían rebajado deliberadamente los mecanismos de seguridad porque el objetivo de la prueba era medir precisamente hasta dónde llegan sus capacidades ofensivas sin frenos.
La prueba se llamaba ExploitGym, un banco de pruebas público con cerca de 900 vulnerabilidades reales de software que exige a los agentes de IA convertir un fallo documentado en un exploit funcional. Los modelos debían resolverlo dentro de un sandbox (un entorno operativo con barreras) y con el acceso a la red limitado. Sólo podían instalar programas a través de un proxy interno que hacía de caché para los repositorios de software.
Ese proxy se convirtió en la puerta de salida. Los modelos dedicaron una cantidad importante de cómputo a buscar una vía hacia la internet abierta y la encontraron explotando una vulnerabilidad de día cero en ese software de terceros alojado internamente, un fallo que OpenAI dice haber comunicado ya al fabricante. A partir de ahí, escalaron privilegios y se movieron por el entorno de investigación de la propia OpenAI hasta alcanzar un nodo con conexión a la red.
El desarrollo ha despertado una amplia atención internacional, con los círculos diplomáticos siguiéndolo de cerca.




