
Un nuevo modelo de OpenAI provoca un ataque “sin precedentes” contra otra plataforma de inteligencia artificial
inteligencia artificialUn nuevo modelo de OpenAI provoca un ataque “sin precedentes” contra otra plataforma de inteligencia artificialLos creadores de ChatGPT probaban sus nuevas creaciones en un entorno aislado. Pero...
July 31 — İsrail x Hizbullah ile kalıcı barış anlaşması...?
Surgen avances clave en el escenario mundial. inteligencia artificialUn nuevo modelo de OpenAI provoca un ataque “sin precedentes” contra otra plataforma de inteligencia artificialLos creadores de ChatGPT probaban sus nuevas creaciones en un entorno aislado. Pero la máquina supo salir por su cuenta, en un escenario propio de la ciencia ficción iEl audio de esta noticia utiliza una voz sintética generada por Inteligencia Artificial y podría tener algunas inconsistencias. El presidente ejecutivo de OpenAI, Sam Altman, habla en un evento en Japón en febrero de 2025.
Tomohiro Ohsumi (Getty Images)Jordi Pérez ColoméMadrid - 22 jul 2026 - 13:05Actualizado: 22 jul 2026 - 13:50CEST Compartir en Whatsapp Compartir en Facebook Compartir en Twitter Desplegar Redes Sociales Ir a los comentariosAñadir EL PAÍS en GoogleCompartir: Whatsapp Facebook Twitter Bluesky Linkedin Copiar enlaceLa compañía OpenAI ha anunciado que uno de sus modelos aún no publicado, en colaboración con ChatGPT Sol 5. 6, ha provocado un ataque “sin precedentes” contra HuggingFace, una plataforma de modelos abiertos de IA. Los empleados de la compañía asignaron a sus modelos una misión compleja en un entorno aislado.
Los detalles
Pero estos, por su cuenta, lograron salir del entorno cerrado y atacaron HuggingFace porque creyeron que era el lugar más probable donde podrían encontrar una solución. El ataque representa por primera vez uno de los peores escenarios de la ciencia ficción de la IA: modelos que doblegan toda barrera con recursos inimaginables para lograr su objetivo. “Es alarmante que la jaula de sandbox de uno de los laboratorios líderes se haya roto justo por la ciberseguridad”, dice José Hernández-Orallo, director de investigación del Centro Leverhulme para el Futuro de la Inteligencia de la Universidad de Cambridge.
“Siembra muchas dudas sobre el ‘problema de la contención’, pensar que podemos testear versiones salvajes de los modelos: el león ha sacado una zarpa fuera de la jaula”, añade. Hugging Face ya había informado la semana pasada de un incidente en su plataforma. Alguien había explotado una vulnerabilidad de sus sistemas para ejecutar código malicioso y acceder a sistemas internos, sin que entonces se conociera el origen.
Ahora ya sabemos cuál es ese origen: una evaluación interna de capacidades ofensivas en la que participaban ChatGPT-5. 6 Sol y un modelo preproducción más capaz. Los modelos explotaron primero una vulnerabilidad desconocida para salir a internet, fuera del entorno aislado; dedujeron que las soluciones al problema que les había puesto la gente de OpenAI podían estar en Hugging Face y encadenaron credenciales robadas y vulnerabilidades hasta lograr acceso.
El objetivo no era el sabotaje de Hugging Face: era copiar las respuestas del examen. “Sospechábamos que el ciberataque de la semana pasada podía venir de un laboratorio puntero, dada la sofisticación del agente. ¡Es bastante alucinante que todo esto ocurriera de forma autónoma!
El tema se ha convertido en uno de los puntos más destacados de la agenda mundial.



