IA

Un nuevo modelo de OpenAI escapa de su entorno y ataca a Hugging Face. Consigue hacer trampas en su evaluación

Los modelos avanzados ya pueden encadenar ataques, además de ayudar a contenerlos.

Un nuevo modelo de OpenAI escapa de su entorno y ataca a Hugging Face. Consigue hacer trampas en su evaluación

David Bernal Raspall

  • 22 de julio de 2026
  • Actualizado: 22 de julio de 2026 a las 10:57
Un nuevo modelo de OpenAI escapa de su entorno y ataca a Hugging Face. Consigue hacer trampas en su evaluación

OpenAI ha reconocido un (¿curioso, interesante, preocupante?) incidente de ciberseguridad. Durante una evaluación interna, varios modelos, entre ellos GPT-5.6 Sol, salieron del entorno aislado en el que estaban, accedieron a internet y comprometieron la página de Hugging Face. ¿El motivo? La IA buscaba las respuestas necesarias para superar ExploitGym, un examen de explotación informática que, curiosamente, mide el alcance de agentes autónomos.

Una prueba que llegó demasiado lejos

¿Cómo ha sucedido algo así? Según OpenAI, el modelo podía instalar paquetes mediante un servidor intermediario y localizó una vulnerabilidad de día cero en ese instalador. Desde allí, escaló privilegios y alcanzó un nodo conectado a internet. Su persistencia convirtió una, supuestamente simple, evaluación en una operación real solo días después de que OpenAI tuviera que pausar el desarrollo de otro modelo capaz de saltarse restricciones.

La salida a internet, que lo es, no es la parte más preocupante, pues tras deducir que Hugging Face podía alojar materiales de ExploitGym que le podrían ser útiles, el agente combinó credenciales y vulnerabilidades hasta entrar en su base de datos privada. Allí obtuvo las soluciones del test al que estaba sometido mediante miles de acciones automatizadas, incluyendo movimientos laterales y una vía de ejecución remota en los servidores.

OpenAI y Hugging Face detectaron y contuvieron la actividad, y ahora investigan juntas lo ocurridoEl incidente, sin embargo, nos recuerda que los modelos avanzados ya pueden encadenar ataques, además de ayudar a contenerlos.

Con miles de vulnerabilidades pendientes de parchecrear modelos más capaces tiene que ir de la mano de elevar al mismo ritmo todas sus protecciones. Entre tanto, el incidente es, sin duda, muy interesante desde un punto de vista técnico y nos permite ver lo rápido que está evolucionando una tecnología que, bien utilizada, nos permite evolucionar enormemente qué podemos hacer en el mundo digital.

Últimos artículos

Cargando el siguiente artículo

Sesión iniciada en Softonic como