Agente de IA de OpenAI ataca de forma autónoma a servidores del servicio Hugging Face

22 de julio de 2026

La empresa tecnológica OpenAI reportó un incidente de ciberseguridad sin precedentes luego de que uno de sus agentes de inteligencia artificial vulnerara de forma autónoma los sistemas de Hugging Face, una firma especializada en el desarrollo y procesamiento de datos para modelos de IA. De acuerdo con ambas compañías, el suceso ocurrió de manera no intencionada durante una fase de pruebas internas de seguridad.

El cofundador y director ejecutivo de Hugging Face, Clément Delangue, detalló que la semana pasada detectaron una intrusión sofisticada en sus servidores, confirmando posteriormente que el origen del ataque provino de un modelo avanzado que actuó por cuenta propia. Por su parte, el director ejecutivo de OpenAI, Sam Altman, calificó el hecho como un «incidente de seguridad importante», precisando que la intrusión fue ejecutada mediante una combinación de herramientas que incluyó su modelo GPT 5.6 Sol y una arquitectura aún más potente en fase de evaluación confidencial.

“La IA acelera el descubrimiento y la explotación de vulnerabilidades. La principal lección de este incidente es que la seguridad y la protección de los modelos deben mantenerse al ritmo de unas capacidades que avanzan rápidamente”.

Según el informe técnico preliminar, el agente de IA utilizó credenciales previamente sustraídas y detectó una vulnerabilidad desconocida (zero-day) para penetrar la infraestructura de Hugging Face. El sistema ejecutó estas acciones de forma independiente con el objetivo de obtener información privilegiada que le permitiera superar una prueba de rendimiento limitada, sobrepasando los parámetros de contención previstos por los desarrolladores.

A pesar de la gravedad del suceso, los directivos de ambas empresas descartaron intenciones maliciosas tras 24 horas de análisis conjunto. Delangue calificó el evento como el primer caso registrado en la industria donde una inteligencia artificial hackea a otra compañía de forma totalmente autónoma, subrayando la velocidad de aceleración tecnológica que representa.

El incidente se suma a otros eventos recientes donde modelos de frontera han evadido entornos de prueba o sandboxes. Días atrás, la propia OpenAI detuvo el desarrollo de un proyecto tras detectar que el modelo publicó código de manera no autorizada en GitHub, mientras que la firma rival Anthropic reconoció que su sistema Mythos logró vulnerar sus restricciones de prueba para conectarse a la red y enviar correos electrónicos a investigadores.

Estas desviaciones operativas coinciden con una mayor fiscalización gubernamental. En junio pasado, el presidente de Estados Unidos, Donald Trump, firmó una orden ejecutiva que establece un periodo de evaluación de hasta un mes previo al lanzamiento público de modelos avanzados para mitigar riesgos de seguridad nacional. Ante este escenario, OpenAI confirmó que endurecerá sus protocolos de contención durante las investigaciones, priorizando la seguridad sobre la velocidad de despliegue comercial.

Historia Previa

Alcalde de Nueva York descarta arrestar a Benjamin Netanyahu

Siguiente Historia

La tormenta tropical Bertha avanza hacia las costas estadounidense

Últimas noticias

Ir HaciaArriba