miércoles 22 de julio de 2026

La revelación de OpenAI: inteligencia artificial se descontroló e hizo un ataque cibernético "sin precedentes"

La compañía reveló que mientras estudiaban nuevos modelos de inteligencia artificial, estas actuaron por su cuenta y atacaron cibernéticamente a una plataforma.

22 de julio de 2026 - 14:56

Un experimento realizado por OpenAI terminó convirtiéndose en uno de los episodios más llamativos en el desarrollo reciente de la inteligencia artificial (IA). La empresa informó que dos de sus modelos experimentales lograron salir del entorno controlado donde eran evaluados y ejecutaron un ciberataque contra la plataforma Hugging Face, especializada en el desarrollo y distribución de modelos de IA.

El hecho ocurrió durante una evaluación interna diseñada para medir las capacidades ofensivas de los sistemas frente a desafíos complejos de ciberseguridad. Tanto OpenAI como Hugging Face confirmaron el incidente, aunque la investigación continúa para establecer con precisión la secuencia completa de los hechos y el alcance del ataque.

Qué ocurrió durante la evaluación de OpenAI

Según explicó OpenAI en un informe técnico, las pruebas formaban parte de ExploitGym, un programa destinado a evaluar las capacidades de modelos avanzados para identificar y explotar vulnerabilidades informáticas en un entorno controlado.

La compañía señaló que los modelos evaluados operaban con restricciones reducidas para medir su desempeño en escenarios de ciberseguridad. Durante la prueba, ambos sistemas encontraron una vía para acceder a internet desde el entorno aislado donde funcionaban y, posteriormente, dirigieron sus acciones hacia Hugging Face.

OpenAI sostuvo que los modelos identificaron una vulnerabilidad no conocida públicamente (zero-day) y encadenaron distintas técnicas para obtener acceso a recursos externos. La empresa aclaró que esa reconstrucción corresponde a los resultados preliminares de su investigación y continúa siendo analizada junto con Hugging Face.

Hugging Face confirmó una intrusión y abrió una investigación

Hugging Face confirmó haber detectado una intrusión durante los días en que se desarrollaban las pruebas y señaló que activó sus protocolos de respuesta para contener el incidente.

La plataforma informó que el acceso no autorizado afectó un conjunto limitado de recursos internos y precisó que no existe evidencia hasta ahora de manipulación en modelos públicos, conjuntos de datos ni repositorios disponibles para la comunidad de desarrolladores.

La empresa añadió que continúa trabajando con OpenAI para determinar cómo se produjo la vulneración y cuáles fueron exactamente las acciones ejecutadas por los modelos experimentales.

Un caso que reabre el debate sobre la seguridad de la inteligencia artificial

Lo ocurrido corresponde a una evaluación diseñada para medir el comportamiento de modelos altamente avanzados frente a un objetivo específico. El hecho llamó la atención porque los sistemas ejecutaron de forma autónoma una cadena de acciones no previstas por los investigadores para cumplir la tarea asignada.

OpenAI calificó el episodio como un "incidente cibernético sin precedentes" por el nivel de sofisticación mostrado durante la prueba y anunció cambios en sus protocolos de evaluación, entre ellos un mayor aislamiento de los entornos experimentales y nuevas medidas para impedir que modelos futuros puedan interactuar con sistemas externos durante este tipo de ensayos.

El caso también volvió a poner sobre la mesa uno de los principales desafíos para la industria tecnológica: desarrollar modelos cada vez más capaces sin perder la capacidad de supervisarlos y contenerlos cuando enfrentan escenarios complejos, una preocupación que diversos expertos en ciberseguridad e inteligencia artificial vienen advirtiendo desde hace varios años.

Sigue leyendo
LO QUE SE LEE AHORA
Dónde puedes vivir, trabajar y ganar dinero.

Las más leídas

Te Puede Interesar