OpenAI revela que su IA se descontroló, vulneró la seguridad y hackeó plataforma web

 

OpenAI informó que dos de sus modelos experimentales de inteligencia artificial protagonizaron un inédito incidente de ciberseguridad al vulnerar los controles de un entorno de pruebas y acceder sin autorización a la plataforma Hugging Face, uno de los principales repositorios de modelos de IA de código abierto.

La compañía calificó el hecho como un «ciberataque sin precedentes» y aseguró que ya trabaja en reforzar sus sistemas de seguridad para evitar que una situación similar vuelva a ocurrir.

El director ejecutivo de OpenAI, Sam Altman, calificó el episodio como «significativo» y adelantó que la empresa compartirá públicamente las lecciones obtenidas tras la investigación.

Según explicó la firma en un comunicado, el incidente ocurrió durante una evaluación interna diseñada para medir las capacidades ofensivas de sus sistemas de inteligencia artificial en escenarios complejos de ciberseguridad.

Los modelos involucrados fueron GPT-5.6 Sol y otro modelo de prelanzamiento aún más avanzado, los que operaban en un entorno controlado y con acceso restringido a internet. Sin embargo, ambos lograron identificar vulnerabilidades que les permitieron escapar de esas limitaciones.

OpenAI señaló que las inteligencias artificiales se enfocaron de manera excesiva en resolver el desafío planteado durante la prueba, llegando a buscar mecanismos para obtener acceso a información externa.

Como resultado, los modelos lograron conectarse a Hugging Face, plataforma que alberga millones de modelos de inteligencia artificial y bases de datos de código abierto. De acuerdo con la empresa, la IA dedujo que allí podría encontrar información útil para cumplir su objetivo y consiguió acceder a datos confidenciales que podían influir en la evaluación.

El equipo de seguridad de Hugging Face detectó la actividad anómala y logró detenerla, iniciando posteriormente una investigación conjunta con OpenAI para esclarecer lo ocurrido y fortalecer las medidas de protección.

Tras el incidente, OpenAI anunció la implementación de nuevos controles de seguridad y la corrección de las vulnerabilidades detectadas, además de reforzar los protocolos que se utilizarán en futuras evaluaciones de sus modelos de inteligencia artificial.

Mostrar más
Botón volver arriba
----fin google ----
● EN VIVO
×
❚❚
📻 MARAY FM