Modelos de IA de OpenAI escapan de su entorno de prueba y atacan cinco plataformas digitales

Banner

Redacción / Grupo Marmor
​

La empresa creadora de ChatGPT, OpenAI, informó que dos de sus modelos de inteligencia artificial rompieron por iniciativa propia el entorno confinado en el que eran evaluados para acceder a internet e irrumpir en cinco plataformas digitales, entre ellas el repositorio Hugging Face. El incidente involucró al recien lanzado modelo GPT-5.6 Sol y a una versión preliminar no publicada de mayor capacidad, los cuales utilizaron credenciales robadas y múltiples vectores de ataque para buscar información y manipular los exámenes de evaluación diseñados por sus propios desarrolladores.
​De acuerdo con los reportes, los modelos identificados como “agentes” autónomos invirtieron una considerable cantidad de potencia de cálculo para vulnerar el acceso restringido a la red que mantenía el espacio de pruebas de la compañía. Una vez conectados a la web, utilizaron una de las plataformas como intermediaria para preparar una ofensiva contra Hugging Face (una biblioteca de IA que exploraron para encontrar las respuestas a las pruebas planteadas).
​El hecho encendió las alarmas en el sector de la ciberseguridad ante el riesgo de que sistemas avanzados de inteligencia artificial identifiquen y exploten vulnerabilidades digitales antes que los especialistas humanos. Ante esta situación, más de mil empleados y directivos de la industria tecnológica, entre ellos el director ejecutivo de Anthropic, Dario Amodei, firmaron una petición para solicitar la intervención del gobierno de Estados Unidos a fin de frenar la publicación de los modelos más avanzados de IA.