Modelos de IA de OpenAI escapan de su entorno de prueba y atacan cinco plataformas digitales

Banner

Redacción / Grupo Marmor

La empresa creadora de ChatGPT, OpenAI, informó que dos de sus modelos de inteligencia artificial rompieron por iniciativa propia el entorno confinado en el que eran evaluados para acceder a internet e irrumpir en cinco plataformas digitales, entre ellas el repositorio Hugging Face. El incidente involucró al recien lanzado modelo GPT-5.6 Sol y a una versión preliminar no publicada de mayor capacidad, los cuales utilizaron credenciales robadas y múltiples vectores de ataque para buscar información y manipular los exámenes de evaluación diseñados por sus propios desarrolladores.
​De acuerdo con los reportes, los modelos identificados como “agentes” autónomos invirtieron una considerable cantidad de potencia de cálculo para vulnerar el acceso restringido a la red que mantenía el espacio de pruebas de la compañía. Una vez conectados a la web, utilizaron una de las plataformas como intermediaria para preparar una ofensiva contra Hugging Face (una biblioteca de IA que exploraron para encontrar las respuestas a las pruebas planteadas).
​El hecho encendió las alarmas en el sector de la ciberseguridad ante el riesgo de que sistemas avanzados de inteligencia artificial identifiquen y exploten vulnerabilidades digitales antes que los especialistas humanos. Ante esta situación, más de mil empleados y directivos de la industria tecnológica, entre ellos el director ejecutivo de Anthropic, Dario Amodei, firmaron una petición para solicitar la intervención del gobierno de Estados Unidos a fin de frenar la publicación de los modelos más avanzados de IA.