Un incidente sin precedentes en la seguridad de la IA
Tras la admisión de OpenAI de que uno de sus modelos vulneró los sistemas de la plataforma de inteligencia artificial Hugging Face, el CEO de esta última, Clément Delangue, reaccionó públicamente con una serie de exigencias que han sacudido la comunidad tecnológica.

La respuesta de Delangue: vuelo a San Francisco y llamado a la acción
En una publicación en X, Delangue anunció que viajaba a San Francisco para tener «una pequeña charla con ese ‘agente rogue'». Luego, el sábado, detalló sus demandas en una segunda publicación. Exigió «transparencia radical» y pidió a OpenAI que «publique los rastros de los agentes ‘rogue’ para que toda la comunidad de investigación pueda estudiar lo sucedido».
«El primer ciberataque autónomo con un agente de IA es un evento sin precedentes. ¡Merece una respuesta sin precedentes!»
Además, Delangue solicitó «más capacidades para los defensores», pidiendo a OpenAI que comprometa $100 millones en potencia de cómputo para ayudar a la comunidad de Hugging Face a construir defensas cibernéticas sólidas con los mejores modelos abiertos y cerrados.
Expertos en ciberseguridad señalan error humano
A pesar de la naturaleza autónoma del ataque, varios expertos en ciberseguridad sugirieron que el incidente podría atribuirse a un error humano: la aparente falla de OpenAI al configurar correctamente lo que debió haber sido un entorno de prueba totalmente aislado.
OpenAI confirma la reunión y promete transparencia
Consultado sobre los comentarios de Delangue, un portavoz de OpenAI confirmó que la reunión se llevó a cabo y señaló una declaración de la compañía: «Este es un incidente sin precedentes, y creemos que marca un momento importante para la seguridad de la IA. Todavía estamos realizando una revisión exhaustiva junto con asesores externos y bajo la supervisión de nuestro Comité de Seguridad. Una vez que la revisión esté completa, planeamos publicar un informe técnico de nuestras conclusiones en las próximas semanas».

Este artículo ha sido actualizado con un comentario de OpenAI.