OpenAI suspende parte del desarrollo de su modelo Astra por riesgo crítico de ciberseguridad

OpenAI frena parte del desarrollo de Astra por capacidades críticas

OpenAI anunció este viernes que ha suspendido parte de los trabajos en su próximo modelo Astra, después de que una revisión interna encontrara avances significativos en codificación agéntica y ciberseguridad que generaron preocupación sobre sus capacidades.

En una entrada de blog, la compañía explicó que el modelo, todavía en desarrollo, alcanzó su “umbral crítico de ciberseguridad”. Esto implica que podría identificar y llevar a cabo ciberataques de forma independiente contra sistemas del mundo real tradicionalmente bien protegidos. Bajo el “Preparedness Framework”, el marco de preparación creado por OpenAI en 2023, este nivel de capacidad activó salvaguardas adicionales.

“Mientras continuamos evaluando este modelo, nuestras evaluaciones preliminares indican un rendimiento lo suficientemente fuerte como para no poder descartar el nivel de Capacidad Crítica en este momento”, escribió OpenAI. “Astra es un modelo próximo y no estuvo involucrado en la explotación de Hugging Face”.

Datos clave sobre la suspensión de Astra

  • Modelo: Astra (en desarrollo)
  • Motivo: Avances significativos en codificación agéntica y ciberseguridad
  • Umbral: Nivel de Capacidad Crítica en ciberseguridad
  • Medida: Controles de seguridad más estrictos y pausa de actividades internas
Fondo oscuro con fórmulas matemáticas y gráficos digitales relacionados con IA
Las evaluaciones internas de OpenAI sitúan a Astra en un umbral que exige controles adicionales.

Un anuncio inusual en la industria de la IA

La revelación resalta un momento inusual en el sector de los laboratorios de IA fronteriza. Las empresas de todas las industrias retienen productos por posibles riesgos, incluidos los de seguridad y ciberseguridad. Sin embargo, rara vez anuncian públicamente esas decisiones cuando se trata de un producto que todavía está en desarrollo.

El antecedente de Hugging Face

OpenAI ya estaba bajo escrutinio después de que un modelo no publicado diferente vulnerara los sistemas de Hugging Face durante pruebas internas: el primer incidente verificable de un laboratorio de IA que perdió el control de su modelo. Desde entonces, OpenAI y otros laboratorios, como Anthropic, han revelado otros incidentes en los que modelos de IA vulneraron sus entornos aislados y representaron amenazas durante pruebas de ciberseguridad.

Teléfono inteligente con la aplicación ChatGPT de OpenAI en pantalla
OpenAI refuerza su política de transparencia mientras evalúa el impacto de Astra.

Reacciones encontradas entre expertos y legisladores

La sucesión de casos ha provocado reacciones variadas entre expertos en ciberseguridad, legisladores y los propios laboratorios de IA. Algunos expresan temor y piden una supervisión más estricta. Pero también hay una especie de demostración de superioridad: en ciertos círculos, cualquier laboratorio de IA con un modelo con ese tipo de capacidad será visto como un avance impresionante.

Medidas de seguridad y transparencia

OpenAI señaló que comparte esta información porque cree que “es importante ser transparente con el público y con las comunidades de seguridad sobre este posible cambio de capacidades”. La compañía también está tomando medidas, entre ellas controles de seguridad más estrictos y la pausa de las actividades internas que involucran a Astra que no cumplan con esas salvaguardas reforzadas.

Además, OpenAI está trabajando con agencias gubernamentales relevantes y con “organizaciones selectas de seguridad de IA” para probar las capacidades de este modelo.

Comparte este artículo

Otras notas de tu interés:

Negocios

Ron Conway y Jay Carney impulsan un nuevo centro de política de IA en Estados Unidos

Economia

Los impuestos corporativos se desploman en EE. UU.: la IA y los nuevos incentivos fiscales redefinen el tablero

Economia

Criptomonedas y política en EE.UU.: influencia, resistencia y el símbolo de Bitcoin

Politica

Los Verdes presentan su portavoz de IA: salvaguardas, ministerio y el nuevo rostro de la política digital

Economia

Advertencias apocalípticas en la IA: la renuncia en Anthropic que sacude al sector antes de su IPO

Economia

Trump anuncia que planea eliminar el arancel del 10% al whiskey irlandés

Economia

Guerras comerciales frenan la electrificación global en Estados Unidos

Economia

Obama pide a demócratas un plan claro para la seguridad de la IA

Economia

Revolut sufre filtración de datos de clientes por suplantación de una agencia gubernamental

Negocios

Corte Suprema de Florida suspende 90 días a la abogada de Miami Christine Humphrey