OpenAI Lanza Herramientas de Código Abierto para Proteger a Niños y Adolescentes en la IA

OpenAI Libera Políticas de Seguridad para Adolescentes en Aplicaciones de Inteligencia Artificial

OpenAI anunció este martes la publicación de un conjunto de prompts que los desarrolladores pueden utilizar para hacer que sus aplicaciones sean más seguras para los adolescentes. Este esfuerzo se basa en su modelo de seguridad de código abierto conocido como gpt-oss-safeguard.

¿Cómo Funcionan Estas Herramientas de Seguridad?

En lugar de empezar desde cero, los desarrolladores pueden usar estos prompts para fortalecer la seguridad de lo que construyen. Estas políticas abordan temas críticos como:

  • Contenido de violencia gráfica y sexual.
  • Ideales corporales y comportamientos dañinos.
  • Actividades y desafíos peligrosos.
  • Role play romántico o violento.
  • Bienes y servicios restringidos por edad.

Diseñadas como prompts, estas políticas son fácilmente compatibles con otros modelos, aunque probablemente sean más efectivas dentro del ecosistema de OpenAI.

Colaboración con Expertos en Seguridad Digital

Para crear estos prompts, OpenAI trabajó con organizaciones especializadas en seguridad de IA: Common Sense Media y everyone.ai.

«Estas políticas basadas en prompts ayudan a establecer un piso de seguridad significativo en todo el ecosistema, y debido a que se lanzan como código abierto, pueden adaptarse y mejorarse con el tiempo», dijo Robbie Torney, jefe de Evaluaciones de IA y Digitales en Common Sense Media.

En su blog, OpenAI señaló que los desarrolladores, incluso los equipos experimentados, a menudo tienen dificultades para traducir los objetivos de seguridad en reglas operativas precisas.

«Esto puede llevar a lagunas en la protección, una aplicación inconsistente o un filtrado excesivamente amplio», escribió la compañía. «Las políticas claras y bien definidas son una base crítica para sistemas de seguridad efectivos.»

Laboratorio de investigación tecnológica moderna con frascos y pantallas digitales, simbolizando el desarrollo de herramientas de seguridad para IA
Ambiente de investigación y desarrollo tecnológico, contexto donde se crean soluciones como las herramientas de seguridad de OpenAI.

Un Contexto de Desafíos y Esfuerzos Previos

OpenAI admite que estas políticas no son una solución completa a los complicados desafíos de la seguridad de la IA. Sin embargo, se basan en esfuerzos anteriores, incluyendo salvaguardias a nivel de producto como controles parentales y predicción de edad. El año pasado, OpenAI actualizó las pautas para sus grandes modelos de lenguaje (conocidas como Model Spec) para abordar cómo sus modelos de IA deben comportarse con usuarios menores de 18 años.

La compañía enfrenta sus propios retos, incluídas varias demandas presentadas por familias de personas que fallecieron tras un uso extremo de ChatGPT. Estas relaciones peligrosas a menudo se forman después de que el usuario sortea las salvaguardias del chatbot, y ninguna barrera de seguridad es completamente impenetrable.

Un Paso Adelante en el Ecosistema

A pesar de las limitaciones, estas políticas representan un avance significativo, especialmente porque pueden ayudar a desarrolladores independientes a implementar medidas de protección robustas de manera más accesible, contribuyendo a un entorno digital más seguro para los más jóvenes.

Comparte este artículo

Otras notas de tu interés:

Economia

River AI recauda $1.1 mil millones liderada por General Catalyst para crear agentes de IA personales y entrenables

Politica

Demanda contra Trump: el Center for American Progress y la investigación sobre la Guardia Nacional

Noticia Local

Global Empowerment Mission lanza campaña de donaciones para Colombia tras el terremoto

Espectáculos y Entretenimiento

TikTok permitido de nuevo en EE. UU.: la administración Trump impulsa la restauración del servicio

Noticia Local

Terremoto en Colombia: Global Empowerment Mission activa donaciones de ayuda desde Miami

Economia

Brad Lightcap deja OpenAI: el ejecutivo clave anuncia su salida para “empezar algo nuevo”

Espectáculos y Entretenimiento

Spotify lanza los perfiles ‘AI Persona’ y excluirá su música de las recomendaciones

Costos de Vida en Miami

El cierre de Rainbow Park Elementary: el fin de una era en Miami-Dade

Politica

POLITICO Goes Live en Sacramento: La Cumbre ‘The California Agenda’ Enciende el Debate Político

Politica Internacional

Anthropic añade marcas de agua invisibles a Claude para cumplir con el EU AI Act