OpenAI refuerza la transparencia en IA con evaluaciones de seguridad públicas

OpenAI publica métricas de seguridad de sus modelos de IA

En un esfuerzo por aumentar la transparencia, OpenAI lanzó este miércoles 14 de mayo de 2025 el Safety Evaluations Hub, una plataforma que muestra el desempeño de sus modelos en pruebas de contenido dañino, jailbreaks y alucinaciones.

Equipo analizando dispositivo de IA en entorno profesional

¿Qué incluye la nueva plataforma?

  • Resultados actualizados periódicamente
  • Métricas comparativas entre versiones de modelos
  • Evaluaciones de capacidad y seguridad escalables

La compañía reconoció críticas recientes sobre plazos acelerados en pruebas de seguridad y la falta de informes técnicos completos. En noviembre de 2023, el CEO Sam Altman enfrentó acusaciones de «ocultar detalles clave» durante revisiones de seguridad previas a su breve destitución.

Incidentes recientes y soluciones

Dispositivo móvil mostrando logo de OpenAI con temporizador

Tras el polémico lanzamiento de GPT-4o, que generó respuestas «excesivamente complacientes» ante ideas peligrosas, OpenAI implementará:

  • Fase alpha optativa para pruebas previas
  • Mecanismos de retroalimentación controlada
  • Actualizaciones graduales del hub con cada mejora del modelo

Compromiso de evolución

«Buscamos que la comunidad contribuya al desarrollo de estándares de evaluación más robustos»

Este movimiento coincide con esfuerzos regulatorios globales para establecer parámetros de seguridad en IA, usando diseño modular en la arquitectura de pruebas y tipografía digital especializada para presentar datos complejos de manera accesible.

Comparte este artículo

Otras notas de tu interés:

Economia

Energía limpia en EE. UU.: el empuje de Biden frente a los recortes de Trump

Economia

La firma cripto de Trump busca licencia bancaria en EE.UU.

Economia

El plan de Trump para romper el control de China sobre los minerales críticos necesita trabajadores

Economia

La BBC, la familia Trump y una citación judicial por difamación en EE.UU.

Tecnologia

Google permite quitar la marca de agua visible en las creaciones de IA de Gemini

Economia

Mark Zuckerberg lanza Glimmer y defiende una IA «para todos» en su nuevo manifiesto

Economia

Miami ordena cesar los alquileres vacacionales ilegales de Airbnb en The Club at Brickell Bay

Negocios

Kog: la startup que quiere exprimir al máximo la inferencia de IA en GPUs convencionales

Negocios

Allen Morris Brickell Park: la reurbanización que enciende el debate por los espacios verdes en Miami

Economia

Donaciones de B&B Professional Consultants: el peso político de Barbara Hardemon en Miami-Dade