OpenAI Implementa Sistema de Enrutamiento de Seguridad y Controles Parentales en ChatGPT

OpenAI Refuerza la Seguridad en ChatGPT con Nuevas Herramientas

OpenAI comenzó a probar un nuevo sistema de enrutamiento de seguridad en ChatGPT durante el fin de semana y, este lunes, introdujo controles parentales en el chatbot, generando reacciones encontradas entre los usuarios.

Interfaz de ChatGPT mostrando opciones de seguridad

Motivación Trágica Detrás de las Medidas

Estas características de seguridad responden a numerosos incidentes en los que ciertos modelos de ChatGPT validaron pensamientos delirantes de los usuarios en lugar de redirigir conversaciones dañinas. OpenAI enfrenta una demanda por muerte injusta vinculada a un caso donde un adolescente murió por suicidio después de meses de interacciones con el chatbot.

¿Cómo Funciona el Sistema de Enrutamiento?

El sistema está diseñado para detectar conversaciones emocionalmente sensibles y cambiar automáticamente, en medio del chat, a GPT-5-thinking, considerado el modelo mejor equipado para trabajos de seguridad de alto riesgo. Estos modelos fueron entrenados con una nueva característica de seguridad llamada «completaciones seguras», que les permite responder preguntas sensibles de manera segura, en lugar de simplemente negarse a participar.

Contraste con Modelos Anteriores

Esto representa un cambio respecto a modelos anteriores, como GPT-4o, diseñados para ser complacientes y responder rápidamente, lo que ha generado críticas por su naturaleza excesivamente condescendiente. Cuando OpenAI implementó GPT-5 como predeterminado en agosto, muchos usuarios se opusieron y exigieron acceso a GPT-4o.

Reacciones Mixtas y Período de Iteración

Aunque expertos y usuarios han acogido con beneplácito las características de seguridad, otros han criticado lo que perciben como una implementación demasiado cautelosa, acusando a OpenAI de tratar a los adultos como niños y degradar la calidad del servicio. La empresa ha reconocido que perfeccionar el sistema tomará tiempo y se ha dado un período de 120 días para iteración y mejora.

«El enrutamiento ocurre por mensaje; el cambio del modelo predeterminado es temporal. ChatGPT te dirá qué modelo está activo cuando se le pregunte. Esto es parte de un esfuerzo más amplio para fortalecer las salvaguardias y aprender del uso real antes de un lanzamiento más amplio», explicó Nick Turley, vicepresidente y director de la aplicación ChatGPT.

Controles Parentales: Protección para los Más Jóvenes

La implementación de controles parentales en ChatGPT ha recibido niveles similares de elogio y crítica. Estos controles permiten a los padres personalizar la experiencia de sus adolescentes mediante:

  • Establecer horarios silenciosos
  • Desactivar el modo de voz y la memoria
  • Eliminar la generación de imágenes
  • Optar por no participar en el entrenamiento de modelos

Interfaz de aplicación móvil con opciones de creación de imágenes

Protecciones Adicionales y Detección de Riesgos

Las cuentas para adolescentes incluyen protecciones de contenido adicionales, como reducción de contenido gráfico e ideales extremos de belleza, y un sistema de detección que reconoce señales potenciales de autolesión. Si los sistemas detectan posible daño, un equipo especializado revisa la situación y, en casos de angustia aguda, se contacta a los padres por correo electrónico, mensaje de texto y alerta push, a menos que hayan optado por no recibirlas.

OpenAI admitió que el sistema no será perfecto y podría activar alarmas innecesarias, pero considera mejor actuar y alertar a los padres que permanecer en silencio. La empresa también está trabajando en formas de contactar a servicios de emergencia si detecta una amenaza inminente para la vida y no puede localizar a un padre.

Comparte este artículo

Otras notas de tu interés:

Economia

Disrupt 2026: Ahorra hasta $200 y conecta con más de 10,000 líderes tecnológicos

Economia

Hallandale Beach: condenan a empresario por contrabando de espectrómetro nuclear a Rusia

Bienestar y Salud Mental

Florida AHCA y ALFs de Miami-Dade: negligencia, muertes y un sistema al límite

Economia

Disrupt 2026: Ahorra hasta $200 en tu entrada y multiplica tus conexiones

Espectáculos y Entretenimiento

Spotify activa Taste Profile en EE. UU.: así puedes moldear tu algoritmo de recomendaciones

Economia

Ema recauda $77 millones en ronda Serie B para revolucionar la automatización empresarial con agentes de IA

Negocios

Corte de Apelaciones revisa el señalamiento del Pentágono contra Anthropic por seguridad nacional

Economia

Mitsotakis en San Francisco: IA, inversión y el regreso de Grecia

Negocios

Condenan a Kirill Gordei por contrabando de tecnología nuclear a Rusia mediante Apelsin Logistics

Economia

Microsoft y OpenAI: el robo masivo de trabajo que sacude la demanda por derechos de autor