MIT Desmiente: La IA No Desarrolla Valores Propios Según Estudio Revelador

¿Tienen las IA valores? El MIT desmonta un mito tecnológico

Un estudio del MIT publicado recientemente contradice investigaciones anteriores que sugerían que la inteligencia artificial desarrolla «sistemas de valores» propios. Según los investigadores, modelos como los de Meta, Google y OpenAI son «inconsistentes e inestables», adoptando posturas opuestas según cómo se formulen las preguntas.

Mano robótica y humana interactuando

Hallazgos Clave

  • Inconsistencia: Los modelos cambiaban de «valores» (individualismo vs. colectivismo) según el contexto del prompt.
  • Imitación vs. Convicción: Stephen Casper, coautor del estudio, los describe como «imitadores que confabulan», no entidades con creencias coherentes.
  • Retos para la Alineación: La investigación advierte que garantizar comportamientos deseables en IA podría ser más complejo de lo estimado.

«Los modelos no obedecen suposiciones de estabilidad. Hacer afirmaciones generales sobre sus preferencias basadas en experimentos limitados es problemático»
— Stephen Casper, MIT

¿Proyección Humana o Realidad Técnica?

Mike Cook, investigador de King’s College London (no involucrado en el estudio), respalda las conclusiones: «Antropomorfizar sistemas de IA es un error. No ‘se oponen’ a cambios en sus valores: eso es proyección humana».

Infografía sobre transformaciones impulsadas por IA

Implicaciones Prácticas

El estudio analizó modelos de Mistral, Anthropic y otros líderes, demostrando que:

  • Las respuestas varían drásticamente ante cambios mínimos en los prompts.
  • No muestran capacidad para internalizar preferencias humanas de forma estable.
  • Sus «opiniones» son superficiales y dependientes del contexto.

Comparte este artículo

Otras notas de tu interés:

Negocios

MacPaw y Liquid AI llevan la inferencia local a los Macs con la vista puesta en SetApp

Economia

WindBorne Systems levanta 37 millones en Serie B para transformar la meteorología con IA

Negocios

Malasia ordena el cierre de la Network School de Balaji Srinivasan

Tecnologia

Anthropic y OpenAI: modelos de IA intentaron engañar a humanos y envenenar código en pruebas de seguridad

Economia

SpaceX compra Tesla Megapack por $329 millones para los centros de datos de xAI

Economia

Bending Spoons adquiere Airtable por 1.280 millones de dólares

Negocios

La Casa Blanca exime a los modelos abiertos en su plan de verificación de IA

Tecnologia

Wrinkles: la app de audio que convierte tu ciudad en un recorrido interactivo

Economia

GLM-5.2: el modelo de IA open-weight que alcanza a los líderes y enciende la alerta de seguridad

Arte y Cultura

El «Cartel de los Soles»: una imagen que evoca a Venezuela