La justicia avala el uso legítimo de libros protegidos para entrenar IA, pero multa a Anthropic

Entrenar IA con libros protegidos: la justicia avala el uso legítimo en el caso Anthropic

Los modelos de inteligencia artificial que impulsan a ChatGPT, Gemini, Claude y otros chatbots se entrenan con bases de datos aparentemente infinitas de obras publicadas: cientos de millones de libros, artículos en línea, trabajos académicos y prácticamente cualquier contenido disponible en internet. Muchos autores publicados han contribuido, sin su conocimiento ni su consentimiento, al desarrollo de las mismas herramientas de IA que amenazan con socavar sus medios de vida. ¿Eso parece ilegal? La realidad no es tan simple.

“En esta área del derecho y de la tecnología hay muchas cosas en juego”, explica Cathy Gellis, abogada con experiencia en propiedad intelectual, copyright y tecnología. “Es muy complejo y hay muchos sentimientos encontrados sobre lo que está ocurriendo, tanto a favor como en contra”.

¿Qué decidió el juez en la demanda contra Anthropic?

El año pasado, en una de las primeras decisiones de este tipo, el juez William Alsup ordenó a Anthropic pagar $1.5 mil millones a un grupo de escritores cuyas obras se utilizaron para entrenar los modelos de IA de la compañía. Sin embargo, aunque el caso parecía una victoria moral de los autores, Alsup determinó que el entrenamiento de IA de Anthropic era legal. Lo que el juez sancionó fue la piratería de libros desde bibliotecas fantasma ilegales en línea.

“Como cualquier lector que aspira a ser escritor, los LLM de Anthropic se entrenaron con obras no para adelantarse, replicarlas o suplantarlas, sino para dar un giro difícil y crear algo diferente”, escribió el juez, comparando la forma en que un modelo de lenguaje ingiere billones de palabras con el estudio de la literatura que hace un escritor.

Para Gellis, la decisión es más beneficiosa para las empresas de IA. Después de todo, ¿qué representa una multa de $1.5 mil millones para una compañía que proyecta $200 mil millones en ingresos anuales para 2028? “Creo que, en general, es una buena noticia para el entrenamiento de IA el hecho de que el juez haya considerado que esto es análogo a leer una obra protegida, no a copiarla”, señaló la abogada. “La ley de copyright depende de la copia, pero no depende de usar la obra, experimentarla, consumirla o leerla”.

Uso legítimo: el debate legal detrás del entrenamiento de IA

La ley de derechos de autor no se actualiza desde 1976, lo que obliga a los jueces a interpretar directrices de hace 50 años frente a preguntas legales que pueden moldear el futuro de la industria de IA. “Todo el mundo está muy preocupado ahora porque la ley es inconsistente, y es por esta pregunta”, afirmó Jason Henderson, abogado senior y fundador de IP & Media Practice en JWL International. “Saben que el modelo de IA ha sido entrenado con muchísimo contenido y la ley no ha alcanzado realmente esa cuestión”.

Estas preguntas suelen depender de la doctrina del uso legítimo (fair use), es decir, si el uso de una obra protegida es lo suficientemente “transformativo” como para considerarse legalmente permitido. El uso legítimo es una excepción del copyright que permite usar material protegido sin permiso expreso y protege la capacidad de comentar e iterar sobre obras mediante la crítica, la parodia, la educación y otros medios. Al decidir si algo es uso legítimo, los jueces consideran factores como:

  • El propósito y el carácter del uso.
  • La naturaleza de la obra protegida.
  • La cantidad y sustancialidad de la porción utilizada.
  • El impacto potencial en el mercado de la obra original.

Thomson Reuters contra Ross Intelligence: el límite de la competencia directa

Henderson hace referencia a un caso en el que Thomson Reuters demandó a Ross Intelligence por copiar su contenido para crear una plataforma legal basada en IA que compitiera directamente con la empresa. “El uso de Ross no es transformativo porque no tiene un propósito ulterior ni un carácter diferente al de Thomson Reuters”, escribió el juez Stephanos Bibas. Mientras tanto, los autores podrían argumentar que los chatbots les compiten al generar nuevos libros sintéticos con sus obras, pero ese argumento todavía no ha prevalecido en los tribunales.

Un mapa de litigios: 29 demandas contra empresas de IA

Entretanto, el panorama legal ya refleja 29 demandas por derechos de autor contra empresas de inteligencia artificial en Estados Unidos. El mapa de estos litigios incluye casos como Bartz v. Anthropic y Authors Guild v. OpenAI, y muestra que las jurisdicciones y los jueces están divididos ante un mismo fenómeno.

Mapa de litigios de derechos de autor contra empresas de IA en Estados Unidos
El mapa de los litigios por derechos de autor contra empresas de IA incluye casos como Bartz v. Anthropic y Authors Guild v. OpenAI.

El copyright de las obras generadas por IA: otra pregunta abierta

Gellis también señala la diferencia entre el copyright aplicado al entrenamiento y el copyright aplicado al contenido generado por IA. En el caso Thaler v. Perlmutter, la corte determinó que si una obra es 100% generada por IA, no es protegible. Eso abre otra caja de preguntas: ¿cómo podemos probar de manera concluyente si una obra fue generada con IA y, si fue así, cómo sabemos qué porcentaje fue creado o asistido por IA?

“Si escribes tu novela en Word y utilizas el corrector ortográfico, nos sentimos cómodos con la idea de que Word no es dueño de tu novela”, explicó Gellis. “La IA nos está obligando a revisar un montón de decisiones que ignoramos durante bastante tiempo”.

Teléfono móvil mostrando el logo de Anthropic sobre un teclado de computadora
La demanda por infracción de derechos de autor contra Anthropic no es una victoria total para los autores.

Un futuro incierto para la IA y los derechos de autor

La mayoría de las empresas de IA continúan inmersas en litigios pendientes sobre estos temas, por lo que no habrá una solución definitiva en el corto plazo. “Lo que se ve es que los primeros disparos de apertura están siendo influyentes, y esa influencia podría deshacerse si otros tribunales deciden cosas diferentes”, señaló Gellis. “Pero mientras tanto, todas estas decisiones están moldeando todo lo que ocurre. Sería un error que las empresas de IA las ignoraran”.

Comparte este artículo

Otras notas de tu interés:

Economia

Demócratas en Ohio: la salud como eje de una posible ganancia política en EE.UU.

Economia

Guerra comercial entre Canadá y EE. UU.: Mark Carney y Donald Trump, entre el conflicto y el diálogo

Economia

Trump impulsa precios más bajos en medicamentos para pérdida de peso, pero varios estados rechazan el acuerdo

Economia

Colapso de las Negociaciones del Acuerdo Comercial entre EE. UU. y Canadá

Economia

La disputa por el histórico First Miami Presbyterian Church frena la torre Nobu en Brickell

Politica

Flock Safety: Garrett Langley pide un equilibrio entre privacidad y seguridad

Economia

The Club at Brickell Bay: Airbnb sigue de fiesta pese al cese y desista

Economia

Starcloud recauda 250 millones de dólares para sus centros de datos orbitales

Economia

Trump pausa el arancel de cuota sobre 300,000 toneladas de carne de res

Economia

Demócratas de San Francisco impulsan impuesto a los multimillonarios en California