Reddit Combate el Spam Generado por IA con sus Propias Herramientas de LLM

En la era digital, el spam ha evolucionado gracias a la facilidad de acceso a modelos de lenguaje de gran escala (LLMs). Plataformas como Reddit han visto un aumento significativo en contenido no deseado generado por inteligencia artificial. Para contrarrestar esta amenaza, Reddit ha desarrollado herramientas basadas en LLMs que detectan y bloquean spam, incluso aquel creado por las mismas tecnologías.

El Problema del Spam Generado por LLMs

Según la plataforma, Reddit bloquea 23 millones de vistas de spam por día y detecta aproximadamente 25,000 nuevos posts y comentarios spam cada día. La proliferación de contenido no auténtico se ha vuelto un desafío mayor con la llegada de los LLMs, que permiten a actores malintencionados generar mensajes masivos de manera sencilla.

Personaje caricaturesco de Reddit (Snoo) sobre fondo verde
Reddit ha implementado nuevas herramientas basadas en LLMs para mantener la plataforma segura.

Cómo Reddit Utiliza LLMs para Combatir el Spam

Reddit ha adoptado un enfoque de “luchar contra el fuego con fuego”. En una publicación oficial, la empresa explicó:

“Aprovechamos los LLMs para detectar los patrones sutiles y coordinados de comportamiento falso y hype artificial que los sistemas antiguos pasaban por alto”.

Estas herramientas actualizadas han mejorado la tasa de detección, permitiendo capturar spam que antes pasaba desapercibido.

La plataforma afirma que logró reducir la exposición de los usuarios al spam en un 20% entre enero y marzo en comparación con los tres meses anteriores. Este avance demuestra que el uso de inteligencia artificial para moderar contenido puede ser efectivo, aunque los expertos recuerdan que debe combinarse con moderación humana.

Interfaz del subreddit r/CustomerSuccess con reglas de comunidad
Las comunidades en Reddit dependen de la moderación para mantener la calidad de las discusiones.

La Lucha Contra la Desinformación en la Era de la IA

Plataformas como YouTube, Meta e Instagram permiten contenido generado por IA siempre que se etiquete correctamente, mientras que TikTok incluso permite a los usuarios ajustar cuánto contenido de IA desean ver. La capacidad de detectar contenido generado por IA rápidamente también abre la puerta a identificar discursos de odio y otras violaciones. Sin embargo, los expertos en plataformas insisten: la moderación por IA debe complementarse con la supervisión humana para obtener los resultados más efectivos.

En definitiva, Reddit demuestra que la misma tecnología que alimenta el spam puede ser utilizada para combatirlo, estableciendo un nuevo estándar en la moderación de contenido automatizada.

Comparte este artículo

Otras notas de tu interés:

Negocios

Ron Conway y Jay Carney impulsan un nuevo centro de política de IA en Estados Unidos

Economia

Los impuestos corporativos se desploman en EE. UU.: la IA y los nuevos incentivos fiscales redefinen el tablero

Economia

Criptomonedas y política en EE.UU.: influencia, resistencia y el símbolo de Bitcoin

Politica

Los Verdes presentan su portavoz de IA: salvaguardas, ministerio y el nuevo rostro de la política digital

Economia

Advertencias apocalípticas en la IA: la renuncia en Anthropic que sacude al sector antes de su IPO

Economia

Guerras comerciales frenan la electrificación global en Estados Unidos

Economia

Obama pide a demócratas un plan claro para la seguridad de la IA

Economia

Revolut sufre filtración de datos de clientes por suplantación de una agencia gubernamental

Politica

Chip Roy deja el Congreso con una advertencia sobre la inteligencia artificial

Negocios

Renuncia en Anthropic: investigador advierte que la IA podría «matarnos a todos»