Reddit está llevando la moderación por inteligencia artificial a un nuevo nivel. La plataforma anunció la expansión de Rules Hub, una herramienta de moderación que utiliza modelos de lenguaje de gran tamaño (LLM) para interpretar las reglas de cada comunidad y decidir si una publicación o un comentario las viola. Inicialmente probada en unas 700 comunidades, la herramienta ya está disponible para todos los nuevos subreddits, con un lanzamiento más amplio previsto para más adelante este año. En paralelo, la empresa estudia cambios en la versión antigua del sitio y en el acceso de los desarrolladores.
La motivación detrás del cambio es doble. un lado, Reddit quiere reducir la dependencia de AutoModerator, la herramienta de moderación basada en palabras clave que hoy es el principal recurso de los moderadores voluntarios. AutoModerator funciona bien con reglas simples, pero es frágil ante los matices, el sarcasmo y los casos límite que exigen interpretación. Los LLM, argumenta la empresa, captan mejor la "intención" de una regla en lugar de solo casar términos literales. otro lado, hay un objetivo de crecimiento: con una moderación más inteligente y consistente, Reddit espera reducir la importancia de los requisitos de karma y de antigüedad de la cuenta que hoy bloquean a nuevos usuarios legítimos, abriendo espacio para más participación.
Esa ambición de bajar las barreras de entrada es significativa. El karma siempre ha funcionado como una especie de peaje de confianza: las comunidades exigen un mínimo para evitar spam y bots. Pero ese mismo mecanismo aleja a los recién llegados genuinos, que terminan frustrados. Si Reddit consigue demostrar que la moderación por IA mantiene la calidad sin depender de esos filtros rígidos, puede desbloquear el crecimiento en un momento en que la plataforma busca monetizar su enorme archivo de conversaciones humanas — un activo cada vez más valioso para el entrenamiento de IA.
Sin embargo, hay riesgos reales. Delegar a los moderadores de IA la decisión sobre qué viola las reglas de una comunidad transfiere poder y responsabilidad a modelos que todavía cometen errores de interpretación. La moderación automatizada tiende a generar falsos positivos — publicaciones eliminadas injustamente — y la falta de transparencia sobre el razonamiento del modelo puede frustrar tanto a usuarios como a moderadores humanos. Además, las reglas de cada subreddit son muy específicas y culturalmente cargadas; un LLM genérico puede no captar el tono implícito de una comunidad pequeña.
El movimiento también plantea una cuestión de control. Al hacer la moderación más centralizada y dependiente de la infraestructura de la plataforma, Reddit reduce el papel de los moderadores voluntarios, que históricamente han sido la columna vertebral del sitio. Para algunos, eso es eficiencia; para otros, es un desplazamiento de la comunidad. La decisión de tocar el acceso de los desarrolladores y el old Reddit refuerza la percepción de que la plataforma está consolidando el control sobre su propio ecosistema.
La pregunta abierta es si la moderación por IA cumplirá lo que promete sin destruir lo que hace único a Reddit: la sensación de comunidades reales gestionadas por personas. Si aumentan los falsos positivos, el desgaste puede ser mayor que la ganancia de crecimiento. Si funciona bien, sin embargo, Reddit podría convertirse en el modelo de cómo las grandes plataformas equilibran escala, seguridad y el toque humano.
Fuentes: The Verge, TechCrunch, The Next Web
✓ Fuentes independientes cruzadas y verificadas antes de la publicación