theverge.com détecté sur le web

Reddit étend Rules Hub, sa modération par LLM, aux nouvelles subs

safety ai-business

TL;DR

  • Rules Hub s'appuie sur des LLM pour juger si un post correspond à l'intention d'une règle, plutôt qu'au matching par mots-clés d'AutoMod.
  • L'outil est déjà utilisé par plus de 700 communautés en test et sera disponible à toutes les subs, nouvelles comme existantes, plus tard cette année.
  • Reddit veut remplacer les capacités d'application d'AutoMod, garder ses autres fonctions, et migrer bots et workflows vers sa Developer Platform.

Reddit étend son test de Rules Hub, une suite d'outils de modération construite sur des grands modèles de langage, à toutes les nouvelles communautés créées sur la plateforme, selon The Verge. L'outil est déjà utilisé par plus de 700 communautés dans un premier cercle de test, et un déploiement à l'ensemble des subs, nouvelles comme existantes, est annoncé pour plus tard cette année.

Le pitch technique tient en une phrase. Là où AutoMod repose depuis des années sur du matching par mots-clés, Rules Hub utilise des LLM pour évaluer si un post ou un commentaire correspond à l'intention d'une règle. La formulation de Reddit est que cette approche permet de mieux gérer la nuance, le langage naturel et les cas limites. Un porte-parole de l'entreprise indique que l'objectif est de remplacer, à terme, les capacités d'application d'AutoMod, tout en conservant ses autres fonctions. Rules Hub s'accompagne de deux briques associées, Post & Comment Guidance et Safety Filters, censées prendre en charge ensemble les workflows d'enforcement.

Ce qui rend le sujet plus large qu'un simple lancement d'outil, c'est le reste du plan rapporté par TechCrunch: Reddit veut aussi abaisser les barrières de karma et d'ancienneté de compte pour les nouveaux utilisateurs, qu'elle décrit comme des freins invisibles à la participation. En parallèle, l'entreprise dit qu'elle va restreindre progressivement les nouvelles demandes d'accès à son API publique et pousser les apps tierces vers sa Developer Platform, et migrer les bots critiques et workflows de modération vers cette stack moderne. Le corollaire, souligné dans plusieurs reprises de l'annonce, est qu'old Reddit, la version historique de vingt et un ans encore utilisée par de nombreux mods, pourrait faire les frais de ce durcissement.

Le caveat honnête, c'est que Reddit ne détaille ni le modèle utilisé, ni les métriques de fiabilité en production, ni le calendrier précis de la dépréciation d'AutoMod ou d'old Reddit. La communication insiste sur le fait qu'aucun workflow existant ne sera modifié tant que les remplacements ne seront pas éprouvés en partenariat avec les modérateurs, formulation qui laisse un large espace d'interprétation. Ce que la couverture ne donne pas non plus, ce sont les voies de recours prévues pour un utilisateur modéré à tort par un LLM.

La lecture qui compte pour la suite, c'est que Reddit tente de faire coïncider trois chantiers d'un coup: automatiser la modération, verrouiller l'accès tiers via sa Developer Platform, et fluidifier l'entrée des nouveaux comptes. Si les trois tiennent la charge en même temps, l'entreprise consolide son emprise sur son propre corpus, un actif dont la valeur, à l'ère des deals de licensing avec les fournisseurs d'IA, n'a rien d'anecdotique.

Shared on Bluesky by 1 AI expert