Reddit vient de présenter Rules Hub, un outil de modération qui repose sur un grand modèle de langage pour faire appliquer les règles des communautés. Le changement est net. Jusqu’ici, la plateforme tournait avec Automod, un filtre à mots-clés que les modérateurs bénévoles réglaient à la main. Vous listez une série de termes interdits, le robot dégage tout ce qui correspond. Parfait pour les insultes évidentes, inutile face à quelqu’un qui contourne le filtre avec une faute d’orthographe volontaire ou une vanne à double sens.
Rules Hub inverse la logique. Au lieu d’une liste de mots, vous écrivez la règle en français normal, genre « interdire le harcèlement déguisé en plaisanterie », et c’est l’IA qui juge l’intention derrière chaque message. Sarcasme, euphémisme, orthographe créative : le modèle est censé attraper ce qu’Automod laissait filer. Le modérateur garde la main et choisit l’action déclenchée, entre mise en attente pour un examen humain, filtrage discret ou suppression pure et simple. On peut aussi tester une règle sur d’anciens posts avant de l’activer, histoire de voir si elle sur-réagit.
Le patron Steve Huffman ne cache pas son but : Automod, dit-il, est « difficile à apprendre, difficile à maintenir ». L’outil traîne depuis plus de dix ans et Reddit aimerait s’en séparer. Rules Hub a déjà été testé pendant plusieurs mois sur plus de 700 communautés. Pour l’instant il arrive sur toutes les communautés nouvellement créées, un déploiement plus large est prévu d’ici la fin de l’année, et les gros forums complexes passeront en dernier. La porte-parole Rosa Kim précise que ça reste optionnel pour les communautés déjà en place.
Pour comprendre le travail humain que ces IA de modération veulent alléger, ce livre plonge dans le quotidien des vrais nettoyeurs du web :
Derrière les écrans (Sarah T. Roberts) → voir sur Amazon
Lien affilié Amazon. En tant que Partenaire Amazon, je réalise un bénéfice sur les achats remplissant les conditions requises.
Sauf que voilà, tout le monde n’applaudit pas. Chez les modérateurs, qui font tourner gratuitement les 100 000 communautés actives du site et gèrent ses 130 millions de visiteurs quotidiens, l’annonce passe mal. Leurs configurations maison, parfois bricolées pendant des années, ne se transféreront pas vers ce système basé sur l’intention. Il faudra tout réécrire. Et confier à une IA le droit de supprimer un message parce qu’elle a cru détecter une mauvaise intention, ça ouvre un beau terrain aux ratés.
Reddit présente d’ailleurs Rules Hub moins comme une nouveauté que comme le successeur d’Automod. Le bénévole qui modérait avec ses filtres devient donc superviseur d’un robot. Et si le robot se plante, c’est toujours lui qui ramassera les plaintes.
Crédit photo : Reddit
