Reddit s'appuie sur des LLM pour aider les modérateurs et lance Rules Hub, un outil de détection automatique des publications enfreignant les règles
Reddit dévoile Rules Hub, un système d'IA utilisant des LLM pour comprendre le contexte et l'intention des publications, afin d'aider les modérateurs de communautés à détecter et supprimer les contenus qui enfreignent les règles
Reddit annonce le déploiement de l'IA pour assister concrètement les modérateurs de communautés, avec une nouvelle fonctionnalité baptisée "Rules Hub", propulsée par des Large Language Models (LLM), destinée à filtrer les contenus qui enfreignent les règles de chaque groupe (subreddit).
Le point fort de ce système est sa capacité à comprendre le contexte, le langage naturel et l'« intention » d'une publication ou d'un commentaire, au lieu de se contenter de vérifier une liste de mots interdits comme auparavant. Lorsque le système détecte un contenu susceptible d'enfreindre les règles, il peut agir, par exemple en le signalant aux modérateurs ou en le supprimant automatiquement.
Reddit commencera par déployer cet ensemble d'outils sur les nouveaux subreddits, avant de l'étendre à l'ensemble du site. L'entreprise élargit dès aujourd'hui l'accès des modérateurs à ces outils, avant un lancement complet dans le courant de l'année.
De son côté, Dexerto rapporte en outre que le système d'IA verra son champ d'action élargi pour aider les modérateurs à gérer à la fois les publications et les communautés qui enfreignent les règles, ce qui reflète la tendance de Reddit à s'appuyer de plus en plus sur l'IA pour la modération de contenus.
Cette annonce intervient alors que Reddit fait face au défi de superviser un nombre considérable de communautés, reposant pour l'essentiel sur des modérateurs bénévoles qui travaillent dur sans être rémunérés. L'apport de l'IA pourrait alléger leur charge de travail, mais soulève aussi la question de la précision avec laquelle ces outils sauront interpréter le contexte.
Les utilisateurs thaïlandais de Reddit ou les gestionnaires de communautés en ligne verront un exemple concret de l'utilisation des LLM pour filtrer les contenus sur une grande plateforme, dont les résultats pourraient définir les orientations de la modération sur les forums et réseaux sociaux du monde entier, tout en alimentant le débat sur la capacité de l'IA à juger les contenus à la place des humains.