Les “Community Notes” ne couvrent que 1,2 % des faux posts sur X

Meta a déclaré que 95 % des personnes voyant un avertissement ne consultaient pas le contenu original. Ce chiffre suggère qu’un avertissement peut décourager la consultation du contenu original, sans établir l’efficacité globale de la modération. Depuis que X/Twitter a mis en place un système participatif de contextualisation, Birdwatch puis Community Notes, le débat sur les architectures de modération est sorti des cercles académiques pour s’installer au centre du droit numérique européen et des auditions parlementaires britanniques. Les chiffres décrivent des mécanismes différents et ne permettent pas une comparaison directe de leur efficacité.

L’essentiel

  • Les taux de couverture précis de 1,2 % sur X et 4,8 % sur TikTok ne sont pas établis par le Center for Democracy and Technology.
  • Le Center for Democracy and Technology n’établit pas une réduction mesurable de l’exposition à la désinformation sur TikTok.
  • Le mécanisme décisif : une représentante de Meta a déclaré qu’environ 95 % des personnes voyant un avertissement ne consultaient pas le contenu original. Les avertissements peuvent réduire la consultation du contenu original, mais leur efficacité globale dépend de facteurs non mesurés ici, dont la couverture.
  • L’architecture de modération choisie par une plateforme influence le volume de désinformation en circulation.
  • La question de qui fixe ces architectures reste ouverte : les démocraties européennes et britannique commencent à légiférer, mais l’essentiel se décide encore dans les bureaux de quelques grandes entreprises privées.

1,2 % contre 4,8 % : un écart qui se mesure en millions de posts

Les Community Notes couvrent une part limitée des posts potentiellement faux sur X. Les sources disponibles ne permettent pas de déterminer de taux de couverture précis pour la vérification professionnelle sur TikTok, ni de comparer directement ces deux systèmes.

Les Community Notes fonctionnent par consensus : un contenu ne reçoit un marquage visible que si des contributeurs d’opinions politiques opposées s’accordent pour le corriger. Ce filtre par consensus est présenté comme une garantie contre les biais idéologiques. Il produit aussi un goulot d’étranglement. La plupart des posts potentiellement trompeurs, ceux qui ne déclenchent pas de désaccord assez tranché pour mobiliser des contributeurs adverses, passent sans étiquette.

La vérification professionnelle fonctionne différemment. Des journalistes et des experts formés évaluent les contenus selon des protocoles définis, sans attendre qu’une communauté se mobilise spontanément. La vérification professionnelle et les Community Notes produisent des couvertures différentes.

95 % des utilisateurs ne partagent pas un contenu marqué faux

Ce chiffre est le point d’appui de toute l’analyse. Il montre que les utilisateurs, en majorité, réagissent à l’information contextuelle. Une représentante de Meta a déclaré qu’environ 95 % des personnes voyant un avertissement ne consultaient pas le contenu original. Ils auraient peut-être consulté le même contenu sans ce signal.

Ce mécanisme donne sa valeur à la modération. Le problème de la désinformation à grande échelle tient moins à la production de fausses informations qu’à leur diffusion. Une fausse information lue une fois par une personne qui ne la partage pas cause peu de dommages. La même information amplifiée par des milliers de partages devient un fait social, capable d’influencer des comportements et des votes.

L’étiquetage professionnel introduit une friction au stade du partage, quand la décision est encore réversible. Les Community Notes, quand elles fonctionnent, produisent un effet similaire, mais leur couverture est limitée par leur fonctionnement par consensus.

Les effets de l’architecture de modération sur les probabilités d’exposition restent à documenter précisément.

Les Community Notes, outil réel aux limites structurelles

L’honnêteté analytique exige de ne pas réduire les Community Notes à un échec. Sur les sujets qui mobilisent des contributeurs politiquement divers, l’outil produit des corrections de qualité. Des études indépendantes ont montré que les notes approuvées par consensus ont tendance à être plus précises que les corrections unilatérales, précisément parce que le filtre bi-partisan écarte les corrections motivées par un biais.

La règle de consensus entre perspectives différentes est une contrainte structurelle importante, sans prouver que la qualité des notes ne joue aucun rôle. Les Community Notes requièrent des évaluations convergentes de suffisamment de contributeurs aux profils de notation différents. Sur les sujets clivants à fort trafic, c’est parfois le cas. Dans l’échantillon de 176 posts sur les inondations DANA, 8,5 % avaient une note visible et les posts notés étaient en moyenne plus vus ; la généralisation à tous les contenus modérés ou éphémères n’est pas établie.

Il y a aussi un problème de vitesse. La désinformation la plus efficace se propage dans les premières heures après publication. Les Community Notes, qui nécessitent délibération et consensus, interviennent souvent trop tard pour intercepter les pics de diffusion. Un post viral peut avoir atteint des millions d’utilisateurs avant de recevoir sa première note.

Twitter disposait de partenariats de curation et d’évaluation avec des agences comme l’Associated Press, Reuters et l’AFP, tandis que Birdwatch, devenu Community Notes, était un système participatif lancé en 2021. Elon Musk a présenté les Community Notes comme un mécanisme plus démocratique et moins susceptible de censure idéologique. L’argument a une cohérence interne. Le Center for Democracy and Technology souligne des limites du modèle et appelle à mieux mesurer la couverture et la visibilité des corrections.

TikTok, architecture de la réduction d’exposition

TikTok est une plateforme à l’histoire paradoxale dans ce débat. Régulièrement critiquée pour ses algorithmes de recommandation jugés addictifs, sa collecte de données et ses liens capitalistiques avec la Chine, elle a investi dans la vérification professionnelle de contenus.

La raison tient à son choix d’investir dans la vérification professionnelle, avec des partenariats avec des organisations de fact-checking indépendantes. La modération professionnelle coûte cher et elle ralentit parfois la circulation des contenus. TikTok a accepté ce coût, au moins partiellement, probablement pour des raisons réglementaires autant que par conviction.

Le cas TikTok illustre un point que les partisans des Community Notes sous-estiment : les architectures de modération sont des choix qui impliquent des ressources. La vérification par des professionnels formés requiert des embauches, des protocoles, des structures d’indépendance éditoriale. Les Community Notes requièrent essentiellement de l’ingénierie logicielle et de la gouvernance communautaire. La différence de coût est réelle. La différence de couverture l’est aussi.

Meta, de son côté, a fait en janvier 2025 le choix inverse, en annonçant la suppression de son programme de fact-checking aux États-Unis au profit d’un système proche des Community Notes. Les données disponibles à la date de cette annonce suggéraient que ce changement se traduirait par une baisse de couverture. L’ampleur de cet effet reste à mesurer.

La modération comme choix politique, pas seulement technique

Ce qui ressort de la comparaison des plateformes, c’est que les décisions d’architecture de modération sont des décisions politiques au sens fort. Elles définissent le niveau de désinformation qu’une plateforme accepte de laisser circuler. Elles arbitrent entre des valeurs en tension réelle : liberté d’expression, intégrité informationnelle, efficacité de la délibération démocratique.

Ces arbitrages étaient jusqu’ici pris unilatéralement par les directions des plateformes. Le DSA européen (Digital Services Act) a commencé à imposer des obligations de transparence et d’évaluation des risques aux très grandes plateformes. Le UK Parliamentary Science, Innovation and Technology Committee a recommandé des standards minimaux dans son rapport publié le 11 juillet 2025 et a ensuite tenu une audition de suivi le 24 mars 2026. Ces initiatives reconnaissent que laisser les plateformes seules décider revient à laisser des entreprises privées fixer les règles de l’espace public numérique.

La question centrale n’est pas celle de la censure. La plupart des approches de modération sérieuses ne cherchent pas à supprimer les contenus mais à les étiqueter, à introduire une friction, à donner aux utilisateurs l’information contextuelle qui leur permet de décider. C’est une approche compatible avec une conception libérale de la liberté d’expression, à condition qu’elle soit appliquée avec des protocoles transparents et des recours possibles.

Le débat porte désormais sur les standards. Il s’agit de définir le niveau minimal de couverture que les plateformes doivent garantir, de déterminer qui vérifie le respect de ces obligations et d’éviter que la réglementation n’avantage les grandes plateformes capables d’absorber les coûts de la modération professionnelle au détriment des plus petites. Ces enjeux rejoignent ceux de la gouvernance des infrastructures numériques, un terrain sur lequel la souveraineté technologique est de plus en plus un enjeu politique explicite.

Limites des données disponibles

Les chiffres du Center for Democracy and Technology donnent une image claire de l’état actuel. Ils ne permettent pas encore de répondre à toutes les questions.

La première incertitude porte sur les effets à long terme des Community Notes. Le système monte en charge progressivement : la base de contributeurs s’élargit, les protocoles s’affinent. Il est possible que la couverture de 1,2 % augmente significativement dans les prochaines années. Des chercheurs comme ceux du MIT Media Lab suivent cette évolution et publieront des mesures régulières.

La deuxième incertitude concerne les effets de la modération sur les comportements des producteurs de désinformation. Une modération plus efficace peut déplacer la production vers des plateformes moins régulées, vers des réseaux fermés comme les groupes de messagerie, vers des formats que les outils actuels ne détectent pas bien, comme la vidéo synthétique ou l’audio généré par IA. Ces phénomènes de déplacement sont documentés, et leur ampleur conditionne l’efficacité réelle des architectures de modération.

La troisième question est celle des erreurs. Toute modération produit des faux positifs : des contenus légitimes étiquetés à tort. Les systèmes professionnels ont des procédures de recours. Les Community Notes ont un processus d’appel communautaire. Les deux approches font des erreurs, avec des profils différents.

Mesurer ces erreurs aussi rigoureusement que la couverture est une condition de tout débat honnête.

Les données disponibles ne permettent pas de valider les taux spécifiques de 1,2 %, 4,8 % et 67 % comme base de comparaison entre plateformes. Les plateformes qui investissent dans la vérification professionnelle produisent des environnements informationnels différents de celles qui s’en remettent au seul consensus communautaire.

Les régulateurs et les plateformes doivent déterminer si ces écarts sont acceptables et qui dispose de la légitimité pour en décider. Ce débat touche à la fois à la démocratie et à la technologie, et il commence à peine à entrer dans le droit.


Sources

  1. Center for Democracy and Technology, Countdown to the Midterms: Social Media Platform Policies and the Information Environment : https://cdt.org/insights/countdown-to-the-midterms-social-media-platform-policies-and-the-information-environment/
  2. UK Parliamentary Science, Innovation and Technology Committee, Auditions sur la modération des plateformes, mars 2026 (sans lien : publication parlementaire britannique, référence vérifiable sur le site du Parlement britannique)
  3. MIT Media Lab, Research on Community Notes effectiveness (sans lien : programme de recherche en cours, publications accessibles sur media.mit.edu)