Accueil / Tech News / Deepfakes haineux : les règles de Meta ne sont pas à la hauteur

Deepfakes haineux : les règles de Meta ne sont pas à la hauteur

Les victimes ignorées, Meta désavouée

Deepfakes haineux : les règles de Meta ne sont pas à la hauteur

Meta doit en faire plus contre les deepfakes diffusant des discours haineux. Cet appel à agir ne vient pas d’une organisation opposée au mastodonte des réseaux sociaux, mais de l’Oversight Board, le conseil de surveillance indépendant de l’entreprise chargé d’examiner certaines décisions de modération des contenus.

L’Oversight Board, créé par Facebook en 2019 et opérationnel depuis 2020, peut rendre des décisions contraignantes sur certains contenus. Son pouvoir est cependant limité, car l’entreprise de Mark Zuckerberg n’est pas tenue de mettre en œuvre les recommandations générales que le comité peut proposer. Néanmoins, les dossiers dont il se saisit et qu’il met en lumière permettent de se faire de mesurer les limites, voire les incohérences, de la politique de modération de Meta.

Une fausse vidéo politique laissée en ligne pendant dix mois

C’est le cas pour deux dossiers dont les décisions ont été publiées le 17 septembre, et qui concernent des deepfakes générés par IA. Le premier est une vidéo partagée sur Facebook en novembre 2025 dans laquelle on peut entendre une conseillère municipale du Parti travailliste écossais affirmer : « Les réfugiés sont les bienvenus ici, même s’ils violent nos femmes, car les Blancs le font aussi. »

Un examen un peu plus approfondi du document permet de conclure à une vidéo générée par IA. Malgré plusieurs demandes et appels de la conseillère en question et d’une autre victime, le post est resté public. Meta a conclu lors de l’appel du comité que la vidéo n’enfreignait pas les standards communautaires et qu’elle ne méritait pas une étiquette IA. Le Board a finalement annulé la décision de maintenir le contenu et a exigé son retrait – Meta a effectivement annoncé la suppression de la vidéo, dix mois après sa mise en ligne.

Le comité a désavoué Meta sur la qualification du contenu. Selon la majorité des membres du Board, la vidéo associait l’ensemble d’un groupe (les réfugiés) à la criminalité et aux violences sexuelles. Elle aurait donc dû être supprimée au titre des règles sur les conduites haineuses.

Et si Meta a jugé bon de n’en rien faire, alors la vidéo aurait tout de même dû être étiquetée « IA à haut risque ». Les règles de l’entreprise concernant l’étiquetage IA pour les hypertrucages sont jugées inadéquates. Dans leur majorité, les membres du comité estiment que Meta devrait se doter de règles plus solides concernant les deepfakes :

  • en élargissant les situations dans lesquelles l’étiquette « IA à haut risque » peut s’appliquer ;
  • en prenant plus de mesures pour restreindre la diffusion de contenus trompeurs générés par l’IA ;
  • en renforçant les sanctions contre les comptes qui publient ce genre de contenus de manière répétée ;
  • et en faisant preuve de plus de transparence sur les conditions d’application de ces étiquettes.

De manière plus générale, le comité estime que ce dossier met en lumière le fait que « les femmes politiques, les journalistes et les militantes sont visées de manière disproportionnée par des deepfakes qui déforment leurs positions, notamment dans le cadre de campagnes de harcèlement ». Les personnalités moins connues manquent souvent de moyens pour répondre à ces harcèlements.

Des attaques violentes visant les femmes

Le deuxième cas concerne une jeune femme musulmane vivant en Europe, interviewée par une télévision. On la voit en tant que bénévole d’une campagne visant à améliorer l’éducation à la santé menstruelle et à combattre la stigmatisation des problèmes de santé touchant les femmes et les filles issues de minorités ethniques.

La vidéo a été manipulée et diffusée sur plusieurs réseaux sociaux pour tourner la personne en ridicule, « en créant un contraste apparent entre son engagement en faveur de la santé et son apparence physique, dans le but manifeste de laisser entendre qu’elle n’était pas légitime pour s’exprimer sur ces questions ». Ces vidéos et images générées par IA ont cumulé des dizaines de millions de vues sur différentes plateformes, dont celles de Meta.

Les appels de la victime auprès de Meta pour faire retirer ces contenus ont reçu une fin de non recevoir. « Meta a depuis confirmé au Conseil que sa décision de ne pas intervenir sur cette publication, en la maintenant sur la plateforme sans lui apposer d’étiquette signalant un contenu généré par IA, était conforme à ses règles », précise l’exposé des faits.

Ce n’est qu’après que le Board l’a interrogée sur des commentaires dénigrants publiés sous la vidéo que Meta est intervenue pour les supprimer. Confirmant au passage qu’ils enfreignaient l’interdiction des comparaisons déshumanisantes inscrite dans les règles relatives à l’intimidation et au harcèlement.

Le conseil est allé plus loin : il a annulé la décision de Meta de maintenir la publication en ligne et ordonné son retrait. Selon la majorité de ses membres, la vidéo constituait elle-même une forme de harcèlement, puisqu’elle utilisait l’IA pour falsifier les paroles et les actes de la jeune femme, l’humilier en raison de son apparence et alimenter une campagne plus large dirigée contre elle.

Le comité recommande à Meta :

  • d’élargir la définition des « images manipulées non sollicitées » afin d’y inclure les deepfakes montrant une personne en train de dire ou de faire des choses qu’elle n’a pas dites ni faites ;
  • d’ajouter les contenus enfreignant cette règle à une base de contenus de référence, afin que leurs copies puissent être automatiquement repérées et supprimées ;
  • de considérer les indices indiquant qu’un contenu a été généré ou manipulé par l’IA comme un facteur aggravant, pour traiter en priorité les signalements concernés.

Là aussi, ce cas illustre les risques que l’IA générative fait peser sur les femmes et les filles, « les abus gagnant en ampleur, en rapidité et en gravité ». Le Board rappelle le rapport publié l’an dernier par ONU Femmes, selon lequel ces attaques sont souvent délibérées et coordonnées, « et visent à réduire au silence les femmes présentes dans la vie publique ».

Ces vidéos générées par IA ont des répercussions importantes sur les droits des utilisateurs des plateformes de Meta, « notamment sur le droit des femmes musulmanes, et plus généralement des femmes et des filles, à participer à la vie publique. »

Origine de l’article : lire l’article original

Traduction