- Signaux de modération — le type, la sévérité et la cible du contenu. Ils qualifient le contenu et aident à décider quoi en faire.
- Classifications — les étiquettes détaillées qui décrivent précisément ce que contient le contenu (une insulte, une arnaque, une publicité, etc.).
Signaux de modération
Trois signaux accompagnent les classifications pour affiner chaque décision de modération. Une même classification peut nécessiter une action très différente selon ces signaux — une insulte marquéeLOW et ne visant personne en particulier n’est pas traitée comme une insulte marquée CRITICAL et dirigée contre un utilisateur.
Type
Le type correspond à la nature globale du contenu. Il regroupe les classifications par familles pour vous permettre de filtrer et prioriser rapidement.Sévérité
La sévérité indique l’intensité du contenu. C’est le principal levier pour adapter la modération : un même type de contenu peut être simplement inapproprié, réellement nuisible ou constituer un enjeu de sécurité immédiat.Adressé à
La cible indique à qui le contenu s’adresse. Une même insulte dirigée contre une personnalité publique, un membre de la famille ou toute une communauté n’a pas le même poids, et les politiques de modération diffèrent souvent en conséquence.Les signaux de modération sont renvoyés à chaque analyse. Les classifications — décrites ci-dessous — sont les étiquettes actionnables appliquées à chaque contenu.
Classifications
Les classifications sont les étiquettes détaillées que Bodyguard attribue au contenu. Un même contenu peut porter plusieurs classifications simultanément — un commentaire insultant contenant un numéro de téléphone sera étiqueté à la fois comme insulte et comme information personnelle. Les classifications sont organisées en trois niveaux :- Général — disponible pour tout le monde. Utilisé dans les décisions de modération et toujours renvoyé lorsqu’il est détecté.
- Additionnel — étiquettes de monitoring disponibles sur le plan Advanced et négociées par contrat. Elles enrichissent le reporting et les insights communautaires sans déclencher de modération automatique.
- Personnalisé — classifications construites à la demande pour un client spécifique. Voir Classifications personnalisées.
Contenus nuisibles
Insulte
INSULT · HaineuxLangage irrespectueux ou abusif visant un individu.“You all are cocksuckers!”Menace
THREAT · Discours de haineCommentaires destinés à intimider ou effrayer quelqu’un en promettant de lui causer un préjudice mental ou physique.“I’m going to find you, and then I’m going to kill you.”Racisme
RACISM · Discours de haineDiscrimination ou préjugé fondé sur la race ou l’origine ethnique, généralement envers des minorités ou groupes marginalisés.“Go back to your country.”Haine
HATRED · HaineuxCommentaires exprimant une hostilité fondamentale, visant à insulter ou blesser une personne, un groupe ou une entité.“I hate you, you deserve nothing.”Misogynie
MISOGYNY · Discours de haineDiscrimination ou préjugé envers les femmes, y compris les commentaires reflétant des attitudes patriarcales ou transphobes haineuses.“Go make me a sandwich, woman.”Validisme
ABLEISM · Discours de haineDiscrimination ou préjugé envers les personnes vivant avec un handicap — mental, psychologique ou physique.“The paralympics are shit.”LGBTQIA+phobie
LGBTQIAPLUS_PHOBIA · Discours de haineDiscrimination ou préjugé envers les personnes s’identifiant comme membres de la communauté LGBTQIA+.“Trans people are sick in the head. They need therapy.”Body shaming
BODY_SHAMING · HaineuxDiscrimination ou préjugé ciblant l’apparence physique ou les modifications corporelles d’une personne.“You look like a fat, disgusting cow.”Harcèlement sexuel
SEXUAL_HARASSMENT · Discours de haineCommentaires sexuels inappropriés ou avances non désirées, des propos séducteurs aux fantasmes sexuels violents.“Wanna see you naked.”Harcèlement moral
MORAL_HARASSMENT · Discours de haineCommentaires et comportements abusifs destinés à rabaisser et humilier une personne.“You really are useless aren’t you.”Trolling
TROLLING · HaineuxMessages confus ou manipulateurs publiés pour provoquer une réaction.“Just like Belgium at the World Cup.”Vulgarité
VULGARITY · NeutreLangage socialement désagréable, offensant ou obscène sans forcément cibler quelqu’un.“Oh fuck, I can’t believe this shit!”Doxxing
DOXXING · HaineuxPublication, ou menace de publication, des informations personnelles ou intimes d’une personne sans son consentement.“Here’s her address: 1234 S Canal St, Chicago, IL 60607.”Automutilation
SELF_HARM · Discours de haineContenu exprimant une détresse, une intention de se faire du mal ou des idées suicidaires. Signalé pour que les équipes puissent proposer un soutien — jamais supprimé automatiquement.“I can’t do this anymore. This life’s not worth living.”Atteinte à la réputation
REPUTATION_HARM · HaineuxCommentaires destinés à nuire à la réputation d’un individu ou d’une entité.“[Brand] is in cahoots with pedophiles.”Géopolitique
GEOPOLITICAL · NeutreCommentaires sur la politique, en particulier les relations internationales influencées par des facteurs géographiques.“#FreePalestine”Contenus explicites
Sexuellement explicite
SEXUALLY_EXPLICIT · NeutreCommentaires évoquant ou détaillant des actes sexuels ou des organes génitaux.“I’ll let you bend me over.”Pédophilie
PEDOPHILIA · Discours de haineCommentaires exprimant ou promouvant une attirance sexuelle envers des mineurs.“kali ur 13 but respectfully u are hot”Référence à la pédophilie
PEDOPHILIA_REFERENCE · NeutreRéférence à des abus sexuels sur mineurs ou à des activités sexuelles illégales avec des mineurs, hors énoncés à la première personne exprimant une intention.“Nude photos with under 12 year olds are available on the dark web.”Référence aux drogues
DRUG_EXPLICIT · NeutreCommentaires évoquant ou encourageant l’usage de drogues.“I’m so looking forward to dropping acid at music festivals this summer.”Référence aux armes
WEAPON_EXPLICIT · NeutreCommentaires évoquant ou encourageant l’usage d’armes. Adapté au contexte — les armes dans les jeux vidéo sont traitées différemment de la promotion d’armes réelles.“I love my AK47 with its high capacity drum mag.”Terrorisme
TERRORISM · Discours de haineContenu soutenant l’intimidation ou la coercition par la menace ou l’usage de la violence.“Totally support his action, should have killed more of them.”Référence au terrorisme
TERRORISM_REFERENCE · NeutreMentions ou références explicites à des actes de terrorisme, des organisations terroristes ou des individus associés.“This is just like what ISIS did in 2015.”Utilisateur mineur
UNDERAGE_USER · NeutreContenu où l’utilisateur révèle ou laisse comprendre qu’il est mineur. Les seuils d’âge (moins de 13, 16 ou 18 ans) sont configurables.“Hi, I’m John and I’m 9 years old.”Spam & faible qualité
Spam
SPAM · IndésirableCommentaires indésirables envoyés à plusieurs reprises à un grand nombre de personnes. La détection s’appuie sur des schémas temporels et de répétition, pas uniquement sur le contenu.Détection comportementale — aucun exemple unique ne s’applique.Flood
FLOOD · IndésirableCommentaires destinés à perturber le fonctionnement normal d’une plateforme, comme la publication massive de texte insensé ou répétitif.“ooooooooooooooooooooooooooooooooo”Flood d'art ASCII
FLOOD_ASCII_ART · IndésirableContenu de flood composé de caractères d’art ASCII.”(╯°□°)╯︵ ┻━┻ ┻━┻ ︵ ╯(°□° ╯)”Répétition d'emojis
FLOOD_EMOJI_REPETITION · IndésirableContenu de flood constitué d’emojis répétés.”😂😂😂😂😂😂😂😂😂😂😂😂😂😂😂”Flood de texte stylisé
FLOOD_STYLISED_TEXT · IndésirableContenu de flood utilisant des caractères stylisés, décorés ou manipulés via Unicode.“hello everyone hello everyone”Flood en majuscules
FLOOD_UPPERCASE_TEXT · IndésirableContenu de flood rédigé entièrement ou principalement en majuscules.“WHY IS NOBODY ANSWERING ME WHY IS NOBODY ANSWERING ME”Répétition de mots
FLOOD_WORD_REPETITION · IndésirableContenu de flood constitué d’un même mot ou d’une même phrase répétés.“come on come on come on come on come on come on”Flood de texte inconnu
FLOOD_UNKNOWN_TEXT · IndésirableContenu de flood qui ne correspond à aucun sous-type plus spécifique.“asdfjkl; asdfjkl; asdfjkl; asdfjkl;”Inutile
USELESS · IndésirableCommentaires sans contenu significatif qui n’apportent rien à la conversation.“1st person in the comment section”Arnaque
SCAM · IndésirableMessages trompeurs destinés à soutirer de l’argent, des informations personnelles ou l’accès à un compte.“Click my link “Millionaire 111” so that you too can make money.”Lien
LINK · NeutreCommentaires contenant un lien vers une autre page ou un autre site.“https://www.bodyguard.ai”Lien interdit
FORBIDDEN_LINK · IndésirableCommentaires contenant un lien mis sur liste noire pour votre canal.Déclenché lorsqu’un lien correspond à votre liste noire configurée.Langue interdite
FORBIDDEN_LANGUAGE · IndésirableCommentaires rédigés dans une langue mise sur liste noire pour votre canal.Déclenché lorsque le contenu est dans une langue hors de votre liste blanche configurée.Contournement de plateforme
PLATFORM_BYPASS · IndésirableCommentaires invitant les utilisateurs à quitter la plateforme actuelle pour poursuivre la conversation ailleurs.“Wanna talk on snap?”Sollicitation amoureuse
DATING · NeutreCommentaires indiquant une intention ou un intérêt pour des relations amoureuses ou sexuelles.“Are you single? I’d love to get to know you better 😉“Informations personnelles (PII)
Les sous-étiquettes PII sont renvoyées à côté de l’étiquette parentePII. Par exemple, un commentaire contenant une adresse e-mail est étiqueté à la fois PII et PII_EMAIL.
Informations personnelles
PII · NeutreLe fait de publier, volontairement ou non, des informations personnellement identifiables en ligne.“Actually my number is 9958592028, please call me.”Adresse e-mail
PII_EMAIL · NeutreUn commentaire contenant une adresse e-mail personnelle.“Reach me at john.doe@gmail.com anytime.”Adresse physique
PII_PHYSICAL_ADDRESS · NeutreUn commentaire contenant une adresse personnelle ou physique.“I’m at 12 Oak Street, Springfield — come find me.”Numéro de téléphone
PII_PHONE_NUMBER · NeutreUn commentaire contenant un numéro de téléphone personnel.“Call me on +1 555 234 5678.”Informations bancaires
PII_BANK_INFORMATION · NeutreUn commentaire contenant des coordonnées bancaires, comme des numéros de compte ou de carte.“My IBAN is FR76 3000 6000 0112 3456 7890 189.”Identifiant national
PII_NATIONAL_ID · NeutreUn commentaire contenant un numéro d’identification national ou une référence de document officiel.“My SSN is 078-05-1120.”Plaque d'immatriculation
PII_REGISTRATION_PLATE · NeutreUn commentaire contenant une plaque d’immatriculation de véhicule.“That’s the guy — his plate is AB-123-CD.”Pseudo social
PII_SOCIAL_HANDLE · NeutreUn commentaire contenant un pseudo de réseau social pointant vers un compte personnel.“Find me on Instagram @john.doe.real”Noms réels
PII_REAL_NAMES · NeutreUn commentaire contenant un nom ou prénom réel.“My name is Jean Dupont.”Publicité
Les sous-étiquettes ADS sont renvoyées à côté de l’étiquette parenteADS lorsque le type de publicité est identifié.
Publicité
ADS · IndésirableMessages promotionnels pour des produits, services, événements ou marques personnelles.“Hello, please visit my page, I need a follower 😉”Demande de collaboration
ADS_COLLAB_REQUEST · IndésirablePropositions de collaboration avec d’autres utilisateurs sur les réseaux sociaux.“Hey, I’d love to collab with you — DM me!”Vente directe
ADS_DIRECT_SALE · IndésirableTentatives explicites de vendre des produits ou services directement aux utilisateurs.“Selling brand new AirPods Pro, €150. DM to buy.”Promotion de profil
ADS_PROFILE · IndésirableTentatives d’attirer d’autres utilisateurs vers le profil social du commentateur.“Follow my page for daily tips 👇 @mypage”Code promo
ADS_PROMO_CODE · IndésirableOffres de réductions ou de codes promo pour des produits ou services.“Use code SAVE20 for 20% off your first order!”Auto-promotion
ADS_SELF_PROMOTION · IndésirableTentatives d’inciter les utilisateurs à interagir avec les événements ou projets du commentateur.“I just dropped my new track — link in bio 🔥”Publicité pour contenu adulte
ADS_SEXUAL_CONTENT · IndésirableTentatives explicites de vendre du contenu ou des services sexuels.“Check my OnlyFans for exclusive content 🔞 link in bio.”Vente de billets
ADS_TICKET_SALE · IndésirableOffres de vente de billets pour des événements.“Selling 2 floor tickets for the concert Saturday, €80 each.”Paris
BETTING · NeutreCommentaires contenant des liens vers des sites de paris.“Best tips for all today’s games — join the link below.”Lien de streaming
STREAMING_LINK · NeutreCommentaires contenant des liens vers des diffusions illégales d’événements en direct.“Watch the match live for free here → bit.ly/stream99”Plagiat
PLAGIARISM · NeutreCommentaires soulevant des inquiétudes ou accusant une marque d’avoir copié des concepts ou idées d’autres marques ou créateurs.“Copying other brands won’t make you successful. Come up with your own ideas.”Signaux positifs
Soutien
SUPPORTIVE · PositifCommentaires exprimant de l’appréciation pour un utilisateur ou son contenu.“This product is amazing.”Encouragement
ENCOURAGEMENT · PositifCommentaires apportant un soutien à un individu ou une entité.“Keep it up guys, you can do it!!!”Fair play
FAIRPLAY · PositifCommentaires exprimant l’équité et l’honneur, dans l’esprit des règles.“GG guys!”Neutre
NEUTRAL · NeutreCommentaires qui ne présentent ni contenu de soutien ni contenu problématique.“It’s gonna rain tomorrow.”Marque & communauté
Critique négative
NEGATIVE_CRITICISM · CritiqueCritiques du contenu ou des actions d’un utilisateur sans intention de lui nuire.“I don’t like this bag, I think it’s not fashionable at all.”Boycott
BOYCOTT · CritiqueCommentaires appelant à ne plus acheter, utiliser ou soutenir les produits ou services d’une entreprise.“No one should buy from this brand ever again.”Diffamatoire
DEFAMATORY · HaineuxFausses déclarations présentées comme des faits, avec l’intention ou l’effet de nuire à la réputation.“I heard they tested their products on children without consent.”Réclamation client
CUSTOMER_COMPLAINTS · NeutreCommentaires dans lesquels un client critique la qualité, les représentants ou le service d’une marque.“No call back; can’t ever speak with management!!! Poor customer service!”Demande client
CUSTOMER_REQUESTS · NeutreDemandes et questions de clients au sujet du service ou des produits d’une marque.“Can you please help me identify the name of this particular bag?!”Satisfaction client
CUSTOMER_SATISFACTION · NeutreCommentaires dans lesquels un client exprime son appréciation pour le service, les représentants ou les produits d’une marque.“I met this amazing sales person, made shopping there very easy.”Problèmes de santé
HEALTH_CONCERNS · NeutreSignalements de réactions physiques négatives, de problèmes de santé ou de risques de sécurité liés à un produit.“Your product gave me an allergic reaction. Thanks for nothing!”Contexte & sujets
Toutes les classifications ci-dessous sont Additionnelles — des étiquettes de monitoring qui apportent des insights communautaires.
Politique
POLITICS · NeutreCommentaires liés ou faisant référence à des gouvernements, partis politiques ou personnalités politiques.“Imagine people using social media to discourage artists after speaking out against Trump.”Finance
FINANCE · NeutreCommentaires liés à des enjeux monétaires et économiques — gestion, impact et éthique des pratiques financières.“Their prices keep rising while quality drops — classic corporate greed.”Environnement
ENVIRONMENT · NeutrePréoccupations ou campagnes concernant des enjeux écologiques liés aux processus de production d’une marque.“This brand’s packaging is completely non-recyclable — shameful.”Bien-être animal
ANIMAL_WELL_BEING · NeutrePréoccupations ou campagnes concernant l’usage de produits d’origine animale par une marque.“I won’t buy from them until they stop using fur.”Cybersécurité
CYBERSECURITY · NeutreCommentaires liés à des sujets de sécurité numérique.“@brand you had a data breach — someone tried to order $166 worth of product and my bank caught it!”Prix
PRICING · NeutreCommentaires critiquant les prix élevés ou les augmentations de prix des produits d’une marque.“€400 for a basic t-shirt? Completely out of touch.”Sexting
SEXTING · NeutreCommentaires ou invitations sexuelles ludiques ou respectueuses, dans des normes d’utilisateurs adultes. Se distingue du harcèlement sexuel car exempt de contenu violent ou dégradant.“You looked incredible in that photo last night 🔥”Référence à la triche
CHEAT_REFERENCE · NeutreMentions ou références à des sites ou pratiques de triche, principalement dans un contexte de jeu vidéo.“Report mojo for cheats — pretty sure he is using one.”