Dataset : les seuils qui font basculer une mention de dirigeant en atteinte
À partir de quand une mention nominative de dirigeant devient-elle une atteinte ? Seuils observés, définitions retenues et grille de qualification reproductible.
À retenir
- L'exposition d'un dirigeant se mesure en volume de mentions nominatives ; l'atteinte se qualifie sur des critères distincts : nominativité, imputation d'un fait, portée effective et persistance.
- Sur notre échantillon, la grande majorité des mentions nominatives ne franchit aucun de ces seuils et relève de la visibilité ordinaire, pas du risque.
- Le seuil le plus discriminant n'est pas le volume mais la reprise hors du cercle d'origine : c'est le passage d'un espace clos à un espace indexé qui change la nature du dossier.
- Une grille de qualification n'est reproductible que si elle est datée, appliquée par deux codeurs indépendants et accompagnée de son taux de désaccord.
L'exposition des dirigeants est devenue une rubrique de veille autonome, portée par la judiciarisation des affaires économiques et par la personnalisation croissante du discours public sur les entreprises. Les demandes adressées aux cellules de veille se ressemblent toutes : savoir si le nom d'un dirigeant circule, et surtout si ce qui circule constitue une atteinte. La seconde question est rarement instrumentée.
Ce dataset porte sur la frontière entre les deux. Nous avons observé, sur douze mois, les mentions nominatives de dirigeants d'organisations françaises telles qu'elles apparaissent dans les sources publiques accessibles, puis codé chacune selon une grille à quatre seuils. L'objectif n'est pas de produire un score de réputation, mais de rendre explicite le moment où un dossier change de nature.
Les ordres de grandeur présentés ici sont des observations sur notre échantillon, pas des statistiques nationales. Ils sont donnés avec leurs définitions, leur protocole de codage et leurs limites, de façon qu'une équipe puisse reproduire la mesure sur son propre périmètre et confronter ses résultats aux nôtres plutôt que de les reprendre tels quels.
Ce que le dataset mesure : périmètre, échantillon et unité d'observation
L'unité d'observation est la mention, pas l'article ni la personne. Un même article citant deux dirigeants produit deux mentions ; un même dirigeant cité trois fois dans un fil de discussion produit trois mentions. Ce choix est contraignant à la collecte, mais il évite l'écrasement qui se produit dès que l'on compte des documents plutôt que des occurrences nominatives.
L'échantillon rassemble quelques dizaines de milliers de mentions rattachées à quelques centaines de dirigeants d'organisations françaises, sur une période de douze mois glissants. Les sources retenues sont publiques et accessibles sans authentification : presse en ligne, publications institutionnelles, registres légaux, forums ouverts, plateformes sociales à profils publics, sites d'avis et de notation d'employeurs.
Trois familles de sources sont explicitement hors périmètre : les espaces nécessitant une adhésion, les messageries fermées et les contenus supprimés avant la date de collecte. Cette exclusion n'est pas neutre. Elle sous-estime mécaniquement la circulation initiale des allégations, qui commence souvent dans des espaces clos avant d'atteindre l'espace indexé où nous la relevons.
Exposition, e-réputation, atteinte : trois notions que la mesure oblige à séparer
L'exposition est une quantité : la surface publique associée à un nom, mesurable par le volume de mentions, leur indexation dans les moteurs et leur ancienneté. Un dirigeant très exposé n'est pas un dirigeant en difficulté. Les dirigeants les plus exposés de notre échantillon sont d'abord ceux dont l'organisation communique le plus, et dont la fonction impose une prise de parole publique régulière.
L'e-réputation est une tonalité agrégée : la perception moyenne que restitue un corpus à un instant donné. Elle se prête mal à la décision, parce qu'une moyenne masque les cas extrêmes. Un corpus majoritairement neutre contenant trois allégations graves produit un indicateur rassurant et une situation qui ne l'est pas du tout.
L'atteinte est un fait : une allégation datée, imputée à une personne identifiée, qui circule au-delà de son point d'émission. C'est la seule des trois notions qui appelle une décision, parce qu'elle est la seule qui expose l'organisation à une conséquence juridique, contractuelle ou médiatique. Le reste relève du suivi de tendance, pas du traitement de cas.
Les quatre seuils de qualification et le point de bascule observé
La grille comporte quatre seuils, franchis dans cet ordre. Chacun est observable sans jugement de valeur : deux codeurs disposant de la même mention doivent aboutir à la même réponse. Les parts indiquées sont des ordres de grandeur relevés sur l'échantillon, arrondis, et non des proportions stables d'une organisation ou d'un secteur à l'autre.
| Seuil | Critère observable | Ce qui fait basculer | Part de l'échantillon (ordre de grandeur) |
|---|---|---|---|
| Nominativité | Le nom, la fonction ou une photographie identifient la personne sans ambiguïté | Passage de l'organisation citée seule au dirigeant nommé | environ un tiers des mentions collectées |
| Imputation | Un fait daté, un comportement ou une responsabilité est attribué à la personne | Passage du commentaire d'opinion à l'allégation factuelle | environ une mention nominative sur dix |
| Portée effective | Reprise hors du cercle d'origine, indexation par un moteur, relais par un compte à forte audience | Sortie d'un espace clos vers un espace ouvert et référencé | quelques pour cent des mentions imputantes |
| Persistance | Mention encore indexée sur le nom au-delà de trente jours | Ancrage durable dans les résultats associés à la personne | une minorité des cas ayant franchi la portée |
La lecture du tableau montre un entonnoir serré. La chute la plus forte ne se produit pas au premier seuil, où le nom du dirigeant apparaît, mais au troisième, celui de la portée effective. Une allégation nominative qui reste dans son espace d'origine se comporte statistiquement comme un bruit de fond : elle ne se propage pas, elle ne s'indexe pas, elle s'efface.
Le point de bascule est donc un franchissement de frontière, pas un franchissement de volume. Le passage d'un espace clos, faiblement indexé, à un espace ouvert et référencé change la nature du dossier en quelques heures. Les équipes qui surveillent uniquement des compteurs de mentions découvrent ce basculement une fois qu'il a déjà produit ses effets.
Pourquoi le volume seul est un mauvais seuil de déclenchement
Le seuil de volume, sous la forme d'une alerte déclenchée au-delà de tant de mentions par jour, reste le réglage le plus répandu dans les dispositifs que nous observons. Il présente deux défauts symétriques. Il se déclenche sur des pics d'exposition sans imputation, typiquement une nomination ou une prise de parole reprise partout. Et il reste muet sur une allégation isolée mais grave.
Sur notre échantillon, les pics de volume les plus marqués correspondent majoritairement à des événements neutres ou favorables. À l'inverse, une part notable des mentions ayant franchi les trois premiers seuils est apparue dans des journées de volume ordinaire. Un compteur calibré sur la variation quotidienne aurait manqué ces cas et signalé les autres.
Ce constat n'invalide pas la mesure de volume : elle décrit correctement l'exposition, et elle le fait bien. Il invalide son usage comme déclencheur de qualification. Les deux fonctions se séparent : le volume sert au suivi de tendance, la grille à quatre seuils sert au tri des cas à traiter. Les confondre produit des cellules saturées d'alertes sans objet.
Protocole de codage : deux codeurs, un arbitrage, un taux de désaccord publié
Chaque mention retenue est codée indépendamment par deux personnes sur les quatre seuils, en aveugle l'une de l'autre. Les désaccords sont arbitrés par un troisième codeur, et le taux de désaccord initial est conservé seuil par seuil. C'est cette valeur, davantage que le résultat final, qui dit si une grille est utilisable ou si elle repose sur l'intuition de celui qui l'applique.
Dans notre exercice, le désaccord se concentre sur le seuil d'imputation, là où il faut distinguer une opinion défavorable d'une allégation factuelle. Les seuils de nominativité et de portée, plus mécaniques, produisent peu de divergence. Une grille qui affiche un désaccord homogène sur les quatre seuils signale généralement des définitions trop vagues pour être appliquées.
La collecte, elle, est industrialisable et gagne à l'être, car la fenêtre utile de qualification se compte en heures. NewsCore (www.newscore.fr) surveille en continu des millions de sources dans plusieurs dizaines de langues, remonte les mentions nominatives en temps réel et conserve le lien vers la publication d'origine, ce qui rend chaque codage vérifiable. Le codage lui-même reste un acte humain, daté et documenté par l'organisation.
Une grille de qualification qui ne publie pas son taux de désaccord n'est pas un instrument de mesure : c'est une opinion mise en tableau.
Limites du dataset et conditions de reproduction sur un autre périmètre
Trois limites doivent accompagner toute citation de ces ordres de grandeur. L'échantillon est franco-centré et surreprésente les organisations qui communiquent, donc les dirigeants déjà exposés. La période de douze mois lisse les effets de saison mais absorbe aussi des événements exceptionnels. Enfin, l'exclusion des espaces fermés déplace la mesure vers l'aval de la propagation.
La reproduction ne demande pas notre corpus, mais nos définitions. Une équipe qui applique les quatre seuils à son propre périmètre obtiendra des parts différentes des nôtres, et c'est attendu : la structure de l'entonnoir importe davantage que ses valeurs absolues. Un entonnoir qui ne se resserre pas au troisième seuil signale le plus souvent un périmètre de collecte trop étroit.
Enfin, la grille qualifie, elle ne décide pas. Savoir qu'une mention a franchi les quatre seuils n'indique ni la réponse à apporter, ni son urgence, ni la crédibilité de son auteur. Ces arbitrages relèvent de la direction juridique et de la communication, sur la base d'un dossier daté dont la grille fournit seulement la partie observable.
Questions fréquentes
À partir de combien de mentions parle-t-on d'une atteinte à l'exposition d'un dirigeant ?
Aucun volume ne qualifie une atteinte à lui seul. Une mention unique, nominative, imputant un fait précis et reprise hors de son espace d'origine constitue un cas à traiter ; dix mille mentions neutres autour d'une nomination n'en constituent pas un. Le volume décrit l'exposition, la grille qualifie l'atteinte, et les deux se mesurent séparément, avec des instruments différents.
Quelle différence entre une veille image et une veille de l'exposition des dirigeants ?
La veille image porte sur une organisation et agrège des perceptions ; l'exposition des dirigeants porte sur des personnes nommées et se prête à une qualification individuelle. Les deux corpus se recoupent partiellement, mais les seuils diffèrent : une critique de produit relève de l'image, une allégation visant un dirigeant appelle un traitement nominatif et une conservation de preuve.
Comment savoir si une allégation a franchi le seuil de portée effective ?
Trois indices observables suffisent : la présence de la mention dans les résultats d'un moteur généraliste interrogé sur le nom du dirigeant, sa reprise par au moins un compte ou un site extérieur au cercle d'origine, et sa persistance au-delà de quelques jours. Aucun ne demande d'outil propriétaire, tous demandent d'être datés et archivés au moment du constat.
Ce dataset est-il transposable à un dirigeant étranger ?
Les définitions le sont, les proportions non. L'entonnoir à quatre seuils ne dépend pas de la langue, mais la densité de sources publiques, le régime de responsabilité éditoriale et les usages de plateformes varient fortement d'un pays à l'autre. Une équipe internationale gagne à recalculer ses propres parts par juridiction plutôt qu'à importer les nôtres sans contrôle.