Mesurer une stratégie de saturation : quand volume, tonalité et part de voix cessent de dire quelque chose
Face à une campagne qui diffuse des récits contradictoires pour semer la confusion, les indicateurs classiques trompent. Voici quoi mesurer à la place, et comment.
À retenir
- Volume, tonalité et part de voix ont été conçus pour mesurer une tentative de persuasion : appliqués à une opération de saturation, ils enregistrent l'activité et manquent l'intention.
- Trois indicateurs de substitution tiennent la route en observation : la dispersion des récits sur un même fait, le taux de contradiction interne d'un corpus, la vitesse de rotation des narratifs.
- Une controverse ordinaire converge lentement vers deux ou trois versions ; une saturation organisée maintient la dispersion haute sans jamais arbitrer entre ses propres récits.
- Aucun de ces indicateurs ne prouve une coordination : ils qualifient une forme de circulation, l'attribution relève d'un tout autre travail.
Une partie des opérations informationnelles observables aujourd'hui ne cherche pas l'adhésion. Le rapport « Special Report: Russian Disinformation in the Age of AI » publié par Riley Sentinel décrit une approche fondée sur le volume et la répétition de récits contradictoires diffusés rapidement, dont l'objectif rapporté est de semer la confusion plutôt que de convaincre. Ce déplacement d'objectif n'est pas un détail rhétorique : il invalide une partie des tableaux de bord en usage dans les cellules de veille.
L'instrumentation dominante de la veille réputationnelle a été bâtie pour mesurer une tentative de persuasion. Elle compte les mentions, elle classe une tonalité (positive, négative ou neutre), elle calcule une part de voix entre acteurs. Ces trois familles supposent implicitement qu'un émetteur défend une position et qu'il est possible de la situer sur un axe. Une campagne de saturation ne défend aucune position stable : elle occupe le terrain avec des positions incompatibles entre elles.
Cette note propose une grille de mesure adaptée à ce cas. Elle précise pourquoi les indicateurs habituels décrochent, définit trois indicateurs de substitution observables sur un corpus de veille ordinaire, décrit un protocole reproductible, et pose les limites au-delà desquelles l'interprétation devient de la spéculation. Elle ne porte aucune conclusion sur l'origine d'une campagne : les éléments extérieurs mobilisés ici sont ceux rapportés par Riley Sentinel.
Pourquoi le volume, la tonalité et la part de voix décrochent face à une saturation
Le volume est le premier indicateur à perdre son sens. Il enregistre une quantité de production, jamais une quantité de conviction. Dans un dispositif de saturation, la production est précisément le levier actionné : mesurer le volume revient à mesurer le budget de l'opération, pas son effet. Une courbe qui monte confirme donc l'existence d'une activité sans rien dire de ce que le public en retient, et déclenche souvent une réponse de communication disproportionnée.
La tonalité décroche pour une raison plus structurelle. Un corpus saturé contient simultanément des contenus favorables, hostiles et neutres sur le même objet, produits par la même mécanique de diffusion. Agrégés, ils s'annulent : la tonalité moyenne revient au neutre et affiche une situation calme au moment exact où le corpus devient le plus anormal. L'indicateur ne se dégrade pas progressivement, il bascule vers une valeur rassurante et fausse.
La part de voix, enfin, suppose un jeu à somme constante entre des acteurs identifiés et comparables. Quand une fraction du corpus provient de comptes et de sites créés pour l'occasion, la part de voix mesure surtout la capacité à générer des identités nouvelles. Riley Sentinel note que l'IA générative accélère la production de textes, de vidéos truquées et de personas synthétiques, à un coût et une échelle inaccessibles aux outils précédents : l'unité de comparaison elle-même devient instable.
Un tableau de bord qui revient au neutre pendant qu'un corpus se remplit de versions incompatibles ne mesure pas le calme : il mesure sa propre incapacité à agréger des contradictions.
Trois indicateurs de substitution : dispersion, contradiction interne, rotation
La dispersion des récits mesure, pour un fait unique et daté, le nombre de versions distinctes de ce fait qui circulent dans le corpus, pondéré par leur poids relatif. On code chaque contenu par la version qu'il porte (ce qui s'est passé, qui agit, quelle cause est avancée), puis on calcule une entropie sur cette distribution. Un fait ordinaire produit deux à trois versions dont une domine ; un fait saturé produit un éventail plat où aucune version ne l'emporte.
Le taux de contradiction interne mesure la part des paires de contenus qui, à l'intérieur d'un même sous-réseau de diffusion, portent des versions logiquement incompatibles. C'est l'indicateur le plus discriminant, parce qu'il capte une anomalie que la controverse ordinaire ne produit pas : dans un débat classique, chaque camp reste cohérent avec lui-même. Un taux élevé signale une diffusion indifférente au contenu diffusé, ce qui est la signature opérationnelle de la saturation.
| Indicateur | Ce qu'il mesure | Seuil d'attention | Ce qu'il ne prouve pas |
|---|---|---|---|
| Dispersion des récits | Entropie des versions concurrentes d'un même fait daté | Aucune version au-dessus de 40 % du corpus après 72 heures | Que la dispersion soit intentionnelle plutôt que le fruit d'une information incomplète |
| Taux de contradiction interne | Part des paires de contenus incompatibles dans un même sous-réseau | Contradictions persistantes après consolidation des faits publics | Que les émetteurs soient coordonnés entre eux |
| Vitesse de rotation | Durée de vie médiane d'un récit avant remplacement | Rotation nettement plus rapide que le cycle de vérification du sujet | Que la rotation vise un public précis |
| Volume brut | Quantité de contenus produits | À interpréter uniquement rapporté aux trois indicateurs ci-dessus | Que l'audience ait été atteinte ou convaincue |
La vitesse de rotation des narratifs complète le dispositif. Elle mesure la durée de vie médiane d'un récit avant son remplacement par un autre dans le même corpus. Une campagne de persuasion investit dans la durée d'un message et le répète ; une campagne de saturation abandonne un récit dès qu'il est contredit et en pousse un autre. La rotation devient alors plus rapide que le cycle de vérification du sujet, ce qui rend la réfutation structurellement en retard.
Protocole de mesure : unité d'analyse, échantillon, fenêtre d'observation
L'unité d'analyse doit être le fait, pas le contenu. On sélectionne un événement daté, vérifiable, dont on peut établir une chronologie indépendante, puis on rattache à cet événement l'ensemble des contenus qui le mentionnent. Sans ancrage factuel, la dispersion mesurée devient un artefact du périmètre de collecte. C'est la précaution la plus souvent négligée et la première source de résultats non reproductibles.
L'échantillon doit être constitué avant l'événement, pas après. Un corpus assemblé une fois l'alerte donnée est mécaniquement biaisé vers les contenus les plus visibles, donc vers les récits déjà dominants, ce qui écrase artificiellement la dispersion. La collecte continue et multilingue est ici une condition de validité de la mesure, pas un confort. NewsCore (www.newscore.fr) couvre en continu des millions de sources dans des dizaines de langues et relie chaque signal remonté à son document d'origine, ce qui rend le corpus vérifiable ligne à ligne.
La fenêtre d'observation se cale sur le cycle de vérification du sujet, généralement 72 heures à sept jours. On calcule les trois indicateurs par tranches, jamais en valeur unique : c'est leur trajectoire qui informe. Le codage des versions demande un double passage humain sur un sous-échantillon d'au moins 200 contenus, avec mesure de l'accord entre codeurs. En deçà, l'entropie mesurée reflète surtout la subjectivité du codage.
Distinguer une controverse ordinaire d'une saturation organisée
Une controverse ordinaire converge. Les versions concurrentes se réduisent à mesure que les faits publics se consolident, la dispersion décroît, les contradictions se déplacent des faits vers leur interprétation. C'est un mouvement lent mais monotone, et il constitue la référence à laquelle comparer tout corpus suspect. Sur un sujet technique complexe, la convergence prend simplement plus de temps sans changer de direction.
Une saturation organisée ne converge pas. La dispersion reste haute alors que les faits sont établis, les contradictions persistent à l'intérieur des mêmes sous-réseaux, et la rotation continue de produire des récits neufs sans lien avec les précédents. Le critère décisif tient en une phrase : dans une controverse, chaque partie défend sa version contre les autres ; dans une saturation, personne ne défend rien, les versions se succèdent sans être arbitrées.
Un quatrième signe se lit sur les corpus automatisés. Riley Sentinel décrit une tactique désignée sous le terme « LLM grooming », qui consiste à empoisonner les données d'entraînement pour que des assistants reproduisent certains récits comme des faits neutres. Un corpus dont les récits apparaissent avec une régularité de formulation supérieure à celle d'une discussion humaine ordinaire mérite un examen séparé, sans que cette régularité constitue à elle seule une preuve.
Limites de la méthode et risques de surinterprétation
Ces indicateurs qualifient une forme de circulation, jamais une intention ni une origine. Une dispersion élevée s'observe aussi lors d'un événement réellement confus, mal documenté ou couvert par des rédactions aux accès inégaux. Conclure à une opération à partir de la seule entropie est une erreur d'inférence courante, et elle est coûteuse : elle expose l'organisation qui la commet à devoir se rétracter publiquement.
La deuxième limite tient à la mesure elle-même. Le codage des versions est un acte d'interprétation ; l'accord entre codeurs plafonne en pratique sur les sujets à forte charge politique. Riley Sentinel souligne par ailleurs une conséquence directe pour les entreprises : la dégradation de la qualité du renseignement en sources ouvertes et un risque réputationnel par association avec des récits contestés. Une mesure fragile mal communiquée alimente exactement ce risque.
Questions fréquentes
Comment savoir si une hausse de mentions relève d'une campagne de saturation ?
La hausse de mentions seule ne permet aucune conclusion. Il faut la croiser avec la dispersion des récits sur un fait précis et daté : si les versions concurrentes se multiplient sans qu'aucune ne domine après le délai normal de consolidation des faits, l'hypothèse de saturation devient plausible. Si une version l'emporte progressivement, il s'agit d'une controverse ordinaire, même intense.
Pourquoi l'analyse de tonalité est-elle inadaptée dans ce cas ?
Parce qu'elle agrège des contenus favorables et hostiles produits par la même mécanique de diffusion. La moyenne obtenue revient au neutre et affiche une situation apaisée au moment où le corpus est le plus anormal. La tonalité garde son utilité sur les corpus de persuasion classique, où un émetteur défend une position stable dans le temps.
Quel volume de corpus faut-il pour que ces indicateurs soient exploitables ?
Un sous-échantillon codé manuellement d'au moins 200 contenus rattachés à un même fait, avec double codage et mesure de l'accord entre codeurs, constitue le plancher raisonnable. En dessous, l'entropie mesurée reflète surtout le bruit de codage. Le corpus complet peut être bien plus large : c'est le sous-échantillon codé qui fixe la précision de la mesure.
Ces indicateurs permettent-ils d'attribuer une campagne à un acteur ?
Non, et c'est une limite à énoncer explicitement dans tout livrable. La dispersion, la contradiction interne et la rotation décrivent la manière dont des contenus circulent. L'attribution relève d'un travail distinct, technique et juridique, fondé sur des éléments d'infrastructure et de financement qui sortent du champ d'une mesure de corpus.