mercredi 7 octobre 2026
Analyses

L'opinion mesurée contre l'opinion agissante : deux objets que la veille confond

L'opinion exprimée en ligne et l'opinion qui agit sur les décisions ne sont pas le même objet. Définitions, mécanismes d'écart et limites de ce qu'une mesure autorise.

L'Observatoire21 août 20268 min de lecture

À retenir

  • L'opinion mesurée est l'ensemble des expressions captables dans un corpus. L'opinion agissante est l'ensemble des dispositions qui modifient un comportement observable.
  • Un corpus de veille échantillonne des locuteurs et des plateformes, jamais une population : sa base de sondage est inconnue et non redressable.
  • Quatre mécanismes séparent l'expression de l'adhésion : le silence des minoritaires, la surenchère des engagés, le mimétisme lexical et la coordination.
  • Une mesure d'opinion établit une répartition d'expressions à une date donnée. Elle n'établit ni une proportion de population, ni une intention d'action.

La veille d'opinion produit des courbes, des tonalités et des parts de voix, que les organisations lisent comme des états de l'opinion. Cette lecture procède d'une confusion entre deux objets que rien n'oblige à coïncider : ce que des locuteurs expriment publiquement, et ce que des populations sont disposées à faire. Cette analyse délimite les deux notions et décrit les mécanismes qui les séparent.

La distinction n'est pas neuve. Les sciences sociales séparent depuis longtemps l'opinion publiée, celle qui circule dans l'espace médiatique, de l'opinion publique, celle qu'un protocole d'enquête cherche à estimer sur une population définie. La veille en ligne a déplacé le problème sans le résoudre : elle a rendu l'opinion publiée massivement observable, ce qui a fait croire qu'elle rendait l'opinion publique mesurable.

Nous ne soutenons pas que la mesure d'expression est sans valeur, l'inverse serait absurde. Nous soutenons qu'elle mesure un objet précis, qu'il faut nommer correctement pour en tirer des conclusions défendables. La question posée n'est donc pas la fiabilité des outils, mais la définition de la grandeur qu'ils renvoient.

Deux définitions à tenir séparées

Nous appelons opinion mesurée l'ensemble des expressions publiques captables dans un corpus délimité, sur une période donnée, à propos d'un objet donné. Cette définition est opératoire : elle dépend du périmètre de sources, de la requête, de la langue et de la fenêtre temporelle. Changer l'un de ces paramètres change la grandeur mesurée, ce qui interdit de la traiter comme une propriété du monde.

Nous appelons opinion agissante l'ensemble des dispositions qui modifient un comportement observable : un achat, un renoncement, un vote, une candidature, une résiliation, une prise de parole en interne. Cette seconde grandeur n'est pas déclarative. Elle se constate par ses effets, avec un décalage temporel et sans qu'aucun locuteur ait nécessairement exprimé quoi que ce soit.

La frontière entre les deux se formule par un critère simple : l'opinion mesurée se lit dans un corpus, l'opinion agissante se lit dans une série de comportements. Un dispositif qui prétend passer de la première à la seconde franchit une inférence, et cette inférence doit être écrite, datée et falsifiable, au lieu d'être absorbée dans un indicateur composite.

Le corpus échantillonne des locuteurs, pas une population

La première raison de l'écart est un problème de base de sondage. Une enquête d'opinion part d'une population définie et construit un échantillon dont la représentativité se discute. Un corpus de veille part de ce qui est publié et capté : il n'a pas de base de sondage, donc pas de représentativité définissable, et aucun redressement ne rétablit ce qui n'a jamais été échantillonné.

La deuxième raison est l'inégalité de participation. Sur toute plateforme, une fraction minoritaire de comptes produit la majorité des contenus, tandis que la majorité lit sans écrire. Le corpus surreprésente donc structurellement les locuteurs les plus actifs, qui sont aussi les plus engagés. Cette distorsion est constitutive du médium et ne se corrige pas par un volume de collecte plus élevé.

La troisième raison est le périmètre technique. Les régimes d'accès aux plateformes déterminent ce qui entre dans le corpus, et ils varient dans le temps sans rapport avec l'opinion. Une fermeture d'interface fait chuter un volume mesuré sans qu'aucune perception n'ait bougé. C'est pourquoi tout indicateur d'opinion doit être accompagné du journal des changements de périmètre de collecte.

Quatre mécanismes qui décollent l'expression de l'adhésion

Le premier mécanisme est le silence des minoritaires. Lorsqu'une position paraît dominante, ceux qui la contestent réduisent leur expression publique plutôt que leur adhésion privée. Le corpus enregistre alors un consensus qui est en réalité une asymétrie de prise de parole. Ce mécanisme produit les erreurs les plus coûteuses, parce qu'il fait disparaître des signaux au moment précis où ils comptent.

Le deuxième mécanisme est la surenchère des engagés. L'intensité d'expression d'un locuteur croît avec son engagement, si bien que les positions extrêmes occupent une part du corpus très supérieure à leur poids dans la population. Une distribution de tonalités en forme de deux pôles opposés reflète souvent cette dynamique de locuteurs, non une polarisation de la population observée.

Le troisième mécanisme est le mimétisme lexical : les formulations se propagent plus vite que les convictions. Un même argument recopié par des milliers de comptes gonfle un volume sans ajouter d'adhésion. Le quatrième mécanisme est la coordination délibérée, qui produit le même effet de façon intentionnelle. Les deux se distinguent par la régularité temporelle et par la généalogie des formulations, pas par le volume.

Ce que la part de voix mesure réellement

La part de voix est l'indicateur le plus utilisé et le plus mal interprété. Elle rapporte le volume de mentions d'un objet au volume total d'un ensemble de référence. Elle mesure donc une occupation de l'espace d'expression capté, à trois paramètres près : la liste des concurrents retenus, le périmètre de sources et la règle de comptage des reprises. Aucun de ces paramètres n'est neutre.

La tonalité pose un problème distinct. Elle attribue une polarité à un énoncé, ce qui suppose de trancher sur l'ironie, la citation et le contexte implicite. Une tonalité agrégée reste utile comme indicateur de variation, à condition d'être produite par une chaîne stable : changer de méthode de classement modifie la série sans que rien n'ait changé dans les expressions elles-mêmes.

Le volume, enfin, est un indicateur d'attention et non d'opinion. Un pic de mentions signale qu'un objet est devenu discutable, pas qu'il est jugé. Sur les corpus que nous examinons, les pics les plus élevés correspondent fréquemment à des tonalités indéterminées, ce qui est cohérent : l'événement précède l'opinion, et le corpus enregistre d'abord la circulation de l'information.

IndicateurCe qu'il compteCe qu'il ne dit pas
Volume de mentionsAttention captée sur une périodeJugement porté sur l'objet
Part de voixOccupation relative de l'espace captéPréférence d'une population
Tonalité agrégéePolarité attribuée aux énoncés captésIntensité de l'adhésion
Portée estiméeAudience potentielle des comptes émetteursAudience réellement exposée
Nombre de locuteurs uniquesDiversité des sources d'expressionIndépendance entre ces locuteurs
EngagementInteractions déclenchéesApprobation du contenu partagé
Une courbe d'opinion en ligne décrit qui a parlé, quand et avec quels mots. Elle ne décrit pas qui pense quoi, et rien dans le corpus ne permet de combler cet écart.

Les observables qui rapprochent la mesure de l'agissant

Le rapprochement ne s'obtient pas en raffinant l'analyse de texte, mais en ajoutant des observables de comportement. Les requêtes de recherche sur une marque, les visites de pages de désabonnement, les demandes de portabilité, les taux de réponse à une campagne de recrutement ou les retours produit sont des traces d'action. Elles sont pauvres en nuance et riches en engagement, exactement l'inverse du corpus textuel.

La méthode consiste alors à confronter deux séries, l'une d'expression, l'autre de comportement, sur la même fenêtre. Trois configurations se présentent : les deux bougent ensemble, l'expression bouge seule, le comportement bouge seul. Le troisième cas est le plus instructif : il signale une opinion agissante que le corpus n'a pas captée, donc un angle mort de périmètre ou un effet de silence.

L'enjeu opérationnel est la couverture des sources d'expression, préalable à toute confrontation. NewsCore (www.newscore.fr) couvre en continu des millions de sources multilingues et fait remonter les signaux pertinents en temps réel, avec la traçabilité vers la publication d'origine. L'arbitrage sur les observables de comportement à rapprocher, lui, appartient à l'organisation qui décide.

Ce qu'une mesure d'opinion autorise à conclure

Trois conclusions sont défendables. Qu'un objet est entré ou sorti de l'espace de discussion capté, avec sa date. Que la composition des locuteurs qui en parlent a changé, ce qui est souvent plus informatif que le volume. Que certaines formulations se sont imposées, ce qui documente le cadrage du débat et se vérifie par la généalogie des expressions.

Trois conclusions ne le sont pas. Qu'une proportion du public partage une position, faute de base de sondage. Qu'une intention d'action existe, faute d'observable comportemental. Qu'une absence de mentions vaut absence de problème, puisque le silence est l'un des mécanismes d'écart les mieux documentés. Ces trois interdits gagnent à figurer en tête des restitutions.

La reproductibilité d'une mesure d'opinion suppose enfin trois pièces versionnées : la liste des sources avec leurs régimes d'accès et leurs dates, la requête exacte avec ses variantes linguistiques, et la règle de comptage des reprises et des doublons. Sans ces pièces, deux relevés successifs ne se comparent pas, et une variation d'outil devient indiscernable d'une variation d'opinion.

Questions fréquentes

Quelle différence entre veille d'opinion et sondage d'opinion ?

Un sondage part d'une population définie et construit un échantillon dont la représentativité se discute et se redresse. Une veille d'opinion part de ce qui est publié et capté : elle décrit une répartition d'expressions dans un corpus, sans base de sondage. La première estime une proportion de population, la seconde décrit une occupation d'espace d'expression. Les deux grandeurs ne sont pas substituables.

Qu'est-ce que l'opinion agissante ?

C'est l'ensemble des dispositions qui modifient un comportement observable : achat, renoncement, résiliation, candidature, vote, prise de parole interne. Elle se constate par ses effets, avec un décalage, et sans qu'aucune expression publique ne l'ait précédée. C'est la grandeur qui intéresse la décision, et c'est précisément celle qu'un corpus textuel n'atteint pas directement.

Un pic de mentions annonce-t-il une crise ?

Il annonce que l'objet est devenu discutable, ce qui est une condition et non une cause. Sur les corpus que nous examinons, les pics les plus élevés sont souvent associés à des tonalités indéterminées, parce que la circulation de l'information précède le jugement. L'indicateur à surveiller est moins le volume que la composition des locuteurs et la persistance du sujet au delà de quelques jours.

Comment corriger la surreprésentation des comptes les plus actifs ?

Aucune correction statistique ne rétablit une représentativité qui n'a jamais existé, faute de base de sondage. La pratique défendable consiste à publier des indicateurs par locuteur unique en plus des indicateurs par mention, à documenter la distribution des contributions, et à confronter la série d'expression à une série de comportement. C'est un changement de protocole, pas un redressement.

Repris dans le réseau

Pour approfondir