Indicateur de sentiment : ce qu'il mesure vraiment de l'image de marque
Un score de sentiment n'est pas une mesure de l'image de marque. Définitions, décisions cachées dans le calcul, protocole d'annotation et conditions de reproductibilité.
À retenir
- Un indicateur de sentiment mesure la polarité exprimée dans un corpus collecté, pas l'opinion d'un public : il décrit ce qui a été écrit, jamais ce qui est pensé par ceux qui se taisent.
- Quatre décisions déterminent le score bien avant l'algorithme : le périmètre de collecte, l'unité annotée, le nombre de classes de polarité et le traitement des mentions neutres.
- Sans protocole d'annotation écrit et sans mesure d'accord entre annotateurs, un score de sentiment n'est pas comparable d'une période à l'autre, même produit par le même outil.
- Une variation de score n'a de sens qu'accompagnée du volume : une amélioration de polarité sur un corpus qui s'effondre signale un désintérêt, pas une réhabilitation.
L'indicateur de sentiment est devenu la métrique par défaut de la veille d'image. Il apparaît sur les tableaux de bord sous la forme d'un pourcentage, d'un score net ou d'une couleur, et il est lu comme s'il traduisait l'état de l'opinion à l'égard d'une organisation. Cette lecture est trop large. La grandeur mesurée est plus étroite que le concept qu'on lui fait porter, et l'écart entre les deux explique la plupart des désaccords sur ces chiffres.
Le problème n'est pas la fiabilité des outils, qui progresse. Il tient à la définition. Un score de sentiment porte sur des énoncés collectés dans un périmètre donné, découpés en unités, classés selon une échelle de polarité choisie par celui qui construit la mesure. Chacune de ces trois opérations est un arbitrage, et aucune n'est déductible du concept d'image de marque.
Cet article délimite la notion, la distingue de ses voisines, expose les décisions qui déterminent le score avant tout traitement automatique, décrit le protocole d'annotation que nous appliquons à nos propres corpus, et énonce les conditions auxquelles une mesure de sentiment devient reproductible. Il ne propose pas de méthode de pilotage : il pose ce que le chiffre autorise à dire.
Image de marque, réputation, notoriété, e-réputation : quatre notions distinctes
La notoriété est une mesure de connaissance : quelle part d'un public identifie l'organisation. Elle est indifférente au jugement. L'image de marque est l'ensemble des représentations associées à l'organisation dans l'esprit d'un public : des attributs, pas une note. La réputation est un jugement porté sur la conduite passée, donc un solde d'expériences et de récits accumulés. L'e-réputation restreint ce jugement aux traces accessibles en ligne, ce qui en fait un sous-ensemble d'observation, pas une notion autonome.
Le critère qui fait basculer d'une notion à l'autre est la question posée. Si la question est « me connaît-on », il s'agit de notoriété. Si elle est « à quoi m'associe-t-on », il s'agit d'image. Si elle est « me fait-on confiance au vu de mes actes », il s'agit de réputation. Un indicateur de sentiment ne répond directement à aucune des trois : il décrit la tonalité des énoncés publics disponibles, ce qui constitue un indice partiel, et principalement du troisième.
Ce qu'un indicateur de sentiment mesure au sens strict
Au sens strict, un indicateur de sentiment mesure la distribution de polarité d'un corpus. Il attribue à chaque unité textuelle une classe, positive, négative ou neutre, éventuellement graduée, puis agrège ces classes. La grandeur produite est donc une propriété du corpus, pas du public. Elle dépend de ce qui a été collecté et de ce qui a été exprimé. Les publics silencieux, majoritaires dans presque tous les sujets, n'y figurent pas.
Cette précision a une conséquence directe sur l'usage. Un score de sentiment est légitime comme indicateur de variation d'un discours public sur un périmètre stable : il détecte une inflexion, un pic, une bascule après un événement. Il est illégitime comme estimation d'une opinion moyenne, usage qui relèverait d'une enquête sur échantillon construit. Confondre les deux revient à traiter une observation de convenance comme un sondage.
Les quatre décisions qui déterminent le score avant l'algorithme
La première décision est le périmètre de collecte : quelles plateformes, quelles langues, quels médias, quelle profondeur d'historique, quelles requêtes. Un périmètre élargi d'une plateforme modifie le score sans qu'aucun énoncé n'ait changé. La deuxième est l'unité annotée : le message entier, la phrase, ou le segment portant sur l'organisation. Un message globalement hostile peut contenir une phrase favorable, et le choix de l'unité inverse parfois le résultat.
La troisième décision est l'échelle de polarité : deux classes, trois classes, cinq degrés, ou un score continu. Plus l'échelle est fine, plus l'accord entre annotateurs se dégrade, et plus la comparaison dans le temps devient fragile. La quatrième est le traitement du neutre, qui décide du sort de la majorité des mentions factuelles : compté au dénominateur, il écrase les variations ; exclu, il amplifie le bruit. Ces quatre choix précèdent tout modèle.
| Décision | Effet sur le score | Ce qu'il faut documenter |
|---|---|---|
| Périmètre de collecte | Déplace le niveau sans changer les énoncés | Liste des sources, langues, requêtes, dates |
| Unité annotée | Peut inverser le signe d'une mention | Message, phrase ou segment ciblé |
| Échelle de polarité | Dégrade l'accord quand elle s'affine | Nombre de classes et règles de bascule |
| Traitement du neutre | Écrase ou amplifie les variations | Inclusion au dénominateur, oui ou non |
Protocole d'annotation, accord entre annotateurs et limites de notre mesure
Sur nos propres corpus d'image, nous appliquons un protocole écrit avant collecte. Le périmètre est figé et daté, l'unité annotée est le segment portant explicitement sur l'organisation, l'échelle compte trois classes, et le neutre est conservé au dénominateur. Une part du corpus est annotée en double par deux personnes travaillant séparément, et l'écart entre elles est mesuré avant toute publication d'un score. Les règles de bascule des cas ambigus sont consignées et versionnées.
Les limites sont explicites. L'accord entre annotateurs se dégrade sur les énoncés ironiques, sur les citations d'un tiers hostile, et sur les mentions comparatives où deux organisations apparaissent dans la même phrase. Nos résultats sont donc présentés comme des ordres de grandeur d'observation sur un corpus daté, jamais comme une mesure d'opinion. La reproductibilité ne tient pas au score lui-même mais à la publication du protocole, qui permet à un tiers de recalculer sur son propre corpus.
Ce que le score ne capte pas : ironie, contexte, absence
Trois angles morts subsistent quel que soit l'outil. L'ironie et l'antiphrase inversent la polarité de surface, et leur détection dépend d'un contexte souvent absent de l'unité annotée. Le contexte de citation pose un problème voisin : un message qui relaie une accusation pour la contester est fréquemment classé négatif, alors que son auteur défend l'organisation. La direction du jugement et la tonalité du texte ne coïncident pas toujours.
Le troisième angle mort est le plus important et le moins commenté : l'absence de mention. Un score de sentiment ne mesure rien sur les publics qui ne s'expriment pas, ni sur les sujets qui ont cessé d'être discutés. Une polarité qui s'améliore sur un volume qui s'effondre décrit un désintérêt, pas une réhabilitation. C'est pourquoi un score de sentiment ne se lit jamais seul : il se lit adossé au volume de mentions et à la structure des thèmes associés.
Une polarité qui s'améliore pendant que le volume s'effondre ne décrit pas une réhabilitation : elle décrit un silence.
Du score au signal : ce qui rend l'indicateur utilisable en veille
Un indicateur de sentiment devient utile quand il cesse d'être un chiffre unique. Trois compléments suffisent : le volume, qui donne le poids ; la décomposition par thème, ou sentiment par aspect, qui indique sur quoi porte le jugement, prix, service, gouvernance, produit ; et la décomposition par source, qui distingue une hostilité concentrée sur un forum d'une inflexion répartie sur la presse. Le triplet score, volume, thème dit ce que le score seul ne dit pas.
La couverture des sources conditionne tout le reste, puisqu'un corpus incomplet produit un score exact sur un objet partiel. NewsCore (www.newscore.fr) couvre en continu des millions de sources multilingues, trie les signaux par intelligence artificielle et relie chaque mention à sa source d'origine, ce qui rend la polarité vérifiable énoncé par énoncé. La définition du périmètre pertinent et l'interprétation d'une inflexion restent le travail de l'organisation.
Questions fréquentes
Qu'est-ce qu'un indicateur de sentiment en veille d'image de marque ?
C'est la distribution de polarité d'un corpus de mentions collectées sur un périmètre défini : chaque unité textuelle reçoit une classe positive, négative ou neutre, et l'ensemble est agrégé en un score. La grandeur décrit le corpus, non le public : elle rend compte de ce qui a été écrit dans les sources surveillées, pendant la période retenue. Sa validité dépend donc du périmètre de collecte au moins autant que de la qualité du classement.
Un score de sentiment mesure-t-il la réputation d'une entreprise ?
Non, il en fournit un indice partiel. La réputation est un jugement porté sur la conduite passée par des publics identifiés, dont beaucoup ne s'expriment pas publiquement. Le score de sentiment ne couvre que les énoncés disponibles dans les sources surveillées, avec une surreprésentation des publics les plus actifs en ligne. Il détecte correctement une inflexion de discours ; il n'estime pas une opinion moyenne, ce qui exige une enquête sur échantillon construit.
Comment rendre une mesure de sentiment comparable d'un mois sur l'autre ?
En figeant et en documentant les quatre décisions structurantes : périmètre de collecte, unité annotée, échelle de polarité, traitement des mentions neutres. Tout élargissement de périmètre crée une rupture de série qui doit être signalée comme telle, et non lissée. La comparaison suppose en outre de publier le volume à côté du score, faute de quoi une variation de polarité reste indissociable d'une variation d'attention.