La dérive de définition, quand une catégorie change de sens sans décision
Une catégorie de classement peut garder le même nom et pourtant changer de sens avec le temps : la détecter par recodage à l'aveugle d'un lot ancien.
À retenir
- Une catégorie peut conserver un intitulé et une définition inchangés pendant que son application concrète dérive progressivement, sans décision explicite.
- Le recodage à l'aveugle d'un lot ancien, comparé au classement d'origine, mesure directement l'écart d'interprétation qui s'est installé.
- L'écart se lit dans son ampleur et dans son sens : élargissement, resserrement ou déplacement du centre de la catégorie n'appellent pas la même lecture.
- Un rituel de recodage annuel, mené à l'aveugle sur un échantillon renouvelé, sert de garde-fou contre un phénomène qui ne se signale jamais de lui-même.
Une catégorie qui semble stable mais qui bouge
Une catégorie de classement peut conserver exactement le même intitulé, la même définition écrite, la même place dans la nomenclature, et pourtant cesser peu à peu de désigner le même ensemble de cas. Ce phénomène, que l'on peut appeler dérive de définition, se distingue d'un changement de référentiel ou d'une définition mal posée dès le départ : ici, le vocabulaire ne bouge pas, c'est son usage concret par les personnes qui classent qui évolue.
La dérive touche en priorité les catégories les plus larges ou les plus qualitatives, celles dont la définition laisse une marge d'appréciation à qui l'applique. Une catégorie strictement quantitative, définie par un seuil chiffré vérifiable, dérive peu, parce que l'application de la règle ne dépend pas du jugement de l'annotateur. Une catégorie qui repose sur une appréciation de gravité, de pertinence ou de proximité thématique, en revanche, se prête à un glissement progressif d'interprétation.
Ce glissement n'est perceptible ni d'un cas à l'autre, ni d'un mois à l'autre : chaque décision de classement, prise isolément, paraît raisonnable au moment où elle est prise, cohérente avec les décisions récentes qui l'entourent. C'est seulement en comparant des décisions éloignées dans le temps que l'écart devient visible, ce qui explique pourquoi la dérive passe inaperçue tant qu'aucune comparaison de ce type n'est organisée.
Comment la dérive s'installe sans décision explicite
La dérive ne résulte presque jamais d'un choix assumé de redéfinir une catégorie. Elle s'installe par une accumulation de micro ajustements : un cas limite classé d'une certaine façon devient une référence informelle pour les cas suivants qui lui ressemblent, sans que quiconque ne relise la définition d'origine pour vérifier que ce précédent s'y conforme réellement.
Le renouvellement des personnes qui classent accélère le phénomène. Une personne qui rejoint l'équipe apprend la catégorie moins à partir de sa définition écrite qu'à partir des cas déjà classés qu'on lui montre comme exemples, cas qui portent déjà, potentiellement, une part de la dérive accumulée avant son arrivée. La dérive se transmet alors d'une génération d'annotateurs à la suivante, chaque transmission l'amplifiant légèrement.
Le contexte extérieur joue également un rôle : quand la nature des cas soumis au classement change progressivement, par exemple parce que le champ observé évolue, la catégorie s'adapte silencieusement à ce nouveau contexte pour continuer à sembler pertinente, plutôt que de révéler que le contexte a dépassé sa définition d'origine.
La détecter : recoder un lot ancien avec la grille actuelle
La méthode la plus directe pour détecter une dérive consiste à prendre un lot de cas classés à une date ancienne, et à le faire reclasser aujourd'hui, par une personne qui applique la définition actuelle de la catégorie sans connaître le classement d'origine. La comparaison entre les deux classements, l'ancien et celui produit aujourd'hui sur les mêmes cas, mesure directement l'écart d'interprétation qui s'est installé.
Ce protocole exige que le recodage se fasse à l'aveugle, sans accès au classement d'origine, faute de quoi la personne qui recode tend à reproduire ce classement plutôt qu'à appliquer sa propre lecture actuelle de la définition. L'aveuglement est ce qui garantit que l'écart mesuré reflète bien une dérive d'interprétation, et non une simple confirmation du classement passé.
Le choix du lot ancien à recoder n'est pas neutre : un lot trop récent sous-estime la dérive, faute de recul suffisant, tandis qu'un lot trop ancien, s'il correspond à une période où le champ observé était structurellement différent, mélange la dérive de définition avec un changement réel de nature des cas. Un lot pris à mi distance, suffisamment ancien pour laisser le temps à une dérive de s'installer mais encore comparable au contexte actuel, donne la mesure la plus interprétable.
Mesurer l'écart et l'interpréter
L'écart entre le classement d'origine et le recodage actuel se lit d'abord globalement, comme une proportion de cas dont le classement change, mais cette lecture globale ne suffit pas : il faut examiner dans quel sens vont les changements. Une dérive qui élargit systématiquement la catégorie, en y faisant entrer des cas auparavant exclus, ne pose pas le même problème qu'une dérive qui la resserre, ou qu'une dérive qui déplace son centre sans changer clairement son étendue.
Un écart faible et sans direction dominante s'interprète comme du bruit normal d'interprétation, inhérent à toute catégorie qui repose sur un jugement humain. Un écart plus élevé, ou orienté nettement dans un sens, signale une dérive réelle qui mérite d'être documentée, indépendamment de la question de savoir si elle doit être corrigée ou seulement actée pour l'interprétation future de la série.
Cette mesure n'a de valeur que rapportée à un seuil de référence propre à chaque catégorie, établi en observant plusieurs cycles de recodage successifs plutôt qu'un seul. Un seul exercice de recodage donne un point de mesure ; c'est la répétition régulière de l'exercice qui permet de distinguer une dérive installée d'une simple variation ponctuelle entre deux personnes qui ont recodé le lot.
Le rituel de recodage annuel comme garde-fou
Face à un phénomène qui, par nature, ne se signale pas de lui-même, la seule protection efficace est un rituel régulier, indépendant de tout soupçon particulier sur une catégorie donnée. Un recodage annuel d'un échantillon de cas anciens, portant sur l'ensemble des catégories jugées sensibles à la dérive, permet de suivre dans le temps l'écart d'interprétation plutôt que de le découvrir tardivement, au moment où il a déjà déformé une série longue.
Ce rituel gagne à être mené par une personne qui n'a pas participé au classement d'origine du lot recodé, pour préserver l'aveuglement nécessaire à la mesure, et à porter chaque année sur un échantillon renouvelé, afin de couvrir progressivement l'ensemble des catégories sensibles sans alourdir démesurément la charge de travail annuelle.
NewsCore conserve le texte intégral des éléments classés au moment de leur traitement initial sur www.newscore.fr, ce qui rend ce type de recodage a posteriori praticable sans dépendre de la mémoire des annotateurs ni d'une reconstitution partielle du contexte d'origine. La série longue en tire une garantie de comparabilité qu'aucune définition écrite, seule, ne peut offrir.
Ce rituel ne prétend pas éliminer la dérive, qui reste, dans une certaine mesure, inhérente à tout classement fondé sur un jugement humain. Il sert à la rendre visible et mesurée, condition nécessaire pour qu'une série longue conserve un sens interprétable, plutôt que de glisser, année après année, vers une signification que plus personne n'a choisie explicitement.
Questions fréquentes
Une dérive de définition est-elle la même chose qu'un changement de référentiel ? Non : un changement de référentiel remplace un système de catégories par un autre, de façon identifiable, alors qu'une dérive de définition touche une catégorie unique, dont l'intitulé et la définition écrite restent inchangés pendant que son application concrète évolue progressivement.
Pourquoi recoder à l'aveugle plutôt que de comparer directement les définitions écrites ? Parce que la dérive porte sur l'écart entre la définition écrite et son application réelle, pas sur la définition elle-même, qui reste souvent inchangée. Seul un recodage effectué sans connaître le classement d'origine révèle comment la catégorie est réellement comprise aujourd'hui, indépendamment du texte qui la définit.
Toutes les catégories sont-elles également exposées à la dérive ? Non : les catégories définies par un critère quantitatif vérifiable dérivent peu, tandis que celles qui reposent sur une appréciation qualitative, de gravité ou de pertinence par exemple, se prêtent davantage à un glissement progressif d'interprétation entre les personnes qui classent et dans le temps.
Faut-il corriger rétroactivement l'historique une fois la dérive mesurée ? Pas nécessairement : corriger l'historique masque, comme une fusion silencieuse, le fait qu'un changement d'interprétation a eu lieu. Documenter la période et l'ampleur de la dérive mesurée permet à qui utilise la série de tenir compte de cette hétérogénéité, sans effacer la trace de son existence.