mercredi 7 octobre 2026
Analyses

Vulnérabilité des modèles génératifs aux arguments répétés : ce que cela implique pour un corpus

Une évaluation académique mesure la sensibilité de modèles génératifs aux fausses informations répétées. Ce que ce résultat impose à la construction d'un corpus de veille.

L'Observatoire6 septembre 20267 min de lecture

À retenir

  • La répétition d'une affirmation fausse agit sur un modèle génératif comme elle agit sur un corpus de veille : elle produit une apparence de convergence sans source supplémentaire.
  • Un corpus qui compte les reprises au lieu de compter les sources primaires fabrique lui-même le signal de confirmation qu'il croit observer.
  • La règle de construction la plus rentable consiste à déduplifier par contenu et non par adresse, puis à ne compter que les sources primaires distinctes.
  • L'exigence de vérification se déplace vers l'amont : la traçabilité de la collecte devient un livrable au même titre que l'analyse.

Une information répétée paraît plus vraie qu'une information énoncée une fois. Ce constat est ancien et documenté chez l'humain ; il concerne désormais aussi les outils qui assistent la veille. Pour une équipe qui construit un corpus, cette convergence est plus qu'une curiosité : elle décrit un même mécanisme de défaillance à deux endroits différents de la chaîne de traitement.

Mirage News rapporte qu'une étude de l'Université d'Arizona, publiée dans Scientific Reports, a évalué sept modèles d'intelligence artificielle générative lors de conversations longues et mesure leur vulnérabilité aux fausses informations répétées. Il s'agit d'une évaluation académique portant sur un comportement, non d'un comparatif commercial, et rien dans ce travail ne désigne un modèle plus robuste qu'un autre.

Cet article ne traite donc pas du choix d'un modèle. Il examine ce que le résultat implique pour l'objet dont une équipe de veille est réellement responsable : son corpus. Nous posons d'abord ce que mesure une évaluation de ce type, puis le parallèle avec la constitution d'un corpus, enfin les règles de construction qui limitent l'effet de la répétition.

Ce que mesure exactement une évaluation de vulnérabilité aux arguments répétés

Une évaluation de ce genre n'établit pas qu'un modèle ignore un fait. Elle mesure la stabilité d'une réponse lorsque l'interlocuteur insiste, reformule et réintroduit la même affirmation à plusieurs reprises au fil d'un échange prolongé. L'objet mesuré est un comportement conversationnel, pas une connaissance : le modèle peut disposer de l'information exacte et cesser malgré tout de la maintenir.

La condition expérimentale importe autant que le résultat. Les conversations longues placent le système dans une situation où le contexte immédiat pèse davantage que ce qui a été établi au début de l'échange. C'est précisément la situation d'un analyste qui travaille plusieurs heures sur un même sujet avec un assistant, en revenant sans cesse sur les mêmes hypothèses.

La portée pratique doit rester mesurée. Ce type d'évaluation décrit une sensibilité observée dans un protocole donné ; il ne dit pas quelle fréquence d'erreur attendre dans un usage professionnel encadré. Nous le retenons comme un signal de conception, pas comme une statistique d'exploitation.

Pourquoi la répétition agit sur un corpus comme elle agit sur un modèle

Un corpus de veille est un ensemble de documents collectés selon des règles. Si ces règles comptent les occurrences plutôt que les origines, la répétition produit mécaniquement un effet de confirmation. Vingt reprises d'une même dépêche par vingt sites différents apparaissent comme vingt éléments concordants, alors qu'il n'existe qu'une seule source primaire, éventuellement fausse.

Le phénomène est structurel et ne dépend d'aucune malveillance. La reprise éditoriale, la syndication de contenus, les agrégateurs automatiques et les traductions produisent en quelques heures une masse documentaire dont la diversité apparente est purement formelle. Un dispositif qui mesure l'importance d'un fait au volume de sa reprise mesure en réalité la vitesse de circulation d'un texte.

Une seconde source de répétition, plus difficile à voir, provient du dispositif lui-même. Les synthèses produites la veille alimentent la lecture du lendemain, les alertes reprennent les formulations des alertes précédentes, et les notes internes citent d'autres notes internes. Au bout de quelques cycles, une hypothèse formulée une seule fois à partir d'une source unique circule dans le dispositif avec l'apparence d'un acquis, sans qu'aucun élément nouveau ne soit venu la soutenir. C'est une contamination interne, indépendante de la circulation médiatique, et elle ne se corrige qu'en conservant le lien entre chaque affirmation et le document primaire qui la fonde.

Le parallèle avec l'évaluation académique s'arrête là où commence la responsabilité de l'équipe. Un modèle subit la répétition qu'on lui présente ; un corpus, lui, est construit. Les règles qui gouvernent son alimentation sont écrites par des humains et restent modifiables, ce qui déplace la question de la fiabilité vers la conception plutôt que vers l'outil.

Un corpus qui compte les reprises au lieu de compter les sources primaires fabrique lui-même le signal de confirmation qu'il croit observer.

Quatre règles de construction d'un corpus qui résiste à la répétition

Les règles utiles sont peu nombreuses et se vérifient. Elles portent toutes sur la même idée : distinguer l'unité documentaire de l'unité informationnelle, c'est-à-dire ne jamais confondre le nombre de documents collectés avec le nombre de choses sues.

Règle de constructionCe qu'elle corrigeComment on vérifie qu'elle est appliquée
Déduplication par contenu et non par adresseLa reprise à l'identique sous des adresses distinctesDeux documents au texte quasi identique portent le même identifiant de groupe
Comptage des sources primaires distinctesL'illusion de concordance créée par la syndicationChaque affirmation du livrable porte le nombre de sources primaires qui la fondent
Datation de la première occurrenceL'attribution d'un fait à son relais le plus visibleL'horodatage retenu est celui de la publication la plus ancienne du corpus
Marquage du statut de chaque élémentLe glissement de l'hypothèse au fait établiChaque ligne indique fait établi, fait rapporté ou hypothèse

Dans les dispositifs que nous observons, la déduplication par contenu est la règle la plus souvent absente et la plus rentable à installer. Elle réduit le volume traité sans réduire l'information disponible, et elle rend immédiatement visible le nombre réel de sources primaires derrière un sujet. Le comptage par sources primaires distinctes vient ensuite : il change la formulation des livrables plus que la collecte, en obligeant à écrire combien d'origines indépendantes fondent chaque affirmation.

L'ordre d'application compte autant que les règles elles-mêmes. Une déduplication conduite après le comptage ne corrige rien, puisque les chiffres déjà diffusés continuent de circuler dans les livrables antérieurs. De même, un marquage de statut appliqué au moment de la rédaction finale arrive trop tard : l'hypothèse a déjà été manipulée comme un fait pendant l'analyse. Les quatre règles se placent donc à la collecte, pas à la restitution, et c'est ce déplacement en amont qui explique pourquoi elles sont si souvent absentes des dispositifs pourtant bien outillés en aval.

Ce que l'exigence de vérification déplace vers l'amont de la chaîne

La question ne se limite pas à la qualité interne d'un dossier de veille. Philstar rapporte que la défense de l'ancien président philippin Rodrigo Duterte a demandé à la Cour pénale internationale de renforcer les protocoles de vérification des preuves numériques, en invoquant la propagation de fausses informations en ligne, dans une requête datée du 31 août. Le mouvement est net : c'est le protocole de collecte, et non la seule conclusion, qui devient l'objet de la contestation.

Pour une équipe de veille, la conséquence est directe. Un livrable dont les affirmations sont exactes mais dont la collecte n'est pas documentée devient difficile à défendre dès qu'il est contesté. La traçabilité de la collecte, c'est-à-dire la conservation des versions, des horodatages et des adresses d'origine, cesse d'être une hygiène interne pour devenir une partie du livrable.

Cette exigence pèse sur l'outillage. Le besoin n'est pas de produire davantage de résumés mais de conserver un chemin vérifiable entre chaque affirmation et son origine. NewsCore (www.newscore.fr) couvre en continu des millions de sources dans des dizaines de langues, relie les reprises d'un même contenu entre elles et ramène chaque signal à sa source d'origine, ce qui raccourcit le délai entre la détection et la décision. La formulation du besoin et l'arbitrage final restent le travail de l'organisation.

Protocole d'observation, échantillon et limites de nos constats

Nos constats sur les corpus reposent sur un relevé d'attributs documentaires : existence d'une règle de déduplication, unité de comptage retenue dans les livrables, présence d'un horodatage de première occurrence, présence d'un statut par ligne. L'unité d'enregistrement est le dispositif, jamais l'analyste, et les attributs sont binaires afin d'éviter toute appréciation de maturité.

Les limites sont assumées. L'échantillon surreprésente les dispositifs déjà formalisés, puisque documenter ses règles suppose d'en avoir. Les valeurs relevées décrivent des pratiques déclarées et vérifiées sur pièces, pas des performances de détection. Enfin, aucun de ces constats ne se transpose au fonctionnement interne d'un modèle génératif : le parallèle proposé ici est un raisonnement de conception, pas un résultat expérimental.

Questions fréquentes

Faut-il renoncer à l'IA générative pour la veille au vu de cette vulnérabilité ?

Non, mais il faut lui confier des tâches dont l'erreur est détectable. Le tri, le regroupement thématique, la traduction et la détection de reprises produisent des sorties vérifiables par recoupement immédiat avec les documents d'origine. En revanche, faire trancher une controverse factuelle au terme d'une conversation longue expose exactement au comportement mesuré par l'évaluation dont rend compte Mirage News. La règle pratique consiste à réinitialiser le contexte dès qu'une hypothèse a été discutée plusieurs fois.

Comment savoir si mon corpus surestime la concordance des sources ?

En comparant deux comptages sur un même sujet : le nombre de documents collectés et le nombre de sources primaires distinctes après déduplication par contenu. Un écart d'un ordre de grandeur signale un corpus dominé par la reprise. Le test se conduit en une heure sur un sujet passé et ne demande aucun outil supplémentaire : il suffit de remonter chaque document à sa première occurrence datée et d'éliminer les textes quasi identiques.

Que faut-il conserver pour qu'une collecte reste défendable en cas de contestation ?

L'adresse d'origine, la date et l'heure de collecte, une capture de la page telle qu'elle se présentait alors, et la trace des modifications ultérieures lorsqu'elles sont détectables. Cet ensemble constitue une chaîne de garde documentaire minimale. Elle ne transforme pas un article de veille en pièce probante, mais elle permet de démontrer ce qui était accessible, à quelle heure et sous quelle forme, ce qui est exactement le point sur lequel portent les contestations.

Sources

Pour approfondir