mercredi 7 octobre 2026
Baromètres

Baromètre du marquage des contenus générés par IA sur les sites d'actualité francophones

Depuis le 2 août 2026, un contenu produit par IA doit porter un marquage. Que voit-on réellement sur les sites d'actualité, et comment le mesurer ?

L'Observatoire2 septembre 20267 min de lecture

À retenir

  • L'article 50 du règlement européen sur l'IA impose depuis le 2 août 2026 un marquage visible et un filigrane technique sur les contenus générés ou modifiés par IA, rappelle Pôle d'excellence cyber.
  • Le marquage se mesure sur trois plans distincts : mention lisible, métadonnée persistante, filigrane résistant aux transformations. Les trois ne coïncident presque jamais.
  • Un baromètre du marquage mesure la conformité déclarative des acteurs de bonne foi, jamais la présence d'IA dans un contenu.
  • Les contenus hostiles restent hors du champ : les opérations décrites par RTBF imitent des rédactions existantes et n'ont aucune raison de se signaler.

Depuis le 2 août 2026, une obligation nouvelle pèse sur les producteurs de contenus en Europe. Pôle d'excellence cyber rappelle que l'article 50 du règlement européen sur l'intelligence artificielle impose d'informer clairement l'utilisateur qu'il dialogue avec une intelligence artificielle, et que les contenus générés ou modifiés par IA doivent porter un marquage visible ainsi qu'un filigrane technique, une échéance du 2 décembre étant prévue pour les outils déjà présents sur le marché.

Une obligation crée une matière observable. Elle rend mesurable ce qui, jusqu'ici, relevait de la déclaration volontaire : la part des contenus d'actualité qui se signalent comme assistés ou produits par une machine. Ce baromètre décrit le protocole que nous employons pour observer cette part sur un échantillon de sites d'actualité francophones, les trois plans de mesure qu'il faut séparer, et surtout ce que l'indicateur ne dit pas.

Une précaution s'impose d'emblée. Un baromètre du marquage n'est pas un baromètre de l'usage de l'IA dans les rédactions. Il mesure une pratique déclarative chez des acteurs identifiés, soumis au droit européen et attachés à leur réputation. La proportion réelle de contenus assistés par une machine reste inaccessible à l'observation externe, et aucune valeur produite ici ne doit être lue comme telle.

Ce que l'obligation de marquage recouvre exactement

Le texte européen distingue deux situations souvent confondues. La première concerne l'interaction : un utilisateur qui échange avec un système conversationnel doit savoir qu'il ne parle pas à une personne. La seconde concerne le contenu produit : image, son, vidéo ou texte généré ou modifié par un système, qui doit être identifiable comme tel. Sur un site d'actualité, seule la seconde situation est massivement en jeu.

Pôle d'excellence cyber précise le cadre de contrôle : le Bureau européen de l'IA travaille avec les autorités nationales, en France la CNIL, la DGCCRF et l'Arcom, et dispose de pouvoirs d'investigation allant jusqu'à l'accès à la documentation technique, aux données d'entraînement et au code source. Les manquements de transparence exposent à des sanctions pouvant atteindre 15 millions d'euros ou 3 % du chiffre d'affaires mondial, ce qui donne à la mesure de conformité une portée concrète.

Protocole d'observation : échantillon, unité de mesure, définitions

L'unité de mesure retenue est la page d'article, non le site. Un média peut marquer scrupuleusement ses illustrations de synthèse et ne rien signaler sur ses résumés automatiques : mesurer au niveau du site écraserait cette différence. Chaque page de l'échantillon est examinée sur trois plans indépendants, la mention lisible par un humain, la métadonnée présente dans le fichier ou dans le balisage, et le filigrane inscrit dans le signal lui-même.

L'échantillon est constitué par tirage sur les flux publics de sites d'actualité francophones, en veillant à répartir les prélèvements sur les jours de la semaine et sur les rubriques. La composition compte autant que la taille : un échantillon composé de grandes rédactions nationales décrit la conformité des acteurs les mieux dotés, pas l'état du web d'information. Nous stratifions donc par taille d'organisation et par type de site.

Le rythme de prélèvement est fixé avant la première campagne et ne varie plus. Deux prélèvements hebdomadaires suffisent à suivre une tendance sans saturer le travail de constat, à condition de conserver les pages capturées : une page d'article se modifie après publication, et une mention ajoutée trois jours plus tard ne se distingue d'une mention initiale qu'à partir d'un archivage daté. Cette contrainte d'archivage est la partie la plus lourde du protocole, et celle sans laquelle rien n'est vérifiable par un tiers.

Les trois formes de marquage et leur valeur probante

Forme de marquageOù elle se constateValeur probante
Mention lisibleLégende, chapeau, encadré de fin d'articleForte pour le lecteur, nulle en cas de reprise du contenu seul
Métadonnée descriptiveChamps du fichier image, balisage de la pageMoyenne, disparaît au premier recadrage ou export
Filigrane techniqueSignal lui-même, image, son ou vidéoForte si l'outil de lecture existe, invisible sans lui
Absence de marquageAucun des trois plansNe prouve rien sur l'origine du contenu

La dernière ligne du tableau est la plus importante. L'absence de marquage se constate, elle ne s'interprète pas : elle recouvre aussi bien un contenu entièrement humain qu'un contenu généré non déclaré. Un baromètre honnête publie donc trois taux, marquage complet sur les trois plans, marquage partiel, absence constatée, et se garde de convertir le troisième en estimation d'usage clandestin.

Le filigrane technique : ce qu'il survit et ce qu'il ne survit pas

Le filigrane est présenté comme la réponse robuste au problème de traçabilité, et il l'est comparé à une simple légende. Sa robustesse reste toutefois relative à des transformations précises. Une capture d'écran, une recompression agressive, un recadrage serré ou une conversion de format dégradent le signal à des degrés très variables selon la technique employée, et le contenu circule ensuite sans porter la marque qu'il portait à l'origine.

Cette fragilité a une conséquence directe sur le protocole : le taux de marquage mesuré à la publication n'est pas le taux de marquage constaté après circulation. Nous mesurons donc les deux, sur les mêmes contenus, à quelques jours d'intervalle, en suivant les reprises. L'écart entre les deux valeurs constitue à lui seul un indicateur intéressant, celui de la persistance du marquage dans l'écosystème réel.

Un marquage qui ne survit pas à une capture d'écran informe le premier lecteur et personne d'autre.

L'angle mort du baromètre : les contenus qui ne seront jamais marqués

La limite structurelle de tout indicateur de conformité tient à ce qu'il ne mesure que les acteurs qui cherchent à se conformer. RTBF décrit deux opérations qui illustrent l'autre versant du problème : Matriochka, qui exploite des comptes factices imitant des médias occidentaux crédibles avec des contenus générés par IA repris sous des logos de rédactions existantes, et Storm-1516, qui diffuse des vidéos et des montages générés par IA faussement attribués à des médias traditionnels et à des personnalités publiques.

Un acteur dont la stratégie repose sur l'usurpation d'identité éditoriale n'a évidemment aucune raison d'apposer un marquage. Pour une équipe de veille, l'enjeu se déplace donc du marquage vers la traçabilité de la reprise. NewsCore (www.newscore.fr) couvre en continu des millions de sources, repère les reprises d'un même contenu sous des identités éditoriales différentes et fait remonter chaque occurrence avec son adresse d'origine. La qualification finale, elle, reste un travail d'analyste.

Ce que le baromètre ne mesure pas, et sa reproductibilité

Trois limites doivent accompagner toute publication de ces taux. Le baromètre ne détecte pas l'IA, il constate une déclaration. Il ne couvre pas les formats non indexables, messageries et fichiers échangés de proche en proche, où circule une part importante des contenus. Il ne préjuge pas de la sincérité du marquage, un contenu pouvant être signalé comme assisté alors qu'il est intégralement généré, ou l'inverse.

La reproductibilité tient au caractère public de l'échantillon et à la publication des règles de constat. Un tiers qui prélève les mêmes pages aux mêmes dates, avec les mêmes définitions des trois plans, doit retrouver les mêmes taux à la marge d'erreur d'échantillonnage près. Nous publions donc les critères de constat avant les résultats, ce qui interdit d'ajuster la définition après avoir vu les chiffres.

Questions fréquentes

Un article de presse doit-il indiquer qu'il a été écrit avec de l'intelligence artificielle ?

Le cadre européen porte sur les contenus générés ou modifiés par un système d'IA, qui doivent être identifiables comme tels selon Pôle d'excellence cyber. La difficulté pratique tient au continuum entre assistance et génération : correction, traduction, résumé et rédaction complète ne se situent pas au même endroit. Les rédactions qui traitent bien le sujet publient une politique explicite décrivant quels usages donnent lieu à mention.

Comment reconnaître un contenu généré par IA sans marquage ?

Aucune méthode externe ne donne de certitude, et c'est pour cette raison que le baromètre mesure le marquage plutôt que la génération. Les indices exploitables sont contextuels plutôt que textuels : ancienneté du nom de domaine, cohérence de l'identité éditoriale, présence du même contenu sous plusieurs signatures, absence de source primaire vérifiable. La convergence de plusieurs indices vaut mieux qu'un verdict d'outil.

Quelles sanctions sont encourues en cas de défaut de marquage ?

Pôle d'excellence cyber indique que les manquements aux obligations de transparence exposent à des sanctions pouvant atteindre 15 millions d'euros ou 3 % du chiffre d'affaires mondial, et que les pratiques interdites relèvent d'un plafond supérieur, 35 millions d'euros ou 7 %. La même source rappelle une obligation moins commentée : démontrer que les équipes comprennent les capacités, limites et risques des systèmes utilisés.

Le marquage protège-t-il contre la désinformation générée par IA ?

Il agit sur les acteurs conformes, pas sur les acteurs hostiles. RTBF rapporte que les agents de propagande ne se contentent plus des réseaux sociaux et visent désormais les moteurs de recherche et les modèles de langage, avec des travaux de NewsGuard faisant état de 34 à 37 % de réponses contaminées en anglais sur le conflit russo-ukrainien et de plus de 50 % en russe et en chinois. Le marquage éclaire une partie du terrain, il n'en couvre pas la totalité.

Pour approfondir