Note de méthode : vérifier l'origine d'un contenu suspecté d'être généré par IA
Un contenu suspecté d'être généré par IA se vérifie par un protocole gradué : indices déclaratifs, techniques et contextuels, puis conclusion motivée plutôt que verdict binaire rendu trop vite.
À retenir
- Origine, authenticité et véracité sont trois questions distinctes, qui appellent trois examens séparés et trois conclusions distinctes.
- Depuis le 2 août 2026, l'article 50 du règlement européen sur l'IA impose d'informer l'utilisateur et de marquer les contenus générés, rapporte le Pôle d'excellence cyber.
- L'absence de marquage est un indice, jamais une preuve : elle se consigne comme une observation.
- La conclusion se formule en niveaux, établie, probable ou indéterminée, avec les éléments qui la fondent.
Une équipe de veille reçoit régulièrement une pièce dont l'origine fait doute : un texte trop régulier, une image dont un détail cloche, une voix vraisemblable dans un enregistrement invérifiable. La tentation est de trancher vite, dans un sens ou dans l'autre, puis de passer à la suite. C'est la principale cause d'erreur documentée sur ce type de dossier : la conclusion binaire précède l'examen, et sélectionne ensuite les indices qui la confirment.
Cette note de méthode décrit le protocole appliqué par l'Observatoire de l'Intelligence Économique pour établir l'origine d'un contenu suspecté d'être généré ou modifié par un système d'intelligence artificielle. Elle sépare les questions, hiérarchise les indices disponibles, fixe des niveaux de conclusion et énonce les limites de l'exercice. Elle intervient dans un contexte réglementaire nouveau, qui modifie la valeur probante de certains indices sans les transformer en preuves.
Origine, authenticité, véracité : trois questions à ne pas fusionner
L'origine porte sur le mode de production du contenu : produit par un humain, généré par un système, ou modifié par un système à partir d'un original humain. L'authenticité porte sur la correspondance entre le contenu et ce qu'il prétend être : cette photographie montre-t-elle bien ce lieu à cette date. La véracité porte sur le fait allégué : l'événement décrit a-t-il eu lieu. Les trois questions sont indépendantes, et leur confusion produit les erreurs les plus embarrassantes d'un dossier de vérification.
Un exemple suffit à le montrer. Une illustration entièrement générée qui accompagne un communiqué exact ne rend pas ce communiqué faux : elle en compromet l'authenticité visuelle, pas la véracité du fait rapporté. Inversement, une photographie authentique, prise par un humain, sert couramment à documenter un événement qui n'a pas eu lieu, par simple recontextualisation. Le protocole traite donc l'origine comme une question autonome, avec ses propres indices et sa propre conclusion, avant toute appréciation du fond.
Cette séparation a une conséquence pratique sur la rédaction des livrables. Un rapport de vérification comporte trois rubriques distinctes, et une conclusion par rubrique. Le lecteur qui n'a que quelques secondes doit voir immédiatement ce qui est établi et ce qui ne l'est pas, sans avoir à démêler une phrase unique où l'origine, la datation et le fond seraient mélangés. Les demandes d'arbitrage qui reviennent en boucle vers l'équipe de veille tiennent presque toujours à ce défaut de découpage.
Ce que l'obligation européenne de marquage change pour la vérification
Le cadre a changé cet été. Depuis le 2 août 2026, l'article 50 du règlement européen sur l'intelligence artificielle impose d'informer clairement l'utilisateur qu'il dialogue avec une intelligence artificielle, et exige que les contenus générés ou modifiés par un système portent un marquage visible ainsi qu'un filigrane technique, rapporte le Pôle d'excellence cyber. Une échéance du 2 décembre est prévue pour les outils déjà présents sur le marché. Les manquements de transparence exposent à des sanctions atteignant 15 millions d'euros ou 3 pour cent du chiffre d'affaires mondial.
La même source décrit la gouvernance mise en place : le Bureau européen de l'intelligence artificielle travaille avec les autorités nationales, en France la CNIL, la DGCCRF et l'Arcom, et dispose de pouvoirs d'investigation incluant l'accès à la documentation technique, aux données d'entraînement et au code source. Le Pôle d'excellence cyber signale par ailleurs une obligation de compétence : les organisations doivent démontrer que leurs équipes comprennent les capacités, les limites et les risques des systèmes d'intelligence artificielle qu'elles utilisent, point vérifiable lors d'un contrôle.
Pour un vérificateur, la conséquence est double et se formule avec prudence. La présence d'un marquage conforme devient un indice fort d'origine générée, exploitable directement et rapidement. Son absence, en revanche, n'établit rien : elle recouvre aussi bien un contenu humain qu'un contenu généré par un outil non conforme, produit hors du champ d'application territorial, ou dont le filigrane a été détruit par un simple recadrage ou une réexportation. L'absence de marque se consigne comme une observation, jamais comme une conclusion.
Hiérarchiser les indices : déclaratif, technique, contextuel
Le protocole classe les indices en trois niveaux, examinés dans cet ordre. Les indices déclaratifs viennent du contenu lui-même ou de son publiant : mention de génération, marquage visible, métadonnées de provenance renseignées, déclaration explicite de l'auteur. Ils sont les plus faciles à collecter et les plus faciles à falsifier, ce qui impose de les consigner avec leur source plutôt que de les tenir pour acquis. Un marquage revendiqué se vérifie sur le fichier, pas sur la page qui l'affiche.
Les indices techniques portent sur le fichier : structure des métadonnées, cohérence des paramètres d'enregistrement, traces de réencodage, présence d'un filigrane détectable, régularités statistiques du texte. Ils demandent un outillage et une compétence, et leur valeur dépend entièrement de la conservation du fichier d'origine. Un contenu récupéré après passage par une plateforme de diffusion a généralement perdu ses métadonnées et subi une recompression, ce qui neutralise une bonne partie de ces indices avant même le début de l'examen.
Les indices contextuels, souvent négligés, sont les plus robustes en pratique. Ils portent sur le compte publiant, sa date de création, son historique, la cohérence entre le contenu et l'activité antérieure, la présence du même contenu ailleurs et antérieurement, l'existence d'une source primaire vérifiable. Un contenu généré s'insère rarement dans une trajectoire de publication cohérente, et c'est cette incohérence, davantage que l'analyse du fichier, qui emporte la conclusion dans la majorité des dossiers traités.
Formuler une conclusion graduée plutôt qu'un verdict binaire
Le protocole n'autorise que quatre conclusions, chacune assortie des éléments qui la fondent. Origine générée établie : marquage conforme vérifié sur le fichier, ou reconnaissance explicite d'un publiant identifié. Origine générée probable : convergence d'au moins deux indices techniques et d'un indice contextuel, sans marquage. Origine indéterminée : indices insuffisants ou contradictoires. Origine humaine probable : source primaire retrouvée, antériorité établie, auteur joignable. Aucune de ces conclusions n'est réversible sans pièce nouvelle versée au dossier.
Cette gradation a un coût organisationnel, celui d'assumer l'indétermination devant un demandeur qui attend une réponse nette. C'est pourtant la seule position tenable : sur ce type de dossier, une conclusion ferme rendue sur des indices faibles se retourne systématiquement contre l'équipe lorsqu'une pièce nouvelle apparaît. Le protocole prévoit donc que la mention indéterminée soit accompagnée de la liste des éléments qui permettraient de conclure, ce qui transforme une non réponse en programme de vérification daté.
L'absence de filigrane ne prouve pas qu'un contenu est humain, elle prouve seulement qu'aucun filigrane n'a survécu jusqu'à nous.
Limites des détecteurs et conditions de reproductibilité
Les détecteurs automatiques d'origine appellent une réserve constante. Leur performance annoncée est mesurée sur des corpus d'évaluation dont la composition ne ressemble pas au flux réel, et elle se dégrade sur les contenus courts, traduits, retouchés ou produits par des systèmes plus récents que le détecteur lui-même. Un score de probabilité n'est pas une preuve d'origine, et son report dans un rapport sans mention de la version du détecteur, de la date d'exécution et de la nature du fichier soumis le rend ininterprétable.
La reproductibilité s'obtient par la conservation du fichier soumis, de son empreinte, de la version de chaque outil utilisé et de la date d'exécution, dans un registre qu'un tiers rejoue à l'identique. Sur l'amont, l'outillage de collecte compte autant : NewsCore (www.newscore.fr) couvre en continu des millions de sources, remonte les signaux en temps réel et conserve le lien direct vers la publication d'origine, ce qui donne au vérificateur l'antériorité et le contexte nécessaires à l'examen. La conclusion, elle, revient à l'analyste.
L'obligation de marquage ne vit pas seule : elle s'appuie sur des dispositifs de plateforme dont la fiabilité est elle-même contrôlée. eucrim rappelle que la Commission européenne a ouvert le 26 janvier 2026 une enquête formelle visant le déploiement de l'outil d'IA Grok au sein de X et les systèmes de recommandation de la plateforme, après avoir sanctionné cette dernière de 120 millions d'euros le 5 décembre 2025, notamment pour une conception trompeuse de la coche bleue. Pour le vérificateur, la conséquence est pratique : un indicateur affiché par une plateforme est une déclaration, pas une preuve, et il se recoupe comme telle.
Questions fréquentes
Comment savoir si un texte a été généré par une intelligence artificielle ?
Aucun examen ne donne de certitude sur un texte court isolé. La démarche fiable combine trois familles d'indices : ce que déclare le contenu et son publiant, ce que révèle le fichier ou la page, et ce que montre le contexte de publication. Les régularités stylistiques constituent un indice faible, très sensible à la longueur et à la langue du texte. La conclusion se formule ensuite en niveaux, origine établie, probable ou indéterminée, avec les éléments qui la fondent.
Le marquage obligatoire des contenus générés rend-il la vérification inutile ?
Non, il en déplace le point d'appui. Un marquage conforme et vérifié sur le fichier constitue un indice fort et fait gagner beaucoup de temps. Son absence n'établit rien, car un contenu produit hors du champ d'application, par un outil non conforme, ou simplement recadré puis réexporté, se présente sans marque. Le marquage réduit donc le nombre de dossiers difficiles, il ne supprime pas le besoin d'un protocole d'examen pour ceux qui restent.
Que faire quand l'origine d'un contenu reste indéterminée ?
L'indétermination se documente et se publie comme telle. Le dossier consigne les indices collectés, ceux qui manquent et la liste des éléments qui permettraient de conclure, par exemple l'obtention du fichier d'origine ou le contact avec l'auteur supposé. En attendant, le contenu est traité selon son usage : il n'est ni cité comme authentique, ni dénoncé comme fabriqué. Cette réserve est une position professionnelle documentée, pas un échec de l'examen.