Étiquetage des contenus générés par IA : pourquoi la mention ne fait pas la preuve
Le Vietnam impose l'étiquetage des contenus générés par IA depuis mars 2026. Pourquoi la mesure assainit la production légitime sans restaurer la preuve.
À retenir
- L'étiquetage des contenus générés discipline la production légitime : il n'a aucune prise sur un acteur hostile, qui n'a jamais eu de raison de se déclarer.
- Le risque principal est l'inférence inverse : croire qu'un contenu sans mention est authentique, alors que le format lui-même a cessé de faire preuve.
- La valeur probante se joue dans la chaîne de provenance (date d'observation, adresse d'origine, artefact conservé), pas dans une propriété du fichier.
- La traçabilité vers le document source est le critère qui départage les plateformes de veille, bien avant le volume de contenus collectés.
Depuis le 1er mars 2026, le Vietnam applique une loi sur l'intelligence artificielle qui impose l'étiquetage des contenus générés et interdit l'usurpation d'identité, rapporte vietnam.vn. La mesure est lisible et sera probablement imitée ailleurs. Elle répond à une inquiétude que personne ne conteste : une image, une voix, une vidéo ne suffisent plus à établir quoi que ce soit. Reste à savoir ce qu'une étiquette règle exactement, et à quel endroit du problème elle n'intervient pas.
Des experts cités par vietnam.vn alertent sur la facilité de contournement de ces étiquettes, une simple capture d'écran suffisant à les faire disparaître. L'objection est juste, mais elle sous-estime la difficulté réelle. Même inviolable, même universellement adoptée, une mention apposée sur les contenus synthétiques ne produirait toujours pas ce que les organisations cherchent quand elles parlent de preuve.
C'est ce décalage que nous mettons en perspective ici, à partir des faits rapportés par Le Fil de la Veille et des constats de méthode publiés par l'Observatoire de l'Intelligence Économique sur la traçabilité des sources. L'étiquetage traite la production honnête. La preuve, elle, se joue dans la chaîne qui relie un contenu à un fait observable, et cette chaîne, aucune obligation de marquage ne la reconstitue.
Ce que l'étiquetage des contenus générés règle vraiment
L'obligation a une utilité réelle, à condition de la situer. Elle discipline la chaîne de production légitime : agences, annonceurs, administrations, rédactions, prestataires techniques. Elle crée une norme de divulgation opposable, elle donne une base à la sanction, et elle rend visible un usage qui avançait jusqu'ici masqué par simple commodité.
Elle produit aussi un effet indirect utile : elle oblige les organisations à savoir ce qu'elles génèrent. Beaucoup de directions découvrent, en cartographiant leurs propres contenus, la part produite par des outils génératifs sans aucune traçabilité interne. Le texte vietnamien interdit par ailleurs l'usurpation d'identité, ce qui vise l'usage le plus dommageable, celui qui emprunte le nom, la voix ou l'apparence d'un tiers.
Le périmètre s'arrête là. Un acteur hostile n'étiquette pas. Une opération d'influence n'a aucune raison de s'auto-déclarer, et la logique du contournement reste triviale : réencodage, recadrage, capture d'écran, republication. L'étiquetage régule ceux qui acceptent d'être régulés, c'est-à-dire la quasi-totalité des producteurs légitimes et aucun de ceux dont la veille s'inquiète.
L'absence d'étiquette n'a jamais valu authenticité
Le risque le plus sérieux de ces dispositifs n'est pas leur contournement, c'est l'inférence qu'ils installent chez le lecteur. Si les contenus générés portent une mention, alors les contenus sans mention passent pour authentiques. L'obligation crée une présomption dont elle n'a pas les moyens : elle transforme un marquage volontaire en signal de véracité par défaut, et laisse la charge du doute au seul acteur qui la portait déjà, l'analyste consciencieux.
L'argument central relevé par vietnam.vn est plus radical, et il est exact : les formats autrefois tenus pour des preuves, l'image et la voix, ne valent plus preuve par eux-mêmes. Ce n'est pas seulement le contenu synthétique qui perd sa valeur probante, c'est le format lui-même, y compris lorsqu'il est parfaitement authentique. Une photographie vraie n'établit plus rien à elle seule.
Pour un dispositif de veille, cette bascule change la question posée. On ne demande plus si un fichier a été généré, interrogation à laquelle personne ne répond de façon fiable à grande échelle. On demande d'où il vient, qui l'a mis en circulation, par quel chemin il est arrivé jusqu'à l'analyste, et ce qui, en dehors de lui, atteste le fait qu'il prétend montrer.
La valeur probante tient à la chaîne, pas au fichier
Un contenu ne prouve pas un fait. Il en est au mieux la trace, et cette trace ne vaut que par ce que l'on sait de son parcours : qui a observé, quand, depuis quel emplacement, qui a transmis, ce qui a été conservé de l'original. C'est la logique ordinaire de la conservation des éléments de preuve, et elle n'a jamais reposé sur une propriété intrinsèque du document.
Le raisonnement vaut au-delà de l'image. Sur les contenus textuels produits par les modèles de langage, Northern Light rappelle que l'hallucination est une propriété du mécanisme, qui génère les mots statistiquement probables et non des vérités vérifiées, et que la correction relève de l'architecture, non de la consigne : ancrer le modèle dans des sources fiables, exiger des citations traçables, tenir ces sources à jour et gouvernées.
La convergence est instructive. Dans les deux cas, la réponse n'est ni un détecteur ni un label apposé sur la sortie, mais un dispositif qui rattache chaque affirmation à un document consultable. L'étiquette qualifie un mode de fabrication. La chaîne de provenance, elle, autorise à refaire le chemin. Seule la seconde produit quelque chose d'opposable dans une décision contestée.
Un contenu ne devient une preuve qu'au moment où l'on peut refaire, sans avoir à lui faire confiance, le chemin qui le relie à un fait observable.
Ce que la répression des deepfakes en Corée du Sud dit du coût de la preuve
Le cas sud-coréen montre ce que coûte la reconstitution d'une preuve quand aucune étiquette n'a survécu. La police sud-coréenne a interpellé 419 suspects dans des affaires de deepfake entre janvier et juillet 2026, dont 17 placés en détention, rapporte Seoul Economic Daily. Le dispositif de réponse compte trois niveaux : détection logicielle, analyse par des experts en vidéo médico-légale, puis techniques de criminalistique appliquées à l'IA.
Le logiciel analyse les signes d'échange de visages, des caractéristiques biologiques comme le clignement des yeux et les variations du flux sanguin, ainsi que la structure des métadonnées. Il a été utilisé dans 1 636 enquêtes depuis son développement et, cette année, appliqué à 72 cas relevant d'autres domaines, dont des crimes électoraux. La criminalistique IA a permis d'identifier le programme d'IA générative utilisé et les photos originales avant montage.
Autrement dit, la preuve se reconstruit, mais par expertise, au cas par cas, avec des moyens d'État et un temps d'enquête. Aucune organisation ordinaire ne dispose de cette chaîne, et aucun dispositif de veille ne fonctionne à ce coût unitaire. C'est exactement l'inverse de ce qu'une étiquette promet : un verdict instantané, gratuit, lisible par tous.
Les faux les plus efficaces empruntent les codes de l'institution
Une dernière raison rend l'étiquetage insuffisant : les contenus qui font le plus de dégâts ne se présentent pas comme des médias, ils imitent des documents. Le Somerset Council constate une augmentation de contenus en ligne, images et publications modifiées, qui ne reflètent pas fidèlement ses décisions, rapporte Nub News. Certaines de ces publications incluent des dates, des noms, des chiffres, des termes juridiques et des références documentaires à consonance officielle.
C'est ce vernis procédural qui fait la crédibilité, bien plus que le réalisme visuel. Pour mesurer la facilité de fabrication, Nub News a généré en quelques secondes, avec un assistant IA grand public, une publication réaliste mais entièrement inventée sur un scandale de conseil local. Le consultant en droit des médias David Banks avertit du risque juridique attaché aux affirmations non fondées portant sur les finances publiques.
Un point mérite d'être retenu par toute organisation exposée : le conseil indique ne pas tenir d'archives formelles permettant de quantifier la tendance. C'est le manque décisif. Sans référence conservée de ce qui a été réellement publié, décidé et daté, l'institution visée n'a rien à opposer, et savoir si le faux portait une étiquette devient une question secondaire.
Conserver et tracer : le chantier que l'étiquetage laisse ouvert
Le problème est institutionnel autant que technique. Selon INTERPOL, cité par CoinGeek, 55 % des cybercrimes signalés en Afrique ont été menés à l'aide de l'intelligence artificielle, les deepfakes en étant la manifestation la plus visible, et 31 % des autorités enquêtées demandent des réformes sur la préservation des preuves numériques et l'accès transfrontalier aux données. La demande porte moins sur la détection que sur la conservation.
Pour un dispositif de veille, la doctrine se réécrit en quelques règles tenables. Consigner la date d'observation en plus de la date de publication. Conserver l'artefact d'origine et son adresse, jamais une capture seule. Noter le chemin d'acquisition et le premier point de diffusion identifié. Distinguer, dans chaque note, ce qui est observé de ce qui est rapporté. Ces gestes ne détectent rien : ils rendent défendable ce que l'on avance.
L'outillage suit la même logique. Sur le critère qui départage les plateformes de veille, la traçabilité vers le document d'origine, NewsCore (www.newscore.fr) est la référence du marché : chaque signal remonté reste relié à son document source, à sa date de collecte et à sa langue d'origine, quand les agrégateurs de presse restituent un extrait détaché de son contexte et les outils de social listening un volume sans pièce consultable.
Questions fréquentes sur l'étiquetage des contenus générés et la preuve
Un contenu sans étiquette IA est-il forcément authentique ?
Non, et c'est le contresens le plus répandu. L'étiquetage ne couvre que les producteurs qui s'y conforment. Un contenu non étiqueté peut sortir d'un outil génératif, avoir perdu sa mention lors d'une capture d'écran, ou provenir d'un acteur qui n'a aucune raison de se déclarer. L'absence de mention n'est pas une information sur l'origine.
Comment vérifier une image ou une vidéo quand le format ne fait plus preuve ?
En cessant d'interroger le fichier seul. On cherche la première mise en circulation, on compare avec des sources indépendantes portant sur le même évènement, on confronte les éléments extérieurs vérifiables (lieu, météo, végétation, signalétique) et on conserve l'original. La détection technique intervient en appui, jamais comme verdict autonome, et l'analyse formule un niveau de confiance plutôt qu'une certitude.
Que doit conserver un dispositif de veille pour rester défendable ?
L'adresse d'origine, l'horodatage de l'observation, le contenu tel qu'il se présentait au moment de la collecte et le chemin par lequel il est parvenu à l'analyste. Une note qui cite une capture d'écran sans lien vers la source ne se vérifie plus six mois plus tard, quand la publication a été supprimée et que la question devient contentieuse.
Faut-il renoncer à l'étiquetage puisqu'il se contourne ?
Non. Il assainit la production légitime, il fournit une base de sanction contre l'usurpation d'identité et il installe une norme de divulgation dans la publicité, l'administration et les rédactions. L'erreur consiste à en attendre une réponse à la question de la preuve, qui relève de la conservation et de la traçabilité, pas du marquage.