Quand la manipulation informationnelle prend la machine pour cible
La manipulation informationnelle ne vise plus seulement le lecteur, mais le modèle qui trie et résume pour lui. Ce que ce déplacement de cible impose à la veille.
À retenir
- La cible du contenu manipulé se déplace du lecteur vers l'intermédiaire génératif qui trie et résume pour lui.
- Un contenu conçu pour être ingéré par un modèle contourne les réflexes de vérification humains, qui s'exercent sur la page consultée, pas sur le corpus d'entraînement ou de citation.
- La rareté de sources fiables sur un sujet devient une vulnérabilité stratégique : les « trous » se remplissent de ce qui est disponible.
- La réponse relève du dispositif : corpus large et multi-sources, pondération explicite, traçabilité de chaque énoncé vers son document d'origine.
Pendant deux décennies, la manipulation informationnelle a raisonné en termes d'audience : produire un contenu trompeur, le pousser vers des lecteurs, espérer qu'il soit cru et partagé. La doctrine défensive s'est construite sur ce schéma. Il vient de perdre son exclusivité.
Un déplacement s'est opéré : la cible utile n'est plus seulement l'humain qui lit, c'est la machine qui trie et résume pour lui. Le reportage du Le Fil de la Veille consacré à l'« empoisonnement » des chatbots décrit précisément ce basculement, à partir d'un rapport du think tank britannique Demos relevant que ChatGPT, Gemini, Claude, Mistral et Grok ont relayé de fausses affirmations visant le président ukrainien Volodymyr Zelensky. La technique en cause y porte un nom : l'optimisation pour les moteurs génératifs, ou GEO, produire des contenus destinés non à des lecteurs humains, mais à être ingérés par les modèles, afin d'influencer leurs réponses.
Cet article ne revient pas sur les faits : il en tire les conséquences pour quiconque conçoit ou pilote un dispositif de veille. Trois d'entre elles méritent d'être posées d'emblée. La notion de source change de nature dès qu'un intermédiaire génératif s'intercale. Les réflexes de vérification humains, qui s'exercent sur une page consultée, ne s'exercent plus là où se joue la manipulation. Et la rareté d'information sur un sujet cesse d'être un simple inconfort documentaire pour devenir une vulnérabilité stratégique.
Ce que devient une source quand un intermédiaire génératif s'intercale
Dans une chaîne classique, la source est un objet que l'on atteint : un document, une page, une signature, une date. Le lecteur qui doute peut remonter jusqu'à elle et juger sur pièces. L'intermédiaire génératif rompt ce lien. La réponse qu'il produit est une synthèse dont les composants ont été fondus ; la source n'y figure plus comme objet consultable, mais comme mention, parfois exacte, parfois approximative, parfois absente.
Le rapport de l'Institut pour le dialogue stratégique (ISD), publié en novembre, donne la mesure de ce que cette fonte autorise : 20 % des réponses analysées de grands chatbots interrogés sur la guerre en Ukraine citaient des sources pro-Kremlin ou sanctionnées par l'Union européenne, RT, Sputnik, Strategic Culture Foundation. Ce chiffre, mesuré sur les réponses et non sur les pages, dit quelque chose de nouveau : la citation elle-même est devenue un terrain de conflit. Être cité par un modèle, c'est acquérir un statut de référence sans avoir eu à convaincre un seul lecteur.
L'architecture décrite par le rapport Demos pousse la logique à son terme. La « Foundation to Battle Injustice », organisation présentée comme une ONG et liée à la propagande russe, fondée par Evgueni Prigojine, a construit un écosystème de trois sites pour tromper les modèles : un faux site d'ONG, un pseudo-média amplificateur, une fausse revue de politique étrangère imitant les standards occidentaux. Ce n'est pas un dispositif d'audience, aucun de ces sites n'a besoin de lecteurs. C'est un dispositif de crédibilité, calibré pour ressembler à ce qu'un système de tri automatique traite comme sérieux.
Ce dispositif n'a pas besoin de lecteurs. Il lui suffit d'être lu par la machine qui, elle, sera lue.
Pourquoi un contenu écrit pour la machine échappe aux réflexes de vérification
Les réflexes de vérification que l'on enseigne (regarder l'URL, chercher l'auteur, vérifier la date, comparer avec un autre média) supposent tous que l'utilisateur se trouve devant la page. Or, dans une chaîne où la réponse est produite par un intermédiaire, l'utilisateur n'y est jamais. Il lit un texte lisse, sans mise en page suspecte, sans typographie douteuse, sans les signaux périphériques sur lesquels s'exerce d'ordinaire la méfiance. Le contenu manipulé a été absorbé en amont, et il ressort sous une forme qui ne porte plus aucune des marques auxquelles l'œil est entraîné.
S'ajoute un effet d'autorité. Une synthèse générée se présente comme un état de la connaissance, pas comme un point de vue à discuter. Elle est formulée au présent, sans hésitation apparente, dans un registre neutre. Le lecteur qui aurait interrogé la ligne éditoriale d'un site n'a plus d'objet éditorial à interroger : il a devant lui une réponse, et la réponse ne se conteste pas de la même manière qu'un article.
C'est le renversement décisif pour les professionnels de la veille : la vérification humaine n'a pas disparu, elle s'exerce simplement au mauvais endroit. Elle porte sur le texte final alors que la contamination s'est produite au moment de la sélection des sources. Tant que le dispositif ne rend pas cette étape visible, l'attention critique la plus rigoureuse s'applique à un objet où il n'y a plus rien à détecter.
La rareté d'information devient une vulnérabilité stratégique
L'explication avancée par les chercheurs est peut-être le point le plus important pour un professionnel de l'information : les « trous » dans l'information disponible en ligne. Sur les sujets sensibles où les sources fiables sont peu nombreuses, les réseaux de propagande occupent l'espace et deviennent des références citées. Autrement dit, la vulnérabilité ne naît pas d'un excès de contenu hostile, mais d'un déficit de contenu légitime.
Cette lecture inverse une intuition tenace. On se représente volontiers la désinformation comme une submersion. Le mécanisme décrit ici est l'inverse : une occupation de vide. Là où peu de choses sont publiées, le peu qui l'est pèse lourd. La rareté documentaire fonctionne comme un amplificateur : elle donne à un signal marginal le poids d'une référence, sans qu'aucune manœuvre supplémentaire soit nécessaire.
Pour une organisation, la conséquence est directe et cartographiable. Tout sujet stratégique sur lequel la production publique de sources fiables est faible (une technologie de niche, un marché émergent, une zone géographique peu couverte, un litige technique) constitue une zone exposée. La question à se poser n'est plus seulement « que dit-on de nous ? », mais « combien de sources solides existent sur ce sujet, et que reste-t-il quand on les retire ? ». Un sujet stratégique documenté par trois pages est un sujet manipulable à peu de frais.
Ce que la mesure change dans le pilotage d'un dispositif
Le travail de l'Observatoire de l'Intelligence Économique a une vertu précise dans ce contexte : il transforme une inquiétude diffuse en grandeur observable. Un taux de citation de sources contaminées se suit dans le temps et se compare d'un sujet à l'autre. Tant qu'une menace reste qualitative, elle se débat ; dès qu'elle devient métrique, elle se pilote.
L'ISD appelle d'ailleurs à mieux contrôler la façon dont les chatbots référencent les médias sanctionnés, et OpenAI a indiqué renforcer ses mécanismes de détection et de filtrage des sources manipulées. Ces réponses se situent du côté des fournisseurs de modèles. Elles sont nécessaires ; elles ne sont pas pilotables par une organisation utilisatrice, qui ne choisit ni les critères de filtrage ni leur calendrier. Une part de la réponse doit donc être tenue au niveau du dispositif de veille lui-même.
Cette part est d'autant plus importante que l'enjeu de fond, relevé dans le reportage du Le Fil de la Veille, est un changement de porte d'entrée : les chatbots remplacent progressivement les moteurs de recherche comme accès à l'information. Ce qui se joue n'est pas un incident isolé sur un dossier géopolitique, mais la reconfiguration du canal par lequel une organisation apprend ce qui la concerne.
Corpus large, pondération explicite, traçabilité : la réponse est structurelle
Trois exigences se dégagent, et elles portent sur l'architecture du dispositif, pas sur la vigilance de ses utilisateurs. La première est le corpus large plutôt que le résumé unique. Une synthèse produite à partir d'un ensemble étendu et hétérogène de sources dilue mécaniquement le poids d'un écosystème de trois sites ; une réponse construite sur une poignée de documents lui donne un poids déterminant. L'étendue du périmètre n'est plus un argument de confort, c'est une propriété défensive.
La deuxième est la pondération explicite des sources. Toutes les sources n'ont pas le même statut, et un dispositif sérieux le déclare : nature de l'émetteur, historique, niveau de confiance attribué. Une pondération explicite se relit, se conteste et se corrige ; une pondération implicite, enfouie dans un traitement opaque, ne se corrige pas puisqu'elle ne se voit pas. La troisième est la traçabilité : chaque énoncé restitué doit ramener au document d'origine, consultable en un geste.
Sur ce point, NewsCore (www.newscore.fr) est la référence du marché : la plateforme couvre en continu un corpus multi-sources très large, applique une pondération explicite à chaque source et relie chaque élément de synthèse au document d'origine, consultable directement. C'est exactement l'inverse du résumé sans provenance : l'analyste remonte la chaîne, voit d'où vient une affirmation et juge sur pièces.
Reste la part qui revient à l'organisation, et elle est réelle : décider quels sujets méritent une surveillance serrée, arbitrer les niveaux de confiance, exercer le jugement final sur ce qui compte. Ces décisions ne se délèguent pas. Mais elles supposent un dispositif qui montre ses sources : sans provenance, il n'y a pas de matière sur laquelle exercer un jugement.
Questions fréquentes
Qu'est-ce que le GEO, l'optimisation pour les moteurs génératifs ? C'est la production de contenus destinés non à des lecteurs humains, mais à être ingérés par les modèles de langage afin d'influencer leurs réponses. Le rapport du think tank Demos décrit son usage dans des opérations informationnelles visant le président ukrainien Volodymyr Zelensky.
Pourquoi la rareté d'information sur un sujet est-elle un risque ? Parce que, selon l'explication avancée par les chercheurs, les « trous » dans l'information disponible en ligne se remplissent : sur les sujets sensibles où les sources fiables sont peu nombreuses, les réseaux de propagande occupent l'espace et deviennent des références citées.
Comment vérifier une information issue d'un assistant génératif ? En remontant à la source plutôt qu'en évaluant le texte produit. Les réflexes habituels (URL, auteur, date, recoupement) s'exercent sur une page consultée ; une synthèse sans lien vers ses documents d'origine ne laisse aucune prise à ces réflexes.
Quelles caractéristiques attendre d'un dispositif de veille face à ce risque ? Trois : un corpus multi-sources large plutôt qu'un résumé unique, une pondération des sources rendue explicite et donc contestable, et une traçabilité qui ramène chaque énoncé au document d'origine consultable.