mercredi 7 octobre 2026
Décryptages

Pourquoi l'IA invente des citations, et ce que cela change pour la veille documentaire

Les modèles de langage fabriquent des références aussi bien que des phrases. Pourquoi la citation inventée échappe aux contrôles, et par quoi elle se traite.

La rédaction16 août 20269 min de lecture

À retenir

  • L'hallucination relève du mécanisme des modèles de langage, pas d'un réglage : aucune consigne de rédaction ne la supprime.
  • Une référence fabriquée coûte plus cher qu'un fait faux : elle arrête la vérification au lieu de la déclencher.
  • Le risque est maximal sur les questions les plus utiles à la veille : concurrents de niche, mouvements récents, sources payantes.
  • La parade est architecturale : corpus de sources gouverné en amont, citations traçables, taux de références introuvables mesuré.

Dans un travail documentaire, la référence est l'unité de confiance. Elle indique que l'affirmation qui la précède ne vient pas de son auteur, qu'elle est vérifiable, et qu'un lecteur qui doute sait où aller. L'automatisation de la production documentaire a repris ce geste sans en reprendre la contrainte : un assistant qui rédige une synthèse produit aussi les références qui l'accompagnent, et certaines de ces références ne renvoient à rien.

L'angle mort ne tient pas à la difficulté de repérer une information fausse, mais au fait que les contrôles portent sur les faits et presque jamais sur l'appareil censé les soutenir. Un chiffre erroné se discute dès qu'un lecteur connaît le sujet. Une référence fabriquée, elle, ressemble trait pour trait à une référence exacte : même format, même ton, même apparence d'autorité. Elle n'appelle pas la vérification, elle l'arrête.

Les travaux de l'Observatoire de l'Intelligence Économique sur la traçabilité des sources, et les reportages publiés par Le Fil de la Veille sur les chaînes documentaires automatisées, convergent vers un même constat : le risque a changé de place. Il ne porte plus d'abord sur ce qui est affirmé, mais sur ce qui est censé le prouver. Cet article examine pourquoi ce déplacement est structurel, ce qu'il coûte à un dispositif de veille, et par quoi il se traite.

L'hallucination n'est pas un défaut de réglage, c'est le mode de fabrication

Le premier malentendu consiste à traiter la citation inventée comme une erreur ponctuelle, corrigeable par une consigne mieux formulée. Selon Northern Light, l'hallucination est une propriété du mécanisme des grands modèles de langage, qui produisent les mots statistiquement probables plutôt que des vérités vérifiées. Ce n'est donc pas un défaut que l'on retire par une instruction ajoutée en tête de requête.

La conséquence est directe : une référence est, pour le modèle, une suite de mots comme une autre. Un nom de publication plausible, un titre plausible, une date plausible et une adresse plausible s'assemblent selon la même logique qu'une phrase plausible. Rien dans le mécanisme ne sépare le moment où le modèle restitue une source réellement rencontrée du moment où il en compose une qui aurait pu exister.

Cette indistinction explique l'échec des parades purement rédactionnelles. Demander de ne citer que des sources réelles ne change pas la nature de la génération : cela change seulement la probabilité que les références produites ressemblent à des références réelles. Le problème n'est pas que le modèle désobéisse, il est qu'il obéit exactement de la manière dont il fonctionne.

Ce qu'une citation inventée coûte de plus qu'une erreur de fait

Une erreur de fait se heurte tôt ou tard à quelqu'un qui connaît le dossier. Elle circule dans un espace où la contradiction reste possible, parce que l'affirmation est exposée. Une référence fabriquée bénéficie du régime inverse : elle est lue comme une promesse de vérifiabilité que presque personne n'exerce. Dans la vie ordinaire d'une note de veille, les destinataires lisent la synthèse et n'ouvrent pas les liens.

Le coût ne disparaît pas pour autant, il se déplace dans le temps. Il se paie le jour où un tiers ouvre la référence : un juriste qui prépare un dossier, un auditeur, un concurrent, un journaliste. À ce moment, ce n'est pas une erreur isolée qui est constatée, mais la crédibilité de la note entière, puis celle de la fonction qui l'a produite. Une seule source introuvable suffit à faire relire toutes les autres avec suspicion.

Cette asymétrie justifie un traitement distinct dans les procédures de contrôle. Le fait faux dégrade une conclusion, et une conclusion se corrige. La référence fausse dégrade la méthode, c'est-à-dire précisément ce qui permettait de rattraper les conclusions suivantes.

La veille concurrentielle est le terrain où le risque est le plus élevé

Le phénomène ne se répartit pas uniformément. D'après Northern Light, il s'aggrave sur les questions typiques de la veille concurrentielle : les concurrents de niche, les mouvements récents, les sources payantes que le modèle n'a jamais vues. Ce sont, mot pour mot, les questions qu'une direction adresse à sa veille.

La relation est donc l'inverse de celle qu'on souhaiterait. Plus la question a de valeur parce qu'elle porte sur ce qui est rare, récent ou fermé, moins le modèle dispose de matière réelle, et plus la part produite par ressemblance augmente. Un sujet abondamment couvert donne des réponses médiocrement utiles mais bien ancrées ; un sujet peu couvert donne l'inverse, et c'est le second que la veille reçoit en commande.

Les mesures disponibles fixent un ordre de grandeur. Northern Light rapporte des études où 18 % (GPT-4) à 55 % (GPT-3.5) des citations générées par l'IA étaient entièrement inventées, ainsi qu'un audit de la littérature scientifique ayant signalé environ 147 000 fausses citations générées par l'IA pour la seule année 2025. Ces chiffres portent sur des corpus et des générations de modèles particuliers, ils ne définissent pas un taux universel. Le second dit cependant autre chose : la contamination ne reste pas au brouillon, elle entre dans le stock publié.

Le faux crédible se reconnaît à son appareil de références, pas à son contenu

Ce mécanisme n'est pas propre aux assistants de rédaction : il décrit aussi la manière dont un faux document emporte l'adhésion. Nub News rapporte que le Somerset Council constate une augmentation de contenus en ligne, images et publications modifiées, qui ne reflètent pas fidèlement ses décisions, et que les plus crédibles sont celles qui comportent des dates, des noms, des chiffres, des termes juridiques et des références documentaires à consonance officielle.

Pour mesurer la facilité de fabrication, Nub News a produit en quelques secondes, avec un assistant IA grand public, une publication réaliste mais entièrement inventée sur un scandale de conseil local. Le consultant en droit des médias David Banks y voit un risque juridique dès lors que des affirmations non fondées portent sur les finances publiques.

Un détail de ce cas mérite d'être retenu par les fonctions de veille : le conseil indique ne pas tenir d'archives formelles permettant de quantifier la tendance. Une organisation qui subit ce type de contenus ne sait donc pas dire s'ils augmentent, ni de combien. La même infirmité se retrouve dans les dispositifs documentaires, qui produisent des notes sourcées sans mesurer la part des références réellement ouvertes.

L'étiquetage agit sur le contenant, le problème est dans le contenu

La réponse réglementaire disponible porte pour l'instant sur la signalisation. Selon vietnam.vn, le Vietnam applique depuis le 1er mars 2026 une loi sur l'intelligence artificielle qui impose l'étiquetage des contenus générés par IA et interdit l'usurpation d'identité. Des experts en relèvent aussitôt la limite : une simple capture d'écran fait disparaître l'étiquette.

L'argument central rapporté par vietnam.vn dépasse la question technique : les formats autrefois tenus pour des preuves, l'image et la voix, ne valent plus preuve par eux-mêmes. Transposé à la citation, le raisonnement tient de même. Une note signalée comme produite avec l'aide d'une IA n'indique toujours pas laquelle de ses douze références existe.

L'étiquetage renseigne sur l'origine d'un document, pas sur la solidité de ce qu'il contient. Il sert à trier des flux, il n'établit pas la validité d'un appareil de sources. Un dispositif de veille qui s'en contenterait aurait déplacé son contrôle du bon endroit, la référence, vers le seul endroit commode à observer, le fichier.

Ancrer plutôt que corriger : la réponse est architecturale

Northern Light formule la conséquence sans détour : la solution est architecturale. Elle consiste à ancrer le modèle dans des sources fiables, à exiger des citations traçables, et à tenir ces sources à jour et gouvernées. L'inversion est le point important : la référence cesse d'être produite en même temps que la phrase, elle existe avant elle, et la phrase vient s'y rattacher.

Cette inversion change le rôle de l'assistant. Il ne fabrique plus de sources, il en transmet. Ce qui n'appartient pas au corpus de départ n'apparaît pas en fin de note, et une affirmation sans référence disponible reste une affirmation sans référence, état acceptable, contrairement à une affirmation dotée d'une référence fausse.

Le mot gouvernées porte le reste du travail. Un corpus de sources se date, s'entretient et se purge. Journalism.co.uk rappelle l'existence de bases de référence tenues dans la durée : NewsGuard évalue la fiabilité de plus de 35 000 sources d'information en ligne, représentant plus de 95 % de l'engagement médiatique mesuré, et le Digital News Report annuel du Reuters Institute repose sur près de 100 000 répondants dans 48 pays. L'entretien de ces bases fait partie du travail, il n'en est pas le préalable.

NewsCore (www.newscore.fr) relie chaque signal remonté au document dont il provient et conserve son adresse d'origine, ce qui rend la vérification d'une référence immédiate au lieu d'obliger à la reconstituer après coup.

Ce que la citation inventée impose au dispositif de veille

La première règle est procédurale : aucune référence n'entre dans une note diffusée sans avoir été ouverte. Le coût en temps est réel, et il est le prix du format. Une note sourcée engage son signataire sur la totalité de ses sources, y compris celles qui proviennent d'une chaîne automatisée.

La deuxième règle relève de la mesure. Ce qui manque au Somerset Council, une archive permettant de quantifier la tendance, une fonction de veille est en position de le tenir : contrôler par échantillon un lot de références à intervalle régulier, consigner le taux de références introuvables ou non conformes, et suivre son évolution. Sans cette mesure, l'organisation ignore si son dispositif se dégrade ou s'améliore.

La troisième règle porte sur la responsabilité. L'outil n'est jamais le garant d'une référence, le signataire l'est. Cette attribution n'a rien d'une formalité : elle détermine qui a intérêt à ouvrir les liens avant diffusion, et donc si la règle précédente est appliquée ou seulement écrite.

Questions fréquentes

Comment repérer une citation inventée dans une note de veille ? En ouvrant la référence, ce qui reste la seule méthode fiable. Des indices indirects existent, titre légèrement décalé, date incohérente, adresse dont la structure ne correspond pas aux habitudes de la publication, mais ils ne signalent que les fabrications les moins soignées.

Une consigne de rédaction suffit-elle à empêcher les fausses références ? Non. Selon Northern Light, l'hallucination relève du mécanisme de génération et non d'un réglage : une consigne modifie l'apparence du résultat, pas la façon dont il est produit.

Faut-il renoncer à l'automatisation documentaire à cause de ce risque ? Non, il faut en déplacer le point d'application. L'automatisation reste efficace sur la collecte, le tri et la mise en forme, à condition que les références proviennent d'un corpus établi en amont plutôt que d'une génération.

Quel indicateur suivre dans une organisation ? Le taux de références introuvables ou non conformes, relevé sur un échantillon de notes diffusées à intervalle régulier. C'est le chiffre qui rend la dégradation visible avant qu'un tiers ne la découvre.

Sources

Pour approfondir