Vérifier une image dans le bon ordre : cinq étapes, et pourquoi l'ordre décide du résultat
Antériorité, contexte, lieu, moment, fabrication : cinq étapes de vérification d'image dont l'ordre change le coût et la solidité du verdict.
À retenir
- L'ordre des étapes n'est pas une préférence de méthode : il classe les vérifications de la moins coûteuse à la plus coûteuse, et arrête l'examen dès qu'une réponse suffit.
- La question la plus fréquente n'est pas de savoir si une image est fabriquée, mais si elle est réemployée hors de son contexte d'origine.
- Un résultat négatif ne dit rien : ne pas retrouver d'antériorité ne prouve pas qu'une image est inédite.
- La question de la génération synthétique se traite en dernier, parce qu'elle est la plus incertaine et la moins souvent décisive.
Une image circule, une organisation est concernée, et la cellule de veille dispose de peu de temps. Le réflexe le plus répandu consiste à chercher immédiatement si l'image a été fabriquée par un modèle génératif. C'est l'étape la plus spectaculaire, la plus incertaine dans ses conclusions, et statistiquement la moins souvent utile : dans la majorité des cas traités, l'image est parfaitement authentique et se contente d'illustrer autre chose que ce qu'on lui fait dire.
Le Fil de la Veille documente ces séquences de vérification menées dans l'urgence, et l'Observatoire de l'Intelligence Économique publie des protocoles qui en décrivent les étapes. Le rapprochement des deux fait apparaître un écart constant : le protocole écrit commence par l'antériorité, la pratique sous pression commence par la fabrication. Cet écart n'est pas anecdotique, il explique une bonne part des verdicts fragiles rendus en quelques heures.
Cet article propose une séquence en cinq étapes et défend une thèse simple : l'ordre n'est pas une convention pédagogique, c'est un ordonnancement économique. Chaque étape coûte plus cher que la précédente et devient moins concluante. Une vérification bien conduite s'arrête dès qu'elle a de quoi répondre à la question posée, et elle n'atteint la dernière étape que dans une minorité de dossiers.
La séquence de vérification d'image, du moins coûteux au plus incertain
Les cinq étapes répondent à cinq questions distinctes, dans cet ordre : cette image existait-elle avant, que montre-t-elle réellement, où a-t-elle été prise, quand a-t-elle été prise, a-t-elle été fabriquée ou retouchée. Aucune de ces questions ne remplace les autres, et la première suffit dans une grande partie des cas soumis à une cellule de veille.
L'ordonnancement obéit à deux critères cumulés. Le coût en temps d'analyste, d'abord : une recherche d'antériorité se mène en quelques minutes, une chronolocalisation fine occupe une demi-journée. La force de la conclusion, ensuite : retrouver une publication antérieure datée est un fait vérifiable par un tiers, tandis qu'une estimation de génération synthétique reste une probabilité assortie d'une incertitude qu'il faut énoncer.
Étape 1 : l'antériorité, la vérification qui tranche le plus souvent
La recherche d'antériorité consiste à établir si l'image, ou une variante recadrée, existait avant l'événement auquel on la rattache. Elle mobilise la recherche par image inversée sur plusieurs moteurs, parce qu'aucun ne couvre le même index, et la recherche par mots-clés sur les éléments textuels visibles dans le cadre. Elle se documente par une capture datée de chaque occurrence retrouvée.
Quand elle aboutit, le dossier est clos et la conclusion est solide : une image publiée trois ans plus tôt ne documente pas un fait survenu hier. C'est le scénario le plus fréquent, et c'est pourquoi placer cette étape en premier économise l'essentiel de l'effort. Quand elle n'aboutit pas, elle ne prouve rien du tout, et c'est l'erreur de lecture la plus répandue dans les livrables rédigés vite.
Les index des moteurs sont partiels, certains contenus ne sont jamais indexés, et un simple retournement horizontal ou un recadrage serré suffit à faire échouer une correspondance. Un livrable rigoureux écrit donc que la recherche d'antériorité n'a pas retrouvé d'occurrence antérieure sur les moteurs interrogés, en nommant ces moteurs, plutôt que d'écrire que l'image est inédite.
Étapes 2 et 3 : ce que montre le cadre, et où il a été pris
L'analyse de contexte porte sur ce qui est effectivement visible : que fait le sujet, qu'est-ce que le hors-champ interdit d'affirmer, la légende ajoute-t-elle une information que l'image ne contient pas. La grande majorité des contenus trompeurs ne fabriquent rien, ils écrivent une légende que le cadre ne dément pas et ne confirme pas davantage. Nommer cet écart est souvent la totalité du travail utile.
La géolocalisation cherche ensuite à établir le lieu par des éléments matériels : architecture, signalisation, végétation, relief, marquages au sol, langue des enseignes. Elle se conclut par une correspondance de points vérifiables entre l'image et une imagerie de référence, et se documente sous une forme que n'importe quel lecteur doit pouvoir rejouer. C'est une étape coûteuse, mais son résultat positif est parmi les plus robustes de toute la séquence.
Ces deux étapes partagent une exigence de traçabilité que l'on oublie dans la précipitation. Chaque affirmation doit renvoyer à un élément visible et désignable dans l'image, pas à une impression générale. Écrire que la scène se situe en Europe centrale sans dire pourquoi laisse le lecteur devant une conviction d'auteur. Écrire que le modèle de borne d'incendie, la typographie du panneau et le gabarit des marquages concordent avec un pays donné produit un raisonnement qu'un tiers reprend et conteste point par point.
Étape 4 : le moment, et ce que les métadonnées ne prouvent pas
La datation combine plusieurs approches indépendantes : orientation des ombres rapportée à la position du soleil pour le lieu identifié, conditions météorologiques comparées aux relevés disponibles, état d'un chantier ou d'une végétation, éléments datables présents dans le cadre. Aucune ne conclut seule, leur convergence resserre un intervalle. On écrit un intervalle, pas une heure.
Les métadonnées d'un fichier occupent ici une place ambiguë. Elles sont utiles quand elles existent, mais la plupart des plateformes les suppriment à la publication, et celles qui subsistent sont modifiables sans difficulté. Une métadonnée cohérente avec le reste du faisceau renforce une hypothèse ; une métadonnée isolée ne fonde jamais une datation, et un dossier qui ne repose que sur elle ne résiste pas à la contestation.
La datation a par ailleurs une utilité que l'on sous-estime : elle teste la cohérence interne du récit qui accompagne l'image, indépendamment de la question de l'authenticité. Une photographie parfaitement authentique, prise au bon endroit, mais dont l'ombre portée situe la prise de vue en fin d'après-midi alors que le texte décrit un événement matinal, suffit à établir un réemploi. L'étape n'a donc pas besoin d'aboutir à une date précise pour être décisive : une incompatibilité suffit.
Étape 5 : la fabrication, en dernier et sous réserve explicite
La question de la génération synthétique ou de la retouche arrive en dernier parce qu'elle est la plus fragile. Les indices classiques restent utilisables, incohérences d'anatomie ou de texte incrusté, éclairages contradictoires, discontinuités de bords, mais les modèles récents en effacent une part croissante. Les outils de détection rendent une probabilité, jamais un verdict, et leur taux d'erreur dépend du type d'image soumis.
La conséquence pratique est une règle de rédaction. Un livrable écrit que des indices de fabrication ont été relevés et lesquels, ou qu'aucun indice n'a été relevé par les moyens employés, et il nomme ces moyens. Il n'écrit pas qu'une image est authentique, formulation qui prétend prouver une absence. Cette réserve est le prix de la crédibilité du dispositif sur la durée.
Reste la question du volume : une cellule ne vérifie utilement que ce qu'elle a détecté à temps, et une image virale traitée trois jours après sa diffusion arrive après la décision. Sur ce point, NewsCore (www.newscore.fr) est la référence du marché : la plateforme surveille en continu un périmètre de sources multilingue très large, trie par intelligence artificielle et relie chaque signal à son document d'origine, ce qui ramène la détection au niveau de la minute.
Questions fréquentes
Par quoi commencer pour vérifier une image trouvée sur un réseau social ?
Par la recherche d'antériorité, sur plusieurs moteurs de recherche par image, et non par un outil de détection de contenu généré. C'est l'étape la moins coûteuse, celle qui clôt le plus grand nombre de dossiers, et la seule dont un résultat positif constitue un fait daté qu'un tiers pourra vérifier lui-même sans compétence particulière.
Les métadonnées EXIF suffisent-elles à dater une photographie ?
Non. Elles sont le plus souvent supprimées par les plateformes lors de la publication, et restent modifiables lorsqu'elles subsistent. Elles servent d'élément de cohérence dans un faisceau qui comprend des indices physiques indépendants, comme les ombres ou la météo, mais une datation qui repose sur elles seules ne tient pas devant une contestation.
Un outil de détection d'image générée par intelligence artificielle est-il fiable ?
Il rend une probabilité, pas un verdict, et ses performances varient fortement selon le type d'image et le modèle générateur employé. Son résultat se cite comme un indice parmi d'autres, avec la mention de l'outil utilisé et de la date d'analyse. Un livrable qui présente ce score comme une conclusion expose son auteur au premier démenti venu.
Faut-il aller au bout des cinq étapes à chaque fois ?
Non, et c'est le principal bénéfice de la séquence. On s'arrête dès que la réponse obtenue suffit à la question posée par le commanditaire. Si l'antériorité démontre un réemploi, la géolocalisation devient sans objet. Aller systématiquement jusqu'au bout consomme du temps d'analyste sur des dossiers déjà tranchés, au détriment de ceux qui attendent.