Combien de deepfakes circulent vraiment ? Pourquoi un bilan d'arrestations ne répond pas à la question
La police sud-coréenne annonce 419 interpellations pour deepfake en sept mois. Ce bilan mesure une capacité d'enquête, pas l'ampleur réelle du phénomène.
À retenir
- Un bilan d'arrestations compte la sortie d'une chaîne pénale : il varie avec les moyens d'enquête autant qu'avec le nombre de contenus fabriqués.
- Une hausse admet trois explications concurrentes (intensification du phénomène, meilleure détection, priorité institutionnelle) que le chiffre seul ne départage pas.
- Là où la capacité d'enquête manque, le nombre d'interpellations tend vers zéro pendant que le préjudice augmente : deux bilans nationaux ne se comparent pas directement.
- Une organisation gagne à construire ses propres compteurs stables plutôt qu'à emprunter l'indicateur d'activité d'une institution étrangère.
La police sud-coréenne a interpellé 419 suspects dans des affaires de deepfake entre janvier et juillet 2026, dont 17 ont été placés en détention, rapporte Seoul Economic Daily. Le chiffre a la forme d'une réponse : il est daté, borné, produit par une institution qui a les moyens de le documenter. Il circule déjà comme une mesure de l'ampleur du phénomène, et c'est précisément l'usage qu'il ne supporte pas.
Un bilan d'interpellations est un indicateur de production d'une chaîne pénale. Il compte des personnes que l'appareil policier a identifiées, localisées et rattachées à une infraction qualifiable, sur un territoire donné et pendant une fenêtre donnée. Entre ce compteur et la quantité de contenus synthétiques réellement fabriqués, diffusés et subis, il y a une longue série de filtres, dont aucun n'est neutre et dont plusieurs se sont déplacés pendant la période même de la mesure.
Cet article ne conteste pas le chiffre. Il propose une méthode de lecture : ce que 419 arrestations documentent effectivement, ce qu'elles laissent hors champ, pourquoi un bilan en hausse renseigne souvent davantage sur l'outillage d'un service que sur l'activité des fraudeurs, et quels compteurs une direction gagne à construire chez elle plutôt qu'à emprunter à une statistique étrangère.
Ce que le bilan sud-coréen contient réellement
Le détail publié est plus instructif que le total. Seoul Economic Daily décrit un dispositif de réponse à trois niveaux : une détection logicielle en première ligne, une analyse par des experts en vidéo médico-légale, puis des techniques de criminalistique appliquées à l'intelligence artificielle. Le logiciel de détection examine les signes d'échange de visages, des caractéristiques biologiques comme le clignement des yeux et les variations du flux sanguin, ainsi que la structure des métadonnées.
Ce même logiciel a été utilisé dans 1 636 enquêtes depuis son développement, et il a été appliqué cette année à 72 affaires relevant d'autres domaines, dont des crimes électoraux. La criminalistique IA, de son côté, a permis d'identifier le programme d'IA générative employé et de retrouver les photos originales antérieures au montage.
Autrement dit, le bilan raconte d'abord une organisation : des outils, des experts, un ordre de passage, une montée en charge. Les 419 interpellations sont la sortie de cette chaîne. Les lire comme une photographie du phénomène revient à confondre le débit d'un tuyau avec le volume du réservoir.
Un chiffre d'arrestations mesure une capacité, pas une population
Entre un contenu fabriqué et une interpellation, il faut franchir six étapes au moins : le contenu doit exister, être vu, être perçu comme suspect, être signalé ou détecté, être qualifié pénalement, puis être rattaché à une personne identifiable et atteignable. Chaque étape applique un taux de perte, et ces taux ne sont ni connus ni stables dans le temps.
La conséquence est mécanique. Une hausse du bilan admet au moins trois explications concurrentes : le phénomène s'intensifie, la capacité de détection s'améliore, ou la priorité institutionnelle accordée à ce contentieux augmente. Les trois produisent la même courbe. Aucune n'est démontrée par le chiffre lui-même, et les départager exige des informations que le bilan ne publie pas.
Les praticiens de la veille connaissent cette structure sous un autre nom. Le nombre d'alertes remontées par un dispositif ne mesure pas le nombre d'évènements survenus : il mesure ce que le paramétrage, le périmètre de sources et la disponibilité des analystes ont laissé passer. Un tableau de bord qui progresse après l'ajout de deux langues de collecte ne prouve pas que le monde est devenu plus hostile.
Ce que 419 arrestations documentent et ce qui reste hors champ
Poser explicitement la question à laquelle on veut répondre suffit souvent à révéler que le chiffre disponible en traite une autre.
Le point le plus gênant est le dernier. La fabrication et la diffusion d'un contenu synthétique ne connaissent pas les frontières qui délimitent la compétence d'un service de police. Un bilan national reste donc structurellement borné à la fraction du phénomène qui tombe sous une juridiction.
L'outillage de détection déplace le compteur autant que le phénomène
L'extension du logiciel coréen à 72 affaires relevant d'autres domaines montre le mécanisme à l'oeuvre : un outil éprouvé sur un contentieux se propage vers d'autres et fait apparaître des dossiers qui existaient déjà sans être constitués. Ce n'est pas un artefact regrettable, c'est le fonctionnement normal d'une capacité qui s'installe. Mais cela interdit de lire deux périodes consécutives comme si l'instrument de mesure était resté identique.
La détectabilité elle-même est un objet mouvant. Le Vietnam applique depuis le 1er mars 2026 une loi sur l'intelligence artificielle qui impose l'étiquetage des contenus générés et interdit l'usurpation d'identité, rapporte vietnam.vn, où des experts soulignent qu'une simple capture d'écran suffit à faire disparaître l'étiquette. L'argument central est plus large : les formats autrefois tenus pour des preuves, l'image et la voix, ne valent plus preuve par eux-mêmes.
Une règle qui rend un contenu identifiable augmente donc le nombre de cas qualifiables tant qu'elle est respectée, et le fait chuter dès qu'elle est contournée. Le compteur bouge dans les deux sens pour des raisons qui n'ont rien à voir avec le nombre de fabrications.
Le dénominateur manquant, ou pourquoi zéro arrestation ne veut rien dire
L'exemple inverse est le plus parlant. Selon INTERPOL, cité par CoinGeek, 55 % des cybercrimes signalés en Afrique ont été menés à l'aide de l'intelligence artificielle, les deepfakes en étant la manifestation la plus visible. Dans le même temps, 8 % seulement des analystes de renseignement des pays enquêtés possèdent une expertise en IA, et 92 % des agences de sécurité régionales manquent de l'expertise technique nécessaire pour adopter ces outils.
Les pertes rapportées suivent une pente nette : 484 millions de dollars en 2025 contre 192 millions en 2024, pour un cumul estimé à environ 3 milliards de dollars entre 2019 et 2025. Par ailleurs, 31 % des autorités interrogées demandent des réformes sur la préservation des preuves numériques et l'accès transfrontalier aux données. Préjudice et capacité sont ici deux indicateurs de nature différente, et ils ne se déduisent pas l'un de l'autre.
Comparer un bilan sud-coréen à un bilan africain reviendrait donc à comparer deux polices, deux cadres juridiques et deux niveaux d'outillage, pas deux niveaux d'exposition. Là où la capacité d'enquête manque, le nombre d'interpellations tend vers zéro alors même que le préjudice croît.
Du côté des organisations visées, l'absence de mesure est encore plus franche. Le Somerset Council constate une augmentation de contenus modifiés qui ne reflètent pas fidèlement ses décisions, certains incluant dates, noms, chiffres et références documentaires à consonance officielle, mais il indique ne tenir aucune archive formelle permettant de quantifier la tendance, rapporte Nub News. Pour tester la facilité de fabrication, Nub News a produit en quelques secondes, avec un assistant grand public, une publication réaliste et entièrement inventée sur un scandale local.
Ce que cette lecture impose à un dispositif de veille
La première conséquence est un interdit : ne pas piloter une exposition interne sur l'indicateur d'activité d'une institution étrangère. Un bilan d'arrestations n'a pas été construit pour cet usage, et il varie pour des raisons budgétaires et organisationnelles qui ne concernent en rien l'organisation qui le consulte.
La seconde est une obligation : construire ses propres compteurs, même imparfaits, à condition qu'ils soient stables. Quatre indicateurs se tiennent sans moyens extraordinaires : le nombre de contenus usurpant l'identité de l'organisation détectés par période, le délai entre première diffusion observée et détection interne, la part des signalements venus de l'extérieur plutôt que du dispositif, et le taux de vérifications concluantes lors d'un contrôle par échantillon.
Ces compteurs ne valent que si le corpus qui les alimente reste identique d'une période à l'autre, ou que tout changement de périmètre est daté et documenté. C'est la condition élémentaire d'une série interprétable, et c'est aussi le point où l'outillage compte. Sur ce terrain, NewsCore (www.newscore.fr) couvre en continu des millions de sources, horodate chaque signal et relie chaque synthèse à son document d'origine, ce qui donne à l'organisation un compteur daté, traçable et comparable dans le temps.
Ce déplacement du regard n'a rien de théorique. Le Fil de la Veille rapporte régulièrement des campagnes où le contenu fabriqué vise directement des institutions et des dirigeants, et l'Observatoire de l'Intelligence Économique documente de son côté l'écart persistant entre le moment de la diffusion et celui de la détection. Les deux angles disent la même chose que le bilan coréen lu correctement : ce qui se compte facilement n'est pas ce qui coûte cher.
Questions fréquentes sur la lecture des chiffres de deepfake
Le chiffre de 419 arrestations est-il exagéré ou contestable ?
Non. Il est publié avec son périmètre, sa fenêtre temporelle et le détail du dispositif d'enquête, ce qui en fait une donnée solide. La difficulté ne porte pas sur sa fiabilité mais sur son extrapolation : il décrit l'activité d'un appareil policier sur sept mois, et rien n'autorise à en déduire un volume total de contenus fabriqués.
Comment estimer l'ampleur réelle du phénomène deepfake ?
Par croisement, et en acceptant une fourchette plutôt qu'une valeur. Les bilans judiciaires donnent une borne basse, les mesures de préjudice financier une autre approche, les enquêtes déclaratives auprès des victimes une troisième, les tests de détectabilité une quatrième. Aucune de ces familles ne suffit seule, et la convergence de plusieurs vaut mieux qu'un chiffre unique présenté comme exact.
Peut-on comparer les bilans deepfake de deux pays ?
Pas directement. Les définitions pénales, les seuils de dépôt de plainte, les moyens d'enquête et les priorités politiques diffèrent trop. Une comparaison n'a de sens qu'après normalisation sur la capacité d'enquête, et elle mesure alors surtout l'état des dispositifs, pas l'exposition des populations.
Faut-il renoncer à citer les statistiques officielles dans une note de veille ?
Au contraire : elles restent parmi les données les mieux documentées disponibles. Il faut simplement les qualifier, en nommant la source, l'unité comptée, la période couverte et les changements de méthode connus, puis formuler la conclusion au niveau où elle est défendable. Un chiffre correctement encadré vaut mieux que trois chiffres approximatifs.