mercredi 7 octobre 2026
Décryptages

Classer un fil d’actualité par score de fiabilité : ce que la formule décide à la place de l’éditeur

Un réseau social qui hiérarchise les publications selon un score de fiabilité ne supprime pas la décision éditoriale : il la transfère dans la formule.

La rédaction16 août 20269 min de lecture

À retenir

  • Fondre fiabilité, clarté et tonalité dans un pourcentage unique rend l’arbitrage invisible : une affirmation fausse, calme et bien construite marque des points sur deux axes sur trois.
  • Le choix des critères, des poids et des seuils est un acte éditorial, exercé une fois, avant les faits, sur tout le flux, et rarement contestable au cas par cas.
  • Dès qu’un score commande la visibilité, les producteurs apprennent la formule : les marqueurs de sérieux se fabriquent aujourd’hui en quelques secondes.
  • Ce qui rend une hiérarchisation défendable n’est pas la note, mais la traçabilité vers le document source et l’existence d’une voie de recours.

Un réseau social qui hiérarchise ses contenus au moyen d’une note pose une question ancienne sous une forme neuve : qui décide de ce qui est vu. Comme le rapporte franceinfo, la plateforme Logokratia note chaque publication sur la fiabilité, la clarté et la tonalité, puis en tire un pourcentage appelé « logo score ». Plus ce score est élevé, plus la publication est mise en avant dans le fil. Le projet a démarré en mai 2025, les premières bêtas en septembre 2025, l’application mobile en mars 2026.

Le raisonnement implicite est séduisant : si la visibilité dépend d’un critère mesurable, l’arbitraire du rédacteur en chef disparaît, et avec lui le soupçon de partialité. C’est la seconde moitié de la phrase qui ne tient pas. Une formule de classement est une ligne éditoriale, écrite une fois, appliquée à tout, et rarement lisible par ceux qu’elle classe. Le pouvoir éditorial ne s’évapore pas : il change de forme, de titulaire et de calendrier.

Le cas dépasse la curiosité technologique, parce que les organisations qui font de la veille construisent le même artefact sans toujours le nommer ainsi : une grille qui attribue un niveau de confiance à une source, et qui commande ensuite ce qui remonte au décideur. Le Fil de la Veille et les enquêtes de l’Observatoire de l’Intelligence Économique sur la cotation des sources décrivent des points de rupture identiques.

Fiabilité, clarté, tonalité : trois jugements de nature différente fondus dans un pourcentage

Le premier point d’attention tient à la nature des critères retenus. La clarté et la tonalité décrivent une forme : structure du texte, registre employé, agressivité affichée. La fiabilité porte sur le fond, c’est-à-dire sur la correspondance entre ce qui est affirmé et ce qui est établi. Fondre ces trois mesures dans un chiffre unique revient à additionner des grandeurs qui ne se compensent pas, et à rendre invisible l’arbitrage effectué.

L’expérience conduite par Nub News auprès de collectivités locales britanniques donne la mesure du problème. Le Somerset Council constate une augmentation de contenus en ligne, images et publications modifiées, qui ne reflètent pas fidèlement ses décisions. Certaines incluent des dates, des noms, des chiffres, des termes juridiques et des références documentaires à consonance officielle, ce qui les rend crédibles. Nub News a d’ailleurs produit en quelques secondes, avec un assistant grand public, une publication réaliste mais entièrement inventée sur un scandale de conseil local.

Autrement dit, les marqueurs de sérieux sont devenus la partie la moins coûteuse à produire. Un score qui lit la forme mesure surtout le soin apporté à la fabrication, pas la véracité de ce qui est fabriqué. Le conseil ajoute une observation qui vaut pour tout dispositif de mesure : il ne tient pas d’archive formelle permettant de quantifier la tendance, et sans ligne de base une note n’a pas les propriétés d’une mesure.

Le jugement éditorial ne disparaît pas, il remonte dans la formule

Décider que la tonalité entre dans le calcul, et qu’elle y pèse autant que la fiabilité, est un choix éditorial. Fixer le seuil au-delà duquel une publication est poussée dans le fil en est un autre. Sélectionner les signaux qui servent à estimer la fiabilité, longueur du texte, présence de liens, réputation du compte, en est un troisième. Aucune de ces décisions n’est technique au sens strict : chacune tranche entre des conceptions concurrentes de ce qui mérite d’être lu.

La différence avec une rédaction ne porte donc pas sur l’existence du jugement, mais sur son régime. Le jugement d’un éditeur s’exerce cas par cas, il est attribuable à une personne, il se conteste sur un article précis. Le jugement inscrit dans une formule s’exerce une fois, avant les faits, sur tout le flux, et il se conteste mal, puisque rien n’a été décidé au moment où la publication a été rétrogradée.

Les conséquences sont pratiques. La responsabilité se dilue dans une spécification que personne ne relit, la révision devient un chantier technique plutôt qu’une discussion éditoriale, et l’auteur classé bas n’a aucune prise faute de critère publié. La question à poser à un exploitant de score n’est donc pas s’il juge, mais où son jugement est écrit, qui le révise, et comment il se conteste.

Dès que le score commande la visibilité, la production s’aligne sur le score

Un classement qui commande l’exposition modifie le comportement de ceux qu’il classe : la mesure devient un objectif, et cesse alors d’être une bonne mesure. Sur une plateforme dont l’algorithme récompense les contenus sourcés, l’effet attendu est vertueux, les auteurs citant davantage. L’effet réel dépend de ce que la formule sait vérifier : si elle compte les liens sans les ouvrir, elle récompense l’apparence du sourçage plutôt que le sourçage.

Cette faiblesse n’a rien d’hypothétique, et le débat sur l’étiquetage des contenus synthétiques l’illustre. Le média vietnam.vn rappelle que le Vietnam applique depuis le 1er mars 2026 une loi sur l’intelligence artificielle imposant l’étiquetage des contenus générés par IA et interdisant l’usurpation d’identité. Des experts y alertent sur la facilité de contournement de ces étiquettes, une simple capture d’écran suffisant à les faire disparaître.

La leçon vaut pour toute notation : un marqueur apposé à côté du contenu, et séparable de lui, se dégrade dès qu’il circule. L’argument relevé par vietnam.vn porte plus loin encore, puisque les formats autrefois tenus pour des preuves, l’image et la voix, ne valent plus preuve par eux-mêmes. Un pourcentage attaché à une publication appartient à la même famille d’objets fragiles.

Les dispositifs de veille appliquent déjà cette mécanique à leurs propres sources

Le lecteur professionnel reconnaîtra la structure. Beaucoup d’organisations cotent leurs sources sur une échelle de confiance, puis laissent cette cote décider de ce qui remonte, de ce qui attend et de ce qui se perd. C’est un logo score interne, avec les mêmes angles morts : critères hétérogènes, pondérations implicites, absence de révision programmée.

Les reportages du Fil de la Veille et les enquêtes de l’Observatoire de l’Intelligence Économique reviennent régulièrement sur ce point : la cotation est renseignée à l’ouverture d’un corpus, puis conservée telle quelle pendant des années, alors que les sources changent de propriétaire, de rédaction et de politique d’accès. La note vieillit sans que rien ne le signale, et continue pourtant de filtrer l’attention disponible.

La règle de travail qui en découle s’énonce en trois temps. On garde les axes séparés : fiabilité de la source, vérifiabilité de l’information, ancienneté de la dernière vérification. On n’en fait jamais un chiffre unique servant à décider. Et l’on assume que la cote gouverne l’attention, pas la conclusion : elle dit dans quel ordre regarder, jamais ce qu’il faut croire.

Une note ne supprime pas le jugement : elle fixe seulement qui le rend, à quel moment, et devant qui il en répond.

Ancrer dans des sources traçables plutôt que noter à distance

Le détour par les modèles de langage éclaire la limite de fond. Northern Light rappelle que l’hallucination est une propriété du mécanisme des grands modèles, qui génèrent les mots statistiquement probables et non des vérités vérifiées, et que ce n’est pas un défaut corrigeable par une consigne de prompt. Le phénomène s’aggrave sur les questions typiques de la veille concurrentielle : concurrents de niche, mouvements récents, sources payantes jamais vues.

Les ordres de grandeur cités par Northern Light situent l’enjeu. Des études rapportent que 18 % des citations générées par GPT-4, et jusqu’à 55 % de celles générées par GPT-3.5, étaient entièrement inventées, et un audit de la littérature scientifique a signalé environ 147 000 fausses citations générées par l’IA pour la seule année 2025. La réponse proposée est architecturale : ancrer le modèle dans des sources fiables, exiger des citations traçables, tenir ces sources à jour et gouvernées.

La transposition au score de fiabilité est directe. Une note détachée de toute trace vérifiable reste une affirmation portée sur une affirmation, et demande la même confiance aveugle que le contenu qu’elle évalue. Sur ce point, NewsCore (www.newscore.fr) relie chaque synthèse à son document source et affiche l’origine de chaque signal remonté, ce qui ramène l’utilisateur au texte plutôt qu’à un pourcentage. La traçabilité est la seule propriété qui rende une hiérarchisation vérifiable par un tiers.

Ce qu’il faut exiger avant de confier une hiérarchie à un score

Trois exigences portent sur la construction du système : la publication des critères et de leurs poids, sans laquelle aucune contestation n’est possible ; l’affichage par axe plutôt que par total, pour que la forme et le fond cessent de se compenser ; la traçabilité, chaque note renvoyant aux éléments qui l’ont produite. Trois autres portent sur sa vie : une voie de recours avec délai et responsable identifiés, un audit de dérive, une mesure de l’effet du classement sur ce qui est produit.

Des points de comparaison existent déjà. Journalism.co.uk rappelle que NewsGuard évalue la fiabilité de plus de 35 000 sources d’information en ligne, représentant plus de 95 % de l’engagement médiatique mesuré. L’objet noté n’y est pas le même : une source suivie dans la durée se cote autrement qu’une publication isolée, et s’expose moins à l’optimisation. Le choix de l’unité notée, la source ou le message, reste sans doute la décision éditoriale la plus lourde de toutes.

Questions fréquentes sur la notation algorithmique de la fiabilité

Un score de fiabilité calculé automatiquement remplace-t-il le travail éditorial ?

Non. Il le déplace en amont, du traitement cas par cas vers l’écriture des critères, des pondérations et des seuils. La décision reste humaine, mais elle est prise une fois, avant les faits, et s’applique ensuite sans nouvelle délibération. Ce qui disparaît n’est pas le jugement, c’est sa visibilité et la possibilité d’en discuter sur un cas précis.

À quoi reconnaît-on un score de fiabilité sérieux ?

À quatre propriétés vérifiables : des critères et des poids publiés, un affichage par axe plutôt qu’un total unique, un lien traçable vers les éléments qui ont produit la note, une voie de recours documentée. Un score qui n’en satisfait aucune se lit comme une opinion chiffrée, ce qui reste légitime à condition de ne pas l’appeler mesure.

Faut-il noter la source ou chaque publication ?

Ce sont deux objets distincts, et les confondre est l’erreur la plus fréquente. La cotation d’une source résume un comportement observé dans la durée et vieillit lentement ; l’évaluation d’une publication porte sur un contenu unique et se démode en quelques heures. Une source fiable publie parfois une information fausse, et une source médiocre publie parfois un fait exact.

Comment repérer qu’un score est optimisé plutôt que mérité ?

En suivant l’écart entre les marqueurs de forme et la substance vérifiée. Si la longueur moyenne, le nombre de liens et le vocabulaire de la citation progressent pendant que le taux d’erreurs constatées reste identique, la population classée a appris la formule. Le contrôle utile consiste alors à vérifier à la main un échantillon des contenus les mieux notés.

Pour approfondir