ChatGPT et Claude retournés contre vous : la désinformation d'État a changé de visage

ChatGPT et Claude retournés contre vous : la désinformation d'État a changé de visage

Les IA conversationnelles sont devenues le nouveau champ de bataille de la propagande mondiale

Pendant que vous demandiez à ChatGPT de rédiger un email ou à Claude de résumer un document, des acteurs étatiques testaient méthodiquement comment transformer ces mêmes outils en machines à narratives. Ce n'est pas une hypothèse. C'est ce que documentent, depuis 2023, plusieurs rapports de chercheurs en sécurité numérique et d'organisations comme le Stanford Internet Observatory.

La désinformation géopolitique n'a pas attendu l'IA générative pour exister. Mais elle vient de trouver son accélérateur.

Comprendre le problème : pourquoi les LLM sont des cibles idéales

Les grands modèles de langage (LLM) comme GPT-4, Claude 3 ou Gemini sont entraînés sur des milliards de textes humains. Ils apprennent à produire du contenu plausible, fluide, contextuel. C'est précisément ce qui les rend utiles — et dangereux entre de mauvaises mains.

Trois caractéristiques en font des vecteurs de propagande particulièrement efficaces :

  • La vitesse de production : générer 10 000 articles pro-gouvernementaux prend quelques heures, pas des semaines.
  • L'adaptabilité linguistique : le même message peut être reformulé en 40 langues avec des nuances culturelles précises.
  • La crédibilité apparente : un texte généré par IA sans instructions contraires évite les fautes stylistiques qui trahissaient autrefois les fermes à trolls.

Les méthodes concrètes utilisées par les acteurs étatiques

1. Le "jailbreak" idéologique

Les équipes d'OpenAI et d'Anthropic publient régulièrement des rapports sur des tentatives de contournement de leurs garde-fous. En mai 2024, OpenAI a révélé avoir identifié et bloqué des opérations liées à la Russie, la Chine, l'Iran et Israël, qui utilisaient ChatGPT pour générer du contenu destiné à des campagnes d'influence. Les techniques varient : reformulation des requêtes, construction de contextes fictifs, exploitation de failles dans les instructions système.

2. La "pollution de contexte"

Une méthode plus subtile consiste à ne pas attaquer l'IA directement, mais à alimenter ses sources d'entraînement futures. En inondant le web de contenus orientés — articles, forums, réseaux sociaux — les acteurs malveillants espèrent biaiser les prochaines versions des modèles. Un investissement à long terme dans la manipulation cognitive.

3. Les faux experts automatisés

Des réseaux de comptes généraient, via API, des prises de position d'experts fictifs sur des conflits géopolitiques. Ces contenus, publiés sur des sites d'apparence légitime, étaient ensuite cités comme sources dans d'autres contenus IA. Un cercle vicieux de désinformation auto-référencée.

Cas documentés : de la théorie à la réalité

Le rapport d'Anthropic de février 2024 mentionne des tentatives d'utilisation de Claude pour rédiger des discours pro-gouvernementaux dans des contextes de crise électorale. Sans préciser les États impliqués, la firme confirme avoir détecté des patterns cohérents avec des opérations coordonnées.

Plus visible encore : l'affaire "CopyCop", révélée par NewsGuard en 2023. Des centaines de sites d'information automatisés, utilisant des LLM, reprenaient et reformulaient des articles de propagande russe pour les rendre indétectables aux filtres habituels. Le résultat ? Des contenus aux accents journalistiques sérieux, traitant de l'Ukraine ou des sanctions occidentales, diffusés à des millions de lecteurs francophones et anglophones.

Ce que les plateformes font — et ce qu'elles ne font pas

OpenAI, Anthropic et Google ont chacun renforcé leurs politiques d'utilisation et investi dans des systèmes de détection comportementale. Mais les limites sont structurelles :

  • Les API publiques restent accessibles avec un simple abonnement.
  • Les modèles open source (LLaMA, Mistral) ne peuvent pas être régulés par leurs créateurs une fois déployés.
  • La frontière entre contenu persuasif légitime et propagande reste juridiquement floue dans la plupart des pays.

L'Union européenne, via l'AI Act entré en vigueur en 2024, impose des obligations de transparence pour les systèmes à haut risque. Mais l'application transfrontalière reste un défi considérable face à des acteurs opérant depuis des juridictions non-coopératives.

Ce que vous pouvez faire, concrètement

Face à cette réalité, la passivité est un choix. Quelques réflexes concrets :

  • Vérifier la chaîne de sources : un article bien écrit sans auteur identifiable ni média référencé est un signal d'alarme.
  • Utiliser des outils de détection : Originality.AI, GPTZero ou le détecteur intégré de certains navigateurs peuvent aider, sans garantie absolue.
  • Croiser systématiquement les informations géopolitiques avec des agences de fact-checking reconnues (AFP Factuel, Reuters Fact Check).
  • Se méfier de la fluidité : un texte trop parfait, trop équilibré, sans aspérités stylistiques, mérite d'être questionné.

Conclusion : l'IA n'est pas le problème. L'absence de vigilance, si.

ChatGPT et Claude ne sont pas devenus des outils de propagande. Ils ont été utilisés comme tels par des acteurs qui ont compris avant beaucoup d'entre nous l'ampleur de leur puissance rhétorique. La technologie est neutre ; les intentions ne le sont jamais.

La vraie question n'est pas de savoir si l'IA peut être détournée — elle l'est déjà. La question est de savoir si nos sociétés, nos institutions et nos individus développeront une littératie critique suffisante pour naviguer dans un environnement informationnel où la plausibilité n'est plus un indicateur de vérité.

L'ère de la désinformation artisanale est révolue. Celle de la désinformation industrielle, personnalisée et scalable vient de commencer.


— Reservoir Live