Wikipedia utilise l'IA : 3 vérités que personne ne vous dit

Wikipedia utilise l'IA : 3 vérités que personne ne vous dit

Quand l'encyclopédie la plus consultée au monde ouvre ses portes à l'IA, deux scénarios opposés deviennent possibles. Et personne ne sait encore lequel va l'emporter.

Chaque jour, plus de 60 millions de personnes ouvrent un article Wikipédia pour trouver une réponse. Ces mêmes articles alimentent désormais les réponses de ChatGPT, Gemini ou Claude. Une boucle s'est formée : l'IA apprend de Wikipédia, et Wikipédia pourrait bientôt être modifié par l'IA. Ce vertige n'est pas théorique. Il est déjà en cours.

Wikipédia, une cible de choix pour les manipulations modernes

Avant de parler d'intelligence artificielle, rappelons un fait souvent oublié : Wikipédia a toujours été vulnérable. Des entreprises ont modifié leurs propres articles pour améliorer leur image. Des gouvernements ont effacé des passages sensibles. Des individus ont inséré de fausses informations qui ont persisté pendant des années avant d'être détectées.

L'IA amplifie ce risque à une échelle sans précédent. Un acteur malveillant équipé d'un modèle de langage peut désormais :

  • Générer des centaines de modifications plausibles en quelques minutes
  • Rédiger des contenus trompeurs dans un style encyclopédique parfait
  • Créer de fausses sources qui semblent crédibles au premier regard
  • Automatiser la création de comptes pour contourner les systèmes de détection

La Wikimedia Foundation en est consciente. Ses équipes ont déjà signalé des vagues de modifications suspectes présentant les caractéristiques stylistiques des textes générés par IA — une certaine fluidité artificielle, des formulations répétitives, une absence de voix humaine reconnaissable.

L'autre face : l'IA comme outil au service des bénévoles

Il serait réducteur de ne voir dans l'IA qu'une menace. La réalité est plus nuancée, et la Wikimedia Foundation l'a bien compris en lançant ses propres expérimentations.

Wikipédia souffre d'un problème structurel grave : le manque de contributeurs. La communauté des éditeurs actifs vieillit, et les articles dans les langues moins dotées — swahili, bengali, créole haïtien — restent lacunaires ou carrément absents. L'IA peut combler ces déserts informationnels en :

  • Générant des ébauches d'articles que les humains finalisent ensuite
  • Traduisant automatiquement des contenus vers des langues sous-représentées
  • Détectant les articles obsolètes ou incomplets qui nécessitent une mise à jour
  • Aidant les nouveaux contributeurs à respecter les règles de style complexes de l'encyclopédie

Des outils comme ORES (Objective Revision Evaluation Service), un système de machine learning développé en interne, filtrent déjà les vandalismes avant même qu'un humain ne les lise. L'IA défend Wikipédia depuis plus longtemps qu'on ne le croit.

Le problème de la contamination en boucle

Voici le scénario qui préoccupe le plus les chercheurs en IA : la contamination circulaire. Les grands modèles de langage — GPT-4, Gemini, Claude — ont été entraînés massivement sur le contenu de Wikipédia. Si ces modèles commencent à modifier Wikipédia, et que les prochaines générations de modèles s'entraînent sur ces articles modifiés, les erreurs s'accumulent et se propagent dans toute l'infrastructure de la connaissance numérique.

Ce n'est pas de la science-fiction. Des études récentes ont démontré que les modèles entraînés sur des données synthétiques — c'est-à-dire générées par d'autres IA — voient leurs performances se dégrader progressivement. Appliqué à Wikipédia, ce phénomène pourrait transformer la plus grande encyclopédie du monde en une chambre d'écho où les approximations se renforcent mutuellement.

Que fait concrètement la communauté Wikipédia ?

La réponse de la communauté est pragmatique, non idéologique. Plusieurs initiatives sont déjà actives :

Une politique de transparence sur les contenus IA. De nombreux projets Wikipédia débattent de règles obligeant à signaler explicitement quand un article a été initié ou substantiellement modifié par un outil d'IA.

Des outils de détection renforcés. Des classifieurs entraînés à reconnaître les textes générés par IA sont intégrés aux processus de vérification, bien que leur fiabilité reste imparfaite — notamment face aux textes retravaillés par un humain.

Une gouvernance communautaire renforcée. Les décisions sur l'usage de l'IA sont prises par vote et consensus au sein des communautés linguistiques, préservant le principe fondateur de Wikipédia : la sagesse collective plutôt que l'autorité centrale.

Ce que cela change pour vous, lecteur ou contributeur

Que vous soyez étudiant, journaliste, chercheur ou simplement curieux, plusieurs réflexes s'imposent désormais face à un article Wikipédia :

  • Vérifiez toujours les sources citées en bas d'article, pas seulement le texte lui-même
  • Méfiez-vous des articles récemment créés sur des sujets très spécifiques ou d'actualité brûlante
  • Consultez l'onglet Discussion : c'est là que la communauté signale les problèmes
  • Si vous le pouvez, contribuez — un regard humain expert reste irremplaçable

Conclusion : la neutralité n'est plus une option

Wikipédia n'a pas le choix de rester neutre face à l'IA. L'outil est déjà dans la place — pour le meilleur comme pour le pire. La vraie question n'est pas si l'IA va transformer l'encyclopédie, mais qui contrôlera cette transformation. Une communauté vigilante et outillée, ou des acteurs opportunistes qui ont compris que modifier Wikipédia, c'est influencer ce que les IA du monde entier diront demain.

L'encyclopédie libre a survécu à vingt ans de vandalismes humains. Le test qu'elle affronte aujourd'hui est d'une autre nature. Et son issue nous concerne tous.


Reservoir Live