Sur Wikipédia en français, le principe est l'interdiction de l'utilisation de l'intelligence artificielle générative (IAg) fondée sur les grands modèles de langage (LLM) pour la rédaction des articles.

En effet, l'expérience montre que l'usage de cet outil conduit quasi-systématiquement à contrevenir aux principes fondateurs et règles de Wikipédia, en particulier la vérifiabilité du contenu. Le mésusage des IAg aboutit à l'introduction de plagiats, d'informations fausses, de sources détournées, inexistantes (hallucinations) ou de mauvaise qualité, etc.

Ce qui apparaît comme un gain de temps individuel pour les utilisateurs d'IAg, induits en erreur par l'apparente facilité d'usage de l'outil, génère en réalité une perte de temps collective et une dégradation du contenu de l'encyclopédie.

Il existe des exceptions à cette interdiction générale : l'usage des outils IAg à des fins de correction orthographique est autorisé ; leur usage raisonné à des fins d'aide à la rédaction par des contributeurs maîtrisant les règles de Wikipédia est possible à certaines conditions, détaillées plus bas.

Avant-propos

modifier

L'intelligence artificielle générative repose sur l'apprentissage de données d'entraînement afin de produire de nouvelles données.

Cette méthode pose deux principaux enjeux. Le premier, les données d'entraînement ne sont pas toujours fiables : une source fictive (ex. : mythe) ou dépassée[1] peut avoir autant de poids qu'une source réelle et contemporaine. Ainsi, la qualité et l'exactitude des informations peuvent être compromises. Le second, les données créées — c'est-à-dire le texte généré — peuvent être statistiquement cohérentes[2] mais peuvent manquer de précision[3] (ex. : un biais) ou de contexte.

Concrètement, l'utilisation d'une intelligence artificielle générative (IAg), sans compréhension fine de son fonctionnement, conduit quasi-systématiquement à l'insertion d'informations hallucinées (y compris des références à des sources qui n'existent pas) ou à des travaux inédits, à l'emploi d'un style non encyclopédique, voire à du plagiat[4]. Ces dérives ne sont pas acceptables et entament la confiance accordée à vos contributions par les autres bénévoles ainsi que celle des lecteurs envers l'encyclopédie elle-même[5].

Risques

modifier

Usages tolérés

modifier

Une utilisation raisonnée des outils d'IAg comme assistance à l'écriture est tolérée pour réaliser certaines tâches, avec discernement. Elle nécessite de déjà maîtriser les règles et recommandations de Wikipédia ainsi que les limites et dangers des outils d'IAg.

Si l'on peut déterminer à la lecture qu'un contenu est généré par une IAg, il doit alors être réécrit ou supprimé.

Exemples

modifier

Parmi les usages tolérés :

  • résumer une source que vous avez déjà lue (tout en veillant à réaliser une synthèse avec d'autres lectures), ce qui implique un sourçage précis et une vérification de la conformité de la synthèse à la source ;
  • aider à la reformulation (attention : ce n'est pas une immunité contre le plagiat, lisez Aide:Rédiger sans plagier) ;
  • corrections orthographiques, typographiques et syntaxiques (attention : les conventions typographiques prévalent) ;
  • vérifier les sens d'un mot étranger (attention : pas de traduction littérale ou mot à mot, veillez à ce qu'il n'y ait pas de contre-sens).

Dans les discussions

modifier

Utiliser des textes générés par IA dans les discussions avec les autres bénévoles est considéré comme une violation des règles de savoir-vivre.

Si vous êtes débutant, exprimez-vous avec vos propres mots, vos propres questionnements, de sorte que votre interlocuteur puisse vous guider au mieux. Utiliser des textes générés par IA dans les discussions conduit généralement à citer à mauvais escient des règles et recommandations que vous n'avez pas nécessairement lues, ce qui est contreproductif et ne vous aide pas à vous familiariser avec le fonctionnement de Wikipédia.

Si vous craignez de faire des erreurs de langue, une simple relecture de vos messages par l'IA est acceptable, du moment que vous avez écrit vous-même le message initial.

Si vous n'êtes pas francophone, privilégiez l'écriture de votre message dans une langue que vous maîtrisez, suivie de l'usage d'un traducteur automatique pour le traduire en français, en précisant dans votre message que vous avez utilisé un traducteur automatique.

Que faire en cas de suspicion d'utilisation ?

modifier

Si vous suspectez qu'un contenu a été généré par une intelligence artificielle (IA) mais que vous n'êtes pas certain(e) des mesures à prendre, vous pouvez le signaler sur l'Observatoire des IA.

Si vous identifiez un mésusage, vous pouvez :

  • pour un article créé : faire une demande de suppression immédiate si la non-conformité est évidente ou que cela relève du canular (Vandalisme, critère G3 d'une demande de suppression). La précision « IA présumée » peut être indiquée dans la demande. Une réaction rapide est particulièrement attendue pour les biographies de personnes vivantes ;
  • pour un contenu partiel : le supprimer en indiquant en résumé de modification le problème standard détecté : inexact, non sourcé ou source invalide, style non-encyclopédique, etc. et en rajoutant « IA présumée » ;
  • discuter avec l'auteur de l'ajout des risques et des problèmes suscités ;
  • placer le bandeau {{IA générative}} ({{IA générative|date=octobre 2026}}) en tête d'article, avec le paramètre certain=oui si l'utilisation est avérée ;
  • indiquer en page de discussion de l'article les problèmes identifiés ;
  • le modifier pour le rendre conforme.

Notes et références

modifier
(en) Cet article est partiellement ou en totalité issu de l’article de Wikipédia en anglais intitulé « Wikipedia:Large language models » (voir la liste des auteurs).
  1. ↑ Les données d'entraînement peuvent contenir des œuvres de fiction, des discussions de forum, du contenu non structuré et de faible qualité optimisé pour le référencement, etc.
  2. ↑ Le contenu génère une suite de mots en faisant apparaître ceux qui sont les plus probables selon les données d'entraînement.
  3. ↑ (en) George Lee, Natalia Loukachevitch et Alexey Khokhlov, « Generating Encyclopedic Articles Based on a Collection of Scientific Publications », Proceedings of the International Conference “Dialogue 2025”,‎ (lire en ligne [PDF], consulté le ).
  4. ↑ (en) Joseph Dien, « Editorial: Generative artificial intelligence as a plagiarism problem », Biological Psychology, (DOI 10.1016/j.biopsycho.2023.108621), p. 108621.
  5. ↑ (en) Selena Deckelmann, « Wikipedia’s value in the age of generative AI », sur Fondation Wikimédia, .
  6. ↑ Quelques exemples :
    • Sites rédigés avec l'assistance d'un chatbot ;
    • Domaine universitaire ;
    • Monde de l'édition : « Sur Amazon, des milliers de livres seraient rédigées par intelligence artificielle sous de faux noms », Ouest-France,‎ (lire en ligne)
    • Presse : Claudia Cohen, « Claire Léost, présidente de Prisma Media : « Voici a publié sur son site ses premiers articles avec l’aide de l’IA » », Le Figaro,‎ (lire en ligne).
  7. ↑ L'insertion de fausses informations est assimilable à du vandalisme.
  8. ↑ Cela s’applique également lorsque le modèle d’IA se trouve dans une juridiction où les œuvres générées entièrement par IA ne sont pas protégées par le droit d’auteur, même si ces cas sont rares.
  9. ↑ Ils peuvent également être contraires à Wikipédia:Conventions de style.
  10. ↑ Le fait de ne pas trouver d'erreur dans 90 % du contenu ne garantit pas qu'il n'y en a aucune ou que les 10 % restants n'en contiennent pas.
  11. ↑ Exemple : prendre suffisamment de recul pour repartir des sources et voir si le contenu généré est fidèle ou pourrait être amélioré.

Voir aussi

modifier