Discussion Wikipédia:Intelligence artificielle générative
Note d'archive
modifier
Remarque Une partie des discussions se sont tenues sur Discussion Projet:Observatoire des IA/Règlementation/Contrôle des textes générés par IA et une autre sur Discussion utilisateur:LD/Intelligence artificielle générative. Les discussions sont aujourd'hui fusionnées. LD (d) 9 juin 2025 à 12:43 (CEST)
Présentation de l'essai
modifierObjectif : L'essai reprend des éléments de l'essai anglophone Large language models et entend jouer un rôle similaire par rapport au projet en:Wikipedia:WikiProject AI Cleanup :
- informer sur les risques d'infractions aux règles,
- indiquer des mesures à prendre (modèles, signalements etc.),
- faire des recommandations pour qui voudrait malgré tout utiliser ces technologies.
Placement : Il serait a priori à placer dans l'espace Wikipédia pour un statut pré-règlementaire à moins qu'on estime qu'un essai de projet soit mieux.
Principes rédactionnels : ça se veut plus direct que l'anglophone avec un essai de classification des recommandations autour de quelques principes : compétence, précaution, transparence, responsabilité personnelle. J'ai essayé d'équilibrer le côté « policier » et pédagogique.
Validation : obtenir un absolu consensus me semble difficile vu les divergences de vue qui se sont faites jour mais il s'agit d'avoir rapidement quelque chose à indiquer aux utilisateurs de bonne foi. On pourra voir plus tard comme le faire évoluer surtout si on se dirige vers un statut de règle/recommandation à faire voter. Fabius Lector (discuter) 3 novembre 2024 à 14:27 (CET)
- Ce contenu me semble être une excellente base, à mettre en évidence dans la page d'accueil du projet. --Pa2chant.bis (discuter) 9 novembre 2024 à 11:59 (CET)
- Question : déplacement dans l'espace Wikipédia ou conservation sur le Projet ? {{Essai}} dit « un essai porté par un projet » et ça lui donne plus ou moins de poids que ceux dans l'espace Wikipédia ? Fabius Lector (discuter) 9 novembre 2024 à 13:15 (CET)
- L'objectif doit être de le basculer sur l'espace WP quand il fera consensus comme recommandation. Son emplacement avant cela n'a pas d'incidence je pense en termes de poids, par contre, c'est nettement plus facile à trouver sur WP. Et pour le trouver plus facilement, je préconise un titre commençant par par "Intelligence artificielle". --Pa2chant.bis (discuter) 11 novembre 2024 à 09:00 (CET)
- @Pa2chant.bis, comme apparemment on n'est que tous les deux à vraiment suivre, je propose le renommage Wikipédia:Intelligence artificielle - Contrôle des textes générés. Quelqu'un qui chercherait verrait que l'essai existe et ça éviterait qu'on ne s'en remette à Wikipédia:Intelligence_artificielle qui est orienté autrement. Ok pour toi ?
- Et je referais les liens dans les modèles pour renvoyer vers le nouvel emplacement plutôt que la redirection, en espérant qu'on ne nous demande pas de rapatrier l'essai sur le projet. Fabius Lector (discuter) 13 novembre 2024 à 10:07 (CET)
- +1 pour l'espace. Un titre plus global, incluant les 3 objectifs (informer sur les risques, préconiser les mesures à prendre, émettre des recommandations en cas d'usage) me semblerait plus adapté toutefois. Par exemple WP:Intelligence artificielle - articles générés par IA. Mais tu peux profiter de ton sondage informel pour valider le titre ou obtenir de meilleures suggestions. La probabilité qu'on demande rapatrier ce texte dans l'espace projet est faible, sauf s'il y a une levée de boucliers lorsque tu le présenteras (dès que possible) sur le Bistro et le Bullpat. --Pa2chant.bis (discuter) 13 novembre 2024 à 13:58 (CET)
- En fait, autant le laisser là en attendant les réactions, suffira d'indiquer que le titre et le placement sont encore en discussion et ça évitera d'attendre d'autres opinions venant du projet.
- Là, j'ai fait du nettoyage sur les pages Accueil, Règlementation et Contrôle, faut que je réfléchisse à une présentation courte pour le Bistro et BullPat, et de mon côté, ça devrait être ok pour demander les avis vendredi ou samedi. Fabius Lector (discuter) 13 novembre 2024 à 14:56 (CET)
- +1 pour l'espace. Un titre plus global, incluant les 3 objectifs (informer sur les risques, préconiser les mesures à prendre, émettre des recommandations en cas d'usage) me semblerait plus adapté toutefois. Par exemple WP:Intelligence artificielle - articles générés par IA. Mais tu peux profiter de ton sondage informel pour valider le titre ou obtenir de meilleures suggestions. La probabilité qu'on demande rapatrier ce texte dans l'espace projet est faible, sauf s'il y a une levée de boucliers lorsque tu le présenteras (dès que possible) sur le Bistro et le Bullpat. --Pa2chant.bis (discuter) 13 novembre 2024 à 13:58 (CET)
- L'objectif doit être de le basculer sur l'espace WP quand il fera consensus comme recommandation. Son emplacement avant cela n'a pas d'incidence je pense en termes de poids, par contre, c'est nettement plus facile à trouver sur WP. Et pour le trouver plus facilement, je préconise un titre commençant par par "Intelligence artificielle". --Pa2chant.bis (discuter) 11 novembre 2024 à 09:00 (CET)
- Question : déplacement dans l'espace Wikipédia ou conservation sur le Projet ? {{Essai}} dit « un essai porté par un projet » et ça lui donne plus ou moins de poids que ceux dans l'espace Wikipédia ? Fabius Lector (discuter) 9 novembre 2024 à 13:15 (CET)
Contenu
modifierJe réalise que j'ai raté un truc majeur, c'est qu'alors que le texte en anglais prévoit et encadre des cas d'utilisation à la marge, ici est cité en exemple " rédaction par Perplexity AI", ce qui me semble-t-il va à l'encontre des discussions tenues sur le sujet. Du coup la rédaction en devient très ambigüe, quasiment contraire à toute la première partie en semblant autoriser ce type de créations, et explique sans doute pourquoi un contributeur s'est cru autorisé à créer un article par Chat GPT en indiquant qu'il était spécialiste et que le texte était bon. --Pa2chant.bis (discuter) 15 novembre 2024 à 07:27 (CET)
- Pour tenir compte d'une objection formulée par LD — "double discours que de dire : n'utilisez pas d'IA ; déclarez-le si vous l'utilisez." —, je viens de tenter de clarifier le texte en distinguant les usages interdits (tel que le comprend JeaNCASPAR) ie génération d'articles ou de parties d'articles, de ceux possibles (aide à la rédaction au sens large). Je découvre que cela se croise avec vos remarques sur le bistro, et risque donc d'engendrer un refus. + @Cosmophilus, @Jules*, @Nanoyo88, @Fabius Lector, @Apollinaire93 et @Aelxen, pourriez-vous indiquer si ces modifications sont pour vous acceptables ? --Pa2chant.bis (discuter) 2 mars 2025 à 22:34 (CET)
- J'approuve les modifications. Aelxen Équipe EBRC 2 mars 2025 à 22:47 (CET)
- C'est toujours pas très clair je trouve. "L'utilisation de l'IA pour générer des articles ou portions d'article est interdit." s'oppose complètement à "rédaction par Perplexity AI" par exemple.
- Je pense que les seules choses qui devraient être interdites, c'est de publier du texte avec des hallucinations, sans citer les sources, ou sans respecter le style. À mon sens ce texte n'a pas besoin d'ajouter de nouvelles interdictions, ces choses-là étant déjà interdites ; simplement de fournir des recommandations sur son bon usage et sur les pièges de ce genre d'outils.
- Et je critique aussi plus précisément cette phrase : "tout texte généré par une IA identifiable comme tel doit être supprimé ou réécrit", en ce qu'il y a probablement des tics de langage qui permettent de reconnaître une IA, comme certains tics de langage qui permettent d'identifier certains contributeurs en particulier, et ce n'est pas rédhibitoire pour autant ; pourquoi dans ce cas appliquer un traitement différencié pour une simple aide à l'écriture (tant que le texte est bon, bien sûr) ? JeanCASPAR (discuter) 2 mars 2025 à 22:47 (CET)
- Je ne sais pas trop comment tout ça est compris et je ne saisis pas bien ce que sont les « outils autres que les générateurs de texte » en question mais la logique à l'origine était :
- si vous ne maîtrisez pas assez les outils et le domaine concerné pour que l'usage soit indiscernable d'un texte normal, ne les utilisez pas ;
- et même si vous avez la maîtrise suffisante, la transparence est malgré tout recommandée pour qu'on sache où en sont les usages (intérêt statistique, suivi des pratiques etc.).
- Forcément, dans un cadre « répressif », d'interdiction, le 2nd point aura peu de chance d'être suivi, les gens préférant ne pas se signaler. Dans un cadre plus pédagogique, de recommandation avec participation transparente, ça a une petite chance de fonctionner. Fabius Lector (discuter) 2 mars 2025 à 22:49 (CET)
- @@JeanCASPAR Pour Perplexity IA, en effet, la mention est à supprimer si on va dans ce sens. Sur le pourquoi d'un traitement différencié, c'est parce que la puissance de production et les difficultés de vérification sont telles (les articles ont l'air correct, et il faut vérifier chaque source pour relever les erreurs) qu'on risque d'être submergés (on l'est déjà de mon point de vue). J'aimerais bien voir deux articles générés par IA qui seraient corrects. @Fabius Lector les outils autres que des générateurs de texte sont ceux de résumé d'un texte, les correcteurs de syntaxe/orthographiques, les outils de traduction, etc. Le problème de la phrase "si vous ne maîtrisez pas les outils ne les utilisez pas" est qu'une grande partie d'utilisateurs peuvent croire qu'ils les maitrisent, et du coup le conseil n'a aucune portée. La question de la transparence s'applique à ces outils d'aide. Pour les textes générés, en effet les gens savent qu'ils risquent d'attirer l'attention sur leurs textes et déjà ne les signalent pas, pour certains en toute connaissance de cause. --Pa2chant.bis (discuter) 2 mars 2025 à 23:04 (CET)
- "Il faut vérifier chaque source pour relever les erreurs" => C'est aussi le cas sans genAI, et ça n'empêchera pas les personnes qui écrivent n'importe quoi sans vérifier de continuer. Pour moi ça va juste faire peser un risque sur des contributeurs qui utilisent de la genAI "correctement".
- Les outils de genAI permettent notamment la reformulation, ce qui est plutôt pratique pour les personnes ayant des difficultés à s'exprimer. Si on interdit la genAI purement et simplement, on interdit cet usage.
- JeanCASPAR (discuter) 2 mars 2025 à 23:09 (CET)
- My two cents : je serais ravi d'une interdiction pure et simple de la genIA sur Wiki. On est envahi par ça sur tout internet, ce serait bien d'épargner notre encyclopédie. Sur la dernière modif de Pa2chant : sorry mais je ne comprends pas les changements sur les paragraphes en haut et tout en bas, ces changements me semblent superflus. Apollinaire93 (discuter) 2 mars 2025 à 23:14 (CET)
- @JeanCASPAR Quand des personnes écrivent n'importe quoi sans GenAI, c'est souvent plus visible, car elles intègrent plus rarement la notion de probabilité que ce qu'elles disent soit exact. Et elles ne le font pas de manière industrielle. Et surtout, le processus est inverse : elles lisent les sources d'abord, donc le risque est moindre. Il y a bien sûr des contre exemples (des articles complètement fake repérés quelques années plus tard) mais cela reste rare.
- Concernant les reformulations, cela fait partie justement des usages possibles. --Pa2chant.bis (discuter) 2 mars 2025 à 23:17 (CET)
- @Apollinaire93 Le texte initial était ambigu, en déconseillant la génération de texte, mais en préconisant toute une série de mesures dans la section Recommandations aux utilisateurs. Le but des modifications est de lever l'ambiguité, en distinguant bien ce qui relève de l'assistance à la rédaction d'une part, de la génération ab nihilo d'autre part. S'il y a des propositions pour une meilleure rédaction, je suis preneuse. (Au passage, je m'aperçois que j'ai oublié de notifier @Jean-Christophe BENOIST, mes excuses).
- Nota : j'ai supprimé la mention de Perplexity et donné des exemples d'utilisation possible. --Pa2chant.bis (discuter) 2 mars 2025 à 23:37 (CET)
- Hello. Pas le temps de regarder en détail, mais il faut àmha simplifier le texte. Le troisième paragraphe de l'intro, par exemple, est trop abstrait (« des mesures de contrôle de type administratif » ? je comprends, mais je doute que tout le monde saisisse qu'on parle de blocage) et trop verbeux.
- Le deuxième aussi d'ailleurs. Au lieu de :
« Étant données les lacunes de ces technologies, tout texte généré par une IA identifiable comme tel doit être supprimé ou réécrit. »
- je propose :
— Jules* 💬 2 mars 2025 à 23:56 (CET)« Si l'on peut déterminer qu'un texte est généré par IA, c'est qu'il contrevient à l'une des règles de Wikipédia (style non encyclopédique, informations fausses, etc.) ; il doit alors être supprimé ou réécrit. »
- J'ai proposé une réécriture du RI. — Jules* 💬 3 mars 2025 à 00:23 (CET)
- Conflit d’édition — Je voulais proposer de remonter la phrase
mais du coup, ton texte est clair. --Pa2chant.bis (discuter) 3 mars 2025 à 00:32 (CET)« Eu égard à ces problèmes, l'utilisation de l'IA pour générer des articles ou portions d'article est interdit, notamment en raison de la prolifération constatée de tels textes, et de la trop grande maintenance qu'ils nécessitent. »
- Perso je ne suis pas pour l'interdiction de l'apport AI en matière de rédaction d'article: il se voit assez bien notamment avec un sourçage absent ou indigent. Certes, il faudra plus de vigilance en patrouille sur le sourçage (mais poser le bandeau idoine et/ou des tags "ref sou", "sources insuffisantes", "évasif", ou autres on sait faire). Ce qui compte àmha c'est attirer l'attention du lecteur sur la prudence à avoir, (voire dans l'idéal l'inciter à chercher des bonne sources..).
- De plus, j'ai du mal à imaginer un détecteur d'IA fiable à 100% en permanence...on a affaire à des IA qui apprennent tout le temps (en attaque et en défense). Et donc in fine on risque d'avoir des contestations sans fins (entre humains ça on sait faire aussi..) si on part sur des interdictions.. Limfjord69 (discuter) 2 mars 2025 à 23:48 (CET)
- Si tu prends le cas qui a été l'origine de l'identification des 172 articles, justement c'était des textes sourcés, à un nom près. Si je n'avais pas connu le connu le sujet, je n'aurais sans doute pas fait très attention à la modification, et surtout, je n'ai vu que dans un second temps que pour l'essentiel, la partie sourcée, où le texte à première vue semblait correspondre aux sources, cela résultait d'une genIA. La majeure partie des textes générés par IA actuellement ont des sources, et ce facteur ne permet pas de repérer les problèmes éventuels. Si l'on se contente de poser des bandeaux (évasif, refconf, etc.) sans une analyse poussée, on peut simplement donner l'impression que ce qui n'est pas tagué est Ok. Et de mon point de vue, accumuler ces pages peut juste contribuer à convaincre les lecteurs que, puisque WP est plein d'IAgen, autant s'adresser directement aux IA.
- Concernant les détecteurs d'IA, on sait qu'ils ne sont pas complètement fiables (20 % d'erreurs dans les deux sens dans le dernier papier que j'avais lu). Raison d'ailleurs pour laquelle, à mon avis, il vaut mieux poser le principe d'une interdiction pour que les choses soient claires. Car on n'arrivera jamais à juguler le truc si c'est vaguement autorisé. (Sur les 172 articles identifiés hier, seuls trois ont été traités à ma connaissance, et je ne suis même pas sure que le bandeau d'IA ait été posé sur tous : rien que cette opération est longue si on veut traiter correctement le problème sans faux positifs.) --Pa2chant.bis (discuter) 3 mars 2025 à 00:08 (CET)
- C'est plutôt le rythme de contribution, le manque de repentir ou de peaufinage, qui peut permettre de distinguer une utilisation d'AI. Rythme qui montre aussi - et surtout - que le seul moyen d'utiliser correctement une AI n'a pas été utilisé : lire et comprendre les sources soi-même, et contrôler soi-même la synthèse qui est est faite par l'AI. Tout cela prend du temps et se fait de manière incrémentale, pas en un coup.
- Je pense que un moyen de lutter est de demander de travailler sur un article dans des brouillons publics, ou l'article lui-même. C'est le cas pour la plupart des contributeurs car c'est de toutes manières très malaisé de mettre au point les wikifications en dehors de Wikipédia, on se complique la vie.
- Je n'ai pas regardé les 172 cas, mais je suis sûr que le rythme est élevé, et des contributions monolithiques, non incrémentales. Jean-Christophe BENOIST (discuter) 3 mars 2025 à 10:27 (CET)
- Pour le moment, sur les quelques cas analysés (très peu, 7, cela prend du temps) la typologie est très large.--Pa2chant.bis (discuter) 3 mars 2025 à 19:37 (CET)
- @Apollinaire93 Le texte initial était ambigu, en déconseillant la génération de texte, mais en préconisant toute une série de mesures dans la section Recommandations aux utilisateurs. Le but des modifications est de lever l'ambiguité, en distinguant bien ce qui relève de l'assistance à la rédaction d'une part, de la génération ab nihilo d'autre part. S'il y a des propositions pour une meilleure rédaction, je suis preneuse. (Au passage, je m'aperçois que j'ai oublié de notifier @Jean-Christophe BENOIST, mes excuses).
- My two cents : je serais ravi d'une interdiction pure et simple de la genIA sur Wiki. On est envahi par ça sur tout internet, ce serait bien d'épargner notre encyclopédie. Sur la dernière modif de Pa2chant : sorry mais je ne comprends pas les changements sur les paragraphes en haut et tout en bas, ces changements me semblent superflus. Apollinaire93 (discuter) 2 mars 2025 à 23:14 (CET)
- @@JeanCASPAR Pour Perplexity IA, en effet, la mention est à supprimer si on va dans ce sens. Sur le pourquoi d'un traitement différencié, c'est parce que la puissance de production et les difficultés de vérification sont telles (les articles ont l'air correct, et il faut vérifier chaque source pour relever les erreurs) qu'on risque d'être submergés (on l'est déjà de mon point de vue). J'aimerais bien voir deux articles générés par IA qui seraient corrects. @Fabius Lector les outils autres que des générateurs de texte sont ceux de résumé d'un texte, les correcteurs de syntaxe/orthographiques, les outils de traduction, etc. Le problème de la phrase "si vous ne maîtrisez pas les outils ne les utilisez pas" est qu'une grande partie d'utilisateurs peuvent croire qu'ils les maitrisent, et du coup le conseil n'a aucune portée. La question de la transparence s'applique à ces outils d'aide. Pour les textes générés, en effet les gens savent qu'ils risquent d'attirer l'attention sur leurs textes et déjà ne les signalent pas, pour certains en toute connaissance de cause. --Pa2chant.bis (discuter) 2 mars 2025 à 23:04 (CET)
- Je ne sais pas trop comment tout ça est compris et je ne saisis pas bien ce que sont les « outils autres que les générateurs de texte » en question mais la logique à l'origine était :
- Bonjour
Je n'étais pas d'accord avec toutes les modifications susmentionnées, en particulier la phrase l'utilisation de l'IA pour générer des articles ou portions d'article est interdit (précisément, le but de la page est de dire quand il est permis avec vigilance et quand il est interdit). Néanmoins, celle-ci ayant été retirée depuis, la page dans son état actuel me semble globalement convenable. - Il faudrait tout de même préciser ce qu'on entend par générateur de texte, notamment dans la section #Recommandations aux utilisateurs d'autres outils IA d'aide à la rédaction, car un outil IA de correction, de synthèse de sources ou de traduction est littéralement un générateur de texte (il génère du texte) ; or ceux-ci se trouvent dans la catégorie « permis avec vigilance », et non « interdit ». Ce qui est interdit, en réalité, ce sont les copiés-collés bruts d'IA conversationnelles de type ChatGPT, non fondés sur des données extérieures et non relues, je pense que nous sommes tous d'accord là-dessus : il faudrait trouver une formulation non ambiguë, pour que toute personne lisant la page comprenne de quoi il s'agit. -- Cosmophilus (discuter) 3 mars 2025 à 19:17 (CET)
- Oui, je me doutais de la remarque. Je pensais avoir contourné la difficulté en parlant des usages, et en opposant "pour produire du texte" à "Certaines utilisations sont admises (résumé d'une source, aide à la traduction, à la reformulation, à la correction orthographique, etc.) mais nécessitent toutefois la même compréhension fine du fonctionnement de ces outils et une vérification scrupuleuse." Mais si tu as (ou quelqu'un d'autre a) une meilleure idée, NHP. --Pa2chant.bis (discuter) 3 mars 2025 à 19:37 (CET)
- J'ai tenté une modification:
- Outre quelques modifications esthétiques, j'ai précisé que l'usage d'IA pour résumer des sources ne peut pas exonérer de lire les sources, et j'ai modifié la phrase "L'utilisation d'autres outils d'aide à la rédaction" puisque ces outils peuvent aussi être des outils d'IA générative. JeanCASPAR (discuter) 3 mars 2025 à 22:09 (CET)
- Solution élégante,
JeanCASPAR. Pour parachever le tout, je propose de remplacer le titre de section Recommandations aux utilisateurs d'autres outils IA d'aide à la rédaction par Utilisation raisonnée de l'IA générative ou Préconisations pour une utilisation raisonnée de l'IA générative (quelque chose de ce genre) : primo, cela renforce la cohérence de la page en rappelant que le risque porte sur la façon dont on utilise les outils, et non tant sur le choix des outils eux-mêmes ; et secundo, cela reflète mieux le contenu de la section. -- Cosmophilus (discuter) 4 mars 2025 à 19:07 (CET)
- Oui, même si cela a une petite connotation "Pas trop, mais on ne peut pas s'en passer" par analogie avec l'agriculture raisonnée, c'est sans doute mieux que le titre actuel.--Pa2chant.bis (discuter) 5 mars 2025 à 08:26 (CET)
- Solution élégante,
- Oui, je me doutais de la remarque. Je pensais avoir contourné la difficulté en parlant des usages, et en opposant "pour produire du texte" à "Certaines utilisations sont admises (résumé d'une source, aide à la traduction, à la reformulation, à la correction orthographique, etc.) mais nécessitent toutefois la même compréhension fine du fonctionnement de ces outils et une vérification scrupuleuse." Mais si tu as (ou quelqu'un d'autre a) une meilleure idée, NHP. --Pa2chant.bis (discuter) 3 mars 2025 à 19:37 (CET)
@LD je regrette qu'après une semaine de discussion sur le contenu du texte, celui-ci, tout imparfait qu'il puisse être, soit chamboulé avec un résultat rendant le cheminement intellectuel incompréhensible, et ne pouvant qu'attirer un réflexe de rejet. Il est possible d'avoir à l'esprit une vision alternative, encore faudrait-il que la démarche aille jusqu'au bout. Dans le cas contraire, j'en revendrai à la version initiale. La notion de blocage possible a par exemple été supprimée, ce qui fait courir le risque d'interprétation d'un "déconseil" purement théorique. Et si proposes une autre version, il faudrait faire ressortir la distinction initiale entre texte généré par AI et composantes d'aide à la rédaction. Cdlt,--Pa2chant.bis (discuter) 8 mars 2025 à 16:47 (CET)
- @Pa2chant.bis C'est entendu. La révision proposée est déplacée dans Utilisateur:LD/Intelligence artificielle générative, bien que non terminée. Les deux versions pourront être proposées (ou non) lors du sondage. Contributions bienvenues. LD (d) 8 mars 2025 à 17:42 (CET)
- Merci LD
, je regarderai cela demain soir. --Pa2chant.bis (discuter) 8 mars 2025 à 18:12 (CET)
- Merci LD
Dans l'espace de discussion
modifierL'utilisation de LLM dans l'espace de discussion est un peu enfoui dans l'ensemble (Projet:Observatoire_des_IA/Règlementation/Contrôle_des_textes_générés_par_IA#Savoir-vivre,_bonne_foi_et_discussions) alors qu'il s'agit d'un sujet fondamentalement différent (à mon opinion). Ne faudrait-il pas en faire un chapitre séparé ? Il est défendable (et j'y suis favorable) d'interdire complètement l'utilisation de LLM dans cet espace, alors que (à juste titre) c'est plus nuancé dans l'espace encyclopédique. Les raisons de dysorthographie ou semblables, ne sont pas vraiment des raisons d'utiliser les LLM dans l'espace de discussion, car nous avons un point d'honneur à tolérer de manière bienveillante (en principe) ce genre de différence. --Jean-Christophe BENOIST (discuter) 8 mars 2025 à 10:07 (CET)
- Je ne sais pas s'il est souhaitable que tout outil de type IA générative, et notamment les outils de retouche, soient interdits en espace de discussion. @Aelxen qui est utilisateur, s'inquiétait justement qu'on puisse en interdire totalement l'usage. Ce qui est certain par contre, c'est que des textes entièrement générés par IA ne sont pas acceptables. Dès lors, si ce point est confirmé, le découpage actuel me parait cohérent --Pa2chant.bis (discuter) 8 mars 2025 à 14:12 (CET)
- Ce serait un constat d'échec de la tolérance à ce genre de différences. Peut-être dans certains cas où la prose est complètement incompréhensible ou pénible, mais après presque 20 ans de WP, je n'ai qu'un seul exemple en tête (que je ne dirais pas), c'est rare. Jean-Christophe BENOIST (discuter) 8 mars 2025 à 14:30 (CET)
- Lui (la personne à qui tu penses) s'en fiche, mais ce n'est pas le cas de tous. Il vaudrait mieux avoir l'avis des personnes concernées plutôt que de trancher à leur place. --Pa2chant.bis (discuter) 8 mars 2025 à 16:33 (CET)
- En effet, les personnes concernées peuvent faire un constat d'échec. Jean-Christophe BENOIST (discuter) 8 mars 2025 à 16:48 (CET)
- Lui (la personne à qui tu penses) s'en fiche, mais ce n'est pas le cas de tous. Il vaudrait mieux avoir l'avis des personnes concernées plutôt que de trancher à leur place. --Pa2chant.bis (discuter) 8 mars 2025 à 16:33 (CET)
- Ce serait un constat d'échec de la tolérance à ce genre de différences. Peut-être dans certains cas où la prose est complètement incompréhensible ou pénible, mais après presque 20 ans de WP, je n'ai qu'un seul exemple en tête (que je ne dirais pas), c'est rare. Jean-Christophe BENOIST (discuter) 8 mars 2025 à 14:30 (CET)
Texte un peu difficile à comprendre
modifierBonjour, merci pour ce texte mais il me semble un peu difficile à comprendre pour des personnes qui utiliseraient ChatGPT ou autre sans savoir vraiment s'en servir (qui est le public visé, je pense). Par exemple, parler d'"hallucinations" dès l'introduction (le mot dans ce contexte n'est expliqué que plus loin et encore, avec une référence à un article qui n'existe pas sur wp-fr (ok, trouvé)). Cdlt, Cgolds (discuter) 8 mars 2025 à 22:44 (CET)
- Merci Cgolds du signalement, J'ai inséré un exemple en note si cela peut aider (mais juste sur cet exemple). Peux-tu donner ton avis sur la contre-proposition de LD Utilisateur:LD/Intelligence artificielle générative ? Il y aurait des détails à rajouter car elle est un peu minimaliste, mais pourquoi pas si une majorité se dégage pour cette version. On pourrait demander aux sondés de choisir, mais cela me semble contradictoire de demander de se prononcer sur l'adoption d'un texte dans un sondage pour ensuite demander si finalement on ne préfèrerait pas adopter un autre texte... (le principe étant le passage en recommandation, pas les détails de présentation du texte lui-même). --Pa2chant.bis (discuter) 9 mars 2025 à 07:26 (CET)
- Au fait, le public visé c'est absolument tout le monde, et en premier lieu, ceux qui pensent savoir maitriser l'outil (je suis en train d'éplucher la liste des 172 insertions faites en recourant à du sourçage via chat-gpt, et qui se remplit presque autant que ce que je la vide, : c'est révélateur des différents problèmes et montre une grande variété de profils dont des personnes opposées sur le papier à l'emploi de l'IA). --Pa2chant.bis (discuter) 9 mars 2025 à 07:34 (CET)
- Bonjour Pa2chant.bis (et tout le monde). Je trouve le texte de la contre-proposition plus clair et plus direct au début (je continue à penser qu'il faut éviter de se référer aux hallucinations immédiatement ou alors dire quelque chose comme "ce qu'on appelle hallucinations en intelligence artificielle"). J'aurais tendance à suggérer de reprendre en introduction le texte de l'avant-propos de la contre-proposition, puis éventuellement utiliser le texte ici pour le développement. Le problème des sources est d'ailleurs un problème important (Chatgpt invente des sources qui ont l'air tout à fait vraisemblables, auteur, titre, lieu de publication etc, mais qui n'existent pas, je me suis fait avoir une fois en essayant de les trouver :)). Je crois qu'il faut insister sur le fait que les IA accessibles librement en ce moment produisent seulement des textes qui ont l'air vraisemblables. Il y a d'autres problèmes en cours sur WP qui ne sont pas pris au sérieux (ex : traduction pure et simple, parfois automatiquement, d'un article se présentant comme un article de synthèse et publié en libre accès - ce n'est donc pas interdit légalement, mais ces articles n'ont pas vocation à être fiables). Cdlt-- Cgolds (discuter) 9 mars 2025 à 13:14 (CET)
- Il est clair que le texte de LD est plus percutant mais sans doute trop synthétique pour des néophytes. Il serait bien d'avoir d'autres avis ou des interventions directement sur sa proposition, comme il l'a demandé. --Pa2chant.bis (discuter) 10 mars 2025 à 19:14 (CET)
- Bonjour Pa2chant.bis (et tout le monde). Je trouve le texte de la contre-proposition plus clair et plus direct au début (je continue à penser qu'il faut éviter de se référer aux hallucinations immédiatement ou alors dire quelque chose comme "ce qu'on appelle hallucinations en intelligence artificielle"). J'aurais tendance à suggérer de reprendre en introduction le texte de l'avant-propos de la contre-proposition, puis éventuellement utiliser le texte ici pour le développement. Le problème des sources est d'ailleurs un problème important (Chatgpt invente des sources qui ont l'air tout à fait vraisemblables, auteur, titre, lieu de publication etc, mais qui n'existent pas, je me suis fait avoir une fois en essayant de les trouver :)). Je crois qu'il faut insister sur le fait que les IA accessibles librement en ce moment produisent seulement des textes qui ont l'air vraisemblables. Il y a d'autres problèmes en cours sur WP qui ne sont pas pris au sérieux (ex : traduction pure et simple, parfois automatiquement, d'un article se présentant comme un article de synthèse et publié en libre accès - ce n'est donc pas interdit légalement, mais ces articles n'ont pas vocation à être fiables). Cdlt-- Cgolds (discuter) 9 mars 2025 à 13:14 (CET)
- Au fait, le public visé c'est absolument tout le monde, et en premier lieu, ceux qui pensent savoir maitriser l'outil (je suis en train d'éplucher la liste des 172 insertions faites en recourant à du sourçage via chat-gpt, et qui se remplit presque autant que ce que je la vide, : c'est révélateur des différents problèmes et montre une grande variété de profils dont des personnes opposées sur le papier à l'emploi de l'IA). --Pa2chant.bis (discuter) 9 mars 2025 à 07:34 (CET)
Remarques
modifier- Certains LLMs citent leurs sources, c'est le cas notamment d'Elicit et de Gemini, il ne faut pas les mettre dans le même panier
- Les hallucinations (et je suis d'accord que c'est LE problème des LLMs) ne sont plus si courantes, du fait que l'apprentissage par renforcement des LLMs a pris le pas sur la simple autocomplétion des modèles de fondation
- Par le design de l'entrainement des modèles de fondation et par expérience, les LLMs sont très consensuels — je ne crois pas que la synthèse inédite soit un problème. Hplotter (discuter) 1 juin 2025 à 16:25 (CEST)
- Bonjour Hplotter . J'ai révoqué tes modifications, en étant notamment en désaccord avec les deux premières, et parce que si le texte est amendable, il parait important de ne pas trop en chambouler la substance alors qu'un vote est en cours, et que des voix se sont déjà exprimées sur une version avant tes interventions.
- Très concrètement, des utilisateurs considèrent bien qu'il y a tromperie à faire passer du texte rédigé par une IA par du texte rédigé par un être humain.
- La question des traductions a volontairement été mise de côté, sachant les problèmes que nous rencontrons avec les trop nombreuses traductions par IA non relues et non sourcées.
- Sur les autres points de ta troisième intervention, ils sont peut-être plus acceptables, mais j'ai cru un instant que tu retirais la mention du risque de TI, et le premier lien cité renvoie à une page blanche. Il faudrait pour ces points là au minimum s'assurer en PDD du sondage que de telles modifications ne posent de problèmes à personne. --Pa2chant.bis (discuter) 1 juin 2025 à 21:09 (CEST)
- Utiliser un LLM n'implique pas « faire passer du texte rédigé par une IA par du texte rédigé par un être humain », raison pour laquelle j'écris pas une tromperie en soi. Hplotter (discuter) 1 juin 2025 à 21:15 (CEST)
- Sans prévenir, si, un peu quand même. --Pa2chant.bis (discuter) 2 juin 2025 à 00:43 (CEST)
- Sans déclaration de l'utilisateur qu'il n'utilise pas de LLM ou que ses modifications sont uniquement humaines (ce qui est le défaut il me semble), non. https://www.larousse.fr/dictionnaires/francais/tromper/79915
- Sans prévenir, si, un peu quand même. --Pa2chant.bis (discuter) 2 juin 2025 à 00:43 (CEST)
- « Il faudrait pour ces points là au minimum s'assurer en PDD du sondage que de telles modifications ne posent de problèmes à personne » Les autres contributeurs, pour lequels vous n'avez pas annulé leurs modifications, n'ont pas demander un accord en PdD, et c'est normal. Par ailleurs, vous devez savoir que WPD fonctionne par consensus, pas à l'unanimité. Hplotter (discuter) 14 juin 2025 à 13:19 (CEST)
- J'ai mis un {{ref nec}} à « conduit quasi systématiquement à l'insertion d'informations hallucinées, à des travaux inédits, à l'emploi d'un style non encyclopédique, voire à du plagiat » une phrase aussi affirmative est sans doute rigoureusement fausse. En tout cas elle a besoin de références solides. Si on remplace par "peut conduire" ça devient ok. --Lewisiscrazy (discuter) 5 juin 2025 à 15:44 (CEST)
- Il y a des outils de détection de texte écrit par IA, est-ce qu'on pourrait demander à la fondation de les implémenter sur les articles ? --Lewisiscrazy (discuter) 5 juin 2025 à 15:44 (CEST)
- @Lewisiscrazy Donne nous un exemple, un seul, ou un texte produit par LLM n'ait pas l'un de ces défauts. Pour le moment, on cherche toujours. Il est vrai que dans la phrase, cela semble cumulatif, la formulation est peut-être à retoucher. Autres avis bienvenus. Mais si c'était seulement une possibilité, on ne serait pas aussi fermes.
- Pour les outils de détection, ils ne sont pour le moment pas fiables, surtout quand il s'agit de traductions de l'anglais. A ma connaissance, il est nécessaire de rajouter systématiquement, sauf pour les cas les plus flagrants, une couche de détection par IH (Intelligence humaine, un vieux nanard pas très à la mode mais qui marche quand même un peu). L'un des contributeurs du projet se demndait si cela ne valait pas le coup de demander à WMF de développer un tel outil, mais vu le budget et les délais, cela a semblé hors de portée à un autre contributeur. --Pa2chant.bis (discuter) 5 juin 2025 à 16:48 (CEST)
- Ahah « donne nous un exemple, un seul! » c'est pas un peu une rhétorique d'avocat véreux? (no offense
). Mais écoute, je viens de demander à ChatGPT de résumer en un paragraphe Three Guineas de Virginia Woolfet je trouve le résultat bluffant. Qu'on ne me méprenne pas, je suis totalement opposé à l'utilisation d'IAg et d'autres formes d'IA dont je trouve l'utilisation abêtissante (cela inclut ma requête ci-dessus), mais ce n'est pas une raison pour dire que tout ce qui sort de chatgpt est halluciné et non encyclopédique. Il y a d'autres raisons de s'y opposer. --Lewisiscrazy (discuter) 5 juin 2025 à 18:25 (CEST)- PS Et https://quillbot.com/fr/detecteur-ia a détecté 100% d'IA dans le paragraphe en français résultat de ma requête: --Lewisiscrazy (discuter) 5 juin 2025 à 18:29 (CEST)
- * Alors, non, au contraire : si j'étais une avocate véreuse, je te balancerais les centaines de sources disant que l'IA générative provoque quasi-systématiquement ceci ou cela...et cela ne prouverait rien. Si tu me donnes 1 texte qui marche, cela prouveque ce n'est pas systématique. (My bad, je n'avais pas fait attention au "quasi", du coup il en faut plus d'un.) Mais bon, je te renvoie à toutes les sources répertoriées sur le projet:Observatoire des IA.
- Pour ton résumé de paragraphe, Félicitations ! Tu viens de tomber pile dans les cas tolérés, notamment le résumé d'1 (UN et un seul) texte, parce qu'on sait que parfois cela peut marcher sans anicroche, mais pas toujours. Raison pour laquelle, même pour cet usage, il faut absolument maitriser le sujet s'il est un peu technique, et relire scrupuleusement. Concernant le résultat correct au détecteur, c'est le problème inverse du premier point : ce n'est pas parce que cela marche une fois que cela marche systématiquement (des sources indiquent un taux de mauvaises réponses de 20 %, à revoir nettement à la hausse si c'est une traduction, même à la mimine, d'un texte en anglais, ou si l'auteur/trce est neuroatypique). Signé : L'avocate véreuse AKA Pa2chant.bis (discuter) 5 juin 2025 à 19:51 (CEST)
- Oh la la j'espère que je t'ai pas vexée quand même --Lewisiscrazy (discuter) 5 juin 2025 à 20:13 (CEST)
- Absolument pas, cela m'a fait rire, oublie l'avocate si ça perturbe la lecture, et regarde le reste de mes réponses. --Pa2chant.bis (discuter) 5 juin 2025 à 20:29 (CEST)
- Bonjour GF38storic
Supprimer le {{ref nec}} vraiment ? cet éditorial source toute la phrase? --Lewisiscrazy (discuter) 7 juin 2025 à 09:38 (CEST)
- Bonjour @Lewisiscrazy, j'aime pas les refnec
, c'était histoire d'avoir rapidement au moins une source (pas la meilleure, je reconnais). Beaucoup de sources parlent du plagiat, peu en mesurent (avec des chiffres) la réalité avec exemples inclus. J'ai hésité avec les suivantes (Recherche humaine, si si si) :
- La tribune dans Le Monde de Serge Abitboul
- Normand Roy et Alexandre Lepage, « L’intelligence artificielle (IA) et le plagiat », sur Erudit.com, Formation et profession, , p. 1–4
- (en) Samuel Eggert et Denis Peskoff, « The Rise of AI-Generated Content in Wikipedia », sur ArXiv, mais parle peu de plagiat au final
- (en) « Copyleaks Research Finds Nearly 60% of GPT-3.5 Outputs Contained Some Form of Plagiarized Content », sur Copyleaks, mais c'est un blog, source primaire (report) avec offre payante de solutions...
- (en) Chris Westfall, « Educators Battle Plagiarism As 89% Of Students Admit To Using OpenAI’s ChatGPT For Homework », sur Forbes.com, Forbes, (j'aime pas la quantité de pop-ups)
- (en) Shushanta Pudasaini, Luis Miralles-Pechuán, David Lillis et Marisa Llorens Salvador, « Survey on AI-Generated Plagiarism Detection: The Impact of Large Language Models on Academic Integrity », sur Springer Nature, Journal of Academic Ethics, (DOI 10.1007/s10805-024-09576-x)
- etc
- Cordialement GF38storic (discuter) 7 juin 2025 à 11:35 (CEST)
- (Réponse par ChatGPT4.0)
- Voici quelques références d'articles qui discutent du sujet du plagiat par les IA génératives :
- Bertho, JM. (2024) - Cet article explore comment le risque de détection a contribué à une diminution du plagiat dans les manuscrits soumis. Il met également en lumière des aspects liés à l'intégrité académique et aux IA génératives.
- Laflamme, AS. (2025) - Cet article souligne que l'approche traditionnelle de prévention du plagiat est insuffisante face à l'émergence des IA génératives. Il propose des pistes pour adapter les politiques académiques.
- Impact des IA génératives sur l'enseignement supérieur (Cité par 55) - L'article examine comment les étudiants utilisent les textes produits par des IA pour commettre des actes de plagiat académique.
- Définitions historiques du plagiat et IA (2023) - L'article discute des définitions historiques du plagiat et de leur transformation face à l'avènement des technologies d'intelligence artificielle.
- Perspectives sur la propriété intellectuelle et IA (2025) - Ce texte analyse pourquoi les contenus produits par des IA ne sont pas techniquement considérés comme du plagiat au regard des lois actuelles sur la propriété intellectuelle.
- Plagiat et intégrité académique face à l'IA - Une page regroupant divers articles, solutions et recherches sur l'impact de l'intelligence artificielle sur le plagiat et l'intégrité académique.
- Ces articles couvrent des perspectives variées, allant des considérations juridiques à l'éthique académique. Si vous souhaitez approfondir un sujet précis, je peux vous aider à trouver les liens ou résumer un contenu spécifique. 😊 GF38storic (discuter) 7 juin 2025 à 11:46 (CEST)
- Personne n'aime les {{ref nec}} (j'imagine que c'est à cause de l'obligation de sourcer qui découle du PF2). Mais cette obligation n'implique pas qu'il faut les remplacer par n'importe quelle source (l'as tu lue?). En tout cas, tu ne réponds pas à ma question, qui me semblait pourtant simple. Quant au deuxième message, le smiley indique que c'est de l'humour sinon je l'aurais pris pour une provocation. --Lewisiscrazy (discuter) 7 juin 2025 à 12:31 (CEST)
- Bonjour @Lewisiscrazy, j'aime pas les refnec
- Bonjour GF38storic
- Absolument pas, cela m'a fait rire, oublie l'avocate si ça perturbe la lecture, et regarde le reste de mes réponses. --Pa2chant.bis (discuter) 5 juin 2025 à 20:29 (CEST)
- Oh la la j'espère que je t'ai pas vexée quand même --Lewisiscrazy (discuter) 5 juin 2025 à 20:13 (CEST)
- Ahah « donne nous un exemple, un seul! » c'est pas un peu une rhétorique d'avocat véreux? (no offense
Respect du PF3 (droit d'auteur)
modifierBonsoir,
le Wikipédia:Droit d'auteur (PF3) indique que si on n'est pas auteur ou autrice d'un texte, il faut vérifier qu'il puisse être partagé sous licence CC-BY-SA 4. Actuellement, le droit peut différer selon les pays mais aux EU, il semble qu'un contenu généré par IA générative ne permet pas d'associer un droit d'auteur. Toutefois, les contenus générés ne sont pas pour autant libres de droits, et certaines IA, comme ChatGPT, précisent que l'intégralité du contenu appartiennent à l'entreprise qui la publie[1]. Il semble donc nécessaire de vérifier cela, et par défaut, on ne peut considérer par défaut qu'un contenu généré par IA puisse être publié sous une licence utilisable dans WPfr. De ce point de vue, l'usage d'une IA pour résumer une source ne semble donc pas respecter ce PF.
- Si on est capable d'identifier l'origine d'un contenu généré par IA, c'est-à-dire savoir par quelle IA il a été généré, alors voyez-vous un autre moyen de maîtriser les usages tolérés que de publier et maintenir à jour une liste des IA utilisables pour les usages tolérés ?
- Si on n'est pas capable d'identifier l'origine d'un contenu généré par une IA (ou si les contributeurs et contributrices n'en sont pas capables), quel moyen voyez-vous d'éviter les débordements ?
- ↑ Caroline Casalonga et Juliette Dionisi, « Une intelligence artificielle peut-elle être un auteur ? », La Tribune, (lire en ligne)
"conduit quasi-systématiquement à l'insertion d'informations hallucinées"
modifierHello,
On lit les mêmes sources ? Source numéro 3 : https://github.com/vectara/hallucination-leaderboard/blob/main/img/hallucination_rates_with_logo.png - 2% de taux d'hallucination. C'est très loin du quasi systématiquement.
Pour l'article de Digital Medecine - qui au passage est spécialisé sur l'usage médical mais soit - https://files.catbox.moe/acd8xy.pdf - je cite :
"Of 12,999 sentences in 450 clinical notes, 191 sentences had hallucinations (1.47%), of which 84 sentences (44%) were major (could impact patient diagnosis and management if left uncorrected)."
"Of the 49,590 sentences from our consultation transcripts, 1712 sentences were omitted (3.45%), of which 286 (16.7%) of which were classified as major and 1426 (83.3%) as minor."
On est donc sur de l'omission, et pas de l'invention. Et l'usage spécifique dans la médecine
Je ne corrige pas, car j'imagine qu'il y a une raison, mais il semble y avoir confusion J'ai finalement corrigé, car ça induit fortement en erreur le lecteur - je suis ne suis pas le premier à avoir mal interprété à en juger l'historique de modifications - j'ai lu la note de Jules* et ai reformulé la phrase pour la rendre plus précise et dans l'idée de ne pas introduire un biais qui laisse à penser au premier abord que l'IA génère quasi systématiquement des hallucinations ce qui est factuellement faux. Global Donald (discuter) 17 juillet 2025 à 23:11 (CEST)
- La phrase d'origine était la suivante, avant insertion de sources sans rapport avec le sujet qui nous occupe (on parle de génération de textes par LLM, pas de résumé d'un texte simple) : Concrètement, l'utilisation d'une IAg, sans compréhension fine de son fonctionnement, conduit quasi systématiquement à l'insertion d'informations hallucinées, à des travaux inédits, à l'emploi d'un style non encyclopédique, voire à du plagiat[3] la dernière source ne portant que sur le plagiat, et Jules ayant bien précisé en commentaire d'édition que le « quasi-systématiquement » ne s'applique pas qu'à l'introduction d'hallucinations, mais à toute la liste. On trouve quasi-systématiquement l'un de ces problèmes dans l'usage d'une IAg « sans compréhension fine de son fonctionnement ».
- Vous êtes la deuxième personne à comprendre que ces erreurs systématiques ne porteraient que sur les hallucinations : il suffit de rajouter un « ou », pour éviter cette mauvaise compréhension.
- Si l'on veut rentrer dans les chiffres, il faut prendre ce qui est comparable, et pas les chiffres pour le court résumé d'un texte unique (article d'actualité), ou le résumé d'une consultation médicalequi contrairement à la génération d'articles, est toléré dans la recommandation, sous réserve de vérifications et de maitrise du sujet. Deux articles récents de synthèse donnent les chiffres suivants :
- LLM : Répondre en un mot ou un nombre à des questions à propos d'informations contenues dans un article : taux d'erreur entre 15 % et 39 % .
- réponses à des questions simples sur des célébrités, sans sélection préalable de textes : les réponses aux questions contiennent encore plus d'erreurs avec les modèles récents intégrant une couche de raisonnement : 33 % avec Open AI-o3, 48 % avec o4-mini .
- questions simples sur des sujets plus généraux : « les taux d'hallucinations pour o3 et o4-mini étaient de 51 % et 79 %. Le système précédent, o1, provoquait des hallucinations dans 44 % des cas. » L'article du NYT reprend par ailleurs les chiffres pour le résumé d'un article d'actualité que vous utilisez, et précise que si les taux d'erreur sont effectivement tombés à des 1 à 2 % pour Open AI et Google, versus 3% à 27 % auparavant, les taux restent élevés pour o3 d'openAI (6,8 %) et R1 de DeepSeek (14,3 %).
- *Je me permets de rappeler que le système jugé le plus prometteur pour la rédaction d'articles WP, STORM, développé par Stanford, était encore considéré l'an dernier comme présentant des problèmes et théoriquement un faible taux d'hallucinations, non corroboré a priori par tentatives que j'avais faites sur cet outil, pas très bon signe même si c'est statistiquement non pertinent.
- La formulation revue par vous et sourcée avec un tableau de stats sans contexte est donc trompeuse : je reviens donc à la version originale en rajoutant le « ou » manquant. Cdlt, --Pa2chant.bis (discuter) 20 juillet 2025 à 21:45 (CEST)
- Nota : j'ai aussi retiré le passage sur l'omission d'informations, cette question n'ayant pas été abordée lors de la phase de rédaction qui a abouti à un consensus sur le texte, les votants lors du sondage ne s'étant jamais prononcés sur un tel argument, qui pourrait d'ailleurs ne pas en être un pour WP vu le caractère accepté d'une encyclopédie en construction : incomplète certes, mais pas censée présenter des éléments faux. --Pa2chant.bis (discuter) 20 juillet 2025 à 22:04 (CEST)
Quid des images ?
modifierBonjour,
Je m'aperçois que le sujet des images n'est pas évoqué sur cette page de recommandation, si ce n'est dans la section « Voir aussi » au sujet de la restauration d'images par IA.
Mais quid d'images entièrement créées par IA ? Je viens de retirer cette image (notif de courtoisie à
Julien Sow 2) car, comme indiqué en commentaire de modif, il n'y a aucune garantie sur la ressemblance effective avec la personnalité représentée (vêtements, seins nus, accessoires, traits du visage, dessins tribaux sur le visage et le corps, etc.), surtout vu le prompt très court indiqué en description du fichier. Le problème s'était déjà posé sur un autre article. D'autres images IA susceptibles d'être utilisées ici sont des copies de vraies œuvres existantes et protégées par le droit d'auteur.
Est-ce qu'il ne faudrait pas ajouter une section sur ce type d'images ? Histoire de lister les cas où l'utilisation de l'IA est acceptée et ceux où elle ne l'est pas ?
Cordialement -- Titlutin (discuter) 21 juillet 2025 à 23:28 (CEST)
- Bonjour Titlutin, Est-il possible que vous puissiez me montrer une image historique générée par IA et qui rentre dans les cadres acceptés par Wikipédia ? Je m'appuie sur des archives existantes sans violer le copyright et je ne comprends pas pourquoi elles ne passe pas. Sans doute que le prompt n'est pas assez complet. Mais le plus simple pour moi serait d'avoir un exemple d'image acceptée par la communauté. Cordialement--Julien Sow 2 (discuter) 21 juillet 2025 à 23:57 (CEST) Julien Sow 2 (discuter) 21 juillet 2025 à 23:58 (CEST)
- Bonjour @Julien Sow 2. C'est justement le but de mon message ici : quels sont les cas acceptés et les autres non. Même sans violer le droit d'auteur, votre image est-elle vraiment représentative de la personnalité et de la façon dont elle s'habillait par exemple (seins nus, dessins tribaux, vêtements : ces détails étaient-ils dans le prompt et historiquement informés, ou ont-ils été automatiquement ajoutés par l'IA) ? Si ce n'est pas le cas, s'il s'agit d'une simple illustration générique destinée à "décorer à tout prix" l'article, ce genre d'image est-il accepté ? --Titlutin (discuter) 22 juillet 2025 à 15:06 (CEST)
- Je n'ai pas compris "je m'appuie sur des archives existantes" : quelles archives ? Sinon en accord avec Titlutin, il n'y a pas de garantie que l'image, l'habillement, les tatouages etc. ne soient pas considéré comme ridicules ou hors de propos par des ethnologues. Je pense que ce genre d'image, dessinée par l'IA ou un humain, devrait être "sourcée" par une image comparable (mais non libre de droits), pour vérification, comme un texte de synthèse. Jean-Christophe BENOIST (discuter) 22 juillet 2025 à 15:21 (CEST)
- Bonsoir Titlutin (discuter), Jean-Christophe BENOIST (discuter)
- Je pense que le mieux pour le moment est de ne pas générer d'image du tout par IA.
- Vous pouvez donc supprimer mon dernier essai (que je trouvais pas mal !)
- File:Mama Onema (essai 2).png — Wikimedia Commons
- Et moi j'attendrai des jours meilleurs.
- Bien à vous Julien Sow 2 (discuter) 22 juillet 2025 à 22:17 (CEST)
- Des schémas, des diagrammes, sont possibles. A expérimenter. Jean-Christophe BENOIST (discuter) 22 juillet 2025 à 22:22 (CEST)
- Je n'ai pas compris "je m'appuie sur des archives existantes" : quelles archives ? Sinon en accord avec Titlutin, il n'y a pas de garantie que l'image, l'habillement, les tatouages etc. ne soient pas considéré comme ridicules ou hors de propos par des ethnologues. Je pense que ce genre d'image, dessinée par l'IA ou un humain, devrait être "sourcée" par une image comparable (mais non libre de droits), pour vérification, comme un texte de synthèse. Jean-Christophe BENOIST (discuter) 22 juillet 2025 à 15:21 (CEST)
- Bonjour @Julien Sow 2. C'est justement le but de mon message ici : quels sont les cas acceptés et les autres non. Même sans violer le droit d'auteur, votre image est-elle vraiment représentative de la personnalité et de la façon dont elle s'habillait par exemple (seins nus, dessins tribaux, vêtements : ces détails étaient-ils dans le prompt et historiquement informés, ou ont-ils été automatiquement ajoutés par l'IA) ? Si ce n'est pas le cas, s'il s'agit d'une simple illustration générique destinée à "décorer à tout prix" l'article, ce genre d'image est-il accepté ? --Titlutin (discuter) 22 juillet 2025 à 15:06 (CEST)
À nuancer
modifierCette recommandation me semble prendre parfois une posture trop radicale.
La première phrase, affirmant que l'usage de l'IA générative est vivement déconseillé, manque beaucoup de nuance. Il peut y avoir de nombreux usages de l'IA générative. Le principal problème est le fait de laisser l'IA au volant pour écrire de grandes quantités de texte. Mais il y a aussi de nombreux usages qui sont rarement un problème et attirent rarement l'attention du moment que l'humain vérifie, par exemple chercher des sources, identifier des problèmes dans un article, corriger la grammaire, se familiariser avec les normes du wiki.
La section "Avant-propos" interprète le fonctionnement des LLMs purement sur la base du pré-entraînement. Mais en pratique, les LLMs grand-public suivent un réglage fin. Et lors de ce réglage fin, le chatbot est entraîné à fournir des réponses vraies, ce qui réduit la fréquence des hallucinations. Je propose de retirer ou de retravailler en profondeur le deuxième paragraphe de "Avant-propos", celui qui commence par "Cette méthode pose deux principaux enjeux". De plus, la proportion d'hallucinations est bien moins importante aujourd'hui qu'en 2023 avec GPT-3.5, donc affirmer que l'IA générative conduit "quasi-systématiquement" à des "l'insertion d'informations hallucinées (y compris des références à des sources qui n'existent pas) ou à des travaux inédits, à l'emploi d'un style non encyclopédique, voire à du plagiat" est de moins en moins vrai, il serait mieux d'écrire "peut conduire à". Je proposes aussi de remplacer "sans compréhension fine de son fonctionnement" par "sans vérification du contenu généré".
Le fait d'imposer aux utilisateurs d'indiquer toute IA utilisée (section "Principes") ne devrait s'appliquer qu'aux modifications ajoutant une quantité significative de texte. Autrement, ça rallonge inutilement le résumé de modification. Personnellement, j'utilise régulièrement l'IA générative pour vérifier mes modifications avant publication (la grammaire, les faits, la neutralité) et pour vérifier si c'est bien une amélioration. Si l'IA propose des corrections de grammaire ou un formulation clairement meilleure, je prends ça en compte. Indiquer l'utilisation de l'IA dans chaque résumé de modification correspondant est lourd et peut conduire les autres utilisateurs à rejeter la modification même si le rôle de l'IA ne consiste qu'en de petites améliorations.
Je propose d'indiquer dans les "Usages tolérés" que le principal problème concerne l'ajout de contenu généré par l'IA, et que les usages périphériques (recherche de sources, identification de potentiels problèmes dans un article...) ne sont pas vraiment un problème.
De plus, l'outil de traduction de Wikipédia utilise par défaut Google Traduction. Les traductions sont donc généralement générées par la machine et raffinées/corrigées par l'humain. Les traductions faites par les LLMs sont généralement de qualité légèrement meilleures, car ils ont une compréhension plus fine de la sémantique que le modèle à bas coût de Google Traduction. Il pourrait donc être raisonnable d'ajouter les traductions aux usages tolérés.
Je trouve plutôt bien que la réglementation mentionne le fait que "les lecteurs et bénévoles s'attendent à ce que Wikipédia soit écrite par des humains". À mes yeux, c'est peut-être la meilleure raison de limiter l'usage de l'IA. Les réglementations s'appuient trop souvent sur le fait de sous-estimer les chatbots comme si on était encore en 2023, mais il y a aussi une question d'authenticité au vu des attentes des lecteurs : même si ChatGPT pouvait réécrir tout Wikipédia en quelque chose d'objectivement meilleur, est-ce que les gens voudraient encore le lire? Alenoach (discuter) 10 janvier 2026 à 09:51 (CET)
- Bonjour,
- Pour votre 4e point, c'est un principe de bon sens qui s'applique dès lors qu'il y a potentielle altération du contenu, pas une règle absolue visant à interdire les corrections avenues : si vous utilisez une méthode (pas seulement l'IA) pour vous corriger, il n'est pas indispensable de le faire figurer ; pour autant, rien ne vous empêche d'en faire mention sur votre PU si vous le souhaitez.
- « Il pourrait donc être raisonnable d'ajouter les traductions aux usages tolérés. » : non, la traduction (même avec Google Traduction) est proscrite sauf un matériau compatible avec nos licences ou une autorisation de l'auteur ou de ses ayants droit. La convention de Berne en est la cause : cela revient à violer le WP:DA. LD (d) 10 janvier 2026 à 11:57 (CET)
- Bonjour @Alenoach. Pour faire court et pour répondre à un point précis (le deuxième paragraphe), ce que tu écris ne correspond précisément pas à ce que j'observe en pratique sur Wikipédia : les ajouts de textes générés par IA contiennent très souvent des hallucinations. (Sinon, d'accord avec la conclusion du message.) Cdlt, — Jules* 💬 10 janvier 2026 à 13:16 (CET)
- Bonjour Jules. La recommandation affirme que ça arrive "quasi-systématiquement", ce qui est une affirmation forte, nécessitant donc des preuves solides. Mais le taux d'hallucinations peut varier en fonction du modèle, du prompt, du cas d'usage, de la complexité de la question ou de la longueur de la réponse. Il n'y a donc de métrique universelle du taux d'hallucinations. La formulation "peut conduire à" me semblerait plus mesurée que "conduit quasi-systématiquement à". Alenoach (discuter) 10 janvier 2026 à 16:35 (CET)
- Bonjour LD. J'ai peut-être manqué de clarté, mais mon point sur les traductions faisait référence à l'outil de traduction d'articles Wikipédia d'une langue vers une autre (pas à la traduction de sources externes vers Wikipédia). Alenoach (discuter) 10 janvier 2026 à 15:40 (CET)
- Bonjour @Alenoach. Pour faire court et pour répondre à un point précis (le deuxième paragraphe), ce que tu écris ne correspond précisément pas à ce que j'observe en pratique sur Wikipédia : les ajouts de textes générés par IA contiennent très souvent des hallucinations. (Sinon, d'accord avec la conclusion du message.) Cdlt, — Jules* 💬 10 janvier 2026 à 13:16 (CET)
Intelligence artificielle - Wikimania
modifierMy apologies for writing in English - unfortunately my French is very basic. SJ Klein and I are organising a pre-conference on AI Tools at this year's Wikimania in Paris. We're going to demo AI-based tool that are in active use and will discuss the challenges posed by LLMs - hopefully both tracks would be interesting for the editors here. Unlike other AI-related events at Wikimania, you don't need a ticket to the conference itself (long sold out) to attend our event. You just need to register before July 7. More information and the registration link can be found here. Alaexis (discuter) 19 juin 2026 à 23:03 (CEST)
Proposition de reformulation de l'introduction
modifierBonjour,
La multiplication des cas de mésusage de l'IAg, par des nouveaux souvent, plus rarement par des anciens, à savoir la publication de textes directement générés par un LLM sans vérification des sources (de leur qualité, de leur existence, de la correspondance entre leur contenu et ce qu'affirme le LLM) me fait penser que si l'esprit voulu pragmatique de notre recommandation est approprié, sa formulation laisse à désirer.
C'est d'autant plus dommageable que les contributeurs utilisent de bonne foi l'IAg avec l'illusion de pouvoir augmenter leur productivité (pour les plus anciens) ou de pouvoir maîtriser rapidement la contribution à Wikipédia (pour les plus nouveaux). Lorsque leurs modifications sont annulées ou supprimées, cela génère de la frustration.
Une partie significative des lecteurs, en particulier des nouveaux, ne lit probablement que le début de la recommandation.
Actuellement, l'introduction est celle-ci :
L'utilisation de l'intelligence artificielle générative (IAg), fondée sur les grands modèles de langage (LLM), est vivement déconseillée.
Si une utilisation raisonnée reste possible, sous conditions exposées ci-dessous, elle présente des risques de mésusage. Le mésusage conduit généralement à bafouer les principes fondateurs ainsi que les règles et recommandations, pouvant entraîner le blocage en écriture du compte concerné.« Vivement déconseillé » résonne probablement comme « autorisé » pour pas mal de monde. L'intro évoque ensuite la possibilité d'usages raisonnés, et après seulement mentionne un risque de mésusage, sans l'expliquer et avec une construction de phrase un peu confuse.
Je propose une reformulation qui :
- énonce d'abord une interdiction de principe d'usage de l'IAg pour la rédaction ;
- puis explique brièvement la nature du problème ;
- et enfin indique qu'il existe des usages tolérés sous conditions.
Il ne s'agit pas de changer ces usages tolérés, décrits dans Wikipédia:Intelligence artificielle générative#Usages tolérés.
Voici la rédaction que je propose :
L'utilisation de l'intelligence artificielle générative (IAg), fondée sur les grands modèles de langage (LLM), pour rédiger des articles est interdite sur Wikipédia en français.
En effet, l'expérience montre que l'usage de cet outil conduit quasi-systématiquement à bafouer les principes fondateurs et règles de Wikipédia, en particulier la vérifiabilité du contenu. Le mésusage des IAg aboutit à l'introduction de plagiats, d'informations fausses, de sources détournées, inexistantes (hallucinations) ou de mauvaise qualité, etc.
Ce qui apparaît comme un gain de temps individuel pour les utilisateurs d'IAg, induits en erreur par l'apparente facilité d'usage de l'outil, génère en réalité une perte de temps collective et une dégradation du contenu de l'encyclopédie.
L'usage des outils d'IAg pour la correction orthographique est en revanche autorisé. Une utilisation raisonnée des outils d'IAg à des fins rédactionnelles par des contributeurs maîtrisant les règles de Wikipédia reste par ailleurs possible à certaines conditions, détaillées plus bas.J'aimerais recueillir de premiers avis à ce sujet, y compris pour améliorer la reformulation proposée, avant d'ouvrir un sondage en bonne et due forme. — Jules* 💬 15 août 2026 à 18:57 (CEST)
- Pour moi, la période de tolérance a été suffisante pour une observation du phénomène assez complète. Je n'ai vu aucune rédaction avec cet outil qui a prouvé un apport positif, bien au contraire. Limfjord* (discuter) 15 août 2026 à 19:13 (CEST)
Pour fort. Oh que oui, qu'il faut interdire ! Dans le 3e §, peut-être préciser que l'utilisation éventuelle à des fins rédactionnelles ne s'applique pas aux pages de discussion. Croquemort Nestor (discuter) 15 août 2026 à 19:54 (CEST)
Pour Bertrand Labévue (discuter) 15 août 2026 à 20:02 (CEST)
Pour fort CaféBuzz (d) 15 août 2026 à 20:08 (CEST)
- Bonne initiative, bonne formulation !
- Faut-il un sondage ? Je ne vois que l'intérêt de faire de la publicité pour ce changement notoire, mais qui ne fait que prolonger ce qui fait consensus à chaque discussion sur l'IA dans WP, au Bistro. Il y a en plus bien du travail pour régler le passif. Il est arrivé que quelques mentions de l'évolution dans des Bistros espacés suffisent si j'ai bonne mémoire, un sondage restant possible. A l'allure où vont les choses, il est aussi possible que des outils pallient une partie des problèmes actuels.
- TigH (discuter) 15 août 2026 à 20:20 (CEST)
- @Croquemort Nestor : je me suis en effet fait la réflexion de l'absence de mention du fait que les messages générés par IA ne sont pas autorisés. Je propose de ne pas encombrer l'intro avec ça, et de plutôt ajouter une courte section, en bas de recommandation, « Usage dans les discussions », indiquant quelque chose du style :
« Utiliser des textes générés par IA dans les discussions avec les autres bénévoles est considéré comme une violation des règles de savoir-vivre.
::::::Si vous êtes débutant, utiliser des textes générés par IA dans les discussions conduit généralement à citer à mauvais escient des règles et recommandations que vous n'avez pas lues ni comprises (et l'IA générative non plus, par définition) ; c'est contreproductif.
::::::Si le français n'est pas votre langue maternelle, que vous êtes dysorthographique ou assimilé, ce n'est pas grave : une discussion dans un français bancal est préférable à un texte impersonnel généré par IA. Vous pouvez toutefois utiliser l'IAg pour corriger votre orthographe ou votre grammaire. »- @TigH : rien n'oblige en effet à un processus formel pour faire évoluer une recommandation, mais je suis d'avis que plus le consensus est fort, mieux c'est. Un sondage est aussi une occasion de sensibiliser les contributeurs (y compris expérimentés, dont certains ignorent d'ailleurs l'existence de la recommandation) à cette question. — Jules* 💬 15 août 2026 à 20:26 (CEST)
Pour — Koreller (d) 15 août 2026 à 23:24 (CEST)
Pour, comme une évidence — Adri08 (discuter) 16 août 2026 à 13:45 (CEST)
Pour un tel passage sur les PDD. Ménestor (discuter) 17 août 2026 à 09:51 (CEST)
Contre - 1. Les usages positifs sont par essence invisibles. 2. L’interdiction n’empêchera pas les mauvais usages. 3. Et comme il est impossible d’être sûr, la suspicion sera donc de mise avec les éternels débats qui finiront par « le problème c’est le contenu et pas le moyen de production ». Je ne vois pas ce que ça apporte dans les faits d’interdit ça. Ça serait comme interdire Microsoft Word, impossible à prouver et au fond le problème c’est la personne qui ne respecte pas les règles éditoriales pas l’outil de production. schiste 15 août 2026 à 20:55 (CEST)
- Les « usages positifs invisibles » sont de fait des usages tolérés par la recommandation ; la modification proposée ci-dessus ne change rien à cela. Plus accessoirement, Microsoft Word n'est pas un outil qui conditionne le résultat produit comme peuvent le faire les LLM ; la comparaison n'a pas vraiment de sens. — Jules* 💬 15 août 2026 à 21:02 (CEST)
- Il semble bien que le consensus reste à consolider. Comme patrouilleur des créations, je suggère que la modification en durcissement du motif de suppression "... intelligence artificielle générative sans relecture" soit ajoutée au sondage prévu. Il est souvent difficile d'estimer qu'il n'y a pas eu de relecture (mais par exemple, il n'y avait pratiquement pas d'article créé sans catégorie, alors que c'est devenu une caractéristique). C'est une vague suggestion parce que les suppressions immédiates sont en principe à utiliser hors tout doute sur leur pertinence et là, on en reste loin. TigH (discuter) 15 août 2026 à 21:52 (CEST)
- Plus j'y réfléchis plus je me dis que Wp a tout intérêt à garder sa patte humaine dans ses rédactions, ne serait-ce que dans une approche prosaïquement marketing. L'IA est en train de devenir d'une telle banalité, que se démarquer des autres, sur ce point, est payant sur le long terme.
- De plus, n'oublions jamais que Wp alimente des IA. Que ferons nos "clients" s'ils n'y trouvent que ce qu'ils ont déjà produits ? Sans parler, bien sûr, de nos utilisateurs humains et de leurs réseaux sociaux qui se chargeront de faire savoir que Wp est devenue une vitrine à IA (et c'est peut-être là qu'est le plus grand danger : deux trois messages bien sentis de la part d'acteurs influents aux poches profondes et l'anecdote devient vite une généralité diffusée sur toute la planète..).
- Donc, il faut à mon avis interdire l'IA dans la rédaction des contributions et se mettre en condition pour le faire savoir haut et fort. Limfjord* (discuter) 16 août 2026 à 00:09 (CEST)
- D'accord avec ce qui a été dit ci-dessus, la rédaction manuelle restera la meilleure manière à Wikipédia de se démarquer. Des lecteurs qui veulent une information d'un LLM iront directement sur un site offrant un tel service et certainement pas ici, alors je vois pas le but de garder/autoriser des articles générés par ceux-ci.
- Comme il y a un CSI déjà dédié à ceci, il me semble en effet pertinent d'interdire son utilisation tout simplement. Cela aidera à éviter une mauvaise interprétation de la recommandation par un novice, considérant qu'environ le quart des articles que je supprime quotidiennement sont spécifiquement dus à une mauvaise relecture d'un LLM. --quebecguy ⚜️ (discuter | contributions) 16 août 2026 à 04:48 (CEST)
- Il semble bien que le consensus reste à consolider. Comme patrouilleur des créations, je suggère que la modification en durcissement du motif de suppression "... intelligence artificielle générative sans relecture" soit ajoutée au sondage prévu. Il est souvent difficile d'estimer qu'il n'y a pas eu de relecture (mais par exemple, il n'y avait pratiquement pas d'article créé sans catégorie, alors que c'est devenu une caractéristique). C'est une vague suggestion parce que les suppressions immédiates sont en principe à utiliser hors tout doute sur leur pertinence et là, on en reste loin. TigH (discuter) 15 août 2026 à 21:52 (CEST)
- Les « usages positifs invisibles » sont de fait des usages tolérés par la recommandation ; la modification proposée ci-dessus ne change rien à cela. Plus accessoirement, Microsoft Word n'est pas un outil qui conditionne le résultat produit comme peuvent le faire les LLM ; la comparaison n'a pas vraiment de sens. — Jules* 💬 15 août 2026 à 21:02 (CEST)
Contre Comme d'habitude, aucune distinction entre l'IA "RAG", avec grand contexte de sources sélectionnées, et vérifiables, et l'IA générative avec développement libre (99%, au moins, des contributions actuelles par IA, et problématiques en effet). Il faut montrer que la communauté Wikipédia a un minimum de connaissance du fonctionnement des LLM, et ne fait pas des recommandation en aveugle de la technique. Sans compter que ce n'est pas clair si "rédaction d'article" comporte les schémas, éventuellemen générés par IA, de manière vérifiable. Par exemple dans Guérisons de Lourdes j'ai généré un graphique, obectivement vérifiable et factuel, par IA. Mettre tout dans le même panier est surtout le symptôme que la communauté ne comprends pas l'IA, et a une posture défensive par manque de compréhension. Jean-Christophe BENOIST (discuter) 16 août 2026 à 14:06 (CEST)
- As-tu conscience, @Jean-Christophe BENOIST, que ton usage est expert (et expérimental, sans être forcément satisfaisant, comme tu l'as écrit ailleurs), celui d'un ingénieur en informatique, à mille lieues de ce que l'on observe au quotidien ? L'introduction de la recommandation (qui n'est pas une règle) vise l'usage commun, celui qu'on rencontre en pratique, pas des usages théoriques. Le commun des mortels n'a aucune idée de ce qu'est la RAG : en parler dans l'intro, c'est le meilleur moyen de perdre tout de suite le lecteur. Par ailleurs, au risque de me répéter, les usages raisonnables par les rares contributeurs qui savent ce qu'ils font, dont celui que tu évoques, restent tolérés et figurent dans la section appropriée ; ma proposition ne change rien à cela. PS : sauf à vouloir jouer sur les mots, la création d'un schéma n'est pas de la rédaction. Je ne vois pas comment on peut faire la confusion à la lecture de la recommandation, même dans son état actuel, vu que tous les risques pointés sont relatifs à l'écriture et à la véracité des informations. — Jules* 💬 16 août 2026 à 14:14 (CEST)
- J'ai regardé le schéma sur Guérisons de Lourdes. Je ne vois pas de rapport non plus avec le sujet et en quoi cette démarche est "fondée sur les grands modèles de langage (LLM)", comme indiqué dans le champ du sujet qui est traité ici. Limfjord* (discuter) 16 août 2026 à 14:43 (CEST)
- Utilisateur:Limfjord Car le script qui génère le schéma a été généré par un LLM. J'ai aussi réalisé un bot pour traiter les données MétéoFrance, qui génère et met à jour des modèles, et qui contribue "à la rédaction des articles de Wikipédia" --Jean-Christophe BENOIST (discuter) 16 août 2026 à 15:47 (CEST)
- J'ai regardé le schéma sur Guérisons de Lourdes. Je ne vois pas de rapport non plus avec le sujet et en quoi cette démarche est "fondée sur les grands modèles de langage (LLM)", comme indiqué dans le champ du sujet qui est traité ici. Limfjord* (discuter) 16 août 2026 à 14:43 (CEST)
- As-tu conscience, @Jean-Christophe BENOIST, que ton usage est expert (et expérimental, sans être forcément satisfaisant, comme tu l'as écrit ailleurs), celui d'un ingénieur en informatique, à mille lieues de ce que l'on observe au quotidien ? L'introduction de la recommandation (qui n'est pas une règle) vise l'usage commun, celui qu'on rencontre en pratique, pas des usages théoriques. Le commun des mortels n'a aucune idée de ce qu'est la RAG : en parler dans l'intro, c'est le meilleur moyen de perdre tout de suite le lecteur. Par ailleurs, au risque de me répéter, les usages raisonnables par les rares contributeurs qui savent ce qu'ils font, dont celui que tu évoques, restent tolérés et figurent dans la section appropriée ; ma proposition ne change rien à cela. PS : sauf à vouloir jouer sur les mots, la création d'un schéma n'est pas de la rédaction. Je ne vois pas comment on peut faire la confusion à la lecture de la recommandation, même dans son état actuel, vu que tous les risques pointés sont relatifs à l'écriture et à la véracité des informations. — Jules* 💬 16 août 2026 à 14:14 (CEST)
Pour fort Merci beaucoup à Jules d'avoir fait cette proposition. Oui il y a quelques personnes expertes qui sont en capacité d'utiliser l'IA pour faire des contributions de qualité. Mais il faut poser l'interdiction, pour les nouveaux et pour les anciens, sinon on risque de se faire déborder encore plus. Apollinaire93 (discuter) 16 août 2026 à 14:36 (CEST)
- Merci @Jules* pour cette proposition.
- Je suis d’accord avec tes 3 propositions mais serait-il possible de trouver une formulation moins contradictoire (1=interdiction ferme.. 2-.. 3-mais il y a des cas acceptés..)?
- Mais sur le fond, je rejoins par ailleurs ton analyse partagée : si dans certains cas (ou pour certains profils tech.) bien controlés, l’IA peut s'avérer pertinente, il est à craindre que pour l'immense majorité des autres, la moindre ouverture soit signe de dérapage massif. — Laszlo 16 août 2026 à 15:21 (CEST)
- @Laszlo : deux propositions (qui répondront peut-être aussi à l'objection de @Jean-Christophe BENOIST ?) pour remplacer la première phrase L'utilisation de l'intelligence artificielle générative (IAg), fondée sur les grands modèles de langage (LLM), pour rédiger des articles est interdite sur Wikipédia en français. (outre une légère reformulation sans impact sur le sens, la modification altérant le sens figure en gras) :
- L'utilisation de l'intelligence artificielle générative (IAg) fondée sur les grands modèles de langage (LLM) est généralement interdite sur Wikipédia en français pour la rédaction d'articles.
- L'utilisation de l'intelligence artificielle générative (IAg) fondée sur les grands modèles de langage (LLM) est interdite sur Wikipédia en français pour la rédaction d'articles (sauf exceptions).
- Je préfère nettement la seconde.
- (Pour ce qui est de ta crainte : c'est déjà le cas, hélas, comme peuvent en témoigner les patrouilleurs et contributeurs qui suivent ça de près.) — Jules* 💬 16 août 2026 à 15:29 (CEST)
- @Jules* : les deux me vont. Merci pour la prise en compte 👍.
Pour donc. — Laszlo 16 août 2026 à 15:46 (CEST)
- En effet, ces formulations reflètent davantage la réalité (il y a des exceptions), et je n'avais pas vu dans un premier temps que certains usages étaient toujours tolérés, à cause de la formulation catégorique initiale. Jean-Christophe BENOIST (discuter) 16 août 2026 à 15:51 (CEST)
- Sinon, une autre approche pour éviter le sentiment d'une contradiction est de laisser la première phrase intacte et de plutôt modifier le paragraphe sur les usages admis en clarifiant l'existence d'exceptions, cf. proposition B, plus bas. — Jules* 💬 16 août 2026 à 15:59 (CEST)
- En effet, ces formulations reflètent davantage la réalité (il y a des exceptions), et je n'avais pas vu dans un premier temps que certains usages étaient toujours tolérés, à cause de la formulation catégorique initiale. Jean-Christophe BENOIST (discuter) 16 août 2026 à 15:51 (CEST)
- @Jules* : les deux me vont. Merci pour la prise en compte 👍.
- @Laszlo : deux propositions (qui répondront peut-être aussi à l'objection de @Jean-Christophe BENOIST ?) pour remplacer la première phrase L'utilisation de l'intelligence artificielle générative (IAg), fondée sur les grands modèles de langage (LLM), pour rédiger des articles est interdite sur Wikipédia en français. (outre une légère reformulation sans impact sur le sens, la modification altérant le sens figure en gras) :
- Indépendamment des discussions de fond, une petite remarque de forme : on ne peut pas écrire "sur Wikipédia" de façon ambigüe ; il faut écrire sans ambiguïté "sur Wikipédia en français" puisque, bien évidemment, ce n'est pas WP:fr qui décide pour l'ensemble des versions linguistiques (même si on peut espérer un minimum de modération aussi dans les autres versions linguistiques, notamment celles qui sont devenues célèbres après avoir vu leur nombre d'articles atteindre les sept chiffres via des traductions automatiques non relues en masse...). SenseiAC (discuter) 16 août 2026 à 15:08 (CEST)
J'ai corrigé, merci. (À noter que la reformulation présente nous rapprochera de la règle anglophone, beaucoup plus développée, avec des exceptions similaires aux nôtres, mais qui en première approche interdit l'usage des LLM pour la rédaction.) — Jules* 💬 16 août 2026 à 15:11 (CEST)
Pour Merci d'avoir relancé la discussion. J'ai toujours été contre l'IAG pour la rédaction. Entropy Fighter 💬 16 août 2026 à 15:33 (CEST)
Pour fort et sans le "généralement" (qui sera lu comme : je peux quand même) et sans la mention des exceptions dans la première phrase.- Je ferais la distinction entre la rédaction (de bout en bout) et l'aide à la rédaction (ponctuelle, pour améliorer ce qu'on a écrit mais sans laisser l'IA chercher et potentiellement inventer du contenu) et reformulerais en conséquence la dernière phrase comme suit :
- Une utilisation raisonnée des outils d'IAg à des fins rédactionnelles par des contributeurs maîtrisant les règles de Wikipédia reste par ailleurs possible à certaines conditions, détaillées plus bas.
- =>
- Une utilisation raisonnée des outils d'IAg à des fins d'aide à la rédaction par des contributeurs maîtrisant les règles de Wikipédia reste possible à certaines conditions, détaillées plus bas.
- Détail pour la 1re phrase (L'utilisation de l'intelligence artificielle générative (IAg), fondée sur les grands modèles de langage (LLM), pour rédiger des articles est interdite sur Wikipédia en français) : pourquoi "rédaction d'articles" et non "rédaction des articles" ? Sherwood6 (discuter) 16 août 2026 à 15:43 (CEST)
En tenant compte des remarques de Sherwood6 ci-dessus, proposition B (les deux paragraphes centraux du milieu ne changent pas) :
L'utilisation de l'intelligence artificielle générative (IAg) fondée sur les grands modèles de langage (LLM) est interdite sur Wikipédia en français pour la rédaction des articles.
En effet, l'expérience montre que l'usage de cet outil conduit quasi-systématiquement à bafouer les principes fondateurs et règles de Wikipédia, en particulier la vérifiabilité du contenu. Le mésusage des IAg aboutit à l'introduction de plagiats, d'informations fausses, de sources détournées, inexistantes (hallucinations) ou de mauvaise qualité, etc.
Ce qui apparaît comme un gain de temps individuel pour les utilisateurs d'IAg, induits en erreur par l'apparente facilité d'usage de l'outil, génère en réalité une perte de temps collective et une dégradation du contenu de l'encyclopédie.
Il existe des exceptions à cette interdiction générale : l'usage des outils IAg à des fins de correction orthographique est autorisé ; leur usage raisonné à des fins d'aide à la rédaction par des contributeurs maîtrisant les règles de Wikipédia est possible à certaines conditions, détaillées plus bas.Pour la première phrase, une proposition C, avec introduction de la notion de « principe » (à laquelle répondra plus loin la notion d'exception) :
— Jules* 💬 16 août 2026 à 16:01 (CEST)
Pour fort Quelle que soit la proposition, je suis favorable à une interdiction claire. Merci @Jules* ! Bien à vous. --Mathsi6542 (discuter) 16 août 2026 à 16:04 (CEST)
Pour la dernière mouture. Par contre, pour les usages autorisés, il y a un truc à clarifier, concernant les résumés de sources. Actuellement il est indiqué résumer une source que vous avez déjà lue (tout en veillant à réaliser une synthèse avec d'autres lectures), ce qui implique un sourçage précis pour témoigner du fait que vous l'avez lue. Certains semblent avoir compris qu'on pouvait repiquer un résumé audio généré par IA, ce qui n'est pas le sens de la phrase à l'origine. A vrai dire, je ne comprends pas même pas ce que fait cette phrase ici : bien sûr qu'on peut se faire résumer des sources, mais si c'est pour les exploiter, il faut bien les lire (comme il est indiqué, d'ailleurs). @Jean-Christophe BENOIST, ton avis ? --Pa2chant.bis (discuter) 16 août 2026 à 16:51 (CEST)
- @Pa2chant.bis Je ne vois vraiment aucun rapport entre cette phrase et "repiquer un résumé audio généré par IA" ?? C'est en plus le cas où "sourcer précisément" est le plus difficile ! Je ne connais aucun exemple de contribution où cette phrase a été respectée a la lettre, ou même dans l'esprit, et qui a posé problème. Jean-Christophe BENOIST (discuter) 16 août 2026 à 17:53 (CEST)
- @ Jean-Christophe BENOIST, je reformule ma question : dès lors que quelqu'un utilise de tels résumés mais en respectant la recommandation, c'est-à-dire en sourçant correctement le passage (c'est-à-dire en ayant AUSSI lu la source) peut-on considérer qu'il s'agit d'un usage de l'IA pour écrire des articles ? Cette "exception" est-elle nécessaire ? (Et si j'en parle c'est que toi, tu ne vois pas le rapport, moi non plus, mais d'autres ont pensé que cela autorisait de telles pratiques). --Pa2chant.bis (discuter) 16 août 2026 à 19:39 (CEST)
- Si une règle est incomprise à ce point, alors qu'elle est claire (?), il peut en être de même de toute règle. Les choses ne sont jamais blanches ou noires. Pour avoir essayé le RAG (puisque c'est de cela qu'il s'agit) le rendu brut n'est souvent pas exploitable directement : les sources doivent être précisées, et vérifiées, et surtout il y a des reformulations et des réorganisations souvent nécessaires pour avoir un plan et un style encyclopédique. Au final, est-ce un travail d'un humain ou d'une IA ? Une bonne utilisation de l'IA c'est un mix des deux.
- Elle est "nécessaire" si on distingue le RAG de la génération pure. Elle ne l'est pas si on confond tout et on met tout dans le même panier. Mais le fait de sourcer précisément (en tout cas dans l'état actuel des LLM) nécessite vraiment un travail d'humain, on ne l'a jamais "gratuitement", et pousse à la relecture des sources (qui sont là en entrée je le rappelle). Et elle empêche l'approche générative (celle qui pose le plus de problèmes, et que on voit 99% - au moins - des cas) où c'est quasiment impossible. Jean-Christophe BENOIST (discuter) 16 août 2026 à 19:56 (CEST)
- @ Jean-Christophe BENOIST, je reformule ma question : dès lors que quelqu'un utilise de tels résumés mais en respectant la recommandation, c'est-à-dire en sourçant correctement le passage (c'est-à-dire en ayant AUSSI lu la source) peut-on considérer qu'il s'agit d'un usage de l'IA pour écrire des articles ? Cette "exception" est-elle nécessaire ? (Et si j'en parle c'est que toi, tu ne vois pas le rapport, moi non plus, mais d'autres ont pensé que cela autorisait de telles pratiques). --Pa2chant.bis (discuter) 16 août 2026 à 19:39 (CEST)
- @Pa2chant.bis Je ne vois vraiment aucun rapport entre cette phrase et "repiquer un résumé audio généré par IA" ?? C'est en plus le cas où "sourcer précisément" est le plus difficile ! Je ne connais aucun exemple de contribution où cette phrase a été respectée a la lettre, ou même dans l'esprit, et qui a posé problème. Jean-Christophe BENOIST (discuter) 16 août 2026 à 17:53 (CEST)
Plutôt contre. Assez en accord avec les avis contre ci-dessus + le "faut faire avec son temps". Je comprends le problème, on le rencontre également sur le forum de relecture où j'ai pas mal traîné.- Le terme "interdite" me semble un peu fort, surtout qu'il y a ensuite des exceptions. Pour moi, cela se contredit un peu. Ce n'est pas vraiment le fond qui me dérange, mais plutôt la forme. Je suis également d'accord pour dire que la formulation actuelle avec "vivement déconseillé" est à revoir.
- Je n'ai pas de préférence particulière entre B et C.
- Après, factuellement, un article entièrement généré par IA se repère assez rapidement et est relativement simple à supprimer. Est-ce que cela pose d'autres problèmes ? Lorsqu'il y a un doute peut-être ? Et est-ce que les admins sont débordés à cause de ça ?
- Je m'interroge également sur le "pour la rédaction des articles" : Quels sont les autres cas, en dehors de la rédaction, où son utilisation serait donc autorisée ?
- Cdt, // Agonatrix 💬 16 août 2026 à 17:02 (CEST)
- Hello @Agonatrix. Ça devient un sérieux problème, oui. Cf. Wikipédia:Bulletin des administrateurs/2026/Semaine 32#Abus d'IA et révocation de masse par exemple, mais tu peux aussi consulter les RA, le BULPAT ou Discussion projet:Observatoire des IA pour trouver d'autres exemples, chez des débutants comme chez des anciens. — Jules* 💬 17 août 2026 à 13:14 (CEST)
Pour Je conseille aussi d'interdire l'utilisation pour les discussions (sauf la traduction). En de-wp nous avions eu pleusieurs cas d'appelle contre un bloque qui a été écrit par IA et tout les reponses été écrit par IA. Der-Wir-Ing (discuter) 16 août 2026 à 17:22 (CEST)
Pour fort proposition C --Dr anakin775 [Allô ?] 16 août 2026 à 19:14 (CEST)
Pour fort, avec une préférence prononcée pour la proposition B. Les gens lisent vite, il faut être le plus direct possible. Merci au passage à tous les contributeurs qui luttent contre ce fléau au quotidien. Ménestor (discuter) 17 août 2026 à 09:46 (CEST)
Pour Bien que j'aie pesé, par ma défense du libre choix de nos outils (IA ou autres) dans le respect des principes wikipédiens, sur la mise en place de la formulation actuelle vivement déconseillée, force est de constater avec le recul qu'elle n'aide pas nos équipes de patrouille. La proposition B me semble la meilleure ; j'aurais peut-être ajouté Sauf exceptions très précises au début de la première phrase pour nuancer malgré tout le propos, mais je comprends les avis qui préfèrent ne mentionner ces exceptions qu'en fin d'introduction pour clarifier l'esprit de cette recommandation. --Cosmophilus (discuter) 17 août 2026 à 19:13 (CEST)
Pour A condition bien entendu que l'aide à la correction puissent toujours possible à partir du moment que c'est relu et relu plusieurs fois pour être sur qu'on ne fasse pas de connerie.- A titre personnel, je m'en sers pour l'aide à la correction moi qui est un piètre rédacteur, il m'aide beaucoup que se soit pour la correction, la reformulation, etc Aelxen Équipe EBRC 18 août 2026 à 18:18 (CEST)
- Perso, je préfère mille fois avoir affaire à un texte imparfait qu'on comprend, qu'à une bouillie bien lisse insipide qui sent l'ennui..
Limfjord* (discuter) 18 août 2026 à 20:35 (CEST)
- Alors oui @Limfjord*, mais pour le coup, mon talent rédactionnel laisse vraiment à désirer par moment, je préfère encore m'aider de ça que d'avoir des textes imbitable ou à la formulation douteuse. Merci la dyspraxie et la dysorthographie.
- Après, je ne génère rien, c'est juste de l'aide à la rédaction, je fais une ébauche, en règle général pas très foufou et après je repasse derrière. Aelxen Équipe EBRC 18 août 2026 à 21:05 (CEST)
- Perso, je préfère mille fois avoir affaire à un texte imparfait qu'on comprend, qu'à une bouillie bien lisse insipide qui sent l'ennui..
Merci pour vos avis. J'ai ébauché Wikipédia:Sondage/Évolution de la recommandation sur l'IA générative, dans l'idée de soumettre le sondage au vote le .
Cdlt, — Jules* 💬 19 août 2026 à 14:41 (CEST)
Résultat du sondage et évolution de la recommandation
modifierBonsoir,
À la suite du résultat de Wikipédia:Sondage/Évolution de la recommandation sur l'IA générative, favorable, j'ai introduit les textes validés par le sondage tels qu'ils avait été proposés, pour l'introduction et pour la section « Dans les discussions ».
Puis j'ai procédé à quelques ajustements, pour la section Wikipédia:Intelligence artificielle générative#Usages tolérés. Elle mériterait peut-être d'être remaniée un peu plus profondément, sur la forme.
Enfin, j'ai effectué plusieurs ajustements dans Wikipédia:Intelligence artificielle générative#Dans les discussions, à partir de remarques faites par les votants au sondage, notamment ceux qui ont donné un avis « neutre ». Ces modifications peuvent évidemment être annulées, complétées, retouchées, discutées…
De la même manière, quelques contributeurs ont promu une légère retouche de la première phrase de l'introduction (notamment @LD et @GF38storic sur la construction de la phrase, et @Patrick.Delbecq et @EmDee sur la mention des LLM) ; je vous laisse voir ce qu'il doit en être.
Cdlt, — Jules* 💬 14 septembre 2026 à 01:32 (CEST)
- Merci @Jules*, je pense qu'on est tous d'accord et que ça éclaircit l'usage dans la version francophone de Wikipédia. Cordialement GF38storic (discuter) 14 septembre 2026 à 07:16 (CEST)
- Salut, j'ai màj les deux modèles d'avertissement pour utilisation de genAI : {{Avertissement IA 1}} et {{Avertissement IA 2}}. bonne journée, (:Julien:) ✒ 14 septembre 2026 à 08:51 (CEST)
- Bonjour
Je pense effectivement que les directives doivent être directes, claires, nettes et précises : pas de périphrases, pas de jargon, pas de détails superfétatoires. Donc "L'usage de l'IAg basé sur les LLM est déconseillé" => "l'usage de l'IA est interdit". Par expérience des textes réglementaires tant français qu'européens dans le domaine dans lequel je travaille, un manque de précision nuit gravement à leur compréhension et leur application. Cordialement. Patrick.Delbecq (discuter) 14 septembre 2026 à 14:01 (CEST)
- Bonjour
- Salut, j'ai màj les deux modèles d'avertissement pour utilisation de genAI : {{Avertissement IA 1}} et {{Avertissement IA 2}}. bonne journée, (:Julien:) ✒ 14 septembre 2026 à 08:51 (CEST)