Discussion Wikipédia:Sondage/Utilisation de l'IA dans les bots

Type d'IA

modifier

Bonsoir, il existe un grand nombre d'IA, et il serait utile de préciser de quoi il s'agit ici. J'ai l'impression, à lire les échanges dont les LI figurent, qu'il s'agit d'IA générative, ça vaudrait le coup de le préciser alors (je me base là-dessus pour la suite).
Il serait aussi utile de clarifier si on parle de bots dont le code est ouvert seulement, qui permettent de comprendre au moins la base de leur fonctionnement, ou pas, et si un mécanisme de vérification est prévu ou pas, puisque selon les IAg utilisées, leur comportement peut évoluer, par exemple lorsque leur base d'apprentissage change.
Enfin, il me semblerait aussi utile d'indiquer si l'IAg utilisée a un code source ouvert, afin de permettre de comprendre son fonctionnement, et une configuration (base d'apprentissage, poids...) ouverte. - Lupin (discuter) 8 février 2026 à 23:41 (CET)Répondre

Notification Lupin~fr : Bonjour ! Peut-être qu'il faudrait faire plusieurs sections par type d'IA (IAg externe, IA entraînée en local, etc.) et ajouter une section pour savoir si le code d'un bot utilisant l'IA doit être public ou non. Simonk (discuter) 10 février 2026 à 10:46 (CET)Répondre
Ce peut être une solution.
On peut poser la question pour un bot dont le code serait fermé mais déjà vu la défiance envers l'IA, je trouverais audacieux de proposer une telle question qui risque d'entraîner des réponses négatives aux autres questions par crainte.
Par ailleurs, cela m'apparaîtrait assez éloigné de l'encyclopédie libre et transparente qu'est WPfr depuis ses débuts - Lupin (discuter) 10 février 2026 à 15:10 (CET)Répondre
Notification Lupin~fr : Sinon, pour la question du code public, il faudrait un autre sondage. Simonk (discuter) 10 février 2026 à 16:12 (CET)Répondre
tu ne crains pas que ne pas garantir un code source ouvert pour auditer l'IAg n'entraîne des votes négatifs ? - Lupin (discuter) 11 février 2026 à 17:28 (CET)Répondre
Notification Lupin~fr : Pour la question du code source ouvert, je voulais parler de tous les bots et pas spécifiquement des bots utilisant l'IA et donc faire un sondage à part qui concerne tous les bots (la question de reprise du code source d'un bot abandonné n'utilisant pas forcément l'IA pourrait aussi y être abordée). Cependant, on pourrait aussi ajouter cette question sur ce sondage pour les bots utilisant l'IA. Simonk (discuter) 12 février 2026 à 13:50 (CET)Répondre
Oui, j'avais bien compris :)
J'y vois deux avantages :
  • maintenabilité, comme tu l'indiques pour un bot qui dysfonctionne ou dont le dresseur n'est pas dispo ;
  • transparence et audit
- Lupin (discuter) 13 février 2026 à 15:36 (CET)Répondre
Bonjour, diviser par type d’entraînement ne change rien au problème de la définition de ce qu’est l’IA, définition qui a varié et continuera de varier au cours du temps. Pour paraphraser Benedict Evans, l’IA c’est « n’importe quoi qui ne marche pas » : une fois qu’un type d’IA est entré dans les mœurs, on « oublie » que c’est de l’IA et on trouve d’autres appellations (apprentissage automatique, classification, etc). À mon sens le sondage ne serait pertinent que pour les IA génératives, quelque soit leur mode d’entraînement. -- Okhjon (discuter) 14 avril 2026 à 22:48 (CEST)Répondre

Question trop large

modifier

Tout est dans le titre. Et si la base est l'utilisation par RevolucionBot, qui n'a été que peu testé et n'a pas fait ses preuves pour la partie IA, je ne vois pas que répondre à part non. --Pa2chant.bis (discuter) 13 février 2026 à 06:14 (CET)Répondre

Notification Pa2chant.bis : Bonjour ! La question est vague et il faudrait préciser le type d’IA. Par exemple, sur Wikipédia en espagnol, il existe aussi un bot anti-vandalisme (en plus d'Automoderator) utilisant https://meta.wikimedia.org/wiki/Machine_learning_models/Production/Language_agnostic_link-based_article_topic (es:User:SeroBOT). Donc il serait intéressant d’ajouter une question sur les IA de WM et les IA autres car j’envisage de l’utiliser dans RevolucioBot en cas d’acceptation. Simonk (discuter) 13 février 2026 à 09:34 (CET)Répondre
Je notifie également Notification Lupin~fr sur ce bot. Simonk (discuter) 13 février 2026 à 09:54 (CET)Répondre
SeroBOT utilise le LLM de Automoderator. Il faudrait effectivement apporter une nuance quant à l'origine des LLM utilisés pour permettre une utilisation ceux de la Fondation ou ceux vérifiés par le Mouvement. Trizek bla 22 juin 2026 à 11:02 (CEST)Répondre
Bonjour Trizek Émoticône. Ne connaissant ni SeroBOT ni Automoderator, je ne suis pas certaine de comprendre la portée de cette remarque. Concernant le bot utilisé par SimonK, il a sauf loupé de ma part renoncé à utiliser l'IA, cette page n'est donc plus vraiment d'actualité. Cdlt, --Pa2chant.bis (discuter) 22 juin 2026 à 11:34 (CEST)Répondre
Automoderator est pareil, développé par la Fondation. Ce dernier utilise le « Multilingual Revert Risk model », un modèle qui détecte les vandalismes. SeroBOT est l'équivalent de Salebot sur la Wikipédia en espagnol. Sauf changement depuis la dernière fois que j'ai vérifié, il utilise le même modèle de détection, sans doute avec quelques subtilités qui m'échappent. Donc déjà des bots qui utilise des LLM sur d'autres wikis et cela pourrait arriver ici. :) Trizek bla 22 juin 2026 à 11:56 (CEST)Répondre
Merci Trizek. Je suppose qu'on les testerait avant acceptation. Émoticône. --Pa2chant.bis (discuter) 22 juin 2026 à 13:18 (CEST)Répondre
Autre possibilité à soumettre : faire confiance aux retours des autres communautés pour un usage similaire. On y gagnerait sans doute du temps. Trizek bla 22 juin 2026 à 16:50 (CEST)Répondre

Évaluations, bandeaux…

modifier

Je vois qu’on parle surtout de vandalisme ici. Pourtant, de nombreuses autres tâches gagneraient à être automatisées en cas de création d’un bot utilisant l’IA. De nombreux articles ne sont par exemple pas évalués. Un bot utilisant l’IA pourrait le faire. Il pourrait aussi déterminer si ils sont à mettre à jour, à wikifier… où si ils sont générés par IA. Il poserait ensuite des bandeaux si nécessaire. Cordialement, PAAR29 (discuter) 29 juin 2026 à 15:08 (CEST)Répondre

IA est polysémique, il serait nécessaire de préciser de quoi on parle.
En particulier, l'impact énergétique nécessaire et les biais possibles me semble des sujets à réfléchir. - Lupin (discuter) 3 juillet 2026 à 13:33 (CEST)Répondre
Oui, il y a par exemple les IA faibles qui ne peuvent accomplir que quelque tâches, les IA génératives qui elles peuvent en faire énormément... PAAR29 (discuter) 3 juillet 2026 à 14:01 (CEST)Répondre
Bonjour ! C'est également une bonne idée de créer un bot basée sur l'IA (générative ou non) pour évaluer les articles car une IA générative analyse mieux le contenu que simplement un algorithme basé sur la longueur de l'article. Simonk (discuter) 22 juillet 2026 à 10:22 (CEST)Répondre
Dans ce cas, un algo effectuant une éval sur des critères clairs et explicites sera bien plus transparente qu'une IA, on évitera les hallucination et on collera aux principes de WP. :) - Lupin (discuter) 24 juillet 2026 à 01:20 (CEST)Répondre

Il ouvre quand le sondage ?

modifier

et est-ce qu'il est possible de programmer un bot pour en être informé ? Est-ce qu'il existe un bot qui t'envoie des rappels ou des notification ?

ça serait pratique en général et merci d'avance BlackJack5671 (discuter) 13 juillet 2026 à 22:03 (CEST)Répondre

Notification BlackJack5671 : Bonjour ! Aucune date n'a été programmée. De plus, il n'y a pas d'urgence. Simonk (discuter) 22 juillet 2026 à 10:20 (CEST)Répondre

Statut de bot avec IA ?

modifier

Bonjour,

Je comprends qu'il faille se moderniser et l'IA serait efficace pour certaines tâches, toutefois, y aurait-il une manière de, si l'IA est acceptée, créer un statut de bot utilisant de l'IA (qui fonctionnerait un peu comme celui de bot, devant être accepté et laissant savoir facilement son utilisation ?

En effet, une telle nouveauté devrait être bien organisée.

En résumé : je suggère de, si l'IA est acceptée, créer un nouveau statut pour ça, mais je ne sais pas si ce serait trop de travail.


Cordialement, Utilisateur ouikipedia (discuter) 4 août 2026 à 20:53 (CEST)Répondre

Bien sûr, si créer un statut technique donne trop de travail, un statut non technique (comme l'arbitre) peut être créé à la place, avec pour seule action technique l'ajout d'un modèle/d'une catégorie pour l'identifier. Utilisateur ouikipedia (discuter) 4 août 2026 à 20:58 (CEST)Répondre
Bonsoir @Utilisateur ouikipedia,
il me semble que WP a parmi ses valeurs de base la transparence. Par IA, on entend souvent IA générative, qui ne dispose pour l'heure pas d'explicabilité. L'usage de ce type d'IA dans les bots m'apparaît donc peu compatible avec nos usages. J'espère que c'est plus clair :) - Lupin (discuter) 5 août 2026 à 00:17 (CEST)Répondre
Bonsoir @Lupin~fr,
Je ne cmprends pas très bien ce que vous voulez dire : mon idée est justement pour permettre à la communauté de savoir qui utilise de l'IA et sur quoi. Aussi, vous dites « L'usage de ce type d'IA dans les bots » je ne comprends pas : de quel type d'IA parlez-vous ? Mon idée est de faire l'élection pour tous les types d'Ia, mais si vous voulez limiter à certains types, je ne m'y oppose pas. Vous dites que l'IA générative ne dispose pas d'explicabilité : savoir quelle est l'intention du bot, pourquoi mettre de l'IA, pourquoi l'IA améliore-t-elle sont déjà des informations précieuses qui, à ma connaissance, sont simples à expliquer.
Cordialement, Utilisateur ouikipedia (discuter) 5 août 2026 à 00:31 (CEST)Répondre
Bonjour @Utilisateur ouikipedia par ce type d'IA, je faisais référence à celle que je décrivais dans la phrase précédente, les IAg.
Avant de se demander comment le faire, il me semble utile de se demander si c'est utile.
Afin de gagner du temps, j'indiquais que pour l'IAg, cela ne semble pas possible à utiliser.
Dans les autres cas, si l'IA en question est explicable (une heuristique par exemple), alors cela semble utilisable car explicable. - Lupin (discuter) 5 août 2026 à 10:30 (CEST)Répondre

Le bon niveau de décision : le statut bot, pas un sondage global

modifier

Je comprends l'intention du sondage, mais je pense qu'il pose la question au mauvais niveau et qu'il risque de trancher dans le vide.

Le problème de fond : « l'IA » n'est pas un objet homogène. Un classifieur anti-vandalisme (façon ClueBot NG sur enwiki), un correcteur orthographique par dictionnaire et un modèle génératif type GPT n'ont ni le même risque, ni le même degré d'explicabilité, ni le même besoin de supervision. Voter « pour » ou « contre » sur l'ensemble ne produira aucune règle réellement actionnable — et comme le note Okhjon plus haut, ce qui est « IA » aujourd'hui devient un algorithme banal demain : une doctrine figée par sondage vieillira mal. Wikipédia glisse déjà sur une pente de dette technique et de ringardisation web, c'est pas le moment de rajouter des couches supplémentaires pour faire fuir des développeurs/bots/IA bénévoles.

Même chose pour les questions 2 et 3 : décider a priori quels modèles sont acceptables, ou quelles tâches sont éligibles, revient à trancher sans avoir vu un seul cas tourner en conditions réelles — alors qu'aucun "bot IA" n'aurait encore de retour d'expérience solide sur fr.wp (voir RevolucionBot).

Ma position : WP:Bot pose déjà le principe qui couvre ce risque, indépendamment de la technologie — l'opérateur est pleinement responsable, et le bot doit être « suffisamment lent pour que les erreurs puissent être repérées rapidement ». Une hallucination IA n'est jamais qu'un bug d'un genre particulier, avec les mêmes recours (page de discussion, kill switch, RA, blocage/ban, bureaucrates…).

Le lieu naturel pour évaluer une IA donnée, c'est donc WP:Bot/Statut : à chaque demande, exiger la description précise de la tâche, la méthode utilisée (avec son niveau d'explicabilité, si ça vous semble nécessaire), des tests probants sur plusieurs dizaines d'édits, puis un vote communautaire au cas par cas. Exactement comme pour n'importe quel bot aujourd'hui ! Ça permet d'évaluer chaque techno dans le contexte réel de sa tâche, plutôt que de figer une position théorique ou générale sur un objet mal défini.

-- Irønie 5 août 2026 à 12:40 (CEST)Répondre

Je comprend le raisonnement, j'y vois juste un souci avec une IA non transparente, qui est que le test est complique pour ne pas dire impossible - Lupin (discuter) 5 août 2026 à 23:44 (CEST)Répondre
Les tests pour un bot IA, c'est exactement pareil que pour n'importe quel autre bot : des dizaines/centaines d'edits de test, une estimation du taux d'erreur acceptable.
Même pour un bot sans IA qui fait des tâches complexes, rien ne garantit qu'il ne foire pas sur des cas nouveaux, hors de l'échantillon testé. C'est un problème connu, pas un mystère, c'est la gestion habituelle des bots. Mon bot CodexBot fixe ses comportements à partir de probabilités évaluées au préalable sur des passes de milliers d'articles, mais y'a toujours des cas où ça merde. Tant pis, on n'a pas mieux.
Et de toute façon, la transparence du code n'apporte pas grand-chose en pratique : très peu de bots actuels ont leur algorithme réellement audité par la communauté (ça demande du temps et des compétences que personne n'a en volume) — on évalue sur les edits produits, on discute avec le dresseur, on signale les erreurs. Un bot "explicable" mais jamais lu reste un boîte noire de facto. Ce qui protège, c'est la méthodo (échantillon large, seuil de tolérance, réversibilité rapide), pas la lisibilité théorique du code. -- Irønie 6 août 2026 à 10:20 (CEST)Répondre
Pour préciser ma pensée, WPfr est transparente car elle permet d'accéder à toutes les contributions. Ça n'empêche pas les problèmes, mais ça permet de les éviter.
De même similaire, je ne dis pas identique, un bot par la transparence de son algorithme et sa programmation permet de vérifier que son fonctionnement répond aux attentes. Ça n'empêche pas les problèmes mais permet un audit.
C'est du reste la même chose pour un logiciel libre par exemple.
À mon sens, la transparence n'est pas une assurance qu'il n'y aura pas de problèmes, mais c'est une facilité pour l'auditer, et pour résoudre les éventuels problèmes. - Lupin (discuter) 6 août 2026 à 16:52 (CEST)Répondre

Préciser le sondage

modifier

Serait-il possible de séparer différents sujets, principalement:

  • Typologie d'IA (NLP, LLMs, etc...) toutes ne représentent pas les mêmes risques
  • Niveau de supervision (décision humaine totale, décision sous conditions, totale autonomie, etc...)
  • Types de tâches (edition d'article, catégorisation, vérification de sources, etc...

Parce que par exemple, un bot totalement autonome qui se charge de laisser en page de discussion d'un article une analyse de sources manquantes, ou de sources erronées, etc... peut être plus autonome qu'un bot qui réécrit les introductions. Le sujet est pour de bonnes raisons sujet de tension, le plus on est précis le plus simple ça sera à mon avis dans la discussion même si ça la complexifie un peu :) schiste 20 août 2026 à 09:24 (CEST)Répondre

Bonjour,
pour qu'un plus grand nombre puisse participer à cette discussion, pourriez vous ne pas la noyer sous du jargon de spécialistes s'il vous plait ? Serait-il possible, au moins, de lier à leur première utilisation des sigles comme NLP (je ne suis même pas sûr que le lien soit correct, j'espère que c'est le bon), LLM (là j'ai moins de doutes, mais est-ce que ce sera la même chose pour tout le monde ?) pour faciliter le suivi des néophytes ? D'avance merci. -- Hippo discutez sans frapper 20 août 2026 à 13:48 (CEST)Répondre
Absolument, désolé j'ai ajouté. Et peut-être même que la typologie de modèle n'est pas si importante que les deux autres questions. Par exemple, un modèle de NLP est utilisé par les masqueur de modifications sur enwp pour détecter les données à caractère personnel dans du contenu ou des discussions. Le modèle classifie et le taux de faux positifs n'est pas important puisque l'impact est très réduit par apport au gain. Mon point étant que l'IA est un sujet plus large que juste les modèles génératifs et que l'on en utilise déjà dans différents sujets et je pense qu'il faut différencier les usages. schiste 20 août 2026 à 14:13 (CEST)Répondre

Messages de robots en page de discussion

modifier

Bonjour,

Pour fournir un exemple dans un autre domaine, j'utilise un LLM dans OrlodrimBot pour la tâche décrite sur Utilisateur:OrlodrimBot/Messages sans destinataire (code source). C'est assez basique : il s'agit de savoir si un message dans une page de discussion contient une question, en quelle langue il est rédigé et si l'utilisateur demande un déblocage. Le robot utilise cette analyse pour construire une réponse à partir de fragments préécrits, ou éventuellement choisir de ne pas répondre. Il n'y a pas de contenu généré par IA dans le texte de la réponse.

Je ne sais pas s'il y a vraiment besoin de figer a priori ce qui est autorisé ou non. Je n'ai pas eu de retours négatifs sur cette tâche, mais si on me demandait sans contexte « voulez-vous autoriser les bots à utiliser l'IA pour poster des messages en page de discussion sans être explicitement sollicités », je pourrais être tenté de répondre non Émoticône.

Orlodrim (discuter) 17 septembre 2026 à 12:31 (CEST)Répondre

Retour à la page du projet « Sondage/Utilisation de l'IA dans les bots ».