Intelligence artificielle · IA générative

ChatGPT et Wikipédia

ce que dit la notice, et ce qui les lie

Le sommaire de la notice encyclopédique, la chronologie datée de l’outil, et les chiffres du recul de trafic annoncés par la Wikimedia Foundation.

Personne assise devant un ordinateur portable et des livres ouverts, entourée de tiroirs de catalogue
Réponse rapide

Une notice Wikipédia consacrée à ChatGPT existe en français : elle décrit l’outil, ses modèles, son modèle économique, sa réception et ses critiques, chaque affirmation renvoyant à une référence numérotée. Dans l’autre sens, l’encyclopédie fait partie des matières premières utilisées pour entraîner les grands modèles de langage, et la Wikimedia Foundation a mesuré en octobre 2025 un recul d’environ 8 % de ses consultations humaines sur la période mai-août 2025.

  • La notice : sept sections, dont une consacrée aux critiques, toutes sourcées.
  • Le point de départ : ouverture au public le 30 novembre 2022.
  • La limite de l’assistant : entraînement arrêté à une date, aucun renvoi vérifiable.
  • La règle de l’encyclopédie : pas d’article rédigé par un modèle de langage.

Deux personnes tapent cette requête pour deux raisons opposées. L’une veut lire la notice encyclopédique consacrée à ChatGPT, avec ses dates et ses controverses. L’autre s’interroge sur le lien entre l’agent conversationnel et l’encyclopédie collaborative : qui se sert de qui, et qui croire.

« ChatGPT Wikipédia »

deux recherches derrière une requête

Une notice existe bien, en français comme en anglais, et elle est maintenue par des contributeurs bénévoles au même titre que n’importe quel autre article. C’est le premier sens de la requête, le plus fréquent.

Encore faut-il atteindre la vraie page. Les résultats de recherche renvoient couramment vers des sites qui recopient l’encyclopédie sans en être : le texte y est souvent figé sur une ancienne version, sans historique ni page de discussion. Le plus sûr reste de passer par le moteur de recherche interne de l’encyclopédie, ou de vérifier le domaine avant de lire.

Le second sens de la requête est plus intéressant : l’encyclopédie fait partie des matières premières qui ont servi à entraîner les modèles de langage, ChatGPT compris. Le rapport n’est donc pas neutre, et il a des effets mesurables sur le trafic de l’encyclopédie.

Ce que contient la notice Wikipédia de ChatGPT

La version française suit un plan classique pour un sujet technologique : les caractéristiques de l’outil et les modèles qui l’animent, ses usages, son modèle économique, la réception initiale, les critiques, les interdictions géographiques, puis les références.

La section la plus utile n’est pas la première. C’est celle des critiques, qui rassemble en un seul endroit ce qu’aucune page officielle ne met en avant : les réponses fausses formulées avec assurance, les biais hérités des données d’entraînement, les litiges sur les droits d’auteur des textes utilisés pour l’entraînement, et les conditions de travail des personnes chargées d’étiqueter les contenus toxiques. Chaque affirmation y est suivie d’un renvoi numéroté vers un article de presse, une publication de recherche ou un communiqué, ce qui permet de sortir de l’encyclopédie pour aller vérifier ailleurs.

Les repères datés qu’on y trouve

La chronologie est la principale raison de consulter cette page plutôt qu’un billet de blog.

DateÉtape
30 novembre 2022Ouverture au public, en accès gratuit de recherche
5 décembre 2022Premier million d’utilisateurs, cinq jours après le lancement
Janvier 2023Cap des cent millions de comptes
Mars 2023Arrivée de GPT-4
Janvier 2024Ouverture d’une boutique de robots conversationnels personnalisés
Mai 2024Lancement de GPT-4o
Août 2025GPT-5 et simplification de l’interface
Octobre 2025Sortie d’un navigateur web maison

Cette succession dit deux choses que le tableau ne formule pas. D’abord un rythme : un modèle majeur par an environ, avec des versions intermédiaires entre deux. Ensuite un glissement de nature : les trois premières années concernent l’outil lui-même, les suivantes son extension en écosystème — boutique de robots personnalisés, puis navigateur. Le produit a cessé d’être une fenêtre de conversation pour devenir une porte d’entrée.

Cette chronologie a par ailleurs une propriété absente des pages promotionnelles : elle est révisable et discutée. Chaque ligne a été ajoutée par quelqu’un, parfois contestée par quelqu’un d’autre, et la trace de ces échanges reste consultable.

Pourquoi ne pas demander à ChatGPT de raconter sa propre histoire

C’est le réflexe le plus courant, et il produit des erreurs pour trois raisons cumulées.

La première est la date de coupure des connaissances. Un modèle est entraîné sur des données arrêtées à un moment donné : la génération diffusée en 2025 s’appuie sur des textes qui s’arrêtent à l’automne 2024. Tout ce qui suit lui est étranger, sauf s’il consulte le web pendant la conversation, ce qui n’est pas systématique.

La deuxième est l’absence de renvoi vérifiable. Quand une date est fausse, rien ne le signale : la formulation reste aussi assurée que pour une date juste.

La troisième est l’absence d’historique. Sur l’encyclopédie, chaque modification est horodatée, signée et annulable, et les désaccords se règlent sur une page de discussion visible. Un assistant réécrit sa réponse à chaque échange, sans mémoire du débat qui a précédé. Les deux outils ne servent donc pas au même moment : l’un pour explorer un sujet, l’autre pour établir des faits.

Dans l’autre sens

l’encyclopédie nourrit les modèles

Wikipédia est l’une des sources textuelles majeures utilisées pour entraîner les grands modèles de langage. La raison est mécanique : un corpus vaste, structuré, rédigé dans un style neutre et librement réutilisable.

La conséquence l’est aussi. Beaucoup de réponses obtenues auprès d’un assistant reprennent la substance d’une notice sans que le lecteur ouvre jamais la page. La Wikimedia Foundation a documenté l’effet en octobre 2025, au terme d’une séquence en trois temps : elle a amélioré ses outils de détection au printemps 2025, découvert qu’une partie du trafic comptabilisé comme humain provenait en réalité de robots configurés pour passer inaperçus, puis constaté après recomptage un recul d’environ 8 % des consultations humaines entre mai et août 2025, par rapport à la même période de l’année précédente. Le reclassement n’a pas créé la baisse : il l’a rendue visible.

Deux flux évoluent donc en sens inverse. Le trafic humain recule, celui des robots d’aspiration grimpe : la fondation fait état d’une hausse d’environ 50 % de la bande passante consommée par ces robots depuis janvier 2024. L’encyclopédie est de moins en moins lue et de plus en plus copiée. Pour un service financé par les dons de ses lecteurs, la mécanique est problématique : on ne fait pas de don à une page qu’on n’ouvre pas.

Ce que Wikipédia autorise, et ce qu’elle refuse

La communauté a tranché : un contributeur ne peut pas faire rédiger ni réécrire un article par un modèle de langage, et une IA ne modifie pas les articles de sa propre initiative. Deux usages assistés restent tolérés, la traduction et la relecture, à condition qu’un humain vérifie et assume le texte publié.

Les motifs invoqués sont concrets. Des faits erronés glissés dans des phrases bien tournées, des références inventées ou impossibles à retrouver, et une désorganisation du travail collectif quand du texte non vérifié arrive plus vite que la capacité de relecture des bénévoles. Des procédures de suppression accélérée visent désormais les contributions manifestement générées.

Copier une réponse d’IA dans un article

Reprendre telle quelle une réponse d’assistant pour compléter une notice expose à une annulation rapide, et le compte peut être bloqué en cas de récidive. Le problème n’est pas l’outil employé pour rédiger, mais l’impossibilité de rattacher chaque affirmation à une source consultable.

Utiliser les deux ensemble, sans se tromper de rôle

Le critère qui les sépare n’est pas la qualité de la réponse, c’est sa vérifiabilité. D’où un ordre de travail simple.

  1. Cadrer avec l’assistant

    Poser une question large pour obtenir le vocabulaire du domaine, les notions à connaître et les pistes à explorer. C’est ce qu’un moteur de recherche fait mal.

  2. Vérifier sur la notice

    Ouvrir la page correspondante et contrôler les faits, les dates et les noms propres. C’est là que les erreurs de l’assistant deviennent visibles.

  3. Descendre dans les références

    Les renvois numérotés en bas de page mènent aux sources primaires. Pour un sujet sensible, c’est le seul niveau qui compte vraiment.

  4. Consulter l’historique si le sujet est contesté

    L’onglet des modifications et la page de discussion révèlent ce qui fait débat entre contributeurs, information qu’aucun résumé ne donne.

Existe-t-il une page Wikipédia sur ChatGPT ?

Oui, en français comme en anglais, maintenue par des contributeurs bénévoles au même titre que n’importe quel autre article. Elle couvre les caractéristiques de l’outil, ses usages, son modèle économique, sa réception, les critiques qui lui sont adressées et les interdictions géographiques dont il a fait l’objet.

Quand ChatGPT est-il sorti ?

Le 30 novembre 2022, en accès gratuit présenté comme un aperçu de recherche. Le premier million d’utilisateurs a été atteint cinq jours plus tard, et le cap des cent millions de comptes en janvier 2023.

ChatGPT peut-il se tromper en parlant de lui-même ?

Oui, pour deux raisons cumulées. Son entraînement s’arrête à une date donnée, ce qui le rend aveugle aux évolutions postérieures, et il ne fournit pas de renvoi vérifiable vers l’origine de ses affirmations. Une date fausse sort avec la même assurance qu’une date juste.

Wikipédia sert-elle à entraîner les modèles d’IA ?

Elle fait partie des sources textuelles majeures utilisées à cette fin : le corpus est vaste, rédigé dans un style neutre et librement réutilisable. La Wikimedia Foundation signale d’ailleurs une hausse d’environ 50 % de la bande passante consommée par les robots d’aspiration depuis janvier 2024.

Les articles de Wikipédia sont-ils écrits par des IA ?

Non. Les contributeurs n’ont pas le droit de faire rédiger ou réécrire un article par un modèle de langage, et une IA ne modifie pas les articles d’elle-même. La traduction et la relecture assistées restent tolérées, à condition qu’un humain relise et assume le texte. Des procédures de suppression accélérée visent les contributions manifestement générées.

La notice consacrée à ChatGPT a une particularité que ses rédacteurs n’avaient pas prévue : elle documente un outil qui s’est entraîné sur elle.