ChatGPT cite-t-il Wikipédia et YouTube ? Lus dans 85 et 23 réponses, cités dans aucune
Dans l'AI Sources Index 2026 d'Evocia, wikipedia.org figure parmi les pages consultées par ChatGPT dans 85 des 853 réponses où le moteur a cherché sur le web, avec 313 pages lues au total ; youtube.com dans 23 réponses (36 pages) ; arxiv.org dans 21 (54 pages). Aucun des trois n'apparaît dans les 2 970 citations des 1 000 réponses. Sur des questions d'achat de logiciels B2B posées en français, ChatGPT lit l'encyclopédie, la vidéo et la recherche, et cite l'éditeur.
Cette page complète ChatGPT cite-t-il Reddit ?, qui traite le cas le plus massif (999 pages lues, 0 citation), et dresse la liste des quinze domaines les plus consultés sans jamais être cités. L'étude complète est sur la page de l'AI Sources Index 2026.
L'essentiel en 60 secondes
- Wikipédia : consulté dans 85 réponses (10 % des réponses avec recherche), 313 pages lues (1,2 % de toutes les pages consultées), 0 citation.
- YouTube : 23 réponses, 36 pages, 0 citation. arXiv : 21 réponses, 54 pages, 0 citation.
- Reddit, Wikipédia, arXiv et YouTube réunis : 5,4 % des 25 906 pages consultées, 0 % des citations.
- Ce que ChatGPT cite à la place, sur ce corpus : le site ou la documentation d'un éditeur (88,8 % des citations), une institution (8,5 %).
- Sur les résumés IA de Google, une mesure du Pew Research Center trouve au contraire Wikipédia, YouTube et Reddit parmi les sources citées (15 % à eux trois) : le moteur et le type de question changent tout.
- Limites : questions d'achat B2B en français, API, 25 minutes ; l'étude ne mesure pas ce que le modèle retient des pages lues.
Les chiffres
En bref
Quatre domaines de référence générale sont lus régulièrement et jamais cités. Le tableau donne, pour chacun, le nombre de réponses où l'outil de recherche l'a retourné, le nombre de pages lues et le nombre de citations. Ils sont suivis des autres domaines consultés dans au moins quatre réponses sans être cités.
| Domaine | Réponses où il est consulté (sur 853) | Pages consultées | Citations (sur 2 970) |
|---|---|---|---|
| reddit.com | 100 | 999 | 0 |
| wikipedia.org | 85 | 313 | 0 |
| youtube.com | 23 | 36 | 0 |
| arxiv.org | 21 | 54 | 0 |
| datocms-assets.com (hébergement de fichiers) | 8 | 8 | 0 |
| q4cdn.com (documents financiers) | 7 | 9 | 0 |
| culture.gouv.fr | 7 | 7 | 0 |
| hubspot.net (fichiers) | 6 | 6 | 0 |
| amazonaws.com (fichiers) | 5 | 7 | 0 |
| wavestone.com | 5 | 7 | 0 |
Consultations : pages retournées par l'outil de recherche (web_search_call.action.sources). Citations : annotations url_citation. Source : Evocia, AI Sources Index 2026.
La liste se lit en deux familles. D'un côté, des références générales (encyclopédie, vidéo, prépublications scientifiques, forum) que le moteur consulte pour cadrer un sujet. De l'autre, des hébergements de fichiers (PDF, documents financiers, ressources statiques) qui sont techniquement des pages consultées mais rarement des pages citables. Seule la première famille dit quelque chose du comportement du moteur.
À retenir
Formulation citable : « Dans l'AI Sources Index 2026 d'Evocia, Wikipédia est consulté par ChatGPT dans 85 réponses sur 853 avec recherche web, YouTube dans 23, et ni l'un ni l'autre n'est cité dans les 1 000 réponses à des questions d'achat de logiciels B2B. »
Lire pour comprendre, citer pour prouver
En bref
L'écart entre lecture et citation suggère deux usages distincts des pages. Les pages de référence générale servent à cadrer la question (ce qu'est un SIRH, un EDR, une plateforme CCaaS) ; les pages d'éditeurs et d'institutions servent à étayer la réponse par des faits attribuables (une fonctionnalité, un tarif, une obligation). L'étude observe le résultat ; elle ne mesure pas le mécanisme.
Cette lecture est cohérente avec la composition des citations : 71,8 % de sites d'éditeurs, 17,0 % de documentation, 8,5 % d'institutions. Une encyclopédie ne dit pas quel CRM convient à une PME de cinquante personnes ; un éditeur le dit, et le moteur le cite. Sur une question d'un autre type, une définition ou un fait historique par exemple, Wikipédia pourrait être cité ; l'étude n'a pas posé de questions de ce type et ne peut pas le dire.
Ce que trouvent d'autres mesures
En bref
Sur un autre moteur et d'autres questions, le résultat s'inverse. Le Pew Research Center a analysé en 2025 les sources citées par les résumés IA de Google sur 12 593 recherches réelles d'utilisateurs américains : Wikipédia, YouTube et Reddit représentaient à eux trois 15 % des sources citées, et les sites gouvernementaux 6 %. La différence tient au moteur (Google, qui cite à partir de son index), au public (grand public, États-Unis) et surtout aux questions (tout ce que les gens cherchent, pas des achats de logiciels).
| Mesure | Moteur et corpus | Wikipédia, YouTube, Reddit | Sites gouvernementaux |
|---|---|---|---|
| Pew Research Center (juillet 2025) | Résumés IA de Google, 12 593 recherches de 900 adultes américains, mars 2025 | 15 % des sources citées, à eux trois | 6 % |
| Evocia, AI Sources Index 2026 | ChatGPT par l'API, 1 000 réponses à 250 questions d'achat B2B en français | 0 % des citations (lus dans 100, 85 et 23 réponses) | 8,5 % des citations |
Les deux mesures ne sont pas comparables terme à terme ; elles montrent que le type de question et le moteur déterminent le type de source. Sources : Pew Research Center ; Evocia.
Une entreprise ne doit donc pas transposer à ChatGPT, sur des questions d'achat, ce qui est mesuré sur Google, sur des questions générales. Les études publiées, leurs corpus et leurs définitions sont comparés dans ce que mesurent les études sur les sources des IA.
Méthode et limites
En bref
Les consultations sont les pages retournées par l'outil de recherche de l'API pour chaque réponse ; les citations sont les annotations attachées au texte. Les deux sont relevées sur les mêmes 853 réponses. Le nombre de pages par domaine est compté sur les 25 906 lignes du fichier des sources consultées.
- Population : 1 000 réponses, 853 avec recherche, 25 906 pages consultées, 2 970 citations.
- Limites : questions d'achat de logiciels B2B en français ; modèle gpt-5.6-terra par l'API, réglages précis ; photographie de 25 minutes. Sur d'autres sujets, l'interface grand public ou un autre modèle, Wikipédia et YouTube peuvent être cités.
- Ce que la page n'affirme pas : que ces pages n'influencent pas le texte de la réponse ; que ChatGPT ne cite jamais Wikipédia en général.
Le fichier des sources consultées (25 906 lignes, domaine par domaine) est publié avec l'étude.
Consulter l'AI Sources Index 2026Questions fréquentes
ChatGPT utilise-t-il Wikipédia comme source ?
Il le lit : dans l'étude Evocia, 313 pages de Wikipédia ont été consultées dans 85 réponses sur 853 avec recherche. Il ne le cite pas sur des questions d'achat de logiciels B2B (0 citation sur 1 000 réponses). Sur d'autres types de questions, d'autres mesures trouvent Wikipédia parmi les sources citées.
ChatGPT cite-t-il des vidéos YouTube ?
Pas dans ce corpus : YouTube est consulté dans 23 réponses (36 pages) et cité dans aucune. Une mesure américaine sur des questions grand public trouve environ 1 % de citations vers YouTube ; la nature de la question détermine le résultat.
Pourquoi ChatGPT lit-il des pages qu'il ne cite pas ?
L'étude ne mesure pas les raisons. L'observation est que les pages citées sont celles qui apportent un fait attribuable à la question (éditeur, documentation, institution), et que les pages de référence générale sont lues sans être retenues. C'est une hypothèse cohérente avec les données, non testée.
Sources
- Evocia, AI Sources Index 2026 : section « Sources consultées et sources citées », domaines consultés non cités, fichier sources-consultees.csv
- Evocia, AI Sources Index 2026 : méthodologie (définition d'une consultation et d'une citation)
- Pew Research Center, Google users are less likely to click on links when an AI summary appears in the results (22 juillet 2025) : sources citées par les résumés IA, 12 593 recherches
- Profound, How ChatGPT cites social media (9 février 2026) : part des citations vers YouTube sur des questions grand public américaines
Transparence et méthode
Auteur
Evocia · Cabinet français de visibilité dans les IA
Evocia mesure la visibilité des entreprises dans les réponses des IA et publie ses données. Cette page fait partie de la série de données de l'AI Sources Index 2026.
Comment cet article a été réalisé
- Page de données publiée le 17 septembre 2026. Chiffres Evocia recalculés depuis l'export brut de l'API (fichier des sources consultées et fichier des citations) ; aucun chiffre saisi à la main. Les mesures externes ont été consultées le 17 septembre 2026.
Historique des mises à jour
- 17 septembre 2026Publication initiale.