Aller au contenu
Evocia
Toutes les ressources

Données

ChatGPT lit 27 pages et en cite 3 : ce qui sépare une source consultée d'une source citée

Par Evocia17 septembre 2026· 7 min de lecture

Partager

Dans l'AI Sources Index 2026 d'Evocia, les 853 réponses de ChatGPT ayant déclenché une recherche web reposent sur 25 906 pages consultées, soit 27,03 par réponse en moyenne et 23 en médiane, réparties sur 4,53 domaines par réponse. Chaque réponse cite en moyenne 3,39 pages. Le rapport entre pages citées et pages consultées est de 11,5 % : une page lue sur neuf est affichée comme source. Sur l'ensemble, 10 549 pages distinctes ont été consultées et 1 397 citées ; 607 domaines ont été consultés et 308 cités.

Cette page décrit l'entonnoir entre ce que le moteur lit et ce qu'il montre, mesuré sur les mêmes réponses grâce aux deux flux que renvoie l'API. L'étude complète est sur la page de l'AI Sources Index 2026.

L'essentiel en 60 secondes

  • 27,03 pages consultées par réponse avec recherche (médiane 23), sur 4,53 domaines ; 3,39 pages citées. Ratio cité / consulté : 11,5 %.
  • 25 906 consultations, 10 549 pages distinctes, 607 domaines consultés ; 2 970 citations, 1 397 pages distinctes, 308 domaines cités.
  • Le mélange des pages lues ressemble à celui des pages citées, à une exception près : 68,0 % des consultations vont à des sites d'éditeurs, 17,6 % à de la documentation, 6,5 % à des institutions, et 4,2 % à des forums (dont 999 pages Reddit) qui disparaissent presque entièrement à la citation.
  • Les sources lues mais jamais citées sont connues : Reddit (999 pages dans 100 réponses), Wikipédia (313 pages, 85 réponses), arXiv (54 pages, 21 réponses), YouTube (36 pages, 23 réponses).
  • Plus le moteur cherche, plus il cite : 2,7 citations après une recherche, 4,2 après deux, 4,8 après trois.
  • Être lu n'est pas être cité. La sélection finale privilégie les pages qui apportent un fait à la réponse ; le mécanisme n'est pas documenté par OpenAI.

L'entonnoir, en chiffres

En bref

Pour une réponse avec recherche, ChatGPT rassemble en moyenne 27 pages, en provenance de 4 à 5 domaines, puis en affiche 3 à 4 comme sources. Sur l'ensemble des 853 réponses, le rapport entre pages distinctes citées et pages distinctes consultées est de 13 % (1 397 sur 10 549), et de 51 % entre domaines (308 sur 607).

ÉtapePar réponse (moyenne)Total distinct sur 853 réponses
Pages consultées27,03 (médiane 23)10 549 pages, 607 domaines
Domaines consultés4,53607
Pages citées3,391 397 pages, 308 domaines
Ratio cité / consulté11,5 %13,2 % des pages, 50,7 % des domaines

Consultations : pages retournées par l'outil de recherche (web_search_call.action.sources) ; citations : annotations url_citation. 853 réponses avec recherche sur 1 000. Source : Evocia, AI Sources Index 2026.

Deux lectures de ce ratio coexistent. Par page, la sélection est sévère : neuf pages lues sur dix ne sont pas montrées. Par domaine, elle l'est moins : la moitié des sites consultés finissent cités au moins une fois dans le corpus. Autrement dit, ChatGPT lit plusieurs pages d'un même site et n'en retient qu'une ; le site apparaît, la page choisie varie.

Ce que ChatGPT lit ressemble à ce qu'il cite

En bref

La répartition des 25 906 consultations par type de source est proche de celle des citations : 68,0 % de sites d'éditeurs, 17,6 % de documentation, 6,5 % d'institutions. La sélection ne transforme donc pas un corpus de forums en un corpus d'éditeurs ; elle part déjà d'un corpus d'éditeurs. La seule catégorie que la sélection efface est celle des forums et communautés : 4,2 % des pages lues, 0,04 % des citations.

Type de sourcePart des consultations (25 906)Part des citations (2 259, corpus principal)
Site d'éditeur ou d'entreprise68,0 %71,8 %
Documentation officielle d'éditeur17,6 %17,0 %
Institution publique, régulateur6,5 %8,5 %
Communauté, forum (dont Reddit)4,2 %0,04 %
Encyclopédie (Wikipédia)1,2 %0 %
Standard, fondation, open source1,0 %1,0 %
Analyste, laboratoire de test0,46 %0,75 %
Réseau social (dont YouTube)0,36 %0,22 %
Média, presse0,29 %0,13 %
Académique, recherche0,22 %0,04 %
Place de marché0,16 %0,44 %
Comparateur, plateforme d'avis0,02 % (6 pages)0 %

Les parts de consultation sont calculées sur les 25 906 pages retournées par l'outil de recherche, classées avec la taxonomie de l'étude relue le 17 septembre 2026 (les domaines consultés mais jamais cités, comme Reddit ou Wikipédia, tombaient auparavant dans le type par défaut). Source : Evocia, AI Sources Index 2026.

Le point qui échappe à ce tableau est celui des domaines très consultés et jamais cités. Reddit figure dans 100 réponses (999 pages lues), Wikipédia dans 85 (313 pages), YouTube dans 23, arXiv dans 21 ; aucun n'est cité. À eux quatre, ils représentent 5,4 % des pages consultées et 0 % des citations. Leur cas est traité dans ChatGPT cite-t-il Reddit ? et Wikipédia et YouTube.

Plus de recherches, plus de citations

En bref

Une réponse avec recherche déclenche en moyenne 1,52 recherche. Le nombre de citations augmente avec le nombre de recherches : 2,73 citations après une seule recherche (350 réponses), 4,23 après deux (265), 4,81 après trois (37). Le moteur ne cite pas plus par recherche ; il cite plus quand la question l'a conduit à chercher plusieurs fois.

Recherches dans la réponseRéponsesCitations par réponse (moyenne)
13502,73
22654,23
3374,81
416,0

Corpus principal, 653 réponses avec recherche. Source : Evocia, AI Sources Index 2026.

Le nombre de citations par réponse, selon l'intention et le secteur, a sa propre page : combien de sources ChatGPT cite-t-il par réponse ?.

Ce que cela signifie pour une entreprise

En bref

Être dans les 27 pages lues est nécessaire, et loin d'être suffisant : il faut encore être dans les 3 retenues. L'étude ne mesure pas ce qui fait passer une page de l'un à l'autre. Elle établit en revanche que la sélection finale ne renverse pas le mélange initial : la page citée pour une question de logiciel est, dans neuf cas sur dix, une page d'éditeur ou de documentation.

  • Ce qui est établi : l'ampleur de l'entonnoir (27 → 3,4), sa composition par type, les domaines lus mais jamais cités, l'effet du nombre de recherches.
  • Ce qui ne l'est pas : les critères de sélection d'une page parmi les pages lues. OpenAI n'en publie aucun ; l'étude n'en teste aucun.
  • Hypothèse raisonnable, non testée : le moteur cite les pages dont il reprend un fait précis (fonctionnalité, prix, définition, obligation), et lit les autres pour le contexte. Ce serait cohérent avec la disparition des forums et des encyclopédies entre lecture et citation.
  • Conséquence pratique : une page qui contient les faits que la question appelle, sur le site de l'éditeur, accessible au robot de recherche, est la candidate naturelle. Les leviers documentés sont dans le guide complet du GEO.

Méthode et limites

En bref

Les consultations sont les pages retournées par l'outil de recherche de l'API pour chaque réponse ; elles ne disent pas si le modèle a lu la page en entier ni ce qu'il en a retenu. Les citations sont les annotations attachées au texte. Les deux flux proviennent des mêmes 853 réponses, ce qui autorise le rapport entre eux.

  • Population : 853 réponses avec recherche sur 1 000 ; 25 906 consultations ; 2 970 citations (2 259 sur le corpus principal pour la répartition par type des citations).
  • Limites : le nombre de pages consultées dépend du réglage de contexte de l'outil (medium) ; un autre réglage ou l'interface grand public peuvent lire plus ou moins de pages. « Consulté » signifie « retourné par l'outil », pas « lu intégralement ».
  • Ce que la page n'affirme pas : que les pages non citées n'ont aucune influence sur la réponse.

Le fichier des 25 906 sources consultées et celui des citations sont téléchargeables avec l'étude, réponse par réponse.

Consulter l'AI Sources Index 2026

Questions fréquentes

Combien de pages ChatGPT lit-il avant de répondre ?

Dans l'étude Evocia, 27 pages en moyenne (23 en médiane) par réponse avec recherche, sur 4 à 5 domaines, avec le réglage de contexte moyen de l'outil de recherche de l'API. Il en cite ensuite 3,4 en moyenne.

Une page consultée par ChatGPT a-t-elle été utilisée ?

Elle a été retournée par l'outil de recherche pour construire la réponse ; l'API ne dit pas ce que le modèle en a retenu. Seules les pages citées sont visibles pour l'utilisateur. L'étude sépare strictement les deux et ne mesure que la seconde comme « source ».

Pourquoi ChatGPT cite-t-il si peu des pages qu'il lit ?

Les critères ne sont pas publiés. L'étude observe que la sélection conserve le mélange initial (éditeurs, documentation, institutions) et écarte presque entièrement forums et encyclopédies ; l'hypothèse d'une préférence pour les pages qui apportent un fait précis est cohérente avec cette observation, mais n'a pas été testée.

Sources

Transparence et méthode

Auteur

Evocia · Cabinet français de visibilité dans les IA

Evocia mesure la visibilité des entreprises dans les réponses des IA et publie ses données. Cette page fait partie de la série de données de l'AI Sources Index 2026.

Comment cet article a été réalisé

  • Page de données publiée le 17 septembre 2026. Chiffres recalculés depuis les deux flux de l'export brut de l'API (sources consultées, citations) sur les mêmes réponses ; aucun chiffre saisi à la main.
  • Le ratio cité / consulté est calculé par réponse (3,39 / 27,03) et sur les totaux distincts ; les deux sont donnés.
  • L'hypothèse sur les critères de sélection est signalée comme non testée.

Historique des mises à jour

  • 17 septembre 2026Publication initiale.

À lire aussi

Commencez par le test gratuit : 3 requêtes, une synthèse claire.

Sans engagement · Nombre limité d'analyses gratuites chaque semaine

Tester ma visibilité IA