Pourquoi les études sur les sources des IA se contredisent : dix mesures, quatre définitions
Les mesures publiées sur les sources citées par les IA donnent des résultats en apparence incompatibles. Une plateforme de relations presse trouve 84 % de médias gagnés sur 25 millions de liens ; l'AI Sources Index 2026 d'Evocia trouve 88,8 % de sites d'éditeurs sur 2 259 citations. Une analyse anglophone sur 1,4 million de requêtes trouve Reddit récupéré massivement et cité dans 1,93 % des cas ; une autre le trouve premier domaine cité ; l'étude Evocia le trouve lu dans 100 réponses et jamais cité. Le nombre de sources par réponse va de 2,6 à 5 pour ChatGPT selon la publication, et jusqu'à 13 pour Claude. Aucun de ces résultats n'est faux : chacun mesure un corpus de questions, un moteur, une interface et une définition de la citation qui lui sont propres.
Cette page aligne dix mesures, vérifiées à la source le 17 septembre 2026, sur ces quatre dimensions, et explique quelles lectures chaque écart autorise. Elle sert de grille avant de citer, ou de comparer, un chiffre sur les sources des IA. L'étude Evocia est sur la page de l'AI Sources Index 2026.
L'essentiel en 60 secondes
- Quatre dimensions séparent les mesures : le corpus de questions (actualité, grand public, achat B2B), le moteur et l'interface (application ou API, avec ou sans recherche), la définition de la citation (annotation, lien affiché, page récupérée) et la classification des sources (site de la marque recommandée, site de toute marque, média gagné).
- 84 % de médias gagnés (Muck Rack, 25 millions de liens, questions générales) et 88,8 % de sites d'éditeurs (Evocia, questions d'achat B2B) mesurent des corpus différents avec des classifications différentes.
- 11,6 % de site de l'éditeur (DerivateX) et 88,8 % (Evocia) : la première compte le site de l'éditeur recommandé, la seconde le site de n'importe quel éditeur.
- Reddit : 1,93 % de citation quand il est récupéré (Ahrefs), 2,4 % des citations (Profound), premier domaine cité (DerivateX), 0 citation (Evocia) : anglais contre français, grand public contre B2B, application contre API.
- Sources par réponse : 2,6 à 4,5 selon le mode de raisonnement (Semrush, 100 requêtes), 3,4 citées pour 27 consultées (Evocia), environ 3 citées pour 20 listées (Resoneo), 5 en moyenne pour ChatGPT, 8 pour Gemini, 13 pour Claude (Muck Rack) : annotation, lien affiché ou page récupérée ne sont pas la même unité.
- Variabilité : 74 % de renouvellement hebdomadaire des domaines (SISTRIX, dérive dans le temps) et 38 % de sources présentes une fois sur quatre (Evocia, même demi-heure) mesurent deux phénomènes qui s'additionnent.
Dix mesures, alignées
En bref
Le tableau donne, pour chaque mesure, son corpus, son moteur et son interface, sa définition de la citation et son résultat principal. Les résultats ne sont comparables qu'à l'intérieur d'une même ligne de définition.
| Mesure (date) | Corpus | Moteur, interface | Ce qui est compté | Résultat principal |
|---|---|---|---|---|
| Evocia, AI Sources Index 2026 (septembre 2026) | 250 questions d'achat de logiciels B2B, français, 1 000 réponses | ChatGPT par l'API, recherche web en mode automatique | Annotations url_citation ; pages consultées comptées à part | 88,8 % de first-party, 0 comparateur, Reddit lu 100 fois et cité 0, 3,46 citations par réponse citante, 38 % de sources présentes 1 fois sur 4 |
| Muck Rack, What Is AI Reading? (mai 2026) | 25 millions de liens, 17 secteurs, questions générales | ChatGPT, Claude, Gemini | Liens cités, classés en médias gagnés, possédés, payants | 84 % de médias gagnés, 27 % de journalisme, 0,3 % de contenus payants |
| Pew Research Center (juillet 2025) | 68 879 recherches réelles de 900 adultes américains, mars 2025 | Résumés IA de Google | Sources citées dans les résumés | Wikipédia, YouTube et Reddit = 15 % des sources ; 88 % des résumés citent 3 sources ou plus ; clic sur un résultat classique 8 % contre 15 % |
| Ahrefs, relayé par Search Engine Journal (avril 2026) | 1,4 million de requêtes, anglais | ChatGPT (modèle 5.2) | Pages récupérées et pages citées | Reddit cité dans 1,93 % des cas où il est récupéré ; 67,8 % des pages récupérées non citées viennent de Reddit |
| Profound, How ChatGPT cites social media (février 2026) | ~700 000 citations de plateformes sociales, utilisateurs américains, octobre à décembre 2025 | ChatGPT | Citations vers des plateformes sociales | Reddit 2,4 % des citations, YouTube 1 %, LinkedIn 0,4 % |
| DerivateX, B2B SaaS AI citation study (mai 2026) | 40 catégories de logiciels × 10 réponses, 233 recommandations, anglais | ChatGPT avec recherche | Site de l'éditeur recommandé contre tiers | 11,6 % de citations vers le site du produit recommandé ; G2 et Capterra 0 ; Reddit premier domaine cité (16) |
| SISTRIX, AI Citation Drift (mai 2026) | 82 619 requêtes, 1,55 million de relevés, 6 pays, 17 semaines | ChatGPT Search, AI Mode, Aperçus IA | Domaines nouveaux d'une semaine à l'autre | Renouvellement hebdomadaire des domaines : ChatGPT 74 %, AI Mode 56 %, Aperçus IA 5 % ; France 42 % pour ChatGPT |
| Havas Market, AI Brand Tracker, relayé par CB News (juin 2026) | 11 000 réponses, 12 secteurs, 150 questions par secteur et par mois, janvier à mai 2026, France | ChatGPT, Gemini | Familles de sources (médias et réseaux, institutions) | ChatGPT : médias et réseaux de 70 % à 38 %, institutions de 5 % à 35 % entre janvier et mai 2026 |
| Resoneo, What ChatGPT pulls, shows, cites (juillet et août 2026) | 1 249 conversations réelles avec récupération | Application ChatGPT, comptes gratuits et payants | Pages récupérées, listées, mises en avant, citées, ouvertes | Médiane : ~20 pages listées, ~5 mises en avant, ~3 citées ; page ouverte citée à 74 %, page seulement récupérée à 7 % ; arXiv récupéré 2 600 fois, cité 10 |
| Semrush, ChatGPT reasoning and AI visibility (30 juin 2026) | 100 requêtes posées deux fois, anglais | ChatGPT (modèle 5.2), mode instantané contre mode raisonnement | Taux de citation et citations par réponse selon le mode | Citations dans 50 % des réponses en mode instantané, 68 % en raisonnement ; 2,6 contre 4,5 citations par réponse ; 25,6 % de domaines communs entre les deux modes |
Toutes les mesures ont été consultées à la source le 17 septembre 2026 ; seuls les chiffres lus sur la page d'origine (ou sur l'article de presse cité) sont repris. Les méthodes de construction des questions ne sont pas toujours publiées.
Écart 1 : médias gagnés contre sites d'éditeurs
En bref
84 % de médias gagnés (Muck Rack) et 88,8 % de sites d'éditeurs (Evocia) sont compatibles. Le premier corpus couvre des questions de tous types dans 17 secteurs ; sur une question d'actualité, la source primaire est un journal. Le second ne contient que des questions d'achat de logiciels ; sur une question de logiciel, la source primaire est l'éditeur. La classification diffère aussi : « média gagné » regroupe tout site tiers, là où l'étude Evocia distingue institutions, analystes, presse et forums.
La mesure française de Havas Market apporte un troisième point de vue, sur des marques B2C : la part des médias et réseaux dans les sources de ChatGPT y est passée de 70 % à 38 % entre janvier et mai 2026, et celle des institutions de 5 % à 35 %. Elle mesure une évolution dans le temps sur un corpus grand public ; l'étude Evocia, une photographie sur un corpus B2B. Le point commun est que le type de question et la période déterminent le type de source ; le détail est dans presse, LinkedIn, analystes : 1,6 % des citations.
Écart 2 : 11,6 % ou 88,8 % de site de l'éditeur
En bref
La mesure anglophone de mai 2026 compte les citations vers le site du produit que ChatGPT recommande dans la réponse ; elle trouve 11,6 %. L'étude Evocia compte les citations vers le site de n'importe quel éditeur, recommandé ou non ; elle trouve 88,8 %. Un éditeur peut être cité pour définir une catégorie, documenter une intégration ou situer une alternative, sans être recommandé. Les deux mesures se complètent ; l'étude Evocia, qui n'analyse pas les marques recommandées, ne peut pas produire la première.
Le même écart de définition explique la plupart des statistiques « first-party contre third-party » qui circulent : selon qu'on compte le site de la marque recommandée, le site de toute marque, ou les médias gagnés, la part va d'environ 10 % à 90 %. Le détail est dans ChatGPT cite-t-il G2 et Capterra ?.
Écart 3 : Reddit, de premier à absent
En bref
Quatre mesures, quatre résultats pour Reddit : premier domaine cité (DerivateX, 16 citations, anglais, application avec recherche), 2,4 % des citations (Profound, grand public américain), cité dans 1,93 % des cas où il est récupéré (Ahrefs, 1,4 million de requêtes en anglais), 0 citation pour 999 pages lues (Evocia, B2B, français, API). Les trois mesures qui distinguent lecture et citation convergent : Reddit est beaucoup lu et peu cité. La part exacte dépend de la langue, du corpus et de l'interface.
La mesure française de Resoneo, sur l'application ChatGPT, ajoute une distinction utile : les pages que le moteur ouvre réellement sont citées à 74 %, celles qu'il ne fait que récupérer à 7 %, et arXiv est récupéré 2 600 fois pour 10 citations. L'étude Evocia observe le même phénomène par l'API, avec ses propres chiffres (arXiv lu dans 21 réponses, jamais cité). Voir ChatGPT cite-t-il Reddit ? et ChatGPT lit 27 pages et en cite 3.
Écart 4 : combien de sources par réponse
En bref
De 2,6 à 13 selon la publication et le moteur, parce que l'unité change : annotation de citation dans le texte (Evocia : 3,46 par réponse citante), pages listées dans un panneau de sources (Resoneo : ~20 listées, ~3 citées), liens affichés (Muck Rack : 5 en moyenne pour ChatGPT, 8 pour Gemini, 13 pour Claude), pages récupérées par l'outil de recherche (Evocia : 27). Le mode du modèle change aussi le résultat : une mesure sur 100 requêtes (Semrush, juin 2026) trouve 2,6 citations en mode instantané et 4,5 en mode raisonnement, avec 25,6 % de recouvrement des domaines entre les deux.
Avant de retenir un chiffre, il faut donc savoir s'il compte ce que le moteur a lu, ce qu'il a affiché ou ce qu'il a attribué à sa réponse. Le détail pour l'étude Evocia est dans combien de sources ChatGPT cite-t-il par réponse ?.
Écart 5 : variabilité dans le temps et variabilité à l'instant
En bref
SISTRIX mesure le renouvellement des domaines cités d'une semaine à l'autre, sur 17 semaines et six pays : 74 % de domaines nouveaux chaque semaine pour ChatGPT Search, 42 % en France. L'étude Evocia mesure la variabilité à conditions constantes, quatre répétitions dans la même demi-heure : 38 % de sources présentes une fois sur quatre, Jaccard 0,55 entre répétitions. Les deux phénomènes s'additionnent : une source peut varier d'une réponse à l'autre le même jour, et disparaître la semaine suivante.
Pour une entreprise, la conséquence est qu'une mesure doit répéter chaque question (pour la variabilité à l'instant) et refaire le relevé à intervalles (pour la dérive). Voir ChatGPT donne-t-il les mêmes sources à chaque fois ? et combien de fois répéter une question.
La grille avant de citer un chiffre
En bref
Quatre questions suffisent à situer une statistique sur les sources des IA : quelles questions ont été posées, à quel moteur et par quelle interface, ce qui a été compté comme citation, et comment les sources ont été classées. Un chiffre sans ces quatre réponses ne peut être ni comparé ni transposé.
| Question | Pourquoi elle change le résultat | Exemple d'écart |
|---|---|---|
| Quelles questions ? | Actualité, grand public ou achat B2B appellent des sources différentes | 84 % de médias gagnés contre 88,8 % d'éditeurs |
| Quel moteur, quelle interface ? | Application ou API, avec ou sans recherche, mode instantané ou raisonnement | 2,6 contre 4,5 citations selon le mode ; Reddit premier ou absent |
| Qu'est-ce qu'une citation ? | Annotation, lien affiché, page récupérée | 3 citées, 20 listées, 27 consultées |
| Comment les sources sont-elles classées ? | Site de la marque recommandée, site de toute marque, média gagné, institution | 11,6 % contre 88,8 % de site de l'éditeur |
Grille de lecture proposée par Evocia à partir des dix mesures du tableau.
L'AI Sources Index 2026 publie ses quatre réponses (250 questions, API Responses, annotations url_citation, taxonomie relue) et ses données, pour être comparé sur ses propres termes.
Consulter l'AI Sources Index 2026Questions fréquentes
Quelle étude sur les sources des IA faut-il croire ?
Toutes, pour ce qu'elles mesurent. Un chiffre sur les sources des IA n'a de sens qu'avec son corpus de questions, son moteur et son interface, sa définition de la citation et sa classification des sources. Deux chiffres ne sont comparables que si ces quatre éléments coïncident.
Pourquoi l'étude Evocia trouve-t-elle si peu de sources tierces ?
Parce que son corpus est fait de questions d'achat de logiciels B2B, pour lesquelles la source primaire est l'éditeur, et parce qu'elle ne compte que les annotations de citation de l'API, en séparant les pages lues (dont 999 pages Reddit) des pages citées. Sur des questions d'actualité, d'autres mesures trouvent une majorité de médias.
Les résultats de l'étude Evocia sont-ils transposables à l'application ChatGPT ?
Pas tels quels : l'étude a été menée par l'API avec des réglages précis. Une mesure française sur l'application (Resoneo) observe le même écart entre pages lues et pages citées, avec des chiffres différents. Le protocole est publié pour permettre la comparaison.
Sources
- Evocia, AI Sources Index 2026 : résultats, méthodologie et données
- Muck Rack, What Is AI Reading? (mai 2026) : 25 millions de liens, 17 secteurs
- Pew Research Center, Google users are less likely to click on links when an AI summary appears in the results (22 juillet 2025)
- Search Engine Journal, ChatGPT often retrieves but rarely cites Reddit pages, data shows (16 avril 2026), relayant une analyse Ahrefs
- Profound, How ChatGPT cites social media (9 février 2026)
- DerivateX, B2B SaaS AI citation study (31 mai 2026)
- SISTRIX, AI Citation Drift : dans quelle mesure les sources sont-elles stables dans les résultats de recherche IA ? (5 mai 2026)
- CB News, IA générative : les sources citées par Gemini et ChatGPT évoluent fortement (Havas Market) (2 juin 2026)
- Resoneo, What ChatGPT pulls, shows, cites (juillet 2026, mise à jour août 2026)
- Semrush, ChatGPT reasoning and AI visibility (30 juin 2026) : 100 requêtes, mode instantané contre raisonnement, 2,6 contre 4,5 citations, 25,6 % de recouvrement
Transparence et méthode
Auteur
Evocia · Cabinet français de visibilité dans les IA
Evocia mesure la visibilité des entreprises dans les réponses des IA et publie ses données. Cette page fait partie de la série de données de l'AI Sources Index 2026.
Comment cet article a été réalisé
- Page publiée le 17 septembre 2026. Chaque mesure externe a été consultée à la source (ou sur l'article de presse cité quand la source refuse les requêtes automatisées) le 17 septembre 2026 ; seuls les chiffres lus sont repris, avec leur date et leur corpus.
- Les mesures ne sont pas agrégées ; la page explique les différences de définition sans hiérarchiser les études.
Historique des mises à jour
- 17 septembre 2026Publication initiale.