Quelles sources ChatGPT cite-t-il quand on lui demande un logiciel B2B ?
Dans l'AI Sources Index 2026 d'Evocia, 88,8 % des 2 259 citations produites par ChatGPT en réponse à 200 questions d'achat de logiciels B2B en français pointent vers une source first-party : le site de l'éditeur (71,8 %) ou sa documentation officielle (17,0 %). Les institutions publiques et les standards représentent 9,5 % ; les sources tierces, analystes, places de marché, réseaux sociaux, presse, forums et recherche réunis, 1,6 %. Aucun comparateur de logiciels n'est cité. Ces chiffres décrivent ChatGPT interrogé par l'API d'OpenAI avec recherche web, sur ce corpus précis, le 14 septembre 2026.
Cette page est le point d'entrée de la série de données de l'étude : chaque type de source a ensuite sa propre page (Reddit, comparateurs, presse, institutions, documentation). L'étude complète, avec ses graphiques et ses fichiers, est sur la page de l'AI Sources Index 2026.
L'essentiel en 60 secondes
- 88,8 % des citations (2 007 sur 2 259) sont first-party : site d'éditeur ou d'entreprise 71,8 %, documentation officielle d'éditeur 17,0 %.
- 9,5 % (215) vont à des institutions publiques et régulateurs (8,5 %, 14 domaines dont cnil.fr et cyber.gouv.fr) ou à des standards et fondations (1,0 %).
- 1,6 % (37) vont à des tiers : analystes 17 citations, places de marché 10, réseau social 5 (un seul domaine, LinkedIn), presse 3, recherche 1, forum 1.
- Sur 653 réponses citantes, 521 (79,8 %) ne citent que des sources first-party.
- Zéro comparateur de logiciels cité. Les forums sont lus (Reddit consulté dans 100 réponses) mais presque jamais cités.
- Le mélange dépend du secteur : 99 % de first-party en CRM, 58 % en cybersécurité, où les institutions pèsent 38 %.
La répartition des 2 259 citations
En bref
Dix types de sources ont été distingués, regroupés en trois familles. Les sources first-party (éditeurs et leur documentation) totalisent 2 007 citations, les sources institutionnelles 215, les sources tierces 37. Le classement a été fait par règles puis relu domaine par domaine ; les 308 domaines cités sont classés, aucun n'est resté inconnu.
| Type de source | Citations | Part des citations | Réponses contenant ce type | Domaines distincts |
|---|---|---|---|---|
| Site d'éditeur ou d'entreprise | 1 622 | 71,8 % | 556 (69,5 % des 800) | 234 |
| Documentation officielle d'éditeur | 385 | 17,0 % | 266 (33,3 %) | 60 |
| Institution publique, régulateur | 193 | 8,5 % | 98 (12,3 %) | 14 |
| Standard, fondation, projet open source | 22 | 1,0 % | 18 (2,3 %) | 7 |
| Analyste, laboratoire de test, étude | 17 | 0,75 % | 10 (1,3 %) | 5 |
| Place de marché | 10 | 0,44 % | 5 (0,6 %) | 4 |
| Réseau social | 5 | 0,22 % | 4 (0,5 %) | 1 |
| Média, presse spécialisée | 3 | 0,13 % | 3 (0,4 %) | 2 |
| Académique, recherche | 1 | 0,04 % | 1 | 1 |
| Communauté, forum | 1 | 0,04 % | 1 | 1 |
| Comparateur de logiciels | 0 | 0 % | 0 | 0 |
Corpus principal, 800 réponses dont 653 avec citation, 2 259 citations. « Réponses contenant ce type » = Response Frequency, part des 800 réponses où le type apparaît au moins une fois. Source : Evocia, AI Sources Index 2026.
Le type « documentation » regroupe les hôtes de documentation, de support et d'apprentissage des éditeurs (learn., docs., support., help.). Il explique à lui seul pourquoi microsoft.com est le domaine le plus cité de l'étude : ses 177 citations viennent presque toutes de learn.microsoft.com. Le détail est dans pourquoi microsoft.com est le site le plus cité par ChatGPT.
Huit réponses sur dix ne citent que des éditeurs
En bref
Le taux de 88,8 % est une moyenne sur les citations ; réponse par réponse, la concentration est plus forte encore. Sur 653 réponses citantes, 521 (79,8 %) ne contiennent aucune source autre que des éditeurs et leur documentation. Une réponse de ChatGPT à une question d'achat B2B est donc, quatre fois sur cinq, une synthèse de ce que les vendeurs disent d'eux-mêmes.
Cette lecture appelle deux précisions. D'abord, « citer un éditeur » ne signifie pas « recommander cet éditeur » : l'étude mesure les sources affichées, pas les marques conseillées dans le texte ; une page d'éditeur peut être citée pour une définition ou un tarif. Ensuite, le modèle lit bien d'autres choses avant de répondre : en moyenne 27 pages consultées par réponse, dont des forums et des encyclopédies, pour 3,4 pages citées. La sélection finale privilégie la source primaire. Ce mécanisme est détaillé dans ChatGPT lit 27 pages et en cite 3.
À retenir
Formulation citable : « Dans l'AI Sources Index 2026 d'Evocia, 88,8 % des 2 259 citations de ChatGPT à des questions d'achat de logiciels B2B pointent vers le site ou la documentation d'un éditeur, et 79,8 % des réponses citantes ne citent aucune autre source. »
Ce que les IA ne citent pas : comparateurs, forums, presse
En bref
Les sources que l'on présente d'ordinaire comme décisives pour les IA sont presque absentes de ce corpus. Aucun comparateur de logiciels n'est cité. Les forums le sont une fois (github.com), la presse trois fois, un réseau social cinq fois (LinkedIn). Les analystes et laboratoires de test, dix-sept fois, concentrés sur la cybersécurité.
| Source | Consultée pendant la recherche | Citée dans la réponse | Page dédiée |
|---|---|---|---|
| 999 pages, dans 100 réponses | 0 fois | ChatGPT cite-t-il Reddit ? | |
| Wikipédia | 313 pages, dans 85 réponses | 0 fois | Wikipédia et YouTube : lus, jamais cités |
| Comparateurs de logiciels | 6 pages, dans 6 réponses (g2.com 4, capterra.fr 1, trustradius.com 1) | 0 fois | ChatGPT cite-t-il G2 et Capterra ? |
| Presse et médias | 74 pages sur 25 906 | 3 fois | Presse, LinkedIn, analystes : 1,6 % des citations |
| Institutions (CNIL, ANSSI, CISA…) | 1 678 pages | 193 fois | ChatGPT cite-t-il la CNIL et l'ANSSI ? |
Consultations : sources retournées par l'outil de recherche (25 906 sur 853 réponses). Citations : annotations url_citation (2 259 sur le corpus principal). Source : Evocia, AI Sources Index 2026.
Chaque ligne a sa page : ChatGPT cite-t-il Reddit ?, Wikipédia et YouTube, G2 et Capterra, presse, LinkedIn et analystes, CNIL, ANSSI et sites gouvernementaux.
Le mélange varie selon le secteur
En bref
La part de first-party va de 99,1 % en CRM à 58,2 % en cybersécurité. Dans ce dernier secteur, les institutions (ANSSI, CISA, CNIL) représentent 37,9 % des citations ; dans le legal et la conformité, 18,4 %. Partout ailleurs, l'éditeur domine à plus de 87 %.
| Secteur | First-party | Institutions et standards | Tiers | Domaines cités |
|---|---|---|---|---|
| CRM et ventes | 99,1 % | 0,9 % | 0 % | 17 |
| Service client et CCaaS | 97,2 % | 1,9 % | 0,9 % | 29 |
| RH et recrutement | 96,8 % | 3,2 % | 0 % | 39 |
| Marketing automation | 95,4 % | 2,5 % | 2,1 % | 38 |
| Data et analytics | 95,4 % | 3,7 % | 0,9 % | 31 |
| Finance et dépenses | 91,8 % | 7,3 % | 0,9 % | 45 |
| Cloud et infrastructure | 90,0 % | 10,0 % | 0 % | 33 |
| E-commerce et paiements | 87,0 % | 5,6 % | 7,4 % | 34 |
| Legal, compliance, RegTech | 79,4 % | 19,3 % | 1,4 % | 72 |
| Cybersécurité | 58,2 % | 39,2 % | 2,6 % | 33 |
80 réponses par secteur. Les parts sont calculées sur les citations du secteur. Source : Evocia, AI Sources Index 2026.
La comparaison complète des dix secteurs (concentration, stabilité, domaines dominants) est dans dix secteurs B2B comparés ; chaque secteur a en outre sa page de données.
Pourquoi ce résultat diffère d'autres études
En bref
D'autres mesures publiées en 2026 trouvent une majorité de sources tierces, presse en tête, dans les citations des IA. Les deux résultats sont compatibles : ils ne posent pas les mêmes questions. Sur des questions d'actualité ou générales, les IA citent la presse ; sur une question d'achat de logiciel, elles citent les éditeurs. Le type de question détermine le type de source.
L'écart tient aussi à la définition de la citation. Cette étude ne compte que les annotations de source renvoyées par l'API, sans rien extraire du texte, et sépare strictement les pages consultées des pages citées. Une mesure qui compterait les pages consultées obtiendrait, ici même, une part de forums et d'encyclopédies plus élevée. Les études comparées, leurs corpus et leurs définitions sont sur ce que mesurent les études sur les sources des IA.
Méthode et limites
En bref
Une citation est une annotation url_citation attachée par l'API à la réponse ; les pages consultées par l'outil de recherche sont comptées à part. Les domaines sont classés par règles (hôtes de documentation, listes d'institutions, de standards, de médias, d'analystes) puis relus un par un ; « site d'éditeur » est le type par défaut d'un domaine commercial. Les parts portent sur le corpus principal de 800 réponses.
- Ce que la donnée établit : la répartition par type des sources que ChatGPT affiche, dans cette configuration, sur ce corpus.
- Ce qu'elle n'établit pas : quelles marques sont recommandées dans le texte (non analysé dans cette édition) ; le comportement de l'interface grand public ; celui d'autres modèles ou d'autres langues ; une causalité entre le type de source et la recommandation.
- Fragilités : la classification est humaine ; les catégories les plus rares (presse, forum, recherche) reposent sur une poignée de citations, et leur part exacte n'a pas de sens statistique au-delà de « quasi nulle ».
La taxonomie des 308 domaines, les fichiers de citations et de sources consultées, et le dictionnaire des variables sont publiés avec l'étude.
Consulter l'AI Sources Index 2026Questions fréquentes
ChatGPT cite-t-il les sites des éditeurs de logiciels ?
Massivement, sur ce corpus : 71,8 % des citations vont à un site d'éditeur ou d'entreprise et 17,0 % à sa documentation officielle, soit 88,8 % de sources first-party sur 2 259 citations. C'est la mesure de l'AI Sources Index 2026 d'Evocia, sur des questions d'achat de logiciels B2B en français.
Quelle part des sources de ChatGPT sont des sites tiers ?
1,6 % dans cette étude (37 citations sur 2 259) : analystes et laboratoires de test 17, places de marché 10, LinkedIn 5, presse 3, recherche 1, forum 1. Les institutions publiques et les standards, comptés à part, pèsent 9,5 %.
Le résultat serait-il le même sur des questions non commerciales ?
Rien ne permet de l'affirmer, et d'autres études suggèrent le contraire sur des questions d'actualité. Cette mesure ne porte que sur des questions d'achat de logiciels B2B ; c'est le type de question qui semble déterminer le type de source, ce que l'étude ne teste pas au-delà de son corpus.
Sources
Transparence et méthode
Auteur
Evocia · Cabinet français de visibilité dans les IA
Evocia mesure la visibilité des entreprises dans les réponses des IA et publie ses données. Cette page fait partie de la série de données de l'AI Sources Index 2026.
Comment cet article a été réalisé
- Page de données publiée le 17 septembre 2026. Chiffres recalculés depuis l'export brut de l'API (corpus principal, 800 réponses, 2 259 citations) ; aucun chiffre saisi à la main.
- La classification des 308 domaines est celle publiée avec l'étude : règles puis relecture manuelle. Les catégories comptant moins de dix citations sont présentées comme quasi nulles, sans interprétation de leurs écarts.
- L'étude ne mesure pas les marques recommandées dans le texte des réponses ; cette page ne l'affirme nulle part.
Historique des mises à jour
- 17 septembre 2026Publication initiale.