Étude Evocia · Recherche originale · Publiée le 14 septembre 2026
Evocia AI Sources Index 2026 : les sources que ChatGPT cite quand un acheteur B2B cherche une solution
250 questions B2B en français, chacune posée quatre fois à ChatGPT de façon indépendante. L'étude mesure quand le moteur consulte le web, quelles sources il cite, et ce qui reste stable quand on répète ou reformule la question.
- réponses analysées
- 1 000
- réponses analysées
- requêtes B2B
- 250
- requêtes B2B
- chaque requête répétée
- 4×
- chaque requête répétée
- des citations pointent vers le site d'un éditeur
- 89 %
- des citations pointent vers le site d'un éditeur
L'étude en 30 secondes
Dix repères, tous recalculés depuis les données brutes. Sauf mention, les comparaisons portent sur le dataset A : 200 requêtes de marché réel, 800 réponses.
- réponses analysées, 0 échec
- 1 000
- réponses analysées, 0 échec
- citations structurées renvoyées par l'API
- 2 970
- citations structurées renvoyées par l'API
- domaines cités, 1 397 URL distinctes
- 308
- domaines cités, 1 397 URL distinctes
- des réponses ont déclenché une recherche web (653 / 800)
- 81,6 %
- des réponses ont déclenché une recherche web (653 / 800)
- citations par réponse citante
- 3,5
- citations par réponse citante
- des citations vont à un site d'éditeur ou à sa documentation
- 89 %
- des citations vont à un site d'éditeur ou à sa documentation
- citation vers un comparateur ou une plateforme d'avis
- 0
- citation vers un comparateur ou une plateforme d'avis
- stabilité moyenne des paires requête × domaine
- 58 %
- stabilité moyenne des paires requête × domaine
- des paires requête × domaine citées 4 fois sur 4
- 27 %
- des paires requête × domaine citées 4 fois sur 4
- des paires requête × domaine citées 1 fois sur 4
- 38 %
- des paires requête × domaine citées 1 fois sur 4
1 · Recherche web
ChatGPT cherche-t-il systématiquement sur le web ?
24 %
seulement, quand la question décrit un problème. 100 % dès qu'elle demande une comparaison.
ChatGPT ne consulte pas le web de la même façon selon votre question
Part des réponses ayant déclenché l'outil de recherche web, par intention de la requête
Une question de comparaison ou de décision déclenche une recherche presque à coup sûr ; une question qui décrit un problème sans nommer de catégorie de solution est traitée de mémoire trois fois sur quatre.
n = 160 réponses par intention (40 requêtes × 4), dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
Sur les 800 réponses du dataset A, 653 (81,6 %) ont déclenché une recherche web et 653 ont produit au moins une citation : dans cette configuration, recherche et citation coïncident exactement. Le modèle décide seul de chercher ; ce choix est presque entièrement déterminé par l'intention. Sur 200 requêtes, 157 ont cherché à chacune des quatre répétitions, 29 n'ont jamais cherché, et 14 ont cherché certaines fois seulement.
2 · Intention
L'intention change-t-elle le nombre de sources citées ?
0,7 → 4,1
citations par réponse, d'une question de type problème à une demande de recommandation.
Le nombre de citations suit le parcours d'achat
Citations par réponse, moyenne par intention, réponses sans citation comptées zéro
La demande de recommandation est le moment où ChatGPT cite le plus de sources : plus de quatre par réponse, contre moins d'une pour une question de type problème.
n = 160 réponses par intention, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
Parmi les réponses qui citent, l'écart persiste : 4,31 citations pour une recommandation contre 3,09 pour une découverte et 2,97 pour un problème. Le nombre de recherches lancées compte aussi : une seule recherche produit 2,7 citations en moyenne, deux recherches 4,2.
| Intention | Réponses | Recherche web | Citations / réponse | IC 95 % | Domaines distincts |
|---|---|---|---|---|---|
| Problème / besoin | 160 | 24,4 % | 0,73 | 0,51 à 0,94 | 15 |
| Découverte de solutions | 160 | 90,6 % | 2,80 | 2,54 à 3,06 | 126 |
| Recommandation | 160 | 94,4 % | 4,06 | 3,79 à 4,33 | 158 |
| Comparaison | 160 | 100,0 % | 3,30 | 3,05 à 3,55 | 105 |
| Décision / achat | 160 | 98,8 % | 3,23 | 3,08 à 3,38 | 112 |
3 · Stabilité
Une même question donne-t-elle les mêmes sources ?
38 %
des paires requête × domaine n'apparaissent que dans une réponse sur quatre. 27 % apparaissent dans les quatre.
Quand un domaine est cité pour une requête, combien de fois sur quatre l'est-il ?
Distribution des paires requête × domaine selon le nombre de répétitions qui citent le domaine
Plus d'une paire sur trois est un événement isolé : le domaine est cité une fois, puis plus jamais sur les trois autres réponses. La stabilité moyenne, définie comme répétitions contenant le domaine sur quatre, est de 58 %.
n = 870 paires requête × domaine, 171 requêtes du dataset A ayant au moins une citation. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
L'unité est la paire requête × domaine, pas la source : un domaine peut être stable sur une requête et occasionnel sur une autre. Restreinte aux 157 requêtes dont les quatre réponses ont cherché sur le web (pour neutraliser l'effet de la recherche elle-même), la distribution bouge peu : 37 % de paires à 1/4, 28 % à 4/4. Sur ces 157 requêtes, seules 21 (13 %) ont cité exactement le même ensemble de domaines quatre fois.
Les comparaisons sont les plus stables, les découvertes les moins
Similarité de Jaccard moyenne entre les ensembles de domaines cités de deux répétitions d'une même requête
Deux réponses à une même question de comparaison partagent près des trois quarts de leurs domaines ; deux réponses à une même question de découverte, à peine plus de deux cinquièmes.
n = 165 requêtes du dataset A ayant au moins deux réponses citantes ; 6 paires de répétitions par requête. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
4 · Sources citées
Qui domine les citations ?
89 %
des citations pointent vers le site d'un éditeur ou sa documentation officielle. Aucune vers un comparateur ou une plateforme d'avis.
ChatGPT cite les éditeurs, pas les comparateurs
Part des citations par type de source (classification Evocia, 288 domaines relus un par un)
Les sites commerciaux des éditeurs et leur documentation concentrent près de neuf citations sur dix ; les institutions publiques et les régulateurs presque tout le reste. Comparateurs, forums, médias et analystes réunis pèsent moins de 2 %.
n = 2 259 citations, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
80 % des réponses citantes (521 sur 653) ne citent que des sources d'éditeurs. Le résultat est d'autant plus net que ChatGPT consulte pourtant d'autres sources : l'API renvoie la liste des pages lues avant de répondre. Sur les 853 réponses avec recherche, 27 URL sont consultées en moyenne pour 3,4 citées ; reddit.com est consulté dans 100 réponses et wikipedia.org dans 85, sans jamais être cités.
27
pages consultées par réponse avant de répondre, en moyenne (médiane 23)
853 réponses avec recherche web · Source : Evocia AI Sources Index 2026
3,4
pages citées par réponse : 11 % de ce qui a été lu
853 réponses avec recherche web · Source : Evocia AI Sources Index 2026
100 / 0
réponses où reddit.com est consulté / réponses où il est cité
1 000 réponses · Source : Evocia AI Sources Index 2026
Les 20 domaines les plus cités
Response Frequency : part des 800 réponses du dataset A citant le domaine au moins une fois
learn.microsoft.com est cité dans une réponse sur cinq et sur 30 % des requêtes, tous secteurs confondus : la documentation Microsoft est la source la plus transversale du corpus B2B.
n = 800 réponses, 200 requêtes, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
| # | Domaine | Type | Réponses | Response Freq. | Citation Share | Query Coverage | Stability |
|---|---|---|---|---|---|---|---|
| 1 | microsoft.com | Documentation officielle d'éditeur | 164 | 20,5 % | 7,8 % | 29,5 % | 69 % |
| 2 | hubspot.com | Site d'éditeur ou d'entreprise | 79 | 9,9 % | 3,8 % | 14,5 % | 68 % |
| 3 | salesforce.com | Site d'éditeur ou d'entreprise | 63 | 7,9 % | 2,9 % | 11,5 % | 68 % |
| 4 | amazon.com | Site d'éditeur ou d'entreprise | 58 | 7,2 % | 3,3 % | 10,0 % | 73 % |
| 5 | google.com | Site d'éditeur ou d'entreprise | 57 | 7,1 % | 3,0 % | 11,5 % | 62 % |
| 6 | adobe.com | Site d'éditeur ou d'entreprise | 50 | 6,3 % | 2,3 % | 8,0 % | 78 % |
| 7 | pipedrive.com | Site d'éditeur ou d'entreprise | 45 | 5,6 % | 2,1 % | 6,5 % | 87 % |
| 8 | cnil.fr | Institution publique | 43 | 5,4 % | 2,7 % | 11,0 % | 49 % |
| 9 | shopify.com | Site d'éditeur ou d'entreprise | 43 | 5,4 % | 2,4 % | 5,5 % | 98 % |
| 10 | lucca.fr | Site d'éditeur ou d'entreprise | 38 | 4,8 % | 2,2 % | 6,5 % | 73 % |
| 11 | freshworks.com | Site d'éditeur ou d'entreprise | 38 | 4,8 % | 2,0 % | 5,5 % | 86 % |
| 12 | hubspot.fr | Site d'éditeur ou d'entreprise | 36 | 4,5 % | 1,7 % | 7,0 % | 64 % |
| 13 | zoho.com | Site d'éditeur ou d'entreprise | 36 | 4,5 % | 1,6 % | 8,0 % | 56 % |
| 14 | brevo.com | Site d'éditeur ou d'entreprise | 35 | 4,4 % | 1,7 % | 5,5 % | 80 % |
| 15 | cyber.gouv.fr | Institution publique | 33 | 4,1 % | 2,8 % | 7,0 % | 59 % |
| 16 | payfit.com | Site d'éditeur ou d'entreprise | 26 | 3,3 % | 1,4 % | 4,0 % | 81 % |
| 17 | pennylane.com | Site d'éditeur ou d'entreprise | 26 | 3,3 % | 1,4 % | 4,5 % | 72 % |
| 18 | genesys.com | Site d'éditeur ou d'entreprise | 26 | 3,3 % | 1,2 % | 4,0 % | 81 % |
| 19 | tableau.com | Site d'éditeur ou d'entreprise | 24 | 3,0 % | 1,2 % | 4,5 % | 67 % |
| 20 | spendesk.com | Site d'éditeur ou d'entreprise | 23 | 2,9 % | 1,2 % | 3,5 % | 82 % |
Couverture × stabilité : quatre profils de sources
Chaque point est un domaine ; taille proportionnelle au nombre de citations ; seuils = médianes
Leaders structurels : microsoft.com, hubspot.com, salesforce.com, google.com, amazon.com, adobe.com. Leader volatil : cnil.fr, cité sur 11 % des requêtes mais stable à 49 % seulement.
n = 85 domaines cités sur au moins 3 requêtes, dataset A ; seuils : couverture 2,5 %, stabilité 58 %. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
Leaders structurels
forte couverture et forte stabilité · 31 domaines
microsoft.com, hubspot.com, salesforce.com, google.com, amazon.com, adobe.com, hubspot.fr, cyber.gouv.fr, pipedrive.com, lucca.fr…
Leaders volatils
forte couverture, stabilité faible · 14 domaines
cnil.fr, zoho.com, sap.com, sage.com, onetrust.com, sellsy.com, personio.fr, scaleway.com, sentinelone.com, zendesk.com…
Experts de niche
faible couverture, forte stabilité · 15 domaines
amplitude.com, intercom.com, adyen.com, mixpanel.com, snowflake.com, mailchimp.com, posthog.com, splunk.com, ironcladapp.com, tomorro.com…
Quelles sources gagnent ou perdent selon le funnel
Response Frequency des 25 premiers domaines, par intention
| Domaine | Problème | Découverte | Recommandation | Comparaison | Décision |
|---|---|---|---|---|---|
| microsoft.com | · | 24 % | 25 % | 24 % | 29 % |
| hubspot.com | · | 9 % | 14 % | 15 % | 11 % |
| salesforce.com | · | 12 % | 10 % | 9 % | 9 % |
| amazon.com | · | 12 % | 8 % | 5 % | 12 % |
| google.com | 1 % | 8 % | 10 % | 10 % | 8 % |
| adobe.com | · | 8 % | 3 % | 14 % | 7 % |
| pipedrive.com | · | 6 % | 10 % | 5 % | 7 % |
| cnil.fr | 4 % | 3 % | 11 % | 1 % | 8 % |
| shopify.com | · | 7 % | 8 % | 5 % | 8 % |
| lucca.fr | · | 4 % | 6 % | 6 % | 8 % |
| freshworks.com | · | 4 % | 9 % | 6 % | 4 % |
| hubspot.fr | · | 1 % | 10 % | 2 % | 9 % |
| zoho.com | · | 3 % | 15 % | 4 % | · |
| brevo.com | · | · | 9 % | 5 % | 8 % |
| cyber.gouv.fr | 10 % | 3 % | 4 % | · | 4 % |
| payfit.com | · | 1 % | 6 % | 3 % | 8 % |
| pennylane.com | · | 4 % | 4 % | 3 % | 6 % |
| genesys.com | · | 4 % | 2 % | 5 % | 5 % |
| tableau.com | · | · | 6 % | 8 % | 2 % |
| spendesk.com | · | 4 % | 2 % | 5 % | 4 % |
| sap.com | · | 6 % | 3 % | 6 % | 1 % |
| agicap.com | · | 3 % | 5 % | · | 6 % |
| sage.com | · | · | 4 % | 4 % | 3 % |
| woocommerce.com | · | · | 4 % | 5 % | 3 % |
| activecampaign.com | · | · | 4 % | 3 % | 5 % |
Sur une question de type problème, aucun des 25 premiers domaines n'est cité, sauf la CNIL. Microsoft est présent à toutes les autres étapes ; HubSpot culmine en comparaison, Pipedrive en recommandation, la CNIL en recommandation et en décision.
n = 160 réponses par intention, dataset A ; valeur = réponses de l'intention citant le domaine / 160. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
5 · Concentration
Les géants dominent-ils vraiment ?
49 %
des citations vont aux 20 premiers domaines. Les 268 autres se partagent le reste, et 95 d'entre eux ne sont cités qu'une fois.
Une tête concentrée, une traîne longue
Part cumulée des citations en fonction du rang du domaine (classement par nombre de citations)
Il faut 22 domaines pour atteindre la moitié des citations et 100 pour en atteindre 84 % : la concentration existe, mais un tiers des domaines cités ne le sont qu'une seule fois.
n = 2 259 citations, 288 domaines, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
22
domaines suffisent pour la moitié des citations
288 domaines cités, dataset A · Source : Evocia AI Sources Index 2026
21 %
des citations vont aux 5 premiers domaines
2 259 citations, dataset A · Source : Evocia AI Sources Index 2026
33 %
des domaines cités ne le sont qu'une seule fois (95 sur 288)
dataset A · Source : Evocia AI Sources Index 2026
6 · Secteurs
Chaque marché a-t-il son propre web ?
72 vs 17
domaines cités en Legal / Compliance contre CRM, à nombre de réponses égal. Les écosystèmes de sources ne se ressemblent pas.
Du marché le plus concentré au plus fragmenté
Nombre de domaines distincts cités par secteur (80 réponses chacun)
Le CRM se joue sur 17 domaines et les dix premiers concentrent 93 % des citations ; la conformité juridique mobilise 72 domaines et les dix premiers moins de la moitié.
n = 80 réponses par secteur (20 requêtes × 4), dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
| Secteur | Recherche web | Citations | Domaines | Top 10 | HHI | Shannon | Stabilité | Sites d'éditeurs |
|---|---|---|---|---|---|---|---|---|
| Cybersécurité | 91 % | 232 | 33 | 80 % | 0,125 | 2,64 | 56 % | 58 % |
| CRM & Sales | 75 % | 220 | 17 | 93 % | 0,120 | 2,35 | 62 % | 99 % |
| Cloud & Infrastructure | 85 % | 249 | 33 | 78 % | 0,105 | 2,74 | 62 % | 90 % |
| E-commerce & Paiements | 89 % | 231 | 34 | 77 % | 0,096 | 2,83 | 69 % | 87 % |
| RH & Recrutement | 75 % | 216 | 39 | 70 % | 0,092 | 2,96 | 57 % | 97 % |
| Data & Analytics | 78 % | 218 | 31 | 78 % | 0,088 | 2,81 | 65 % | 95 % |
| Marketing Automation | 81 % | 237 | 38 | 76 % | 0,083 | 2,92 | 66 % | 95 % |
| Service Client & CCaaS | 75 % | 214 | 29 | 77 % | 0,076 | 2,86 | 60 % | 97 % |
| Finance & Spend Management | 80 % | 219 | 45 | 71 % | 0,072 | 3,08 | 49 % | 92 % |
| Legal / Compliance / RegTech | 88 % | 223 | 72 | 48 % | 0,035 | 3,81 | 45 % | 79 % |
La cybersécurité et le juridique s'appuient sur les institutions, le CRM sur les éditeurs
Part des citations par type de source, pour chaque secteur
| Secteur | editeur | documentation | institution | standard | analyste |
|---|---|---|---|---|---|
| CRM & Sales | 85 % | 15 % | 1 % | · | · |
| Marketing Automation | 78 % | 18 % | 2 % | 0 % | · |
| RH & Recrutement | 92 % | 5 % | 3 % | · | · |
| Finance & Spend Management | 85 % | 7 % | 7 % | · | 0 % |
| Cybersécurité | 33 % | 25 % | 38 % | 1 % | 3 % |
| Cloud & Infrastructure | 54 % | 36 % | 7 % | 3 % | · |
| Data & Analytics | 67 % | 28 % | 1 % | 2 % | 0 % |
| Service Client & CCaaS | 84 % | 13 % | 1 % | 1 % | 1 % |
| E-commerce & Paiements | 72 % | 15 % | 5 % | 1 % | 3 % |
| Legal / Compliance / RegTech | 74 % | 6 % | 18 % | 1 % | · |
Deux secteurs sortent du modèle « tout éditeur » : la cybersécurité, où les institutions (cyber.gouv.fr, CISA, NIST) reçoivent 38 % des citations, et le juridique, 18 % (CNIL, Europa). Partout ailleurs, sites d'éditeurs et documentation réunis dépassent 87 % des citations.
n = citations du secteur (214 à 249), dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
Colonnes : editeur = site d'éditeur ; documentation = documentation officielle d'éditeur ; institution = institution publique ou régulateur ; standard = standard, fondation, open source ; analyste = analyste, laboratoire, étude.
Les 15 premiers domaines, secteur par secteur
Response Frequency dans le secteur : part des 80 réponses du secteur citant le domaine
| Secteur | microsoft.com | hubspot.com | salesforce.com | amazon.com | google.com | adobe.com | pipedrive.com | cnil.fr | shopify.com | lucca.fr | freshworks.com | hubspot.fr | zoho.com | brevo.com | cyber.gouv.fr |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| CRM & Sales | 31 % | 33 % | 34 % | · | · | · | 55 % | 3 % | · | · | 15 % | 25 % | 19 % | 5 % | · |
| Marketing Automation | 4 % | 44 % | 25 % | · | 1 % | 33 % | 1 % | 6 % | · | · | · | 18 % | 3 % | 39 % | · |
| RH & Recrutement | 3 % | · | · | · | · | · | · | 8 % | · | 45 % | · | · | 5 % | · | · |
| Finance & Spend Management | 14 % | · | · | · | 1 % | · | · | · | · | 3 % | · | · | 5 % | · | · |
| Cybersécurité | 56 % | 1 % | · | · | 5 % | · | · | 5 % | · | · | · | · | · | · | 34 % |
| Cloud & Infrastructure | 50 % | · | · | 51 % | 21 % | · | · | 6 % | · | · | · | · | · | · | 4 % |
| Data & Analytics | 40 % | · | · | 6 % | 38 % | · | · | 4 % | · | · | · | · | · | · | · |
| Service Client & CCaaS | 4 % | 21 % | 14 % | 15 % | 1 % | · | · | 1 % | · | · | 33 % | 3 % | 13 % | · | · |
| E-commerce & Paiements | · | · | 5 % | · | 4 % | 26 % | · | · | 54 % | · | · | · | · | · | · |
| Legal / Compliance / RegTech | 4 % | · | 1 % | · | · | 4 % | · | 21 % | · | · | · | · | 1 % | · | 4 % |
Microsoft traverse neuf secteurs sur dix, la CNIL huit, Google sept ; la plupart des autres domaines n'existent que dans un ou deux secteurs. Le web de ChatGPT est sectoriel.
n = 80 réponses par secteur, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
Explorez votre secteur
Réponses, recherche web, domaines cités, top 10, concentration, stabilité et types de sources, pour chacun des dix secteurs du dataset A.
80
réponses analysées (20 requêtes × 4)
75 %
ont déclenché une recherche web
17
domaines cités
93 %
des citations vont aux 10 premiers domaines
62 %
stabilité moyenne des paires requête × domaine
99 %
des citations vers un site d'éditeur ou sa documentation
Top 10 des domaines cités
- 1.pipedrive.com44 réponses · 47 citations
- 2.hubspot.com26 réponses · 31 citations
- 3.salesforce.com27 réponses · 28 citations
- 4.microsoft.com25 réponses · 28 citations
- 5.hubspot.fr20 réponses · 21 citations
- 6.zoho.com15 réponses · 15 citations
- 7.sellsy.com12 réponses · 12 citations
- 8.freshworks.com12 réponses · 12 citations
- 9.monday.com7 réponses · 7 citations
- 10.odoo.com4 réponses · 4 citations
Types de sources citées (part des citations)
- Sites d'éditeurs84,6 %
- Documentation éditeur14,5 %
- Institutions, régulateurs0,9 %
Indice de concentration HHI : 0,120 · entropie de Shannon : 2,35 · 86 URL distinctes · 2,75 citations par réponse.
7 · Reformulation · exploratoire
Que se passe-t-il lorsqu'on change la question ?
37 %
de domaines en commun, en moyenne, entre deux formulations voisines d'une même question. 60 % quand on répète la même formulation.
25 reformulations, de la plus stable à la plus perturbée
Similarité de Jaccard entre les domaines cités par la version A et par la version B (union des 4 répétitions de chaque version)
Imposer une intégration, exiger de l'open source ou changer la taille de l'entreprise remplace presque toutes les sources ; préciser un budget ou allonger la question les conserve aux deux tiers. Résultats exploratoires : une expérience par variable.
n = 25 expériences, dataset B, 8 réponses par expérience ; 0 % = aucun domaine en commun, 100 % = mêmes domaines. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.
La ligne pointillée donne l'ordre de grandeur du bruit : sur une même requête du dataset A, l'union des répétitions 1 et 2 partage 60 % de ses domaines avec l'union des répétitions 3 et 4. Une reformulation fait descendre cette similarité à 37 % en moyenne (médiane 33 %) : changer la question change davantage les sources que la répéter.
Avant / après : trois reformulations
Version A · EXP-19
« Quel prestataire de paiement choisir ? »
6 domaines cités sur 4 réponses · 4,00 citations par réponse
- adyen.comdisparue
- mollie.comdisparue
- paypal.comdisparue
- payplug.comdisparue
- stripe.comdisparue
- sumup.comdisparue
Version B · variable : Intégration imposée
« Quel prestataire de paiement choisir s'il doit impérativement s'intégrer à Shopify Plus ? »
1 domaines cités sur 4 réponses · 4,50 citations par réponse
- shopify.comnouvelle
Similarité de Jaccard : 0 % · 0 domaine(s) en commun, 6 disparu(s), 1 nouveau(x).
Version A · EXP-22
« Quelle plateforme de marketing automation choisir ? »
7 domaines cités sur 4 réponses · 4,75 citations par réponse
- activecampaign.comdisparue
- adobe.comdisparue
- brevo.comdisparue
- hubspot.comdisparue
- klaviyo.comdisparue
- plezi.codisparue
- salesforce.comdisparue
Version B · variable : Open source
« Quelle plateforme open source de marketing automation choisir pour une PME ? »
3 domaines cités sur 4 réponses · 2,25 citations par réponse
- github.comnouvelle
- listmonk.appnouvelle
- mautic.orgnouvelle
Similarité de Jaccard : 0 % · 0 domaine(s) en commun, 7 disparu(s), 3 nouveau(x).
Version A · EXP-07
« Quel outil BI choisir ? »
3 domaines cités sur 4 réponses · 3,00 citations par réponse
- google.comconservée
- microsoft.comconservée
- tableau.comconservée
Version B · variable : Question courte vs détaillée
« Quel outil BI choisir pour une PME de 120 salariés qui souhaite remplacer ses tableaux de bord Excel ? »
4 domaines cités sur 4 réponses · 3,25 citations par réponse
- google.comconservée
- microsoft.comconservée
- qlik.comnouvelle
- tableau.comconservée
Similarité de Jaccard : 75 % · 3 domaine(s) en commun, 0 disparu(s), 1 nouveau(x).
8 · Implications
Ce que cela change pour le GEO
01
La page citée est la vôtre
89 % des citations vont au site d'un éditeur ou à sa documentation. L'effort de visibilité se porte d'abord sur vos propres pages : existence, lisibilité par OAI-SearchBot, réponse directe à l'intention.
02
Une page par intention
Le nombre de citations et le déclenchement de la recherche varient du simple au quadruple selon l'intention. Recommandation, comparaison et décision sont trois pages, pas trois paragraphes.
03
La documentation compte autant que le site
17 % des citations vont à des hôtes de documentation (learn., docs., support., help.). Une documentation publique et indexable est une source citable.
04
Mesurer en fréquence, jamais en capture
38 % des paires requête × domaine sont des événements isolés. Seule une mesure répétée sur un panel figé permet de lire une tendance.
05
Couvrir les formulations, pas les mots-clés
Reformuler une question conserve 37 % des sources en moyenne. Un panel de requêtes doit décliner chaque besoin avec ses contraintes réelles.
06
Connaître le web de sa catégorie
De 17 à 72 domaines selon le secteur, avec une part institutionnelle qui varie de 1 % à 39 %. Le benchmark pertinent est sectoriel.
Ces implications découlent d'une configuration précise (voir limites). Aucune ne garantit une citation : l'étude décrit des fréquences, pas un mécanisme de classement.
9 · Données
Explorez les 308 domaines cités
Cherchez votre entreprise ou un concurrent, filtrez par secteur, intention et type de source, triez sur chaque métrique. Population : les 1 000 réponses (datasets A et B).
308 domaines sur 308
| Domaine | Type | |||||||
|---|---|---|---|---|---|---|---|---|
| microsoft.com | Documentation éditeur | 205 | 230 | 20,5 % | 28,8 % | 71 % | 40 % | 108 |
| hubspot.com | Site d'éditeur | 105 | 112 | 10,5 % | 16,4 % | 64 % | 32 % | 40 |
| salesforce.com | Site d'éditeur | 84 | 86 | 8,4 % | 12,8 % | 66 % | 41 % | 34 |
| amazon.com | Site d'éditeur | 69 | 88 | 6,9 % | 10,0 % | 69 % | 40 % | 41 |
| google.com | Site d'éditeur | 68 | 80 | 6,8 % | 11,2 % | 61 % | 21 % | 44 |
| pipedrive.com | Site d'éditeur | 67 | 70 | 6,7 % | 7,6 % | 88 % | 68 % | 9 |
| cnil.fr | Institution, régulateur | 61 | 82 | 6,1 % | 12,0 % | 51 % | 13 % | 41 |
| brevo.com | Site d'éditeur | 56 | 61 | 5,6 % | 6,8 % | 82 % | 71 % | 6 |
| shopify.com | Site d'éditeur | 55 | 81 | 5,5 % | 5,6 % | 98 % | 93 % | 40 |
| adobe.com | Site d'éditeur | 55 | 56 | 5,5 % | 7,2 % | 76 % | 56 % | 19 |
| zoho.com | Site d'éditeur | 53 | 53 | 5,3 % | 9,6 % | 55 % | 17 % | 22 |
| hubspot.fr | Site d'éditeur | 52 | 54 | 5,2 % | 9,6 % | 54 % | 17 % | 18 |
| lucca.fr | Site d'éditeur | 50 | 64 | 5,0 % | 6,8 % | 74 % | 47 % | 15 |
| freshworks.com | Site d'éditeur | 46 | 56 | 4,6 % | 5,2 % | 88 % | 62 % | 21 |
| payfit.com | Site d'éditeur | 42 | 52 | 4,2 % | 5,2 % | 81 % | 62 % | 19 |
| pennylane.com | Site d'éditeur | 39 | 48 | 3,9 % | 5,6 % | 70 % | 50 % | 12 |
| agicap.com | Site d'éditeur | 37 | 44 | 3,7 % | 4,8 % | 77 % | 50 % | 9 |
| activecampaign.com | Site d'éditeur | 37 | 37 | 3,7 % | 4,4 % | 84 % | 73 % | 7 |
| cyber.gouv.fr | Institution, régulateur | 34 | 65 | 3,4 % | 6,0 % | 57 % | 27 % | 25 |
| spendesk.com | Site d'éditeur | 31 | 34 | 3,1 % | 3,6 % | 86 % | 67 % | 10 |
| tableau.com | Site d'éditeur | 30 | 33 | 3,0 % | 4,4 % | 68 % | 36 % | 13 |
| genesys.com | Site d'éditeur | 28 | 29 | 2,8 % | 4,0 % | 70 % | 50 % | 8 |
| sellsy.com | Site d'éditeur | 26 | 26 | 2,6 % | 4,8 % | 54 % | 17 % | 8 |
| crowdstrike.com | Site d'éditeur | 25 | 26 | 2,5 % | 4,4 % | 57 % | 18 % | 12 |
| ovhcloud.com | Site d'éditeur | 24 | 25 | 2,4 % | 3,6 % | 67 % | 44 % | 15 |
| sap.com | Site d'éditeur | 24 | 24 | 2,4 % | 5,2 % | 46 % | 8 % | 16 |
| sage.com | Site d'éditeur | 23 | 33 | 2,3 % | 4,4 % | 52 % | 18 % | 13 |
| woocommerce.com | Site d'éditeur | 23 | 25 | 2,3 % | 2,4 % | 96 % | 83 % | 7 |
| nice.com | Site d'éditeur | 23 | 23 | 2,3 % | 2,8 % | 82 % | 57 % | 13 |
| stripe.com | Site d'éditeur | 22 | 25 | 2,2 % | 2,8 % | 79 % | 71 % | 8 |
| amplitude.com | Site d'éditeur | 20 | 21 | 2,0 % | 2,0 % | 100 % | 100 % | 10 |
| servicenow.com | Site d'éditeur | 20 | 21 | 2,0 % | 3,2 % | 63 % | 25 % | 7 |
| onetrust.com | Site d'éditeur | 19 | 21 | 1,9 % | 3,6 % | 53 % | 33 % | 12 |
| eurecia.com | Site d'éditeur | 19 | 20 | 1,9 % | 3,6 % | 53 % | 11 % | 9 |
| klaviyo.com | Site d'éditeur | 19 | 19 | 1,9 % | 3,2 % | 59 % | 25 % | 6 |
| adyen.com | Site d'éditeur | 18 | 19 | 1,8 % | 2,0 % | 90 % | 60 % | 4 |
| mixpanel.com | Site d'éditeur | 18 | 18 | 1,8 % | 2,0 % | 90 % | 60 % | 7 |
| posthog.com | Site d'éditeur | 17 | 18 | 1,7 % | 2,0 % | 85 % | 40 % | 3 |
| prestashop.com | Site d'éditeur | 17 | 17 | 1,7 % | 2,4 % | 71 % | 33 % | 6 |
| scaleway.com | Site d'éditeur | 16 | 18 | 1,6 % | 2,8 % | 57 % | 14 % | 12 |
| zendesk.com | Documentation éditeur | 16 | 18 | 1,6 % | 3,2 % | 50 % | 25 % | 9 |
| mailchimp.com | Site d'éditeur | 16 | 17 | 1,6 % | 2,4 % | 67 % | 17 % | 7 |
| intercom.com | Site d'éditeur | 16 | 16 | 1,6 % | 1,6 % | 100 % | 100 % | 7 |
| tomorro.com | Site d'éditeur | 16 | 16 | 1,6 % | 2,4 % | 67 % | 33 % | 4 |
| personio.fr | Site d'éditeur | 15 | 19 | 1,5 % | 3,2 % | 47 % | 0 % | 7 |
| elastic.co | Site d'éditeur | 15 | 15 | 1,5 % | 2,4 % | 63 % | 33 % | 11 |
| impots.gouv.fr | Institution, régulateur | 15 | 15 | 1,5 % | 2,4 % | 63 % | 33 % | 7 |
| grafana.com | Site d'éditeur | 14 | 17 | 1,4 % | 2,0 % | 70 % | 60 % | 7 |
| sentinelone.com | Site d'éditeur | 14 | 14 | 1,4 % | 3,6 % | 39 % | 11 % | 7 |
| talkdesk.com | Site d'éditeur | 14 | 14 | 1,4 % | 2,4 % | 58 % | 17 % | 7 |
10 · Méthodologie
Comment l'étude a été menée
Moteur et configuration. ChatGPT via l'API Responses d'OpenAI, modèle gpt-5.6-terra, outil de recherche web intégré (contexte de recherche « medium », choix d'outil automatique, effort de raisonnement « low »), localisation approximative Paris, France. Prompt système identique pour tous les appels : « Réponds à la question en français, de façon concise et factuelle. ». Aucun historique, aucun cache : chaque réponse est un appel indépendant.
Corpus. 250 requêtes en français. Dataset A : 200 requêtes de marché réel, 10 secteurs B2B × 5 intentions × 4 requêtes. Dataset B : 25 expériences A/B, deux variantes chacune, une seule variable modifiée par expérience. Chaque requête a été posée 4 fois : 1 000 réponses attendues, 1 000 terminées, 0 échec, en 25 minutes le 14 septembre 2026.
Définition d'une citation. Une citation est une annotation « url_citation » renvoyée par l'API et attachée au texte de la réponse. Rien n'est déduit du texte. La liste des pages consultées par l'outil de recherche (sources) est conservée à part et n'entre pas dans les métriques de citation.
Normalisation. Hôte en minuscules, préfixe www. retiré, domaine enregistrable calculé avec la Public Suffix List ; URL sans fragment ni paramètres de suivi. Deux champs sont conservés : le domaine enregistrable (microsoft.com) et l'hôte (learn.microsoft.com), parce qu'un sous-domaine peut avoir une fonction propre.
Taxonomie. Chaque domaine est classé par règles (hôtes de documentation, listes d'institutions, de standards, de médias, d'analystes, de places de marché) puis relu un par un. Le type « site d'éditeur » est le type par défaut d'un domaine commercial. Aucun domaine n'est resté « inconnu ». Regroupement : première partie (éditeur, documentation), institutionnel (institution, standard), tierce partie (le reste).
Métriques.
- Search Activation Rate = réponses avec recherche web / réponses analysées.
- Response Frequency = réponses contenant le domaine au moins une fois / réponses de la population.
- Citation Share = citations du domaine / citations totales.
- Query Coverage = requêtes distinctes où le domaine apparaît / requêtes de la population.
- Citation Stability = pour chaque requête où le domaine apparaît, répétitions le contenant / 4 ; valeur du domaine = moyenne sur ces requêtes.
- Similarité de Jaccard = domaines communs / domaines de l'union, entre deux ensembles de domaines cités.
- HHI = somme des carrés des parts de citations des domaines d'un secteur ; Shannon = entropie naturelle de cette distribution.
- Intervalles de confiance à 95 % : moyenne ± 1,96 × écart-type / √n.
Populations. Les comparaisons par intention, secteur, stabilité et concentration portent sur le dataset A (800 réponses). L'explorateur de domaines et les totaux généraux portent sur les 1 000 réponses. Les expériences A/B portent sur le dataset B et sont présentées comme exploratoires.
Reproductibilité. Chaque statistique publiée est recalculée par un script à partir des feuilles brutes (requêtes, réponses, citations) et non des feuilles de synthèse de l'export. Numérateur, dénominateur et population sont indiqués sous chaque graphique. Coût total de la collecte : 40,11 USD.
Rapport de qualité des données
| Critère | Statut | Valeur | Détail |
|---|---|---|---|
| Requêtes uniques (identifiant) | PASS | 250 | |
| Textes de requête uniques | WARNING | 247 / 250 | 3 textes apparaissent deux fois, par construction : EXP-01-A et EXP-21-A partagent la variante A ; EXP-01-B reprend CRM-009 et EXP-08-A reprend CX-009. Les identifiants restent distincts et les runs indépendants ; aucune fusion n'est faite. |
| Réponses attendues / terminées | PASS | 1000 / 1000 | |
| 4 répétitions par requête | PASS | 250 / 250 requêtes | |
| Doublons (run_id, response_id) | PASS | 0 | |
| Réponses vides | PASS | 0 | |
| Erreurs API | PASS | 0 ; 1 run a nécessité une seconde tentative automatique | |
| Recherche web déclenchée | PASS | 853 réponses sur 1 000 | Le champ « searched » est renseigné pour chaque réponse ; recherche et citation coïncident exactement (aucune réponse citante sans recherche, aucune recherche sans citation). |
| Citations structurées | PASS | 2970 citations inline ; 25906 sources consultées | Seules les annotations url_citation de l'API sont comptées comme citations ; les sources consultées (web_search_call.action.sources) sont analysées séparément. |
| URL et domaines exploitables | PASS | 1397 URL, 308 domaines | Normalisation runner (www., paramètres de suivi, fragments) revérifiée : domaine enregistrable recalculé cohérent sur 100 % des lignes. |
| Modèle | PASS | gpt-5.6-terra | Un seul modèle retourné par l'API sur les 1 000 réponses. |
| Fenêtre de collecte | PASS | 14 septembre 2026, 10:33 à 10:58 UTC | 25 minutes : aucune dérive temporelle possible entre répétitions. |
| Coût | PASS | 40.11 USD | Recalculé par somme des coûts par réponse. |
| Indépendance des sessions | PASS | appels synchrones sans historique | Selon la méthodologie du runner : aucune conversation, aucun cache ; les 4 répétitions ont des identifiants de réponse distincts. |
| Cohérence des catégories | PASS | 10 secteurs × 5 intentions × 4 requêtes = 200 | Le plan d'expérience du dataset A est parfaitement équilibré ; le dataset B porte 25 expériences × 2 variantes. |
| Classification des sources | PASS | 308 domaines classés, 0 inconnu | Le fichier livré laissait 253 domaines « unknown » ; ils ont été classés par règles (hôte de documentation, listes d'institutions, standards, médias, analystes) puis relus un par un. Le type « Site d'éditeur » est le type par défaut pour un domaine commercial. |
11 · Limites
Ce que l'étude ne dit pas
Une configuration, pas « ChatGPT »
Les résultats décrivent l'API Responses avec l'outil de recherche web, modèle gpt-5.6-terra, le 14 septembre 2026, en français, depuis la France. L'interface grand public, d'autres modèles, d'autres dates ou d'autres langues peuvent se comporter différemment.
Des citations visibles, pas tout le raisonnement
Seules les citations structurées renvoyées par l'API sont comptées. Les pages consultées sans être citées ont pu influencer la réponse ; l'étude les mesure à part mais ne peut pas dire ce qu'elles ont pesé.
Un corpus B2B logiciel
250 requêtes sur dix catégories de logiciels et de services d'entreprise, en français. Rien ne permet d'extrapoler au grand public, à l'e-commerce de détail ou à d'autres marchés.
Une photographie
Quatre répétitions en 25 minutes mesurent la variabilité intra-journée, pas l'évolution dans le temps. La comparaison entre éditions successives de l'index dira ce qui bouge.
A/B exploratoires
Une seule expérience par variable et huit réponses par expérience : les résultats A/B montrent des ordres de grandeur, pas des effets établis.
Classification humaine
La taxonomie des sources a été construite par règles puis relue manuellement par Evocia ; une autre équipe pourrait classer autrement quelques cas limites (places de marché citées pour leurs pages vendeurs, fondations, laboratoires).
Pas d'analyse des marques
L'extraction des marques recommandées dans le texte des réponses n'a pas été jugée assez fiable pour être publiée dans cette édition. Le lien entre recommandation et citation du site officiel n'est donc mesuré qu'indirectement, par la part de citations de première partie.
Volatilité
Les sources varient d'une réponse à l'autre : tout chiffre par domaine est une fréquence sur 4 répétitions, avec la marge d'erreur que cela implique pour les domaines rarement cités.
12 · Données ouvertes
Télécharger les données
Le dataset complet est publié sous licence CC BY 4.0 : réutilisation, y compris commerciale, avec attribution. Les graphiques de cette page peuvent être reproduits avec la mention « Source : Evocia AI Sources Index 2026, evocia.fr ».
- XLSXevocia-ai-sources-index-2026.xlsxClasseur complet : requêtes, réponses, citations, sources consultées, domaines, dictionnaire, méthodologie
- CSVrequetes.csvLes 250 requêtes avec secteur, intention, dataset et variable testée
- CSVreponses.csvLes 1 000 réponses : identifiants, recherche web, nombre de citations, texte de la réponse
- CSVcitations.csvLes 2 970 citations : URL originale et normalisée, hôte, domaine, type de source, position
- CSVsources-consultees.csvLes 25 906 pages consultées par l'outil de recherche sans être nécessairement citées
- CSVdomaines.csvLes 308 domaines avec les métriques Response Frequency, Citation Share, Query Coverage, Stability
- CSVexperiences-ab.csvLes 25 expériences : variantes, domaines A et B, communs, disparus, nouveaux, Jaccard
- MDdictionnaire.mdDictionnaire des données : chaque colonne, son type, sa définition
- MDmethodologie.mdMéthodologie complète et rapport de qualité, en texte
Citer l'étude
Evocia (2026). Evocia AI Sources Index 2026 : les sources citées par ChatGPT en recherche B2B. https://evocia.fr/etudes/ai-sources-index-2026
Questions fréquentes
- Quelles sources ChatGPT cite-t-il le plus en B2B ?
- Dans cette étude, les sites des éditeurs et leur documentation : 89 % des citations. Le domaine le plus cité est microsoft.com (learn.microsoft.com), présent dans 21 % des réponses, suivi de hubspot.com, salesforce.com, amazon.com (AWS) et google.com (Google Cloud).
- ChatGPT cite-t-il G2, Capterra ou Reddit ?
- Pas dans cette configuration : 0 citation vers un comparateur ou une plateforme d'avis sur 2 970, et reddit.com est consulté dans 100 réponses sans jamais être cité.
- ChatGPT cherche-t-il toujours sur le web ?
- Non. 85,3 % des 1 000 réponses ont déclenché une recherche. Le taux dépend de l'intention : 24 % pour une question qui décrit un problème, 100 % pour une comparaison.
- Les sources sont-elles stables d'une réponse à l'autre ?
- Partiellement. Sur 870 paires requête × domaine, 38 % n'apparaissent que dans une réponse sur quatre et 27 % dans les quatre. La stabilité moyenne est de 58 %.
- Que change une reformulation de la question ?
- Beaucoup : deux formulations voisines partagent en moyenne 37 % de leurs domaines cités, contre 60 % pour la même formulation répétée.
- Peut-on réutiliser les données et les graphiques ?
- Oui, sous licence CC BY 4.0, avec la mention « Source : Evocia AI Sources Index 2026, evocia.fr ». Chaque graphique dispose d'un lien direct et d'un export SVG.
Mesurer la visibilité IA de votre marque
L'étude mesure un marché. Evocia applique le même protocole à une entreprise : panel de requêtes de sa catégorie, répétitions, plusieurs moteurs, sources citées. Le test gratuit porte sur trois requêtes.