Aller au contenu
Evocia

Étude Evocia · Recherche originale · Publiée le 14 septembre 2026

Evocia AI Sources Index 2026 : les sources que ChatGPT cite quand un acheteur B2B cherche une solution

250 questions B2B en français, chacune posée quatre fois à ChatGPT de façon indépendante. L'étude mesure quand le moteur consulte le web, quelles sources il cite, et ce qui reste stable quand on répète ou reformule la question.

réponses analysées
1 000
réponses analysées
requêtes B2B
250
requêtes B2B
chaque requête répétée
chaque requête répétée
des citations pointent vers le site d'un éditeur
89 %
des citations pointent vers le site d'un éditeur

L'étude en 30 secondes

Dix repères, tous recalculés depuis les données brutes. Sauf mention, les comparaisons portent sur le dataset A : 200 requêtes de marché réel, 800 réponses.

réponses analysées, 0 échec
1 000
réponses analysées, 0 échec
citations structurées renvoyées par l'API
2 970
citations structurées renvoyées par l'API
domaines cités, 1 397 URL distinctes
308
domaines cités, 1 397 URL distinctes
des réponses ont déclenché une recherche web (653 / 800)
81,6 %
des réponses ont déclenché une recherche web (653 / 800)
citations par réponse citante
3,5
citations par réponse citante
des citations vont à un site d'éditeur ou à sa documentation
89 %
des citations vont à un site d'éditeur ou à sa documentation
citation vers un comparateur ou une plateforme d'avis
0
citation vers un comparateur ou une plateforme d'avis
stabilité moyenne des paires requête × domaine
58 %
stabilité moyenne des paires requête × domaine
des paires requête × domaine citées 4 fois sur 4
27 %
des paires requête × domaine citées 4 fois sur 4
des paires requête × domaine citées 1 fois sur 4
38 %
des paires requête × domaine citées 1 fois sur 4

1 · Recherche web

ChatGPT cherche-t-il systématiquement sur le web ?

24 %

seulement, quand la question décrit un problème. 100 % dès qu'elle demande une comparaison.

ChatGPT ne consulte pas le web de la même façon selon votre question

Part des réponses ayant déclenché l'outil de recherche web, par intention de la requête

Une question de comparaison ou de décision déclenche une recherche presque à coup sûr ; une question qui décrit un problème sans nommer de catégorie de solution est traitée de mémoire trois fois sur quatre.

n = 160 réponses par intention (40 requêtes × 4), dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

Sur les 800 réponses du dataset A, 653 (81,6 %) ont déclenché une recherche web et 653 ont produit au moins une citation : dans cette configuration, recherche et citation coïncident exactement. Le modèle décide seul de chercher ; ce choix est presque entièrement déterminé par l'intention. Sur 200 requêtes, 157 ont cherché à chacune des quatre répétitions, 29 n'ont jamais cherché, et 14 ont cherché certaines fois seulement.

2 · Intention

L'intention change-t-elle le nombre de sources citées ?

0,7 → 4,1

citations par réponse, d'une question de type problème à une demande de recommandation.

Le nombre de citations suit le parcours d'achat

Citations par réponse, moyenne par intention, réponses sans citation comptées zéro

La demande de recommandation est le moment où ChatGPT cite le plus de sources : plus de quatre par réponse, contre moins d'une pour une question de type problème.

n = 160 réponses par intention, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

Parmi les réponses qui citent, l'écart persiste : 4,31 citations pour une recommandation contre 3,09 pour une découverte et 2,97 pour un problème. Le nombre de recherches lancées compte aussi : une seule recherche produit 2,7 citations en moyenne, deux recherches 4,2.

IntentionRéponsesRecherche webCitations / réponseIC 95 %Domaines distincts
Problème / besoin16024,4 %0,730,51 à 0,9415
Découverte de solutions16090,6 %2,802,54 à 3,06126
Recommandation16094,4 %4,063,79 à 4,33158
Comparaison160100,0 %3,303,05 à 3,55105
Décision / achat16098,8 %3,233,08 à 3,38112

3 · Stabilité

Une même question donne-t-elle les mêmes sources ?

38 %

des paires requête × domaine n'apparaissent que dans une réponse sur quatre. 27 % apparaissent dans les quatre.

Quand un domaine est cité pour une requête, combien de fois sur quatre l'est-il ?

Distribution des paires requête × domaine selon le nombre de répétitions qui citent le domaine

Plus d'une paire sur trois est un événement isolé : le domaine est cité une fois, puis plus jamais sur les trois autres réponses. La stabilité moyenne, définie comme répétitions contenant le domaine sur quatre, est de 58 %.

n = 870 paires requête × domaine, 171 requêtes du dataset A ayant au moins une citation. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

L'unité est la paire requête × domaine, pas la source : un domaine peut être stable sur une requête et occasionnel sur une autre. Restreinte aux 157 requêtes dont les quatre réponses ont cherché sur le web (pour neutraliser l'effet de la recherche elle-même), la distribution bouge peu : 37 % de paires à 1/4, 28 % à 4/4. Sur ces 157 requêtes, seules 21 (13 %) ont cité exactement le même ensemble de domaines quatre fois.

Les comparaisons sont les plus stables, les découvertes les moins

Similarité de Jaccard moyenne entre les ensembles de domaines cités de deux répétitions d'une même requête

Deux réponses à une même question de comparaison partagent près des trois quarts de leurs domaines ; deux réponses à une même question de découverte, à peine plus de deux cinquièmes.

n = 165 requêtes du dataset A ayant au moins deux réponses citantes ; 6 paires de répétitions par requête. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

4 · Sources citées

Qui domine les citations ?

89 %

des citations pointent vers le site d'un éditeur ou sa documentation officielle. Aucune vers un comparateur ou une plateforme d'avis.

ChatGPT cite les éditeurs, pas les comparateurs

Part des citations par type de source (classification Evocia, 288 domaines relus un par un)

Les sites commerciaux des éditeurs et leur documentation concentrent près de neuf citations sur dix ; les institutions publiques et les régulateurs presque tout le reste. Comparateurs, forums, médias et analystes réunis pèsent moins de 2 %.

n = 2 259 citations, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

80 % des réponses citantes (521 sur 653) ne citent que des sources d'éditeurs. Le résultat est d'autant plus net que ChatGPT consulte pourtant d'autres sources : l'API renvoie la liste des pages lues avant de répondre. Sur les 853 réponses avec recherche, 27 URL sont consultées en moyenne pour 3,4 citées ; reddit.com est consulté dans 100 réponses et wikipedia.org dans 85, sans jamais être cités.

27

pages consultées par réponse avant de répondre, en moyenne (médiane 23)

853 réponses avec recherche web · Source : Evocia AI Sources Index 2026

3,4

pages citées par réponse : 11 % de ce qui a été lu

853 réponses avec recherche web · Source : Evocia AI Sources Index 2026

100 / 0

réponses où reddit.com est consulté / réponses où il est cité

1 000 réponses · Source : Evocia AI Sources Index 2026

Les 20 domaines les plus cités

Response Frequency : part des 800 réponses du dataset A citant le domaine au moins une fois

learn.microsoft.com est cité dans une réponse sur cinq et sur 30 % des requêtes, tous secteurs confondus : la documentation Microsoft est la source la plus transversale du corpus B2B.

n = 800 réponses, 200 requêtes, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

Top 20 par Response Frequency, avec les quatre métriques. Définitions dans la méthodologie.
#DomaineTypeRéponsesResponse Freq.Citation ShareQuery CoverageStability
1microsoft.comDocumentation officielle d'éditeur16420,5 %7,8 %29,5 %69 %
2hubspot.comSite d'éditeur ou d'entreprise799,9 %3,8 %14,5 %68 %
3salesforce.comSite d'éditeur ou d'entreprise637,9 %2,9 %11,5 %68 %
4amazon.comSite d'éditeur ou d'entreprise587,2 %3,3 %10,0 %73 %
5google.comSite d'éditeur ou d'entreprise577,1 %3,0 %11,5 %62 %
6adobe.comSite d'éditeur ou d'entreprise506,3 %2,3 %8,0 %78 %
7pipedrive.comSite d'éditeur ou d'entreprise455,6 %2,1 %6,5 %87 %
8cnil.frInstitution publique435,4 %2,7 %11,0 %49 %
9shopify.comSite d'éditeur ou d'entreprise435,4 %2,4 %5,5 %98 %
10lucca.frSite d'éditeur ou d'entreprise384,8 %2,2 %6,5 %73 %
11freshworks.comSite d'éditeur ou d'entreprise384,8 %2,0 %5,5 %86 %
12hubspot.frSite d'éditeur ou d'entreprise364,5 %1,7 %7,0 %64 %
13zoho.comSite d'éditeur ou d'entreprise364,5 %1,6 %8,0 %56 %
14brevo.comSite d'éditeur ou d'entreprise354,4 %1,7 %5,5 %80 %
15cyber.gouv.frInstitution publique334,1 %2,8 %7,0 %59 %
16payfit.comSite d'éditeur ou d'entreprise263,3 %1,4 %4,0 %81 %
17pennylane.comSite d'éditeur ou d'entreprise263,3 %1,4 %4,5 %72 %
18genesys.comSite d'éditeur ou d'entreprise263,3 %1,2 %4,0 %81 %
19tableau.comSite d'éditeur ou d'entreprise243,0 %1,2 %4,5 %67 %
20spendesk.comSite d'éditeur ou d'entreprise232,9 %1,2 %3,5 %82 %

Couverture × stabilité : quatre profils de sources

Chaque point est un domaine ; taille proportionnelle au nombre de citations ; seuils = médianes

Leaders structurels : microsoft.com, hubspot.com, salesforce.com, google.com, amazon.com, adobe.com. Leader volatil : cnil.fr, cité sur 11 % des requêtes mais stable à 49 % seulement.

n = 85 domaines cités sur au moins 3 requêtes, dataset A ; seuils : couverture 2,5 %, stabilité 58 %. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

Leaders structurels

forte couverture et forte stabilité · 31 domaines

microsoft.com, hubspot.com, salesforce.com, google.com, amazon.com, adobe.com, hubspot.fr, cyber.gouv.fr, pipedrive.com, lucca.fr

Leaders volatils

forte couverture, stabilité faible · 14 domaines

cnil.fr, zoho.com, sap.com, sage.com, onetrust.com, sellsy.com, personio.fr, scaleway.com, sentinelone.com, zendesk.com

Experts de niche

faible couverture, forte stabilité · 15 domaines

amplitude.com, intercom.com, adyen.com, mixpanel.com, snowflake.com, mailchimp.com, posthog.com, splunk.com, ironcladapp.com, tomorro.com

Quelles sources gagnent ou perdent selon le funnel

Response Frequency des 25 premiers domaines, par intention

Sur une question de type problème, aucun des 25 premiers domaines n'est cité, sauf la CNIL. Microsoft est présent à toutes les autres étapes ; HubSpot culmine en comparaison, Pipedrive en recommandation, la CNIL en recommandation et en décision.

n = 160 réponses par intention, dataset A ; valeur = réponses de l'intention citant le domaine / 160. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

5 · Concentration

Les géants dominent-ils vraiment ?

49 %

des citations vont aux 20 premiers domaines. Les 268 autres se partagent le reste, et 95 d'entre eux ne sont cités qu'une fois.

Une tête concentrée, une traîne longue

Part cumulée des citations en fonction du rang du domaine (classement par nombre de citations)

Il faut 22 domaines pour atteindre la moitié des citations et 100 pour en atteindre 84 % : la concentration existe, mais un tiers des domaines cités ne le sont qu'une seule fois.

n = 2 259 citations, 288 domaines, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

22

domaines suffisent pour la moitié des citations

288 domaines cités, dataset A · Source : Evocia AI Sources Index 2026

21 %

des citations vont aux 5 premiers domaines

2 259 citations, dataset A · Source : Evocia AI Sources Index 2026

33 %

des domaines cités ne le sont qu'une seule fois (95 sur 288)

dataset A · Source : Evocia AI Sources Index 2026

6 · Secteurs

Chaque marché a-t-il son propre web ?

72 vs 17

domaines cités en Legal / Compliance contre CRM, à nombre de réponses égal. Les écosystèmes de sources ne se ressemblent pas.

Du marché le plus concentré au plus fragmenté

Nombre de domaines distincts cités par secteur (80 réponses chacun)

Le CRM se joue sur 17 domaines et les dix premiers concentrent 93 % des citations ; la conformité juridique mobilise 72 domaines et les dix premiers moins de la moitié.

n = 80 réponses par secteur (20 requêtes × 4), dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

Diversité des sources par secteur. HHI : somme des carrés des parts de citations (1 = un seul domaine) ; Shannon : entropie de la distribution.
SecteurRecherche webCitationsDomainesTop 10HHIShannonStabilitéSites d'éditeurs
Cybersécurité91 %2323380 %0,1252,6456 %58 %
CRM & Sales75 %2201793 %0,1202,3562 %99 %
Cloud & Infrastructure85 %2493378 %0,1052,7462 %90 %
E-commerce & Paiements89 %2313477 %0,0962,8369 %87 %
RH & Recrutement75 %2163970 %0,0922,9657 %97 %
Data & Analytics78 %2183178 %0,0882,8165 %95 %
Marketing Automation81 %2373876 %0,0832,9266 %95 %
Service Client & CCaaS75 %2142977 %0,0762,8660 %97 %
Finance & Spend Management80 %2194571 %0,0723,0849 %92 %
Legal / Compliance / RegTech88 %2237248 %0,0353,8145 %79 %

La cybersécurité et le juridique s'appuient sur les institutions, le CRM sur les éditeurs

Part des citations par type de source, pour chaque secteur

Deux secteurs sortent du modèle « tout éditeur » : la cybersécurité, où les institutions (cyber.gouv.fr, CISA, NIST) reçoivent 38 % des citations, et le juridique, 18 % (CNIL, Europa). Partout ailleurs, sites d'éditeurs et documentation réunis dépassent 87 % des citations.

n = citations du secteur (214 à 249), dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

Colonnes : editeur = site d'éditeur ; documentation = documentation officielle d'éditeur ; institution = institution publique ou régulateur ; standard = standard, fondation, open source ; analyste = analyste, laboratoire, étude.

Les 15 premiers domaines, secteur par secteur

Response Frequency dans le secteur : part des 80 réponses du secteur citant le domaine

Microsoft traverse neuf secteurs sur dix, la CNIL huit, Google sept ; la plupart des autres domaines n'existent que dans un ou deux secteurs. Le web de ChatGPT est sectoriel.

n = 80 réponses par secteur, dataset A. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

Explorez votre secteur

Réponses, recherche web, domaines cités, top 10, concentration, stabilité et types de sources, pour chacun des dix secteurs du dataset A.

80

réponses analysées (20 requêtes × 4)

75 %

ont déclenché une recherche web

17

domaines cités

93 %

des citations vont aux 10 premiers domaines

62 %

stabilité moyenne des paires requête × domaine

99 %

des citations vers un site d'éditeur ou sa documentation

Top 10 des domaines cités

  1. 1.pipedrive.com44 réponses · 47 citations
  2. 2.hubspot.com26 réponses · 31 citations
  3. 3.salesforce.com27 réponses · 28 citations
  4. 4.microsoft.com25 réponses · 28 citations
  5. 5.hubspot.fr20 réponses · 21 citations
  6. 6.zoho.com15 réponses · 15 citations
  7. 7.sellsy.com12 réponses · 12 citations
  8. 8.freshworks.com12 réponses · 12 citations
  9. 9.monday.com7 réponses · 7 citations
  10. 10.odoo.com4 réponses · 4 citations

Types de sources citées (part des citations)

  • Sites d'éditeurs84,6 %
  • Documentation éditeur14,5 %
  • Institutions, régulateurs0,9 %

Indice de concentration HHI : 0,120 · entropie de Shannon : 2,35 · 86 URL distinctes · 2,75 citations par réponse.

7 · Reformulation · exploratoire

Que se passe-t-il lorsqu'on change la question ?

37 %

de domaines en commun, en moyenne, entre deux formulations voisines d'une même question. 60 % quand on répète la même formulation.

25 reformulations, de la plus stable à la plus perturbée

Similarité de Jaccard entre les domaines cités par la version A et par la version B (union des 4 répétitions de chaque version)

Imposer une intégration, exiger de l'open source ou changer la taille de l'entreprise remplace presque toutes les sources ; préciser un budget ou allonger la question les conserve aux deux tiers. Résultats exploratoires : une expérience par variable.

n = 25 expériences, dataset B, 8 réponses par expérience ; 0 % = aucun domaine en commun, 100 % = mêmes domaines. Source : Evocia AI Sources Index 2026, 1 000 réponses ChatGPT (API OpenAI, outil de recherche web), 250 requêtes B2B en français × 4 répétitions, collecte du 14 septembre 2026.

La ligne pointillée donne l'ordre de grandeur du bruit : sur une même requête du dataset A, l'union des répétitions 1 et 2 partage 60 % de ses domaines avec l'union des répétitions 3 et 4. Une reformulation fait descendre cette similarité à 37 % en moyenne (médiane 33 %) : changer la question change davantage les sources que la répéter.

Avant / après : trois reformulations

Version A · EXP-19

« Quel prestataire de paiement choisir ? »

6 domaines cités sur 4 réponses · 4,00 citations par réponse

  • adyen.comdisparue
  • mollie.comdisparue
  • paypal.comdisparue
  • payplug.comdisparue
  • stripe.comdisparue
  • sumup.comdisparue

Version B · variable : Intégration imposée

« Quel prestataire de paiement choisir s'il doit impérativement s'intégrer à Shopify Plus ? »

1 domaines cités sur 4 réponses · 4,50 citations par réponse

  • shopify.comnouvelle

Similarité de Jaccard : 0 % · 0 domaine(s) en commun, 6 disparu(s), 1 nouveau(x).

Version A · EXP-22

« Quelle plateforme de marketing automation choisir ? »

7 domaines cités sur 4 réponses · 4,75 citations par réponse

  • activecampaign.comdisparue
  • adobe.comdisparue
  • brevo.comdisparue
  • hubspot.comdisparue
  • klaviyo.comdisparue
  • plezi.codisparue
  • salesforce.comdisparue

Version B · variable : Open source

« Quelle plateforme open source de marketing automation choisir pour une PME ? »

3 domaines cités sur 4 réponses · 2,25 citations par réponse

  • github.comnouvelle
  • listmonk.appnouvelle
  • mautic.orgnouvelle

Similarité de Jaccard : 0 % · 0 domaine(s) en commun, 7 disparu(s), 3 nouveau(x).

Version A · EXP-07

« Quel outil BI choisir ? »

3 domaines cités sur 4 réponses · 3,00 citations par réponse

  • google.comconservée
  • microsoft.comconservée
  • tableau.comconservée

Version B · variable : Question courte vs détaillée

« Quel outil BI choisir pour une PME de 120 salariés qui souhaite remplacer ses tableaux de bord Excel ? »

4 domaines cités sur 4 réponses · 3,25 citations par réponse

  • google.comconservée
  • microsoft.comconservée
  • qlik.comnouvelle
  • tableau.comconservée

Similarité de Jaccard : 75 % · 3 domaine(s) en commun, 0 disparu(s), 1 nouveau(x).

8 · Implications

Ce que cela change pour le GEO

  1. 01

    La page citée est la vôtre

    89 % des citations vont au site d'un éditeur ou à sa documentation. L'effort de visibilité se porte d'abord sur vos propres pages : existence, lisibilité par OAI-SearchBot, réponse directe à l'intention.

  2. 02

    Une page par intention

    Le nombre de citations et le déclenchement de la recherche varient du simple au quadruple selon l'intention. Recommandation, comparaison et décision sont trois pages, pas trois paragraphes.

  3. 03

    La documentation compte autant que le site

    17 % des citations vont à des hôtes de documentation (learn., docs., support., help.). Une documentation publique et indexable est une source citable.

  4. 04

    Mesurer en fréquence, jamais en capture

    38 % des paires requête × domaine sont des événements isolés. Seule une mesure répétée sur un panel figé permet de lire une tendance.

  5. 05

    Couvrir les formulations, pas les mots-clés

    Reformuler une question conserve 37 % des sources en moyenne. Un panel de requêtes doit décliner chaque besoin avec ses contraintes réelles.

  6. 06

    Connaître le web de sa catégorie

    De 17 à 72 domaines selon le secteur, avec une part institutionnelle qui varie de 1 % à 39 %. Le benchmark pertinent est sectoriel.

Ces implications découlent d'une configuration précise (voir limites). Aucune ne garantit une citation : l'étude décrit des fréquences, pas un mécanisme de classement.

9 · Données

Explorez les 308 domaines cités

Cherchez votre entreprise ou un concurrent, filtrez par secteur, intention et type de source, triez sur chaque métrique. Population : les 1 000 réponses (datasets A et B).

308 domaines sur 308

DomaineType
microsoft.comDocumentation éditeur20523020,5 %28,8 %71 %40 %108
hubspot.comSite d'éditeur10511210,5 %16,4 %64 %32 %40
salesforce.comSite d'éditeur84868,4 %12,8 %66 %41 %34
amazon.comSite d'éditeur69886,9 %10,0 %69 %40 %41
google.comSite d'éditeur68806,8 %11,2 %61 %21 %44
pipedrive.comSite d'éditeur67706,7 %7,6 %88 %68 %9
cnil.frInstitution, régulateur61826,1 %12,0 %51 %13 %41
brevo.comSite d'éditeur56615,6 %6,8 %82 %71 %6
shopify.comSite d'éditeur55815,5 %5,6 %98 %93 %40
adobe.comSite d'éditeur55565,5 %7,2 %76 %56 %19
zoho.comSite d'éditeur53535,3 %9,6 %55 %17 %22
hubspot.frSite d'éditeur52545,2 %9,6 %54 %17 %18
lucca.frSite d'éditeur50645,0 %6,8 %74 %47 %15
freshworks.comSite d'éditeur46564,6 %5,2 %88 %62 %21
payfit.comSite d'éditeur42524,2 %5,2 %81 %62 %19
pennylane.comSite d'éditeur39483,9 %5,6 %70 %50 %12
agicap.comSite d'éditeur37443,7 %4,8 %77 %50 %9
activecampaign.comSite d'éditeur37373,7 %4,4 %84 %73 %7
cyber.gouv.frInstitution, régulateur34653,4 %6,0 %57 %27 %25
spendesk.comSite d'éditeur31343,1 %3,6 %86 %67 %10
tableau.comSite d'éditeur30333,0 %4,4 %68 %36 %13
genesys.comSite d'éditeur28292,8 %4,0 %70 %50 %8
sellsy.comSite d'éditeur26262,6 %4,8 %54 %17 %8
crowdstrike.comSite d'éditeur25262,5 %4,4 %57 %18 %12
ovhcloud.comSite d'éditeur24252,4 %3,6 %67 %44 %15
sap.comSite d'éditeur24242,4 %5,2 %46 %8 %16
sage.comSite d'éditeur23332,3 %4,4 %52 %18 %13
woocommerce.comSite d'éditeur23252,3 %2,4 %96 %83 %7
nice.comSite d'éditeur23232,3 %2,8 %82 %57 %13
stripe.comSite d'éditeur22252,2 %2,8 %79 %71 %8
amplitude.comSite d'éditeur20212,0 %2,0 %100 %100 %10
servicenow.comSite d'éditeur20212,0 %3,2 %63 %25 %7
onetrust.comSite d'éditeur19211,9 %3,6 %53 %33 %12
eurecia.comSite d'éditeur19201,9 %3,6 %53 %11 %9
klaviyo.comSite d'éditeur19191,9 %3,2 %59 %25 %6
adyen.comSite d'éditeur18191,8 %2,0 %90 %60 %4
mixpanel.comSite d'éditeur18181,8 %2,0 %90 %60 %7
posthog.comSite d'éditeur17181,7 %2,0 %85 %40 %3
prestashop.comSite d'éditeur17171,7 %2,4 %71 %33 %6
scaleway.comSite d'éditeur16181,6 %2,8 %57 %14 %12
zendesk.comDocumentation éditeur16181,6 %3,2 %50 %25 %9
mailchimp.comSite d'éditeur16171,6 %2,4 %67 %17 %7
intercom.comSite d'éditeur16161,6 %1,6 %100 %100 %7
tomorro.comSite d'éditeur16161,6 %2,4 %67 %33 %4
personio.frSite d'éditeur15191,5 %3,2 %47 %0 %7
elastic.coSite d'éditeur15151,5 %2,4 %63 %33 %11
impots.gouv.frInstitution, régulateur15151,5 %2,4 %63 %33 %7
grafana.comSite d'éditeur14171,4 %2,0 %70 %60 %7
sentinelone.comSite d'éditeur14141,4 %3,6 %39 %11 %7
talkdesk.comSite d'éditeur14141,4 %2,4 %58 %17 %7

10 · Méthodologie

Comment l'étude a été menée

Moteur et configuration. ChatGPT via l'API Responses d'OpenAI, modèle gpt-5.6-terra, outil de recherche web intégré (contexte de recherche « medium », choix d'outil automatique, effort de raisonnement « low »), localisation approximative Paris, France. Prompt système identique pour tous les appels : « Réponds à la question en français, de façon concise et factuelle. ». Aucun historique, aucun cache : chaque réponse est un appel indépendant.

Corpus. 250 requêtes en français. Dataset A : 200 requêtes de marché réel, 10 secteurs B2B × 5 intentions × 4 requêtes. Dataset B : 25 expériences A/B, deux variantes chacune, une seule variable modifiée par expérience. Chaque requête a été posée 4 fois : 1 000 réponses attendues, 1 000 terminées, 0 échec, en 25 minutes le 14 septembre 2026.

Définition d'une citation. Une citation est une annotation « url_citation » renvoyée par l'API et attachée au texte de la réponse. Rien n'est déduit du texte. La liste des pages consultées par l'outil de recherche (sources) est conservée à part et n'entre pas dans les métriques de citation.

Normalisation. Hôte en minuscules, préfixe www. retiré, domaine enregistrable calculé avec la Public Suffix List ; URL sans fragment ni paramètres de suivi. Deux champs sont conservés : le domaine enregistrable (microsoft.com) et l'hôte (learn.microsoft.com), parce qu'un sous-domaine peut avoir une fonction propre.

Taxonomie. Chaque domaine est classé par règles (hôtes de documentation, listes d'institutions, de standards, de médias, d'analystes, de places de marché) puis relu un par un. Le type « site d'éditeur » est le type par défaut d'un domaine commercial. Aucun domaine n'est resté « inconnu ». Regroupement : première partie (éditeur, documentation), institutionnel (institution, standard), tierce partie (le reste).

Métriques.

  • Search Activation Rate = réponses avec recherche web / réponses analysées.
  • Response Frequency = réponses contenant le domaine au moins une fois / réponses de la population.
  • Citation Share = citations du domaine / citations totales.
  • Query Coverage = requêtes distinctes où le domaine apparaît / requêtes de la population.
  • Citation Stability = pour chaque requête où le domaine apparaît, répétitions le contenant / 4 ; valeur du domaine = moyenne sur ces requêtes.
  • Similarité de Jaccard = domaines communs / domaines de l'union, entre deux ensembles de domaines cités.
  • HHI = somme des carrés des parts de citations des domaines d'un secteur ; Shannon = entropie naturelle de cette distribution.
  • Intervalles de confiance à 95 % : moyenne ± 1,96 × écart-type / √n.

Populations. Les comparaisons par intention, secteur, stabilité et concentration portent sur le dataset A (800 réponses). L'explorateur de domaines et les totaux généraux portent sur les 1 000 réponses. Les expériences A/B portent sur le dataset B et sont présentées comme exploratoires.

Reproductibilité. Chaque statistique publiée est recalculée par un script à partir des feuilles brutes (requêtes, réponses, citations) et non des feuilles de synthèse de l'export. Numérateur, dénominateur et population sont indiqués sous chaque graphique. Coût total de la collecte : 40,11 USD.

Rapport de qualité des données

CritèreStatutValeurDétail
Requêtes uniques (identifiant)PASS250
Textes de requête uniquesWARNING247 / 2503 textes apparaissent deux fois, par construction : EXP-01-A et EXP-21-A partagent la variante A ; EXP-01-B reprend CRM-009 et EXP-08-A reprend CX-009. Les identifiants restent distincts et les runs indépendants ; aucune fusion n'est faite.
Réponses attendues / terminéesPASS1000 / 1000
4 répétitions par requêtePASS250 / 250 requêtes
Doublons (run_id, response_id)PASS0
Réponses videsPASS0
Erreurs APIPASS0 ; 1 run a nécessité une seconde tentative automatique
Recherche web déclenchéePASS853 réponses sur 1 000Le champ « searched » est renseigné pour chaque réponse ; recherche et citation coïncident exactement (aucune réponse citante sans recherche, aucune recherche sans citation).
Citations structuréesPASS2970 citations inline ; 25906 sources consultéesSeules les annotations url_citation de l'API sont comptées comme citations ; les sources consultées (web_search_call.action.sources) sont analysées séparément.
URL et domaines exploitablesPASS1397 URL, 308 domainesNormalisation runner (www., paramètres de suivi, fragments) revérifiée : domaine enregistrable recalculé cohérent sur 100 % des lignes.
ModèlePASSgpt-5.6-terraUn seul modèle retourné par l'API sur les 1 000 réponses.
Fenêtre de collectePASS14 septembre 2026, 10:33 à 10:58 UTC25 minutes : aucune dérive temporelle possible entre répétitions.
CoûtPASS40.11 USDRecalculé par somme des coûts par réponse.
Indépendance des sessionsPASSappels synchrones sans historiqueSelon la méthodologie du runner : aucune conversation, aucun cache ; les 4 répétitions ont des identifiants de réponse distincts.
Cohérence des catégoriesPASS10 secteurs × 5 intentions × 4 requêtes = 200Le plan d'expérience du dataset A est parfaitement équilibré ; le dataset B porte 25 expériences × 2 variantes.
Classification des sourcesPASS308 domaines classés, 0 inconnuLe fichier livré laissait 253 domaines « unknown » ; ils ont été classés par règles (hôte de documentation, listes d'institutions, standards, médias, analystes) puis relus un par un. Le type « Site d'éditeur » est le type par défaut pour un domaine commercial.

11 · Limites

Ce que l'étude ne dit pas

  • Une configuration, pas « ChatGPT »

    Les résultats décrivent l'API Responses avec l'outil de recherche web, modèle gpt-5.6-terra, le 14 septembre 2026, en français, depuis la France. L'interface grand public, d'autres modèles, d'autres dates ou d'autres langues peuvent se comporter différemment.

  • Des citations visibles, pas tout le raisonnement

    Seules les citations structurées renvoyées par l'API sont comptées. Les pages consultées sans être citées ont pu influencer la réponse ; l'étude les mesure à part mais ne peut pas dire ce qu'elles ont pesé.

  • Un corpus B2B logiciel

    250 requêtes sur dix catégories de logiciels et de services d'entreprise, en français. Rien ne permet d'extrapoler au grand public, à l'e-commerce de détail ou à d'autres marchés.

  • Une photographie

    Quatre répétitions en 25 minutes mesurent la variabilité intra-journée, pas l'évolution dans le temps. La comparaison entre éditions successives de l'index dira ce qui bouge.

  • A/B exploratoires

    Une seule expérience par variable et huit réponses par expérience : les résultats A/B montrent des ordres de grandeur, pas des effets établis.

  • Classification humaine

    La taxonomie des sources a été construite par règles puis relue manuellement par Evocia ; une autre équipe pourrait classer autrement quelques cas limites (places de marché citées pour leurs pages vendeurs, fondations, laboratoires).

  • Pas d'analyse des marques

    L'extraction des marques recommandées dans le texte des réponses n'a pas été jugée assez fiable pour être publiée dans cette édition. Le lien entre recommandation et citation du site officiel n'est donc mesuré qu'indirectement, par la part de citations de première partie.

  • Volatilité

    Les sources varient d'une réponse à l'autre : tout chiffre par domaine est une fréquence sur 4 répétitions, avec la marge d'erreur que cela implique pour les domaines rarement cités.

Questions fréquentes

Quelles sources ChatGPT cite-t-il le plus en B2B ?
Dans cette étude, les sites des éditeurs et leur documentation : 89 % des citations. Le domaine le plus cité est microsoft.com (learn.microsoft.com), présent dans 21 % des réponses, suivi de hubspot.com, salesforce.com, amazon.com (AWS) et google.com (Google Cloud).
ChatGPT cite-t-il G2, Capterra ou Reddit ?
Pas dans cette configuration : 0 citation vers un comparateur ou une plateforme d'avis sur 2 970, et reddit.com est consulté dans 100 réponses sans jamais être cité.
ChatGPT cherche-t-il toujours sur le web ?
Non. 85,3 % des 1 000 réponses ont déclenché une recherche. Le taux dépend de l'intention : 24 % pour une question qui décrit un problème, 100 % pour une comparaison.
Les sources sont-elles stables d'une réponse à l'autre ?
Partiellement. Sur 870 paires requête × domaine, 38 % n'apparaissent que dans une réponse sur quatre et 27 % dans les quatre. La stabilité moyenne est de 58 %.
Que change une reformulation de la question ?
Beaucoup : deux formulations voisines partagent en moyenne 37 % de leurs domaines cités, contre 60 % pour la même formulation répétée.
Peut-on réutiliser les données et les graphiques ?
Oui, sous licence CC BY 4.0, avec la mention « Source : Evocia AI Sources Index 2026, evocia.fr ». Chaque graphique dispose d'un lien direct et d'un export SVG.

Mesurer la visibilité IA de votre marque

L'étude mesure un marché. Evocia applique le même protocole à une entreprise : panel de requêtes de sa catégorie, répétitions, plusieurs moteurs, sources citées. Le test gratuit porte sur trois requêtes.