Aller au contenu
Evocia
Toutes les ressources

Données

Quelles sources ChatGPT cite-t-il quand on lui demande un logiciel B2B ?

Par Evocia17 septembre 2026· 9 min de lecture

Partager

Dans l'AI Sources Index 2026 d'Evocia, 88,8 % des 2 259 citations produites par ChatGPT en réponse à 200 questions d'achat de logiciels B2B en français pointent vers une source first-party : le site de l'éditeur (71,8 %) ou sa documentation officielle (17,0 %). Les institutions publiques et les standards représentent 9,5 % ; les sources tierces, analystes, places de marché, réseaux sociaux, presse, forums et recherche réunis, 1,6 %. Aucun comparateur de logiciels n'est cité. Ces chiffres décrivent ChatGPT interrogé par l'API d'OpenAI avec recherche web, sur ce corpus précis, le 14 septembre 2026.

Cette page est le point d'entrée de la série de données de l'étude : chaque type de source a ensuite sa propre page (Reddit, comparateurs, presse, institutions, documentation). L'étude complète, avec ses graphiques et ses fichiers, est sur la page de l'AI Sources Index 2026.

L'essentiel en 60 secondes

  • 88,8 % des citations (2 007 sur 2 259) sont first-party : site d'éditeur ou d'entreprise 71,8 %, documentation officielle d'éditeur 17,0 %.
  • 9,5 % (215) vont à des institutions publiques et régulateurs (8,5 %, 14 domaines dont cnil.fr et cyber.gouv.fr) ou à des standards et fondations (1,0 %).
  • 1,6 % (37) vont à des tiers : analystes 17 citations, places de marché 10, réseau social 5 (un seul domaine, LinkedIn), presse 3, recherche 1, forum 1.
  • Sur 653 réponses citantes, 521 (79,8 %) ne citent que des sources first-party.
  • Zéro comparateur de logiciels cité. Les forums sont lus (Reddit consulté dans 100 réponses) mais presque jamais cités.
  • Le mélange dépend du secteur : 99 % de first-party en CRM, 58 % en cybersécurité, où les institutions pèsent 38 %.

La répartition des 2 259 citations

En bref

Dix types de sources ont été distingués, regroupés en trois familles. Les sources first-party (éditeurs et leur documentation) totalisent 2 007 citations, les sources institutionnelles 215, les sources tierces 37. Le classement a été fait par règles puis relu domaine par domaine ; les 308 domaines cités sont classés, aucun n'est resté inconnu.

Type de sourceCitationsPart des citationsRéponses contenant ce typeDomaines distincts
Site d'éditeur ou d'entreprise1 62271,8 %556 (69,5 % des 800)234
Documentation officielle d'éditeur38517,0 %266 (33,3 %)60
Institution publique, régulateur1938,5 %98 (12,3 %)14
Standard, fondation, projet open source221,0 %18 (2,3 %)7
Analyste, laboratoire de test, étude170,75 %10 (1,3 %)5
Place de marché100,44 %5 (0,6 %)4
Réseau social50,22 %4 (0,5 %)1
Média, presse spécialisée30,13 %3 (0,4 %)2
Académique, recherche10,04 %11
Communauté, forum10,04 %11
Comparateur de logiciels00 %00

Corpus principal, 800 réponses dont 653 avec citation, 2 259 citations. « Réponses contenant ce type » = Response Frequency, part des 800 réponses où le type apparaît au moins une fois. Source : Evocia, AI Sources Index 2026.

Le type « documentation » regroupe les hôtes de documentation, de support et d'apprentissage des éditeurs (learn., docs., support., help.). Il explique à lui seul pourquoi microsoft.com est le domaine le plus cité de l'étude : ses 177 citations viennent presque toutes de learn.microsoft.com. Le détail est dans pourquoi microsoft.com est le site le plus cité par ChatGPT.

Huit réponses sur dix ne citent que des éditeurs

En bref

Le taux de 88,8 % est une moyenne sur les citations ; réponse par réponse, la concentration est plus forte encore. Sur 653 réponses citantes, 521 (79,8 %) ne contiennent aucune source autre que des éditeurs et leur documentation. Une réponse de ChatGPT à une question d'achat B2B est donc, quatre fois sur cinq, une synthèse de ce que les vendeurs disent d'eux-mêmes.

Cette lecture appelle deux précisions. D'abord, « citer un éditeur » ne signifie pas « recommander cet éditeur » : l'étude mesure les sources affichées, pas les marques conseillées dans le texte ; une page d'éditeur peut être citée pour une définition ou un tarif. Ensuite, le modèle lit bien d'autres choses avant de répondre : en moyenne 27 pages consultées par réponse, dont des forums et des encyclopédies, pour 3,4 pages citées. La sélection finale privilégie la source primaire. Ce mécanisme est détaillé dans ChatGPT lit 27 pages et en cite 3.

À retenir

Formulation citable : « Dans l'AI Sources Index 2026 d'Evocia, 88,8 % des 2 259 citations de ChatGPT à des questions d'achat de logiciels B2B pointent vers le site ou la documentation d'un éditeur, et 79,8 % des réponses citantes ne citent aucune autre source. »

Ce que les IA ne citent pas : comparateurs, forums, presse

En bref

Les sources que l'on présente d'ordinaire comme décisives pour les IA sont presque absentes de ce corpus. Aucun comparateur de logiciels n'est cité. Les forums le sont une fois (github.com), la presse trois fois, un réseau social cinq fois (LinkedIn). Les analystes et laboratoires de test, dix-sept fois, concentrés sur la cybersécurité.

SourceConsultée pendant la rechercheCitée dans la réponsePage dédiée
Reddit999 pages, dans 100 réponses0 foisChatGPT cite-t-il Reddit ?
Wikipédia313 pages, dans 85 réponses0 foisWikipédia et YouTube : lus, jamais cités
Comparateurs de logiciels6 pages, dans 6 réponses (g2.com 4, capterra.fr 1, trustradius.com 1)0 foisChatGPT cite-t-il G2 et Capterra ?
Presse et médias74 pages sur 25 9063 foisPresse, LinkedIn, analystes : 1,6 % des citations
Institutions (CNIL, ANSSI, CISA…)1 678 pages193 foisChatGPT cite-t-il la CNIL et l'ANSSI ?

Consultations : sources retournées par l'outil de recherche (25 906 sur 853 réponses). Citations : annotations url_citation (2 259 sur le corpus principal). Source : Evocia, AI Sources Index 2026.

Chaque ligne a sa page : ChatGPT cite-t-il Reddit ?, Wikipédia et YouTube, G2 et Capterra, presse, LinkedIn et analystes, CNIL, ANSSI et sites gouvernementaux.

Le mélange varie selon le secteur

En bref

La part de first-party va de 99,1 % en CRM à 58,2 % en cybersécurité. Dans ce dernier secteur, les institutions (ANSSI, CISA, CNIL) représentent 37,9 % des citations ; dans le legal et la conformité, 18,4 %. Partout ailleurs, l'éditeur domine à plus de 87 %.

SecteurFirst-partyInstitutions et standardsTiersDomaines cités
CRM et ventes99,1 %0,9 %0 %17
Service client et CCaaS97,2 %1,9 %0,9 %29
RH et recrutement96,8 %3,2 %0 %39
Marketing automation95,4 %2,5 %2,1 %38
Data et analytics95,4 %3,7 %0,9 %31
Finance et dépenses91,8 %7,3 %0,9 %45
Cloud et infrastructure90,0 %10,0 %0 %33
E-commerce et paiements87,0 %5,6 %7,4 %34
Legal, compliance, RegTech79,4 %19,3 %1,4 %72
Cybersécurité58,2 %39,2 %2,6 %33

80 réponses par secteur. Les parts sont calculées sur les citations du secteur. Source : Evocia, AI Sources Index 2026.

La comparaison complète des dix secteurs (concentration, stabilité, domaines dominants) est dans dix secteurs B2B comparés ; chaque secteur a en outre sa page de données.

Pourquoi ce résultat diffère d'autres études

En bref

D'autres mesures publiées en 2026 trouvent une majorité de sources tierces, presse en tête, dans les citations des IA. Les deux résultats sont compatibles : ils ne posent pas les mêmes questions. Sur des questions d'actualité ou générales, les IA citent la presse ; sur une question d'achat de logiciel, elles citent les éditeurs. Le type de question détermine le type de source.

L'écart tient aussi à la définition de la citation. Cette étude ne compte que les annotations de source renvoyées par l'API, sans rien extraire du texte, et sépare strictement les pages consultées des pages citées. Une mesure qui compterait les pages consultées obtiendrait, ici même, une part de forums et d'encyclopédies plus élevée. Les études comparées, leurs corpus et leurs définitions sont sur ce que mesurent les études sur les sources des IA.

Méthode et limites

En bref

Une citation est une annotation url_citation attachée par l'API à la réponse ; les pages consultées par l'outil de recherche sont comptées à part. Les domaines sont classés par règles (hôtes de documentation, listes d'institutions, de standards, de médias, d'analystes) puis relus un par un ; « site d'éditeur » est le type par défaut d'un domaine commercial. Les parts portent sur le corpus principal de 800 réponses.

  • Ce que la donnée établit : la répartition par type des sources que ChatGPT affiche, dans cette configuration, sur ce corpus.
  • Ce qu'elle n'établit pas : quelles marques sont recommandées dans le texte (non analysé dans cette édition) ; le comportement de l'interface grand public ; celui d'autres modèles ou d'autres langues ; une causalité entre le type de source et la recommandation.
  • Fragilités : la classification est humaine ; les catégories les plus rares (presse, forum, recherche) reposent sur une poignée de citations, et leur part exacte n'a pas de sens statistique au-delà de « quasi nulle ».

La taxonomie des 308 domaines, les fichiers de citations et de sources consultées, et le dictionnaire des variables sont publiés avec l'étude.

Consulter l'AI Sources Index 2026

Questions fréquentes

ChatGPT cite-t-il les sites des éditeurs de logiciels ?

Massivement, sur ce corpus : 71,8 % des citations vont à un site d'éditeur ou d'entreprise et 17,0 % à sa documentation officielle, soit 88,8 % de sources first-party sur 2 259 citations. C'est la mesure de l'AI Sources Index 2026 d'Evocia, sur des questions d'achat de logiciels B2B en français.

Quelle part des sources de ChatGPT sont des sites tiers ?

1,6 % dans cette étude (37 citations sur 2 259) : analystes et laboratoires de test 17, places de marché 10, LinkedIn 5, presse 3, recherche 1, forum 1. Les institutions publiques et les standards, comptés à part, pèsent 9,5 %.

Le résultat serait-il le même sur des questions non commerciales ?

Rien ne permet de l'affirmer, et d'autres études suggèrent le contraire sur des questions d'actualité. Cette mesure ne porte que sur des questions d'achat de logiciels B2B ; c'est le type de question qui semble déterminer le type de source, ce que l'étude ne teste pas au-delà de son corpus.

Sources

Transparence et méthode

Auteur

Evocia · Cabinet français de visibilité dans les IA

Evocia mesure la visibilité des entreprises dans les réponses des IA et publie ses données. Cette page fait partie de la série de données de l'AI Sources Index 2026.

Comment cet article a été réalisé

  • Page de données publiée le 17 septembre 2026. Chiffres recalculés depuis l'export brut de l'API (corpus principal, 800 réponses, 2 259 citations) ; aucun chiffre saisi à la main.
  • La classification des 308 domaines est celle publiée avec l'étude : règles puis relecture manuelle. Les catégories comptant moins de dix citations sont présentées comme quasi nulles, sans interprétation de leurs écarts.
  • L'étude ne mesure pas les marques recommandées dans le texte des réponses ; cette page ne l'affirme nulle part.

Historique des mises à jour

  • 17 septembre 2026Publication initiale.

À lire aussi

Commencez par le test gratuit : 3 requêtes, une synthèse claire.

Sans engagement · Nombre limité d'analyses gratuites chaque semaine

Tester ma visibilité IA