# Evocia AI Sources Index 2026 : méthodologie

## Objet
Mesurer, de façon reproductible, les sources (URL et domaines) que ChatGPT cite lorsqu'un acheteur B2B francophone cherche une solution, et la stabilité de ces sources quand une même requête est répétée ou reformulée.

## Moteur et configuration exacte
- ChatGPT via l'API Responses d'OpenAI, modèle demandé et retourné : gpt-5.6-terra.
- Outil de recherche web intégré : search_context_size = medium, tool_choice = auto, reasoning.effort = low.
- Localisation approximative transmise : France, Paris, Île-de-France, Europe/Paris.
- Prompt système identique pour tous les appels : « Réponds à la question en français, de façon concise et factuelle. ».
- max_output_tokens = 1200 ; température et seed non envoyées (défauts de l'API).
- Chaque appel est indépendant : aucun historique de conversation, aucune réponse précédente injectée, pas de cache.

## Corpus
- 250 requêtes en français, rédigées à l'avance (corpus maître Evocia).
- Dataset A (200) : 10 secteurs B2B (CRM & Sales ; Marketing Automation ; RH & Recrutement ; Finance & Spend Management ; Cybersécurité ; Cloud & Infrastructure ; Data & Analytics ; Service Client & CCaaS ; E-commerce & Paiements ; Legal / Compliance / RegTech) × 5 intentions (Problème / besoin ; Découverte de solutions ; Recommandation ; Comparaison ; Décision / achat) × 4 requêtes.
- Dataset B (50) : 25 expériences A/B, deux variantes chacune, une variable modifiée par expérience.
- 4 répétitions par requête : 1 000 réponses attendues, 1 000 terminées, 0 échec, collecte du 14 septembre 2026 entre 10:33 et 10:58 UTC.

## Définition d'une citation
Une citation est une annotation « url_citation » attachée par l'API au texte de la réponse. Rien n'est extrait du texte. Les pages consultées par l'outil de recherche (web_search_call.action.sources) sont conservées à part (sources-consultees.csv) et n'entrent pas dans les métriques de citation.

## Normalisation
Hôte en minuscules, préfixe www. retiré, domaine enregistrable calculé avec la Public Suffix List ; URL normalisée sans fragment, sans paramètres de suivi (utm_*, fbclid, gclid…), paramètres triés, slash final retiré. L'URL originale est conservée.

## Taxonomie des sources
Classification par règles puis relecture manuelle par Evocia :
- documentation : hôte commençant par docs., learn., support., help., helpcenter., developer(s)., documentation., knowledge., dev., api., start., helpdesk., assistance., academy. ;
- institution : domaines gouvernementaux et régulateurs (gouv.fr, cnil.fr, cisa.gov, nist.gov, europa.eu, urssaf.fr, service-public.fr, banque-france.fr, bpifrance-creation.fr) ;
- standard : iso.org, mitre.org, finops.org, opentelemetry.io, apache.org, mautic.org, matomo.org, glpi-project.org, prestashop-project.org ;
- analyste : gartner.com, forrester.com, baymard.com, av-comparatives.org, av-test.org, ciopages.com, afte.com ;
- media : silicon.fr, daf-mag.fr, techradar.com ; marketplace : amazon.fr, etsy.com, leboncoin.info, amazonservices.com ; social : linkedin.com ; communaute : github.com, hôtes community. ; academique : u-pec.fr ;
- editeur : type par défaut d'un domaine commercial.
Familles : first_party = editeur + documentation ; institutional = institution + standard ; third_party = le reste.

## Métriques
- Search Activation Rate = réponses avec recherche web / réponses analysées.
- Response Frequency (domaine) = réponses contenant le domaine au moins une fois / réponses de la population.
- Citation Share (domaine) = citations du domaine / citations totales.
- Query Coverage (domaine) = requêtes distinctes où le domaine apparaît / requêtes de la population.
- Citation Stability (domaine) = pour chaque requête où le domaine apparaît, répétitions le contenant / 4 ; valeur = moyenne sur ces requêtes.
- Stabilité des paires : pour chaque paire requête × domaine (dataset A), nombre de répétitions citant le domaine (1 à 4).
- Similarité de Jaccard = domaines communs / domaines de l'union.
- HHI = somme des carrés des parts de citations des domaines d'un secteur ; Shannon = entropie naturelle.
- Intervalle de confiance à 95 % = moyenne ± 1,96 × écart-type / racine(n).

## Populations
Comparaisons par intention, secteur, stabilité, concentration : dataset A (800 réponses). Totaux généraux et explorateur de domaines : 1 000 réponses. Expériences A/B : dataset B (200 réponses), résultats exploratoires.

## Rapport de qualité des données
| Critère | Statut | Valeur | Détail |
|---|---|---|---|
| Requêtes uniques (identifiant) | PASS | 250 |  |
| Textes de requête uniques | WARNING | 247 / 250 | 3 textes apparaissent deux fois, par construction : EXP-01-A et EXP-21-A partagent la variante A ; EXP-01-B reprend CRM-009 et EXP-08-A reprend CX-009. Les identifiants restent distincts et les runs indépendants ; aucune fusion n'est faite. |
| Réponses attendues / terminées | PASS | 1000 / 1000 |  |
| 4 répétitions par requête | PASS | 250 / 250 requêtes |  |
| Doublons (run_id, response_id) | PASS | 0 |  |
| Réponses vides | PASS | 0 |  |
| Erreurs API | PASS | 0 ; 1 run a nécessité une seconde tentative automatique |  |
| Recherche web déclenchée | PASS | 853 réponses sur 1 000 | Le champ « searched » est renseigné pour chaque réponse ; recherche et citation coïncident exactement (aucune réponse citante sans recherche, aucune recherche sans citation). |
| Citations structurées | PASS | 2970 citations inline ; 25906 sources consultées | Seules les annotations url_citation de l'API sont comptées comme citations ; les sources consultées (web_search_call.action.sources) sont analysées séparément. |
| URL et domaines exploitables | PASS | 1397 URL, 308 domaines | Normalisation runner (www., paramètres de suivi, fragments) revérifiée : domaine enregistrable recalculé cohérent sur 100 % des lignes. |
| Modèle | PASS | gpt-5.6-terra | Un seul modèle retourné par l'API sur les 1 000 réponses. |
| Fenêtre de collecte | PASS | 14 septembre 2026, 10:33 à 10:58 UTC | 25 minutes : aucune dérive temporelle possible entre répétitions. |
| Coût | PASS | 40.11 USD | Recalculé par somme des coûts par réponse. |
| Indépendance des sessions | PASS | appels synchrones sans historique | Selon la méthodologie du runner : aucune conversation, aucun cache ; les 4 répétitions ont des identifiants de réponse distincts. |
| Cohérence des catégories | PASS | 10 secteurs × 5 intentions × 4 requêtes = 200 | Le plan d'expérience du dataset A est parfaitement équilibré ; le dataset B porte 25 expériences × 2 variantes. |
| Classification des sources | PASS | 308 domaines classés, 0 inconnu | Le fichier livré laissait 253 domaines « unknown » ; ils ont été classés par règles (hôte de documentation, listes d'institutions, standards, médias, analystes) puis relus un par un. Le type « Site d'éditeur » est le type par défaut pour un domaine commercial. |

## Limites
Configuration API précise à une date donnée (non transposable telle quelle à l'interface grand public, à d'autres modèles ou langues) ; citations visibles seulement ; corpus B2B logiciel francophone ; photographie sur 25 minutes ; A/B exploratoires (une expérience par variable) ; classification humaine ; pas d'analyse des marques recommandées dans cette édition.

## Coût
40.11 USD, calculé à partir des usages retournés par l'API.
