Observatoire · Étude Happia

Quelles sources les IA citent-elles vraiment ? Notre étude sur 5 moteurs (2026)

Première édition de notre observatoire. 27 requêtes, 5 moteurs, 1 752 citations analysées. Le recouvrement entre moteurs est bien plus faible que tout le monde le suppose.

Quelles sources les IA citent-elles vraiment ? Notre étude sur 5 moteurs (2026)

Quand on parle de visibilité dans les IA, on parle presque toujours de ChatGPT, et on suppose que le reste suit. Nous avons voulu vérifier. Depuis le 25 juillet, nous posons les mêmes questions à cinq moteurs de réponse et nous enregistrons chaque lien qu'ils citent. Voici la première édition de cet observatoire, et son résultat principal tient en une phrase : les cinq moteurs ne puisent pas dans le même web.

En bref. Sur 27 requêtes en français posées aux cinq mêmes moteurs entre le 25 juillet et le 24 septembre 2026, nous avons relevé 1 752 citations uniques renvoyant vers 852 domaines. Deux résultats ressortent. D'abord le volume : Perplexity cite en moyenne 24,6 sources par réponse contre 7,0 pour ChatGPT, soit trois fois et demie plus de places disponibles sur la même question. Ensuite le recouvrement : 76,9 % des domaines cités ne le sont que par un seul moteur sur cinq, et neuf domaines seulement, soit 1,1 %, sont cités par les cinq. Il n'existe pas une liste des sites que lisent les IA. Il en existe cinq, et elles se recoupent à peine.
CS
Christophe Solczynski · Co-fondateur Happia
25 septembre 2026 · 9 min de lecture

1Ce que nous avons mesuré, et comment

Commençons par la méthode, parce qu'une étude qui ne publie pas la sienne ne vaut pas grand-chose. C'est d'ailleurs le reproche que nous faisions, dans un article précédent, à la plupart des chiffres qui circulent sur les citations IA.

Notre dispositif interroge en continu plusieurs moteurs de réponse avec des requêtes en français, et enregistre pour chaque réponse l'intégralité des liens cités, avec le moteur, la requête, le secteur et la date. Pour cette première édition, nous avons volontairement restreint l'analyse à un sous-ensemble strict.

Deux précisions honnêtes avant les résultats. Grok fait partie de notre collecte globale mais n'a pas été interrogé sur ces 27 requêtes précises : il est donc absent de cette comparaison. Et les chiffres ci-dessous portent sur des requêtes en français, tous secteurs confondus, sans découpage ville par ville. Nous y revenons dans la dernière section.

2Résultat 1 : de 7 à 25 sources selon le moteur

Premier constat, le plus simple à vérifier et le plus rarement énoncé : à question identique, les moteurs n'ouvrent pas le même nombre de places.

Moteur Sources citées par réponse Domaines distincts
Perplexity24,6367
Gemini12,5283
Claude12,1215
Google AI Overviews8,8156
ChatGPT7,0149

L'écart est de un à trois et demi entre les deux extrêmes. Sur une même question, Perplexity mobilise en moyenne près de vingt-cinq sources quand ChatGPT en retient sept.

Ce chiffre a une conséquence directe et rarement dite : la difficulté d'être cité n'est pas la même selon le moteur. Sur Perplexity, il y a beaucoup de places, et un site correct a des chances raisonnables d'en occuper une. Sur ChatGPT, sept places pour l'ensemble du web francophone pertinent, c'est une sélection beaucoup plus dure. Un commerce qui n'apparaît pas sur ChatGPT mais apparaît sur Perplexity n'a pas forcément un problème de fond : il se heurte à une barre plus haute.

À retenir pour la mesure

Comparer un score de visibilité obtenu sur Perplexity et un score obtenu sur ChatGPT n'a pas de sens si l'on ne tient pas compte de cet écart de volume. C'est l'une des raisons pour lesquelles nous interrogeons plusieurs moteurs plutôt qu'un seul, comme expliqué dans notre article sur la mesure de la visibilité IA.

3Résultat 2 : 77 % des sites ne sont vus que par un seul moteur

C'est le résultat qui nous a le plus surpris, et celui qui a le plus de conséquences pratiques.

Sur les 852 domaines cités au moins une fois pendant ces deux mois, voici comment ils se répartissent selon le nombre de moteurs qui les ont cités.

Cité par Nombre de domaines Part
1 moteur sur 565576,9 %
2 moteurs11513,5 %
3 moteurs526,1 %
4 moteurs212,5 %
Les 5 moteurs91,1 %

Plus des trois quarts des sites cités ne le sont que par un seul moteur. Et à l'autre bout, neuf domaines seulement sur huit cent cinquante-deux font l'unanimité.

Il n'y a pas une liste, il y en a cinq

L'idée d'un web de référence que toutes les IA consulteraient ne résiste pas à la mesure. Chaque moteur s'est constitué son propre terrain, et ces terrains se recouvrent à peine.

La conséquence est directe : une mesure de visibilité faite sur un seul moteur ne dit presque rien des autres. Si ton outil, ou ton agence, ne teste que ChatGPT, il te renseigne sur un cinquième du sujet, et pas sur les quatre autres. C'est exactement le genre d'angle mort que nous décrivions dans notre article sur le choix d'un outil de visibilité IA.

Elle explique aussi une situation que beaucoup de commerçants nous décrivent sans comprendre : être très bien placé sur un moteur et invisible sur un autre, sans avoir rien changé. Ce n'est pas une anomalie, c'est la règle.

4Résultat 3 : le socle commun tient en neuf domaines

Ces neuf domaines cités par les cinq moteurs méritent qu'on les regarde de près, parce qu'ils sont la seule chose qui traverse tout l'écosystème sur notre échantillon.

Ce dernier point est le plus encourageant de toute l'étude. Le socle commun n'est pas réservé aux grandes plateformes. Un site de commerce indépendant peut figurer parmi les rares sources que les cinq moteurs reprennent. Cela ne se produit pas par hasard, et c'est précisément ce que travaille le GEO, dont les principes sont détaillés dans notre article de fond.

Ce qu'il ne faut pas conclure

Neuf domaines, ce n'est pas une liste de courses. Il ne s'agit pas d'aller s'inscrire sur ces quatre plateformes en espérant un effet mécanique : trois d'entre elles ne concernent qu'un métier précis, et leur présence tient à leur pertinence sur les requêtes testées. La leçon utile est ailleurs : les sources qui traversent les cinq moteurs sont soit très généralistes et très établies, soit très spécialisées sur un métier. Le milieu de gamme, lui, n'est vu que par un moteur ou deux.

5Ce que ça change pour un commerce

Trois conséquences concrètes, dans l'ordre où elles se présentent.

  1. Arrête de juger ta visibilité IA sur un seul test
    Poser la question à ChatGPT un dimanche soir et en tirer une conclusion générale n'a pas de sens. Il faut au minimum interroger trois ou quatre moteurs pour avoir une idée de sa situation réelle, et recommencer dans le temps.
  2. Choisis tes batailles par moteur, pas dans l'absolu
    Si tes clients utilisent surtout ChatGPT, la barre est haute et la priorité va à ce qui fait une source solide : cohérence des informations, fiche Google tenue, contenus qui répondent vraiment. Si Perplexity compte pour toi, le nombre de places disponibles rend l'entrée plus accessible, et la présence sur des sources spécialisées de ton métier pèse davantage.
  3. Le générique et le spécialisé battent le milieu de gamme
    Sur les sources externes où investir ton temps, les deux extrémités fonctionnent : les grands annuaires établis d'un côté, les plateformes spécifiques à ton métier de l'autre. Les sites intermédiaires, connus mais sans spécialisation nette, sont ceux qui n'apparaissent que chez un moteur.
Comment on travaille là-dessus

L'audit Happia pose tes requêtes réelles à plusieurs moteurs et te dit, pour chacun, si tu es cité et à partir de quelles sources. C'est le même dispositif qui alimente cet observatoire. Voir la méthode complète.

6Ce que cette édition ne dit pas

Une étude est aussi utile par ce qu'elle refuse d'affirmer. Voici ce que nos chiffres ne permettent pas de conclure, et ce que nous avons choisi de ne pas publier.

L'échantillon est petit. Vingt-sept requêtes et six secteurs, ce sont des ordres de grandeur, pas une vérité statistique. Un écart de un à trois et demi sur le nombre de sources est trop large pour être du bruit, et une répartition à 76,9 % contre 1,1 % l'est aussi. En revanche, nous ne publions aucun classement fin, aucun détail secteur par secteur, et aucun pourcentage à la décimale près sur un sous-groupe : la base ne le supporterait pas.

La dimension locale n'est pas isolée. Les requêtes sont en français et couvrent des métiers de proximité, mais cette édition ne découpe pas ville par ville. Savoir si les sources citées pour « un bon restaurant à Cannes » diffèrent de celles citées pour la même question à Lille est exactement ce que nous voulons mesurer, et ce n'est pas encore possible avec la donnée telle qu'elle est stockée aujourd'hui. C'est le premier chantier de l'édition suivante.

Nous ne publions pas la répartition par type de source. C'est le chiffre qu'on nous demandera le plus, et c'est précisément celui que nous refusons de sortir pour l'instant. Notre classification actuelle range entre 60 et 82 % des citations, selon le moteur, dans une catégorie fourre-tout qui mélange des sites de commerces, des annuaires de niche et des blogs de contenu. Tant que ces trois choses ne sont pas séparées proprement, annoncer « X % des citations vont aux sites des commerçants » serait un chiffre inventé avec une apparence de rigueur. Nous préférons le dire que le maquiller.

Deux mois, c'est court, et ces systèmes bougent vite. Nous avons vu ailleurs à quelle vitesse la part d'une source peut s'effondrer en quelques semaines. Un observatoire n'a d'intérêt que répété : c'est la comparaison entre éditions qui produira le vrai signal, pas cette première photo.

Enfin, nous mesurons ce qui est cité, pas ce qui est lu. Qu'un moteur cite une source ne dit rien du poids qu'elle a eu dans la réponse, ni de ce que le lecteur en a fait. C'est une limite commune à toutes les études de ce type, y compris les grandes études américaines.

Et toi, quels moteurs te citent ?

L'audit Happia pose tes vraies requêtes de clients à plusieurs moteurs de réponse et te dit, pour chacun, si tu es nommé et à partir de quelles sources. Inclus dès le premier jour de ton essai de 14 jours.

Tester ma visibilité

7FAQ

Combien de sources une IA cite-t-elle pour répondre à une question ?

Cela dépend énormément du moteur. Sur les 27 requêtes posées aux cinq moteurs entre juillet et septembre 2026, Perplexity cite en moyenne 24,6 sources par réponse, Gemini 12,5, Claude 12,1, les AI Overviews de Google 8,8 et ChatGPT 7,0. Sur une même question, Perplexity ouvre donc environ trois fois et demie plus de places que ChatGPT.

Les IA citent-elles les mêmes sites ?

Non, et l'écart est bien plus large qu'on ne l'imagine. Sur les 852 domaines observés, 76,9 % ne sont cités que par un seul des cinq moteurs. Seuls 9 domaines, soit 1,1 %, sont cités par les cinq. Il n'existe pas une liste de sites de référence des IA, mais cinq listes qui se recoupent peu.

Être cité par ChatGPT suffit-il à être visible dans les IA ?

Non. Puisque plus des trois quarts des domaines ne sont vus que par un seul moteur, une mesure faite sur ChatGPT seul ne dit à peu près rien de ce qui se passe sur Perplexity ou Gemini. Un outil qui ne mesure qu'un moteur mesure un cinquième du sujet.

Quels sont les sites cités par les cinq moteurs à la fois ?

Neuf domaines seulement sur cette première édition : un annuaire généraliste (PagesJaunes), trois plateformes de réservation sectorielles (Privateaser, Resalib, Medoucine), quatre sites de niche comparateurs ou annuaires spécialisés, et le site d'un restaurant indépendant. Ce dernier point compte : le socle commun n'est pas réservé aux grandes plateformes.

Cette étude porte-t-elle sur des requêtes locales françaises ?

Les requêtes sont en français et couvrent six secteurs dont la restauration et le commerce physique, mais cette première édition n'isole pas la dimension ville par ville. C'est le principal chantier de l'édition suivante, avec une classification plus fine du type de source.

Pourquoi ne publiez-vous pas la répartition par type de source ?

Parce que notre classification actuelle n'est pas assez fine pour être publiée honnêtement. Une catégorie fourre-tout absorbe aujourd'hui entre 60 et 82 % des citations selon le moteur, et elle mélange des choses très différentes : sites de commerces, annuaires de niche, blogs de contenu. Publier ce chiffre reviendrait à donner une précision que la donnée n'a pas.

Méthode et sources

Les chiffres de cet article proviennent de notre propre collecte, décrite en section 1. Périmètre : 27 requêtes en français posées aux cinq mêmes moteurs (ChatGPT, Claude, Gemini, Perplexity, Google AI Overviews) entre le 25 juillet et le 24 septembre 2026, 1 752 citations uniques après dédoublonnage, 852 domaines distincts, six secteurs. Une citation correspond à une adresse citée par un moteur pour une requête donnée. Les requêtes couvertes par moins de cinq moteurs sont exclues de l'analyse.

CS
À propos de l'auteur
Christophe Solczynski
Co-fondateur de Happia · pilote la méthodologie GEO
Plus de 15 ans dans le commerce local indépendant : ancien directeur réseau pendant 5 ans dans un grand groupe de restauration, puis entrepreneur (7 commerces ouverts et exploités en propre). Il conçoit la méthode de mesure GEO de Happia — « mesurer, jamais supposer ».
Voir l'équipe →Happia sur LinkedIn