Aller au contenu
Visibilité IAÉtude
FR

Nous avons posé la même question à quatre surfaces d'IA. Cinquante et une sources sont revenues et aucune n'était présente sur les quatre.

Même question, même marché, même instant, quatre surfaces. Quarante et une des cinquante et une sources citées n'apparaissent que sur une seule.

· Mis à jour · 11 min de lecture

Chaque étude publiée ici porte la même limite : une surface, Google AI Overview. Celle-ci mesure ce que cette phrase coûte.

Nous avons posé deux questions à quatre surfaces au même instant : AI Overview, Google AI Mode, Gemini et ChatGPT. À elles quatre, elles ont cité 51 domaines distincts. Aucun n’est apparu sur les quatre. 41 ne sont apparus que sur une seule.

Le point gênant pour Google est que trois de ces quatre surfaces sont les siennes, et AI Overview et Gemini n’ont partagé aucune source, sur aucune des deux questions.

Comment c’est mesuré : deux prompts, États-Unis, anglais, 7 août 2026, une exécution par surface, les quatre interrogées dans le même appel. Une exécution est un tirage et non un taux, c’est pourquoi cet article compte le recouvrement entre surfaces plutôt que la fréquence à l’intérieur de chacune. Domaines cités uniquement, jamais les mentions de marque. Les deux mesures figurent dans notre registre avec le détail par surface.


Question une : chaussures de running

SurfaceDomaines cités
ChatGPT11
AI Overview5
AI Mode4
Gemini3

20 domaines distincts. Un est apparu sur trois surfaces (runrepeat.com), un sur deux, et 18 sur une seule.

Question deux : plateformes d’emailing pour l’ecommerce

SurfaceDomaines cités
ChatGPT16
AI Mode11
AI Overview8
Gemini5

31 domaines distincts. Un est apparu sur trois (drip.com), sept sur deux, et 23 sur une seule.

Les deux questions réunies

Domaines présents sur…NombrePart
Les quatre surfaces00 %
Trois surfaces24 %
Deux surfaces816 %
Une seule surface4180 %
Les quatre surfaces0 (0%)Trois surfaces2 (4%)Deux surfaces8 (16%)Une seule surface41 (80%)
Cinquante et un domaines distincts sur deux questions d'achat. Aucun n'est apparu sur les quatre surfaces et quatre cinquièmes sur une seule. États-Unis en anglais, AI Overview, AI Mode, ChatGPT et Gemini, une exécution par surface : c'est un tirage, pas un taux.
Combien des 51 domaines cités sont apparus sur une, deux, trois ou les quatre surfaces
value
Les quatre surfaces0
Trois surfaces2
Deux surfaces8
Une seule surface41

Quatre cinquièmes du web cité, pour ces questions, ne sont visibles que sur un seul des quatre endroits où un acheteur peut poser la question.

Pourquoi c’est pire que « les moteurs diffèrent »

Tout le monde dans cette catégorie vous dira que les moteurs diffèrent. Ce que ces chiffres ajoutent, c’est l’ampleur, et un résultat précis que personne n’affiche.

AI Overview et Gemini n’ont rien cité en commun. Sur aucune des deux questions. Les deux appartiennent à Google. Posez la même question à l’IA du moteur de Google et à l’assistant de Google dans la même minute, et les preuves sous les deux réponses sont disjointes.

AI Mode, également de Google, partage un domaine avec AI Overview sur la première question et quatre sur la seconde. Mieux, et toujours largement séparé.

Si vous mesurez une surface Google et que vous appelez cela « Google », vous mesurez une surface Google.

Le résultat qui se place juste à côté

Voilà ce qui rend le constat tranchant plutôt que simplement curieux.

Les chaussures de running sont la catégorie la plus stable que nous ayons jamais mesurée. Dans notre étude sur la stabilité des réponses, trois exécutions de cette même question sur AI Overview ont renvoyé cinq domaines, et les cinq sont apparus à chaque exécution. Reproductibilité parfaite à l’intérieur d’une surface.

Cette même question, posée à quatre surfaces, a produit vingt domaines dont dix-huit ne sont apparus que sur une seule.

La reproductibilité à l’intérieur d’une surface ne dit rien de l’accord entre surfaces. Un éditeur peut vous annoncer en toute honnêteté que votre mesure est solide, la répéter tout le mois, et décrire un quart du tableau. Ce sont deux propriétés différentes, et ce marché vend couramment la première en laissant entendre la seconde.

ChatGPT cite le plus, Gemini le moins

ChatGPT a renvoyé la liste de sources la plus longue sur les deux questions, 11 et 16. Gemini la plus courte, 3 et 5. AI Overview et AI Mode se situent entre les deux.

Nous n’allons pas vous dire ce que cela signifie sur la qualité des réponses, parce que nous n’avons pas mesuré la qualité. En pratique, cela veut dire que la surface mesurée change non seulement quelles sources vous voyez mais combien, et qu’un pourcentage de part de voix calculé sur un dénominateur de trois domaines n’est pas comparable à un calcul sur seize.

C’est un problème d’arithmétique élémentaire caché à l’intérieur de beaucoup de tableaux de bord.

Ce que cela change à l’achat

Un prix par moteur est un prix par photo. Notre catalogue vérifié comprend des offres d’entrée couvrant un moteur (Surfer, et notre propre offre à 29 €), trois (Siftly, Writesonic), quatre (Nightwatch) et six (Promptmonitor à 29 $, Rank Prompt). Avec ces données, l’écart entre un moteur et quatre n’est pas un raffinement. C’est l’essentiel de la donnée.

Ne faites pas la moyenne entre moteurs. Avec 80 % des sources n’apparaissant que sur une surface, un score de visibilité agrégé mélange quatre populations largement disjointes en un chiffre qui n’en décrit aucune. Lisez-les séparément ou ne les lisez pas.

Vérifiez quelle surface vos acheteurs utilisent réellement avant d’optimiser pour celle que votre outil couvre. C’est une question sur votre marché, pas sur l’IA.

Et n’oubliez pas l’autre axe. Le nombre d’exécutions dont une catégorie a besoin va d’environ trois à environ trente, et cet article ajoute une seconde dimension par-dessus. La couverture et la répétition sont deux achats distincts, et la plupart des éditeurs vous vendent une quantité fixe des deux.

Répliqué cinq fois de plus le 7 août 2026

Cet article mesurait deux questions grand public. Depuis, nous avons lancé le même instrument cinq fois de plus, sur des questions qui n’ont rien à voir avec des chaussures de course. Le résultat a tenu sur quatre et s’est rompu sur la cinquième.

QuestionMarchéDomaines citésSur deux surfacesSur trois ou quatre
Meilleure agence GEOÉtats-Unis2050
Meilleure agence GEOFrance1940
Meilleure agence GEOEspagne1640
Quel outil de visibilité IAÉtats-Unis2110
Meilleure agence GEOAllemagne, ajoutée le 7 août 20261822

Une autre catégorie, quatre langues, et l’une des exécutions porte sur un logiciel d’entreprise et non sur un service. Sur les quatre premières réplications, aucune source n’a été citée par trois des quatre surfaces. L’Allemagne, lancée en dernier, a rompu cela. Deux domaines y ont atteint trois surfaces, et les deux sont des sites d’agence : l’un appartient à Aufgesang, l’autre à Suchhelden. Quatre exécutions donnaient l’allure d’une règle et la cinquième dit que ce n’en est pas une, ce à quoi sert la réplication. Sur la question des outils, Google AI Overview a renvoyé une erreur serveur : cette ligne compte trois surfaces et non quatre, et c’est notre instrument qui a échoué, pas Google qui s’est tu.

Ajoutez les deux questions de cet article et cela fait sept jeux de questions, deux catégories et quatre langues. Aucun n’a produit une source citée par les quatre surfaces, et c’est la partie qui a tenu à chaque fois. Sur trois surfaces, le tableau est plus maigre sans être vide : les deux questions grand public d’ici ont obtenu exactement une source chacune, quatre des cinq exécutions récentes aucune, et l’Allemagne deux. Nous n’en faisons pas une loi, car chacune est une seule exécution et nous savons ce que vaut une seule exécution. Ce que nous pouvons dire, c’est que la colonne des quatre surfaces n’a pas bougé de zéro en sept essais, et que celle des trois bouge selon qu’un acteur de ce marché a publié une page sur laquelle il vaut la peine de s’accorder. Et le recouvrement n’est pas la seule chose qui dépende de la question posée : la même catégorie interrogée en question d’achat puis en question de définition donne huit domaines cités puis aucun, sur la même surface et le même jour.

Ce que cette étude ne montre pas

L’une des quatre surfaces renvoie moins qu’elle ne cite, et cela atteint le titre. Mesuré le 15 août 2026 : une réponse d’AI Mode imprime des marqueurs de citation numérotés dans son corps et la liste structurée que nous lisons en porte environ la moitié, tandis que celle d’AI Overview les porte tous. Donc « aucun n’est apparu sur les quatre » est en partie une affirmation sur la capture d’AI Mode : un domaine présent sur toutes les surfaces pourrait manquer dans la colonne AI Mode et briser la série sans avoir jamais manqué dans la réponse.

Ce qui reste intact est la moitié la plus nette. AI Overview et Gemini ont cité zéro domaine en commun sur les deux questions, et ces deux listes portent tous les marqueurs que leurs réponses impriment, ce couple est donc mesuré avec un seul instrument des deux côtés. La capture de ChatGPT, nous ne pouvons pas la vérifier, car cet appel expire sur cette route.

  • Une exécution par surface. Deux questions, huit réponses de surface. Cela mesure le peu de recouvrement entre les quatre ensembles de sources à un instant donné. Cela ne mesure pas la fréquence d’apparition d’un domaine, et ne le peut pas : il faudrait de la répétition, un protocole différent et bien plus coûteux.
  • Deux questions, un marché, une langue, un jour. Les deux portent sur des logiciels grand public ou PME, aux États-Unis et en anglais.
  • Le recouvrement n’est pas la justesse. Que quatre surfaces divergent ne rend aucune d’elles fausse. Des preuves différentes peuvent soutenir la même recommandation, et de fait les quatre ont nommé des produits communs en citant des sources différentes.
  • Nous avons compté des domaines, pas leur importance. Un domaine cité une fois et un domaine sur lequel la réponse s’appuie comptent pareil.
  • Rien de causal, et rien sur les mentions de marque. Ce sont des données de citation.
  • Les surfaces bougent. Ce sont quatre produits en développement actif, mesurés une après-midi.

Questions fréquentes sur les différences entre moteurs d’IA

ChatGPT, Gemini et Google AI Overview citent-ils les mêmes sources ?

À peine. Sur deux questions posées à quatre surfaces au même instant, 51 domaines distincts ont été cités et aucun n’est apparu sur les quatre. 41 des 51, environ 80 %, ne sont apparus que sur une seule surface.

Les surfaces d’IA de Google s’accordent-elles entre elles ?

Pas d’après nos données. AI Overview et Gemini ont cité zéro domaine en commun sur les deux questions. AI Mode, également de Google, partageait un domaine avec AI Overview sur la première question et quatre sur la seconde. Mesurer une surface Google ne vous renseigne pas sur les autres.

Quel moteur d’IA cite le plus de sources ?

ChatGPT, sur les deux questions testées, avec 11 et 16 domaines distincts. Gemini en a cité le moins, 3 et 5. Cela compte pour tout pourcentage : une part de voix calculée sur cinq sources n’est pas comparable à une part calculée sur seize.

Vaut-il la peine de payer pour un outil couvrant plus de moteurs ?

Avec ces données, l’écart de couverture est l’essentiel de la donnée et non un raffinement, puisque quatre cinquièmes des sources citées n’apparaissaient que sur une surface. Les offres d’entrée de notre catalogue vérifié vont d’un moteur à six pour des prix voisins, la comparaison mérite donc d’être faite délibérément.

Si ma mesure est stable, est-ce que je vois tout ?

Non, et c’est le piège. La question de cette étude dont la reproductibilité était parfaite à l’intérieur d’une surface, cinq domaines cités à chacune des trois exécutions, a produit dix-huit domaines mono-surface sur vingt lorsque nous avons interrogé quatre surfaces. Reproductibilité et couverture sont deux propriétés distinctes, et un outil peut exceller dans la première sans rien dire de la seconde.

Puis-je le reproduire ?

Oui. Deux prompts, États-Unis, anglais, quatre surfaces, une exécution chacune, le 7 août 2026, les deux prompts étant cités intégralement ci-dessus et le détail par surface figurant dans notre registre. Posez la même question à quatre surfaces dans la même session et notez les domaines que chacune cite.

Interrogez une IA sur cet article

Ouvre votre assistant avec cette page déjà chargée, pour vérifier les chiffres, discuter la méthode ou demander ce que cela change pour vous.

Perplexity et Google répondent directement. ChatGPT et Claude remplissent le champ et attendent que vous appuyiez sur entrée, ce qui relève de leur comportement et non du nôtre.

Écrit par

Maher El Ouahabi

CTO et cofondateur d’EchoWi

Construit le logiciel qui montre aux marques ce que l’IA dit vraiment d’elles, puis quoi changer pour que la réponse suivante soit meilleure. Douze moteurs, mesurés avant et après.

LinkedIn Maher El Ouahabi (ouvre un nouvel onglet)