Deux questions de voyage, quatre marchés. Indiscernables en Allemagne, séparées de 53 points aux États-Unis.
Hôtels et vols, posés sur quatre marchés et trois surfaces IA. L'écart entre les deux questions va de 3 points en Allemagne à 53 aux États-Unis.
Nous avons posé deux questions de réservation de voyage, les hôtels et les vols, sur quatre marchés et trois surfaces IA. En Allemagne, les deux questions nous n’avons pas su les distinguer, 39 % et 42 %. Aux États-Unis, 53 points les séparent. Même secteur, même semaine, même méthode.
C’est le chiffre à emporter dans une conversation client sur la visibilité IA : la stabilité de vos réponses n’est pas une propriété de votre secteur. C’est une propriété de la question exacte, sur le marché exact, et les deux ne se combinent d’aucune manière prévisible à partir de l’une ou de l’autre.
Transparence : EchoWi vend de la mesure de visibilité IA. C’est un conflit d’intérêts, et la réponse à un conflit d’intérêts est une méthode vérifiable, pas une promesse de neutralité. Les questions, les surfaces, les marchés, le nombre d’exécutions et les dates sont tous ci-dessous, et chaque ligne figure dans notre registre public de mesures.
Mis à jour le 10 août 2026. Après publication, nous avons lu une question cinq fois dans la journée et vu sa part stable passer de 39 % à 89 % pendant que le nombre de sources durables restait à sept ou huit. Cela ne touche ni les 53 points américains ni les 45 espagnols, tous deux très au-delà de cette plage et dont l’un a été répliqué dans une seconde session. Cela retire en revanche une affirmation : un écart de trois points n’est pas un résultat. La ligne allemande est écrite ici comme deux questions que cet instrument ne sait pas séparer, ce qu’elle a toujours été, et les cinq lectures sont dans l’étude suivante.
La version courte
- L’écart entre deux questions sur un même marché va d’indiscernable à 53 points. Les hôtels et les vols allemands reviennent à 39 % et 42 %. Ceux des États-Unis reviennent à 96 % et 43 %.
- Une question est réellement, et de façon répétable, stable. La question hôtelière américaine a conservé 24 sources sur 25 sur deux exécutions, puis 24 sur 26 lors d’une seconde session, et les vingt-quatre sont les mêmes vingt-quatre domaines.
- Rien dans le mot « voyage » n’explique quoi que ce soit. Sur les sept questions comparables, la part stable va de 14 % à 96 %.
- Le voyage est globalement plus stable que l’achat d’agence, et cela cache plus que cela ne dit. 47 % des sources citées ont tenu ici contre 32 % dans notre étude sur dix-neuf questions d’agence, et la dispersion à l’intérieur du voyage est bien plus large que l’écart entre les deux secteurs.
- L’extrémité instable est pire que tout ce que nous avons publié. La question des vols en espagnol a renvoyé 35 sources, dont 5 ont tenu et 30 ne sont apparues qu’une seule fois.
Ce que nous avons mesuré
| Questions | 2 intentions, « quel est le meilleur site pour réserver un hôtel » et « …pour réserver un vol », dans la langue du marché |
|---|---|
| Marchés | États-Unis et anglais, Espagne et espagnol, France et français, Allemagne et allemand, chacun défini explicitement |
| Surfaces | Google AI Overview, Google AI Mode et Gemini, regroupées par question |
| Exécutions | 2 par question, consignées par question plutôt que supposées |
| Cache | Contourné. Chaque exécution est un appel neuf |
| Date | 10 août 2026 |
Sept questions portent un chiffre de stabilité. Trois autres ont été mesurées et sont exclues, chacune pour une raison énoncée : la question française sur les vols n’a renvoyé qu’une seule exécution, et à cette taille toute source est trivialement stable et trivialement unique ; et une tentative antérieure sur la question hôtelière espagnole s’est achevée sur deux surfaces au lieu de trois, elle puise donc dans un ensemble plus petit et ne peut pas figurer à côté des autres. Les deux sont au registre, parce que le registre consigne ce qui s’est passé.
La méthode reprend délibérément celle de l’étude sur les agences, pour que les deux se comparent sans discuter des instruments.
Les deux questions, marché par marché
| Marché | Hôtels | Vols | Écart |
|---|---|---|---|
| États-Unis | 96 % (24 sur 25) | 43 % (9 sur 21) | 53 points |
| Espagne | 59 % (13 sur 22) | 14 % (5 sur 35) | 45 points |
| Allemagne | 39 % (7 sur 18) | 42 % (11 sur 26) | 3 points |
| France | 50 % (10 sur 20) | une exécution, pas de taux |
| citées à chaque exécution | sources citées distinctes | |
|---|---|---|
| États-Unis · hôtels | 24 | 25 |
| Espagne · hôtels | 13 | 22 |
| France · hôtels | 10 | 20 |
| Allemagne · vols | 11 | 26 |
| États-Unis · vols | 9 | 21 |
| Allemagne · hôtels | 7 | 18 |
| Espagne · vols | 5 | 35 |
Lisez la ligne allemande et la ligne américaine ensemble, car c’est là qu’est le résultat. En Allemagne, demander des hôtels et demander des vols a produit des réponses à trois points d’écart, que cet instrument ne sait pas séparer. Ce n’est pas dire qu’elles se comportent de la même façon : c’est dire qu’une lecture ne les distingue pas, et qu’aucune ne décrit l’autre. Aux États-Unis, ces deux mêmes questions sont séparées de 53 points, et quiconque aurait mesuré l’une pour en déduire l’autre se serait trompé de plus de la moitié de l’échelle.
L’Espagne se situe entre les deux par la forme et tout en bas par le niveau : 45 points d’écart, avec la question des vols qui renvoie la réponse la moins stable de tout ce que nous avons publié.
L’exception a tenu, ce qui n’était pas le cas la dernière fois
La question hôtelière américaine est revenue avec 24 sources sur 25 citées lors des deux exécutions. C’est très au-dessus de tout ce que contient notre étude sur les agences, dont le meilleur résultat sur dix-neuf questions était 13 sur 20. Elle a donc reçu le traitement que cette étude nous a appris : mesurer de nouveau.
| Sources citées | Stables | Part | |
|---|---|---|---|
| Première session | 25 | 24 | 96 % |
| Seconde session | 26 | 24 | 92 % |
Et les vingt-quatre sont les mêmes vingt-quatre domaines, vérifiés par leur nom et non par leur nombre : booking.com, kayak.com, expedia.com, reddit.com, youtube.com, google.com, forbes.com et dix-sept autres, dans les deux sessions.
C’est l’inverse de ce qui est arrivé à la question la plus stable de l’étude sur les agences, tombée de 65 % à 29 % du jour au lendemain. Les deux résultats comptent et disent deux moitiés d’une même règle. Un chiffre élevé n’est pas suspect parce qu’il est élevé ; il mérite la vérification la moins chère possible, et parfois la vérification confirme un noyau sur lequel on peut réellement bâtir. Six ou sept sources stables par question, c’est un brief éditorial. Vingt-quatre, c’est une carte.
Pourquoi le résultat allemand est le plus utile
La tentation, devant un tel tableau, est d’ouvrir sur les 96 %. La ligne allemande vaut davantage, parce que c’est elle qui vous donne la forme du problème.
Si la question et le marché interagissaient de façon simple, l’Allemagne montrerait le même écart que les États-Unis, plus petit ou plus grand, mais présent. Elle montre trois points, autrement dit aucun écart résoluble. Ce qui rend la question hôtelière américaine tellement plus stable que la question américaine sur les vols n’est donc pas une propriété des hôtels, puisque cela ne voyage pas jusqu’en Allemagne.
Nous ne pouvons pas dire ce que c’est à partir de ces données, et cette étude ne va pas faire semblant. Ce qu’elle peut dire, c’est ce qu’une agence doit en faire : mesurez la question pour laquelle on vous paie, sur le marché pour lequel on vous paie. Un chiffre de stabilité venu d’une question voisine dans le même secteur n’est pas une preuve concernant la vôtre, et sur l’un de nos trois marchés il se serait trompé de 53 points.
Face à l’étude sur les agences, qui utilisait le même instrument
| Questions d’achat d’agence | Questions de réservation de voyage | |
|---|---|---|
| Questions | 19 | 7 |
| Part stable | 32 % | 47 % |
| Citées exactement une fois | 58 % | 53 % |
| Amplitude entre questions | 17 % à 65 % | 14 % à 96 % |
Le voyage paraît plus stable, et l’agrégat est la ligne la moins intéressante du tableau. C’est l’amplitude qui compte. La part stable du voyage couvre 82 points sur sept questions ; celle des agences couvre 48 sur dix-neuf. Une moyenne sectorielle aurait masqué à la fois les 96 % et les 14 %, c’est-à-dire précisément les deux lignes qu’un acheteur voudrait connaître.
C’est la même conclusion que l’étude sur les agences atteignait par l’autre bout : là-bas, deux des quatre comparaisons de marchés exploitables différaient de 15 et 35 points, et deux de 3 et 2. Ni le marché ni le secteur n’est un coefficient que l’on applique.
Ce que cette étude ne montre pas
- Sept questions comparables, c’est peu. Deux intentions, quatre marchés, et seulement trois marchés portent les deux intentions. Chaque pourcentage a un dénominateur à deux chiffres.
- Deux exécutions, pas trois. « Citée à chaque exécution » est une barre plus facile sur deux exécutions, ces chiffres ne sont donc pas comparables à des mesures sur trois exécutions, y compris à des parties de notre propre étude sur les agences. Cette étude a chiffré cet effet à une dizaine de points.
- Une session par question, sauf une. Seule la question hôtelière américaine a une seconde session. Le reste décrit la session dans laquelle il a été mesuré, et c’est exactement la limite qui, la dernière fois que nous l’avons testée, est devenue un résultat.
- Trois surfaces, pas quatre. ChatGPT est exclu parce que la voie que nous utilisons ne renvoie aucune liste de sources pour lui, et rapporter cela comme un zéro reviendrait à rapporter notre instrument.
- La ligne espagnole des vols est irrégulière. AI Overview a répondu une fois là où les deux autres surfaces ont répondu deux fois. Elle est consignée comme deux exécutions et signalée plutôt que lissée, et c’est la ligne la moins fiable du tableau.
- Une seule formulation par question. Une étude espagnole portant sur une autre catégorie a utilisé quatre formulations et trouvé 49 sources, dont aucune n’apparaissait dans les quatre : ces ensembles appartiennent donc à ces formulations.
- Rien ici n’est causal. Nous n’avons rien modifié et avons consigné ce qui revenait.
Questions fréquentes sur cette étude
Les réponses IA sont-elles stables pour les questions de réservation de voyage ?
Cela dépend entièrement de la question et du marché. Sur sept questions comparables, la part des sources citées à chaque exécution allait de 14 % à 96 %. La question hôtelière américaine a conservé 24 sources sur 25 et a répété ce résultat lors d’une seconde session ; la question espagnole sur les vols en a conservé 5 sur 35. Il n’existe pas de chiffre unique pour le voyage, et tout éditeur qui en cite un fait une moyenne sur une amplitude qui couvre presque toute l’échelle.
Une même question se comporte-t-elle pareil dans des pays différents ?
Non, et même pas approximativement. La question de la réservation d’hôtel a renvoyé 96 % de sources stables aux États-Unis, 59 % en Espagne, 50 % en France et 39 % en Allemagne. Cela fait 57 points d’amplitude sur une seule question, avec le marché pour unique variable, mesurée le même jour sur les mêmes surfaces. Le marché où vous êtes n’est pas un détail de la même réponse, il change les sources qui existent : nous avons mesuré les mêmes marques perdant l’essentiel de leur visibilité IA à mesure que le marché s’éloigne des États-Unis.
Le voyage est-il plus stable que d’autres catégories dans la recherche IA ?
Sur l’agrégat, légèrement : 47 % des sources citées ont tenu ici contre 32 % dans notre étude sur dix-neuf questions d’agence. L’agrégat induit en erreur. L’amplitude du voyage va de 14 % à 96 % et celle de l’étude sur les agences de 17 % à 65 %, la dispersion à l’intérieur du voyage est donc plus large que l’écart entre les deux catégories.
Faut-il faire confiance à un score élevé de visibilité IA ?
Assez pour le vérifier une fois, et c’est peu coûteux. Le meilleur résultat de notre étude sur les agences est tombé de 65 % à 29 % le lendemain. Le meilleur de notre étude sur le voyage a tenu à 96 % puis 92 %, avec les mêmes vingt-quatre domaines les deux fois. La vérification est ce qui les sépare, et c’est la seule chose qui les sépare.
Quelles surfaces IA ont été mesurées ?
Google AI Overview, Google AI Mode et Gemini, regroupées par question, avec le cache contourné pour que chaque exécution soit un appel neuf. ChatGPT est délibérément absent : la voie utilisée ici ne renvoie aucune liste de sources pour lui, et un zéro produit par un instrument est indiscernable d’un zéro réel.
Où puis-je voir les lignes brutes ?
Dans notre registre de mesures, qui porte chaque question de cette étude avec son prompt tel qu’il a été posé, son marché, ses surfaces, son nombre d’exécutions et sa date, y compris les trois lignes exclues de l’analyse et la raison de chaque exclusion.
Ce que cela vous laisse
La question de départ était de savoir si un secteur possède un profil de stabilité. Il n’en possède pas. Deux questions à l’intérieur d’un même secteur peuvent être indiscernables dans un pays et séparées de 53 points dans un autre, et aucune moyenne sur « le voyage » ne vous aurait dit dans quel pays vous vous trouviez.
Pour quiconque rend compte de visibilité IA, cela se réduit à une seule instruction : mesurez la question sur laquelle votre client est réellement jugé, sur le marché où il vend réellement, et plus d’une fois. Tout le reste de cette page est la preuve que la version bon marché de cette instruction ne marche pas.
Et si vous trouvez un chiffre aussi haut que 96 %, vérifiez-le avant de célébrer. Le nôtre a survécu. Le meilleur chiffre de notre étude sur les agences n’a pas survécu, et la différence entre ces deux issues tient à une seule mesure répétée.
Interrogez une IA sur cet article
Ouvre votre assistant avec cette page déjà chargée, pour vérifier les chiffres, discuter la méthode ou demander ce que cela change pour vous.
- ChatGPT (ouvre un nouvel onglet. la question est pré-remplie, appuyez sur entrée pour l’envoyer)
- Claude (ouvre un nouvel onglet. la question est pré-remplie, appuyez sur entrée pour l’envoyer)
- Perplexity (ouvre un nouvel onglet)
- Google AI Mode (ouvre un nouvel onglet)
Perplexity et Google répondent directement. ChatGPT et Claude remplissent le champ et attendent que vous appuyiez sur entrée, ce qui relève de leur comportement et non du nôtre.