Zum Inhalt springen
AI VisibilityResearch
DE

Dieselbe Frage in drei Märkten, drei verschiedene Antworten

Wir fragten in den USA, Spanien und Frankreich, welches Werkzeug die ChatGPT-Sichtbarkeit misst. Keines wurde in mehr als einem Markt beständig empfohlen.

· 15 Min. Lesezeit

Wir haben Googles AI Overview dieselbe Frage in drei Märkten gestellt: welches Werkzeug soll ich nutzen, um die Sichtbarkeit meiner Marke in ChatGPT zu verfolgen? In den Vereinigten Staaten auf Englisch, in Spanien auf Spanisch, in Frankreich auf Französisch.

Zwölf Durchläufe. Die drei Märkte zitierten 16, 17 und 13 Domains, und sie überschneiden sich kaum. Kein einziges Werkzeug wurde in mehr als einem Markt beständig empfohlen.

Die französische Antwort nannte in jedem einzelnen Durchlauf einen freiberuflichen SEO-Berater aus Nizza, noch vor jeder finanzierten Plattform der Kategorie.

Offenlegung: EchoWi ist unser Produkt und tritt in dieser Kategorie an. Das ist ein Interessenkonflikt, und die Antwort auf einen Konflikt ist eine überprüfbare Methode statt eines Versprechens, neutral zu sein: die Frage, die Oberfläche, die Märkte, die Durchlaufzahlen und die Daten stehen alle oben, jedes davon lässt sich also gegen uns wiederholen.


Die kurze Fassung

  1. Kein Werkzeug erscheint stabil in mehr als einem Markt. Die stabilen Mengen überschneiden sich überhaupt nicht.
  2. Lokale Seiten dominieren lokal. Frankreichs Antwort besteht aus französischen Seiten. Spaniens aus spanischen. Die Vereinigten Staaten bekommen amerikanische.
  3. Kein einziger finanzierter Anbieter erschien, nirgends. Null über zwölf Durchläufe und drei Märkte für Profound, AirOps, Scrunch, Peec AI, Evertune und Semrush.
  4. In Frankreich schlug ein einzelner Berater die gesamte Kategorie, zitiert in jedem Durchlauf.
  5. Nur eine Domain kam einer Grenzüberschreitung nahe: seranking.com, stabil in zwei Märkten und bei 67 % im dritten.

Methode

FrageIn jeder Sprache dieselbe: welches Werkzeug eignet sich am besten, um die Sichtbarkeit einer Marke in ChatGPT zu verfolgen
OberflächeGoogles AI Overview
MärkteVereinigte Staaten und Englisch, Spanien und Spanisch, Frankreich und Französisch, alle ausdrücklich gesetzt
Durchläufe6 in den USA, 3 in Spanien, 3 in Frankreich
CacheUmgangen. Jeder Durchlauf ist ein frischer Aufruf
AusführungSeriell
Daten5. und 6. August 2026

Den Markt ausdrücklich zu setzen ist das ganze Experiment. Messwerkzeuge stellen standardmäßig auf die Vereinigten Staaten und Englisch. Lässt man das so, wird eine französische Frage vom amerikanischen Markt beantwortet, und nichts im Bericht sagt es Ihnen. Das hätte drei identische Ergebnisse und eine völlig falsche Schlussfolgerung erzeugt.

Die Einschränkung, klar gesagt: die Frage handelt von ChatGPT, gemessen wird aber Googles AI Overview. Das ist eine der Arten, wie Menschen diese Frage recherchieren, nicht die einzige. Die US-Stichprobe ist doppelt so groß wie die beiden anderen.


Das Ergebnis nebeneinander

Vereinigte StaatenSpanienFrankreich
Durchläufe633
Zitierte Domains161713
In jedem Durchlauf zitiert534
Genau einmal zitiert8127
in jedem Durchlauf zitiertverschiedene zitierte DomainsVereinigte Staaten, 6 Durchläufe5 → 16Spanien, 3 Durchläufe3 → 17Frankreich, 3 Durchläufe4 → 13
Wie viel der zitierten Menge jedes Marktes stabil ist. Der linke Punkt sind die in jedem einzelnen Durchlauf zitierten Domains, der rechte jede überhaupt zitierte Domain. Googles AI Overview, Land und Sprache ausdrücklich gesetzt, 5. und 6. August 2026.
In jedem Durchlauf zitierte Domains gegen alle verschiedenen zitierten Domains, für die Vereinigten Staaten, Spanien und Frankreich
in jedem Durchlauf zitiertverschiedene zitierte Domains
Vereinigte Staaten, 6 Durchläufe516
Spanien, 3 Durchläufe317
Frankreich, 3 Durchläufe413

Und die in jedem Durchlauf zitierten Domains, wo das Ergebnis wohnt:

Vereinigte StaatenSpanienFrankreich
reddit.comuseomnia.cominvox.fr
seranking.comsurfeo.airedback-optimisation.fr
youtube.comblog.hubspot.esseranking.com
siftly.aiyoutube.com
alhena.ai

Sehen Sie sich gezielt die Werkzeuge an. Die Vereinigten Staaten bekommen siftly.ai und alhena.ai. Spanien bekommt useomnia.com und surfeo.ai. Frankreich bekommt keines der beiden Paare. Zwischen keinen zwei dieser drei Listen gibt es ein gemeinsames Werkzeug.

Die einzige Domain, die sich Beständigkeit nähert, ist seranking.com, eine SEO-Suite und kein Werkzeug für KI-Sichtbarkeit: stabil in den Vereinigten Staaten und Frankreich und bei 67 % in Spanien.


Zwei Tage später erneut gelaufen, und die Form hielt, die Namen nicht

Am 7. August 2026 haben wir alle drei Märkte erneut gemessen. Die Summe bewegte sich kaum:

Veröffentlicht, 5. bis 6. AugustErneut gemessen, 7. August
Vereinigte Staaten6 Durchläufe, 16 Domains, 5 stabil4 Durchläufe, 23 Domains, 3 stabil
Spanien3 Durchläufe, 17 Domains, 3 stabil3 Durchläufe, 17 Domains, 3 stabil
Frankreich3 Durchläufe, 13 Domains, 4 stabil3 Durchläufe, 13 Domains, 3 stabil

Spanien lieferte zweimal dieselbe Zahl: siebzehn Domains, drei davon in jedem Durchlauf. Frankreich lieferte beide Male dreizehn Domains. Sähen Sie nur auf die Gesamtzahlen, würden Sie schließen, diese Messung sei hoch reproduzierbar.

Sehen Sie nun, welche Domains das waren.

Stabil am 6. AugustStabil am 7. August
Spanienuseomnia.com, surfeo.ai, blog.hubspot.esacumbamail.com, blog.hubspot.es, youtube.com
Frankreichinvox.fr, redback-optimisation.fr, seranking.com, youtube.comseranking.com, invox.fr, meltwater.com

Eine von Spaniens dreien überlebte. Beide spanischen Werkzeuge fielen heraus, und die Ersatzmenge enthält überhaupt kein Werkzeug für KI-Sichtbarkeit: eine E-Mail-Marketing-Firma, ein HubSpot-Blog und YouTube.

Wir haben Frankreich am selben Tag ein zweites Mal laufen lassen, in einer getrennten Sitzung. Es lieferte erneut eine dritte Antwort: seranking.com und dageno.ai stabil, meltwater.com abwesend, redback-optimisation.fr in einem von zwei Durchläufen. Über alle drei bisher erfassten französischen Sitzungen hinweg ist genau eine Domain in allen stabil, seranking.com.

Das ist das nützliche Ergebnis, und es ist nicht das, was wir zuerst veröffentlicht haben. Größe und Form der Antwort sind reproduzierbar. Die Zusammensetzung nicht. Ein Anbieter, der meldet, Sie seien in 100 % der Durchläufe zitiert worden, beschreibt diese Sitzung, und unsere eigenen Zahlen sagen, dass die nächste Sitzung ihr widersprechen wird.

Was wir methodisch falsch gemacht haben: die Studie oben beschrieb ihre Fragen, veröffentlichte aber nie die exakten Zeichenketten. Das hier ist also eine Neumessung derselben Frage und keine strenge Replikation, und wir haben seither gezeigt, dass eine Umformulierung fast jede zurückgegebene Quelle ändert. Jede Messung, die wir jetzt veröffentlichen, hält den Prompt wörtlich fest, mit Markt, Oberfläche, Datum und Durchlaufzahl, in unserem Messregister.

Zwei Dinge weiter unten müssen ebenfalls dagegen markiert werden. siftly.ai, in den Vereinigten Staaten stabil, erschien am 7. August in zwei von drei französischen Durchläufen, was einer Grenzüberschreitung am nächsten kommt. Und tryprofound.com erschien einmal in Frankreich, die Behauptung weiter unten, dass nirgends ein finanzierter Anbieter auftauchte, gilt also für die ursprünglichen zwölf Durchläufe und nicht mehr allgemein.

Frankreich empfahl einen Freiberufler

Das ist das auffälligste Einzelergebnis der Studie und zugleich dasjenige, das die Neumessung nicht überstanden hat. Lesen Sie es zusammen mit dem Abschnitt darüber.

redback-optimisation.fr wurde in allen drei französischen Durchläufen zitiert. Die Domain gehört einem freiberuflichen SEO-Berater mit Sitz in Nizza, der französischsprachigen Unternehmen Audits und laufende Optimierung anbietet.

Eine Person, in Nizza, in jedem Durchlauf zitiert, noch vor jedem Unternehmen dieser Kategorie mit einer Series A.

Und in fünf weiteren französischen Durchläufen am 7. August wurde diese Domain in einem zitiert. Null in der Sitzung mit drei Durchläufen, eins in der mit zweien. Die ursprüngliche Beobachtung war echt und wir ziehen sie nicht zurück; drei Durchläufe können «immer» schlicht nicht von «manchmal» unterscheiden, was das ganze Argument des Abschnitts darüber ist. Sagen lässt sich weiterhin die schwächere und haltbarere Fassung: ein unabhängiger Berater wurde von dieser Oberfläche überhaupt zitiert, wiederholt, in einer Kategorie, in der finanzierte Plattformen es nicht wurden.

Die andere in jedem Durchlauf zitierte französische Domain, invox.fr, gab auf unsere Anfrage einen 403 zurück, wir können also nicht beschreiben, worum es sich handelt. Wir führen sie auf, weil sie zitiert wurde, und beschreiben sie nicht, weil wir sie nicht prüfen konnten.


Niemand mit Finanzierung erschien, in keinem Markt

Über zwölf Durchläufe in drei Märkten erschienen die folgenden null Mal:

AnbieterEingesammelt oder bewertet mit
Profound155 Mio. $+ eingesammelt, 1 Mrd. $ Bewertung
AirOps~118 Mio. $ eingesammelt
ScrunchÜbernommen für berichtete 225 Mio. $
Peec AI29,1 Mio. $ eingesammelt
Evertune19 Mio. $ eingesammelt
SemrushBörsennotiert

Wir sind mit der Erwartung angetreten, die finanzierten Anbieter würden zumindest ihren Heimatmarkt dominieren. Sie erschienen dort überhaupt nicht.


Was das bedeutet

  1. Ein Vergleichsartikel, der in einem Markt geschrieben wurde, beschreibt keinen anderen. Wenn Sie in Frankreich ein Werkzeug auswählen, beschreibt eine englischsprachige Liste der besten GEO-Werkzeuge eine andere Antwort auf Ihre Frage. Die Werkzeuge, die die KI Ihres eigenen Marktes empfiehlt, stehen nicht darauf.

  2. Sprache ist kein Übersetzungsproblem, sondern ein Abrufproblem. Das deckt sich mit Veröffentlichtem: in Temsos Analyse von über 7 Millionen Zitaten wurden französische Prompts in AI Overviews zu 82,1 % mit französischsprachigen Quellen beantwortet. Unsere drei Märkte sind eine viel kleinere Stichprobe, die in dieselbe Richtung zeigt.

  3. Größe ist nicht der Vorteil, den man annimmt. Ein Berater in Nizza und zwei Werkzeuge, über die in der Branche niemand spricht, schlugen jede finanzierte Plattform. Der Abruf weiß nicht, wie hoch irgendjemand bewertet ist.

  4. Wer in mehreren Märkten verkauft, hat mehrere Sichtbarkeitsprobleme. Nicht ein Problem, gemessen aus der Zentrale. Das ist die praktische und teure Folgerung, und der Grund, warum wir bei jeder veröffentlichten Messung Land und Sprache ausdrücklich setzen.


Der Fehler, der all das verdeckt hätte

Diese Studie existiert wegen einer einzigen Einstellung, und es lohnt sich, dabei konkret zu werden, denn sie falsch zu setzen erzeugt ein Ergebnis, das vollkommen gesund aussieht.

Fast jedes Messwerkzeug dieser Kategorie stellt standardmäßig auf die Vereinigten Staaten und Englisch. Dieser Standard wird im Bericht nicht angekündigt. Stellen Sie eine spanische Frage, ohne ihn zu ändern, und die Antwort kommt aus dem amerikanischen Markt, identisch formatiert wie ein spanisches Ergebnis, ohne dass irgendetwas am Bildschirm den Unterschied kennzeichnet.

Hätten wir den Standard gelassen, hätten alle drei Durchläufe ungefähr dieselben amerikanischen Domains geliefert, und der ehrliche Schluss wäre das Gegenteil des wirklichen gewesen: dass die KI überall dieselben Werkzeuge empfiehlt und eine Messung Sie also abdeckt. Dieser Schluss wäre bequem, billig und falsch gewesen.

Was Sie in jedem Bericht prüfen sollten, ob in unserem oder dem eines Anbieters:

  1. Welches Land und welche Sprache gesetzt waren. Sagt der Bericht es nicht, nehmen Sie den Standard an.
  2. Ob jeder Markt getrennt gelaufen ist. Ein Durchschnitt über vier Märkte kann verbergen, dass Sie in dreien unsichtbar sind.
  3. Wie viele Durchläufe hinter der Zahl stehen. Antworten schwanken zwischen identischen Anfragen, ein Durchlauf ist also eine Ziehung und keine Rate.
  4. Ob der Cache umgangen wurde. Eine gecachte, fünfmal wiederholte Antwort ist eine Messung, fünfmal gezeigt.
  5. Welche Domains zitiert wurden, nicht nur, ob Sie genannt wurden. Das ist der Teil, an dem Sie arbeiten können.

Nichts davon ist teuer zu erfragen, und ein Werkzeug, das es nicht beantworten kann, produziert eine Zahl, die niemand verteidigen kann.


Seit der Veröffentlichung haben wir dieselbe Form zweimal weiter gefunden

Der naheliegende Einwand gegen die Studie oben lautet, GEO-Software sei eine seltsame, winzige Kategorie und nichts hier lasse sich verallgemeinern. Also haben wir dasselbe Design in zwei Branchen laufen lassen, die nichts damit zu tun haben.

Flüge, und eine Korrektur. Dieser Abschnitt berichtete ursprünglich, die amerikanische Flugantwort zitiere 6 Domains, von denen nur Reddit jedes Mal erscheine, und keine Buchungsseite werde in fünf Durchläufen mehr als einmal zitiert. Mit dem korrigierten Instrument am 7. August 2026 erneut gemessen, lieferte dieselbe Frage 6 zitierte Domains, und alle sechs erschienen in jedem Durchlauf. Die Instabilität war nicht da. Sie kam von einem Skript, das die Suchen hinter einer Antwort zusammen mit den tatsächlich zitierten Quellen zählte, was die Domainliste mit einmaligen Einträgen aufblähte.

Die korrigierte Zahl ist registriert, und der vollständige Vergleich über Kategorien steht in unserer Studie dazu, wie stabil KI-Antworten sind, wo Flugbuchung bei den stabilsten Kategorien liegt, die wir gemessen haben, und nicht bei den instabilsten.

Universitäten. Wir haben gefragt, welches die besten privaten Universitäten in Madrid sind, fünf Durchläufe, und welches die besten Universitäten in Paris sind, drei Durchläufe. Beide nannten jedes Mal die Einrichtung, die wir verfolgten. Keine zitierte in ihrer stabilen Menge auch nur eine einzige Universitätswebsite. Die Quellen, die beide Fragen beantworteten, waren Studentenwohnheime, eine Sprachschule, eine Relocation-Agentur und Bildungsverzeichnisse.

Drei Branchen, vier Länder, drei Sprachen, und die Form hält:

Stabile Zitate gingen an
GEO-Software, USAReddit, YouTube, zwei Werkzeuge, über die niemand spricht
GEO-Software, FrankreichEinen unabhängigen Berater in Nizza
Flugbuchung, SpanienZwei Metasuchmaschinen, Reddit, Instagram, TikTok
Flugbuchung, USASechs Domains, jede einzelne in jedem Durchlauf
Universitäten, MadridZwei Studentenwohnheime und eine Beratungsplattform
Universitäten, ParisEine Sprachschule, eine Relocation-Agentur, eine Nachhilfefirma

Das Muster ist nicht, dass große Marken verlieren. Es ist, dass die stabilen Zitate an denjenigen gehen, der Inhalte veröffentlicht hat, die vergleichen, erklären oder diskutieren, und das ist selten das Unternehmen, dessen Produkt verglichen wird. Ein Buchungsformular, ein Lehrplan und eine Produktseite haben für eine Abrufschicht nichts zu extrahieren, welche Marke auch immer darauf steht.

Hier stand einmal ein zweites Muster, und es war falsch. Wir berichteten, die amerikanische Antwort sei in beiden Kategorien weniger stabil als die europäische, und bauten darauf eine Hypothese über umkämpfte Märkte, in denen der Abruf ohne entscheidende Antwort bleibt. Dieses Muster war ein Artefakt des oben beschriebenen Zählfehlers. Erneut gemessen ist die amerikanische Flugantwort vollkommen stabil: sechs Domains, alle sechs in jedem Durchlauf.

Die Hypothese überlebte in anderer Form, die wir seither ordentlich über sechs Kategorien geprüft haben. Instabilität folgt nicht dem Markt. Sie folgt der Kategorie: gesetzte Produktkategorien liefern jedes Mal dieselben Quellen, während professionelle Dienstleistungen und aufkommende Softwarekategorien bei fast jedem Durchlauf eine andere Teilmenge liefern. Das ist eine eigene Studie mit eigenen Daten, und das ist die Fassung, die wir heute verteidigen würden.


Was das nicht zeigt

  • Nichts über Produktqualität. Ein Zitat ist keine Rezension. Ein kontrollierter Genauigkeitsvergleich der Werkzeuge dieser Kategorie ist von niemandem veröffentlicht worden, von uns eingeschlossen.
  • Nichts Kausales. Eine Übersicht über 45 GEO-Studien vom Juli 2026 fand keine Technik mit nachgewiesener kausaler, stabiler, plattformübergreifender Wirkung. Zwölf Durchläufe ändern das nicht.
  • Nichts über andere Oberflächen. Das ist Googles AI Overview. ChatGPT, Perplexity und Gemini bräuchten jeweils ihre eigene Messung.
  • Nichts Dauerhaftes. Das sind Antworten an drei Tagen im August 2026, und die Neumessung oben zeigt, wie sich die Zusammensetzung zwischen zweien davon bewegt. Wiederholen Sie es in einem Monat und rechnen Sie mit Bewegung.

Häufige Fragen zu dieser Studie

Welche Werkzeuge empfiehlt Googles KI zum Verfolgen der ChatGPT-Sichtbarkeit?

Das hängt vollständig vom Markt ab und vom Tag. Am 6. August wurden siftly.ai und alhena.ai in jedem US-Durchlauf zitiert, useomnia.com und surfeo.ai in jedem spanischen, und keines der beiden Paare in Frankreich. Am 7. August enthielt die spanische stabile Menge überhaupt kein Werkzeug. Behandeln Sie jede Antwort auf diese Frage als Momentaufnahme, auch diese.

Warum unterscheiden sich die Antworten so stark zwischen Ländern?

Der Abruf zieht stark zu Quellen in der Sprache der Frage, was über Engines und Sprachen hinweg dokumentiert ist. Eine französische Frage wird weitgehend aus dem französischsprachigen Web beantwortet, wo ein anderer Satz von Seiten existiert.

Sind zwölf Durchläufe genug, um das zu schließen?

Sie genügen, um festzustellen, dass sich die stabilen Mengen nicht überschneiden, was die aufgestellte Behauptung ist. Für genaue Raten genügen sie nicht, und die US-Stichprobe ist doppelt so groß wie die anderen. Jeder Durchlauf wird abgerechnet und seriell ausgeführt, Stichprobengröße hat also reale Kosten.

Die Neumessung hat das geschärft. Zwölf Durchläufe genügten für die Summe, die sich fast exakt reproduzierte, und nicht für irgendeine Aussage über eine bestimmte Domain: drei Durchläufe nannten eine Quelle «in jedem Durchlauf zitiert», die fünf spätere Durchläufe einmal zitierten. Durchläufe innerhalb einer Sitzung sagen etwas über diese Sitzung. Um zu behaupten, eine Domain werde dauerhaft zitiert, brauchen Sie Sitzungen an verschiedenen Tagen, was ein anderes und teureres Design ist als das, was in dieser Kategorie derzeit verkauft wird.

Warum erschien kein finanzierter Anbieter?

Die Messung kann es nicht mit Sicherheit sagen. Die wahrscheinlichste Erklärung, und die von veröffentlichter Forschung am besten gestützte, ist, dass der Abruf Seiten bevorzugt, die die Frage direkt beantworten, und Anbieter-Marketingseiten geschrieben sind, um zu verkaufen, nicht um zu antworten. Finanzierung kauft Vertriebskapazität, die eine Abrufschicht nicht sehen kann.

Sollte ich ein Werkzeug danach auswählen, was die KI empfiehlt?

Nein. Zwei der fünf stabilen US-Domains waren überhaupt keine Produkte, und die französische Antwort nannte einen Berater statt Software. Nutzen Sie es, um zu verstehen, was Ihren Käufern erzählt wird, nicht als Auswahlliste.

Kann ich das reproduzieren?

Ja. Die Frage, die Oberfläche, die Märkte, die Sprachen, die Durchlaufzahlen und die Daten stehen alle oben. Bekommen Sie eine andere Antwort, liegt es daran, dass sich das Modell geändert hat oder dass Sie den Markt nicht ausdrücklich gesetzt haben.


Wo Sie das hinstellt

Das Ergebnis, das wir nicht erwartet hatten, war die Abwesenheit, nicht die Anwesenheit. Sechs Unternehmen, die zusammen mehr als 200 Millionen Dollar halten, erschienen null Mal, über zwölf Durchläufe und drei Märkte, bei der Anfrage, die ihr eigenes Produkt beschreibt.

Und an dem Tag, an dem wir maßen, war der Gewinner in Frankreich eine Person mit einem Laptop in Nizza.

Wenn Sie versuchen, von diesen Systemen empfohlen zu werden, ist das entweder das ermutigendste Ergebnis dieses Artikels oder das alarmierendste, je nachdem, auf welcher Seite Sie stehen. Die Neumessung hat eine dritte Lesart ergänzt, und das ist die, nach der wir tatsächlich handeln würden: die Position ist zu gewinnen und nicht zu halten. Eine Quelle, der eine Frage diese Woche gehört, ist nicht die Quelle, der sie nächste Woche gehört, und die praktische Antwort darauf ist, planmäßig zu messen statt einen Screenshot zu feiern.

Wir haben dieses Design seither über sechs Kategorien laufen lassen, um herauszufinden, ob die Fluktuation eine Eigenschaft von KI-Antworten oder eine Eigenschaft dieser Kategorie ist. Es ist die Kategorie: manche Kategorien zitieren jedes Mal dieselben Quellen, und unsere gehört nicht dazu.

Fragen Sie eine KI zu diesem Artikel

Öffnet Ihren Assistenten mit dieser Seite bereits geladen, damit Sie die Zahlen prüfen, die Methode hinterfragen oder fragen können, was das für Sie bedeutet.

Perplexity und Google antworten sofort. ChatGPT und Claude füllen das Feld und warten auf Ihr Enter, das ist ihr Verhalten und nichts, was wir einstellen können.

Geschrieben von

Maher El Ouahabi

CTO und Mitgründer von EchoWi

Baut die Software, die Marken zeigt, was KI wirklich über sie sagt, und was zu ändern ist, damit die nächste Antwort besser ausfällt. Zwölf Engines, vorher und nachher gemessen.

LinkedIn Maher El Ouahabi (öffnet in neuem Tab)