Wir haben die KI zweimal nach der besten GEO-Agentur in Deutschland gefragt: 36 zitierte Domains, zwei überleben beide Fragen
Zwei Formulierungen derselben Kauffrage, vier Oberflächen, 36 zitierte Domains. Nur zwei tauchen in beiden Fragen und auf mehreren Oberflächen auf.
Wir haben dieselbe Kauffrage zweimal gestellt, in zwei Formulierungen, die ein deutscher Einkäufer tatsächlich tippen würde, und sie an vier KI-Oberflächen gleichzeitig geschickt. Zurück kamen 36 verschiedene zitierte Domains. Zwei davon tauchen in beiden Fragen und auf mehr als einer Oberfläche auf.
Keine einzige Domain wurde von allen vier Oberflächen zitiert. Bei der ersten Frage schafften es zwei auf drei von vier, und beide gehören Agenturen, die in der Antwort selbst vorkommen.
Offenlegung: EchoWi verkauft Messung der KI-Sichtbarkeit und GEO-Beratung. Die hier genannten Agenturen sind in einem Teil dieses Geschäfts Wettbewerber. Beide Messungen sind eigene Durchläufe vom 7. August 2026, Land Deutschland und Sprache Deutsch bei jedem Aufruf explizit gesetzt, mit dem Prompt im Wortlaut in unserem Messregister. Wir zählen zitierte Domains, nie Markennennungen: das sind zwei verschiedene Ergebnisse.
Die kurze Fassung
- 36 verschiedene zitierte Domains über zwei Fragen und vier Oberflächen.
- Null Domains auf allen vier Oberflächen. Bei Frage 1 erreichten zwei drei von vier, bei Frage 2 keine einzige.
- Nur sechs Domains tauchen in beiden Fragen auf. Eine andere Formulierung derselben Kauffrage ist eine andere Messung.
- Gemini hat bei Frage 2 fünf Agenturen genannt und keine einzige Quelle zitiert. Genannt werden und zitiert werden sind nicht dasselbe.
- Die meistzitierten Seiten sind Agenturseiten, die sich in der eigenen Rangliste führen.
Was wir gefragt haben, und was zurückkam
| Frage 1 | Frage 2 | |
|---|---|---|
| Wortlaut | Welche ist die beste GEO-Agentur (Generative Engine Optimization) in Deutschland? | Welche Agentur für KI-Sichtbarkeit sollte ich in Deutschland beauftragen? |
| Oberflächen, die geantwortet haben | 4 von 4 | 4 von 4 |
| Zitierte Domains gesamt | 18 | 24 |
| ChatGPT | 3 | 1 |
| Gemini | 2 | 0 |
| Google AI Overview | 9 | 16 |
| Google AI Mode | 10 | 12 |
| Auf allen vier | 0 | 0 |
| Auf dreien | 2 | 0 |
| Auf zweien | 2 | 5 |
| Auf genau einer | 14 | 19 |
Beide Fragen enthalten keinen Markennamen. Eine Frage, die eine Agentur bereits nennt, misst deren Ruf und nicht, wen die KI von sich aus vorschlägt.
Die zwei Seiten, die es auf drei Oberflächen geschafft haben
Bei Frage 1 wurden zwei Domains von drei der vier Oberflächen zitiert:
sem-deutschland.de, zitiert von Gemini, AI Overview und AI Mode. Die Seite trägt den Titel «Beste GEO-Agenturen für Generative Engine Optimierung in Deutschland für 2026». Die Domain gehört Aufgesang, und das Inhaltsverzeichnis derselben Seite führt als Abschnitt 3 «LLMO-Agentur-Dienstleistungen für Generative Engine Optimierung (GEO) von Aufgesang». Gelesen am 7. August 2026.suchhelden.de, zitiert von Gemini, AI Overview und AI Mode. Es ist die Leistungsseite der Agentur Suchhelden zum Thema GEO.
Bei Frage 2 erreichte keine Domain drei Oberflächen. Fünf erreichten zwei: seowerk.de, bavaria-ai.com, youtube.com, suchhelden.de und claneo.com.
Zusammengenommen sind suchhelden.de und claneo.com die einzigen zwei Domains, die in beiden Fragen und auf mehr als einer Oberfläche zitiert wurden. Zwei von 36.
Die Antwort wird von Leuten geschrieben, die in ihr vorkommen
Das ist der Teil, den ein Einkäufer wissen sollte, bevor er eine dieser Listen liest. Drei der zitierten Quellen sind Ranglisten, die von einer Agentur veröffentlicht wurden, die selbst darin steht. Nachgelesen auf den Seiten selbst, am 7. August 2026:
| Zitierte Quelle | Was sie ist | Wer sie veröffentlicht |
|---|---|---|
sem-deutschland.de | «Beste GEO-Agenturen … für 2026» | Aufgesang, mit einem eigenen Leistungsabschnitt auf derselben Seite |
dreikon.de | Rangliste der besten SEO- und GEO-Agenturen 2026 | Dreikon, das in der eigenen Liste auf «Platz 1» steht |
finance-seo.de | Übersicht der besten GEO-Agenturen | Finance SEO, das in der eigenen Tabelle als Anbieter für die Finanzbranche geführt wird |
Wir nennen hier keine ihrer Werbeaussagen. Der Befund ist die Struktur, nicht die Formulierung: Wer die Rangliste schreibt, steht in der Rangliste, und die KI zitiert die Rangliste.
Dasselbe Muster haben wir im Werkzeugmarkt gemessen: von 27 Vergleichen von Werkzeugen für KI-Sichtbarkeit waren 22 von einem Anbieter geschrieben, der in der Liste steht, und mindestens elf setzen sich auf Platz eins oder zwei. Der deutsche Agenturmarkt macht es genauso. Zwölf Tage später haben wir die erste Google-Seite dieser Kaufanfrage systematisch geöffnet statt nur ihre Snippets gezählt, und vier von vier Ranking-Seiten stehen in ihrer eigenen Liste, drei davon an erster Stelle.
Gemini hat fünf Agenturen genannt und nichts zitiert
Bei Frage 2 antwortete Gemini mit einer Liste aus fünf namentlich genannten deutschen Agenturen und lieferte null Zitationen. Bei Frage 1 zitierte dieselbe Oberfläche zwei Domains.
Das ist kein Fehler, sondern ein Verhalten mit Folgen für die Messung. Eine Antwort ohne Quellen lässt sich nicht auf ihre Grundlage prüfen, und sie bewegt sich nicht dadurch, dass man auf einer zitierten Seite erscheint. Deshalb trennen wir in jeder Messung zwei Ergebnisse:
- Zitiert werden heißt, dass die Antwort auf eine bestimmte Seite gestützt wurde. Das ist nachprüfbar, und es ist der einzige Teil einer KI-Antwort, der noch einen Besuch schicken kann.
- Genannt werden heißt, dass der Name im Text steht. Das kann aus dem Modellgedächtnis kommen und hängt daran, was Dritte über die Marke geschrieben haben.
Wer beides in eine Zahl zusammenrechnet, bekommt einen Wert, der in beide Richtungen falsch sein kann.
Warum diese Frage in Deutschland teuer ist
Der Grund, warum wir diese Messung im deutschsprachigen Raum gemacht haben, steht in den Nachfragedaten. Gemessen am 7. August 2026, Land und Sprache jeweils explizit gesetzt:
| Suchbegriff | Deutschland | Österreich | Schweiz | CPC (DE) |
|---|---|---|---|---|
| geo agentur | 1.000 | 720 | 50 | 24,75 € |
| generative engine optimization | 1.300 | 170 | 260 | 7,79 € |
| geo optimierung | 1.000 | 110 | 70 | 10,63 € |
| llmo | 390 | 140 | 16,24 € | |
| geo tools | 210 | 11,73 € | ||
| ki suchmaschinenoptimierung | 90 | 10 | 10 | 21,82 € |
Zwei Dinge daran sind ungewöhnlich. Der Klickpreis für «geo agentur» liegt bei 24,75 €, und «ki suchmaschinenoptimierung» bei 21,82 €, was für eine Kategorie, die es vor zwei Jahren nicht gab, ein sehr reifer Markt ist. Und die Schwierigkeit ist trotzdem niedrig: «geo optimierung» steht bei einem Keyword-Difficulty-Wert von 0, «geo agentur» bei 5.
Ein Markt, in dem der Klick 25 € kostet und die organische Hürde bei null liegt, ist ein Markt, in dem noch niemand die vergleichende Seite geschrieben hat, die die Antwort braucht. Genau das zeigt auch die Messung oben: die Antwort greift auf Ranglisten zurück, und die Ranglisten schreiben die Anbieter selbst.
Was das für eine deutsche Agentur bedeutet
Eine Position ist keine Position. Es gibt keine Rangliste, in der man steht. Es gibt vier Oberflächen, die auf dieselbe Frage vier verschiedene Antworten mit fast disjunkten Quellenmengen geben. Bei zwei Formulierungen derselben Frage überschneiden sich die Quellen zu einem Sechstel.
Die eigene Leistungsseite reicht als Ziel nicht. suchhelden.de wird zitiert, weil dort eine ausführliche, vergleichende Seite zum Thema steht, nicht weil dort ein Angebot steht. Der Unterschied zwischen einer verkaufenden und einer vergleichenden Seite entscheidet in diesen Antworten häufiger als die Größe der Marke.
Wer misst, muss Land und Sprache setzen. Die meisten Werkzeuge dieser Kategorie sind auf die USA und Englisch voreingestellt und sagen es nicht. Eine deutsche Frage, ohne diese Einstellung gestellt, wird vom amerikanischen Markt beantwortet, und im Bericht steht nichts davon.
Und eine Messung ist eine Momentaufnahme. Das hier sind zwei Fragen an einem Tag. Es sind keine Raten und keine Trends, und wir stellen sie auch nicht so dar.
Was eine Agentur daraus als Angebot baut, steht getrennt: das GEO-Playbook für Agenturen beschreibt die Methode, das Lieferobjekt und die Preisbildung, und vor allem, was man nicht versprechen sollte.
Was wir nicht messen konnten
- Eine dritte Formulierung. Wir wollten «Wer kann meine Marke in ChatGPT und Perplexity sichtbar machen?» als drittes Muster laufen lassen. Der Aufruf lief in eine Zeitüberschreitung, und wir veröffentlichen zwei echte Fragen statt drei, von denen eine erfunden wäre.
- Perplexity und Claude. Unsere Messung liest ChatGPT, Gemini, Google AI Overview und Google AI Mode über ihre echten Oberflächen. Perplexity und Claude gehören nicht dazu, und wir behaupten nichts über sie.
- Wiederholungen je Oberfläche. Ein Durchlauf je Oberfläche und Frage. Das reicht, um zu zeigen, dass die Oberflächen sich nicht einig sind, und es reicht nicht für Prozentsätze. Vier oder fünf Wiederholungen trennen das Stabile vom Zufälligen, und die stehen für den nächsten Durchgang an.
- Ob die Agenturen gut sind. Diese Studie misst, wen die KI zitiert. Über Ergebnisse, Preise oder Qualität der genannten Agenturen sagt sie nichts.
Der Vergleich mit drei anderen Märkten
Wir haben dieselbe Kauffrage bereits in den Vereinigten Staaten, in Frankreich und in Spanien gestellt, jeweils über vier Oberflächen an einem Tag:
| Markt | Zitierte Domains | Auf vier | Auf drei | Auf zwei | Auf einer |
|---|---|---|---|---|---|
| Vereinigte Staaten | 20 | 0 | 0 | 5 | 15 |
| Frankreich | 19 | 0 | 0 | 4 | 15 |
| Spanien | 16 | 0 | 0 | 4 | 12 |
| Deutschland | 18 | 0 | 2 | 2 | 14 |
Deutschland ist der erste dieser vier Märkte, in dem überhaupt etwas drei Oberflächen erreicht hat. Das ist kein großer Vorsprung, aber es ist ein Unterschied, und er zeigt in eine bestimmte Richtung: In Deutschland gibt es bereits eine Ebene aus vergleichenden Inhalten über GEO-Agenturen, dicht genug, dass mehrere Oberflächen auf dieselben zwei Seiten zurückgreifen. In den anderen drei Märkten gibt es diese Ebene noch nicht.
Alle vier Messungen stehen mit Prompt, Markt, Datum und Zahl der Durchläufe in unserem Messregister. Wer die Fragen selbst stellt, bekommt eigene Antworten, und genau dafür veröffentlichen wir sie.
Wenn Sie dasselbe für Ihre eigenen Kauffragen wissen wollen, statt für unsere: das ist die Arbeit, die unsere Plattform macht. Ihre Fragen, ohne Ihren Markennamen darin, je Markt wiederholt, mit den Quellen hinter jeder Antwort.
Häufige Fragen zu GEO-Agenturen in Deutschland
Wer ist Marktführer bei GEO-Agenturen in Deutschland?
Darauf gibt es keine belastbare Antwort, und genau das ist das Ergebnis. Wir haben dieselbe Kauffrage in zwei Formulierungen an vier KI-Oberflächen geschickt, und zurück kamen 36 verschiedene zitierte Domains. Nur zwei davon überstanden beide Formulierungen auf mehr als einer Oberfläche. Wer eine Rangliste der führenden Agenturen sieht, sieht das Ergebnis einer einzelnen Formulierung an einem einzelnen Tag. Die brauchbarere Frage an eine Agentur lautet deshalb nicht, ob sie führend ist, sondern welche Quellen sie in Ihrem Markt nachweislich bearbeitet hat und woran sie das gemessen hat.
KI-Assistenten zitieren in unserem Markt immer dieselben Fachportale, in denen wir nicht vorkommen. Wer bringt uns dort hinein?
Der erste Schritt ist nicht die Agenturauswahl, sondern die Liste. Stellen Sie den Oberflächen, auf denen Ihre Käufer suchen, mehrfach dieselbe Kauffrage und notieren Sie jede zitierte Domain samt Häufigkeit. Was dabei entsteht, ist eine kurze und marktspezifische Liste von Fachportalen und Medien. In unserer Messung kamen auf dieselbe Frage 36 Domains zurück, und die meisten davon tauchten nur ein einziges Mal auf, waren also gar kein festes Ziel. Erst gegen eine solche Liste lässt sich beurteilen, ob eine Agentur die richtigen Quellen bearbeitet. Ohne sie kaufen Sie eine Maßnahme ohne Ziel. Das Erstellen der Liste ist von Hand möglich und dauert pro Frage einige Durchläufe; wer sie laufend und über mehrere Oberflächen führen will, misst sie mit einem Werkzeug, und genau das macht EchoWi.
Gilt das auch für den DACH-Raum und nicht nur für Deutschland?
Gemessen haben wir Deutschland auf Deutsch, und darauf beschränkt sich die Aussage. Österreich und die Schweiz sind eigene Antwortlandschaften und bräuchten ihre eigene Messung. Wie wenig sich solche Ergebnisse übertragen lassen, zeigt der Vergleich weiter oben: Die zitierten Quellen wandern kaum über Ländergrenzen, und wer eine deutsche Quellenliste für den DACH-Raum verwendet, arbeitet in zwei Dritteln des Raums gegen die falschen Ziele.
Ist eine LLMO-Agentur dasselbe wie eine GEO-Agentur?
In der Praxis meinen beide Begriffe dieselbe Arbeit, und die Wortwahl sagt eher etwas über das Alter der Website als über die Leistung. GEO steht für Generative Engine Optimization, LLMO für Large Language Model Optimization. Beide bezeichnen den Versuch, in generierten Antworten vorzukommen statt nur in der blauen Linkliste. Entscheidend ist nicht das Kürzel, sondern ob die Agentur Ihnen zeigt, welche Quellen die Oberflächen in Ihrem Markt tatsächlich zitieren, und ob sie dieselbe Frage mehr als einmal gestellt hat.
Welche GEO-Agentur ist die beste in Deutschland?
Keine der vier KI-Oberflächen hat eine benannt. Alle vier haben mit derselben Einschränkung geantwortet, dass es keine allgemein beste gibt, und danach unterschiedliche Listen geliefert. Über zwei Formulierungen der Frage wurden 36 verschiedene Domains zitiert und nur sechs davon in beiden.
Was ist eine GEO-Agentur?
Eine Agentur, die daran arbeitet, wie eine Marke in KI-generierten Antworten erscheint, in ChatGPT, Google AI Overviews, Gemini oder Perplexity. Der Unterschied zu klassischem SEO steht in unserem GEO-Glossar: SEO optimiert für sortierte Linklisten, GEO dafür, wie Informationen ausgewählt, zusammengefasst und zitiert werden.
Warum zitieren die KI-Oberflächen unterschiedliche Quellen?
Weil sie unterschiedlich abrufen. In dieser Messung zitierte Google AI Mode zehn Domains und ChatGPT drei, bei derselben Frage am selben Tag. Wer nur eine Oberfläche prüft und daraus verallgemeinert, berichtet über eine von vier Welten.
Kann man Sichtbarkeit in ChatGPT messen?
Ja, indem man ein festes Set von Fragen wiederholt stellt, Land und Sprache explizit setzt und festhält, welche Quellen die Antwort gebaut haben. Was man nicht bekommt, ist eine Position: es gibt keine Rangliste, nur die Antwort. Wie wir das aufschreiben, steht im Messregister.
Wie oft sollte man messen?
Öfter als einmal. Antworten schwanken zwischen identischen Anfragen, deshalb kann ein einzelner Durchlauf eine stabile Zitation nicht von einem Zufall unterscheiden. Vier oder fünf Wiederholungen je Frage und Oberfläche trennen das eine vom anderen, ohne genaue Prozentsätze zu liefern.
Wie vergleicht sich das mit anderen Märkten?
In den Vereinigten Staaten, in Frankreich und in Spanien erreichte bei derselben Frage keine einzige Domain drei der vier Oberflächen. In Deutschland waren es zwei, und beide gehören Agenturen. Die vollständigen Zahlen stehen in der Tabelle oben und im Messregister.
Fragen Sie eine KI zu diesem Artikel
Öffnet Ihren Assistenten mit dieser Seite bereits geladen, damit Sie die Zahlen prüfen, die Methode hinterfragen oder fragen können, was das für Sie bedeutet.
- ChatGPT (öffnet in neuem Tab. die Frage steht schon da, mit Enter abschicken)
- Claude (öffnet in neuem Tab. die Frage steht schon da, mit Enter abschicken)
- Perplexity (öffnet in neuem Tab)
- Google AI Mode (öffnet in neuem Tab)
Perplexity und Google antworten sofort. ChatGPT und Claude füllen das Feld und warten auf Ihr Enter, das ist ihr Verhalten und nichts, was wir einstellen können.