Zum Inhalt springen
KI-SichtbarkeitGEO
DE

Jede Messung, die wir veröffentlicht haben, wurde auf einer einzigen Oberfläche genommen. Wir haben dieselben fünf Fragen auf einer zweiten gestellt.

Die Oberfläche zu wechseln kostet mehr als den Tag: Median-Überschneidung der Quellen 0,40 gegen 0,63 über zwei Tage, bei identischen Fragen.

· Aktualisiert · 19 Min. Lesezeit

Jede Zeile in unserem Messregister wurde auf Googles AI Overview genommen. Das ist die größte Grenze von allem, was wir veröffentlicht haben, denn ein Befund darüber, wie sich Kategorien unterscheiden, könnte ein Befund darüber sein, wie ein einziges Produkt abruft. Also haben wir die fünf Kauffragen aus unserer Studie über abgeglichene Kategorien genommen und sie erneut auf AI Mode gestellt: derselbe Markt, dieselben drei Durchläufe, dieselbe Regel dafür, was als Anbieter zählt, und nichts verändert außer der Oberfläche. Die Median-Überschneidung zwischen den beiden Mengen dauerhafter Quellen beträgt 0,40. Dieselbe Frage zwei Tage später ergibt 0,63. Die Oberfläche kostet mehr als der Tag.

Eine der fünf Kategorien teilt überhaupt keine dauerhafte Quelle zwischen den beiden Oberflächen, eine zweite liefert auf der neuen Oberfläche gar keine dauerhafte Quelle, und die beiden Oberflächen sind sich nicht einig, welche Kategorie Anbietern am freundlichsten ist.

Transparenz: EchoWi verkauft Messung von KI-Sichtbarkeit, und dieser Text setzt eine Zahl auf den schwächsten Teil unserer eigenen veröffentlichten Arbeit, was ein Verkäufer lieber vage ließe. Die fünf Fragen stehen in unserem Messregister, mit jedem Domain, den jede Oberfläche zurückgab, der Vergleich lässt sich also gegen uns wiederholen.


Die kurze Fassung

  1. Die Median-Überschneidung zwischen AI Overview und AI Mode beträgt 0,40, über die sechs Zellen in zwei Märkten, in denen beide Oberflächen alle drei Durchläufe beantworteten.
  2. Das ist schlechter als zwei Tage. Dieselben Fragen mit zwei Tagen Abstand auf einer Oberfläche ergaben einen Median von 0,63, und zwei Lesungen am selben Nachmittag ergeben 0,67 bis 0,70.
  3. Eine Kategorie teilt nichts. Onlineshop-Plattformen liefern auf jeder Oberfläche vier dauerhafte Domains, und keiner davon steht auf beiden Listen.
  4. Die Extreme überleben, die Reihenfolge nicht. Webhosting und Onlineshops geben Anbietern auf beiden Oberflächen null dauerhafte Plätze. Aber Buchhaltung ist auf AI Overview die anbieterfreundlichste Kategorie und CRM ist es auf AI Mode, die von uns veröffentlichte Reihenfolge überträgt sich also nicht.
  5. Und eine leere dauerhafte Menge ist eine Eigenschaft einer Lesung, nicht der Oberfläche. Vier Zellen lieferten auf AI Mode beim ersten Mal nichts Dauerhaftes. Erneut gefragt, kamen alle vier mit einer Menge zurück, eine Aussage, die wir darauf gestützt veröffentlicht hatten, ist weiter unten zurückgezogen.

Warum das die Studie war, die anstand

Unser Register enthält jede Messung hinter allem auf diesem Blog, und bis heute trug jede dieser Zeilen denselben Wert in der Spalte Oberfläche. Der Grenzen-Abschnitt jeder Studie sagt das. Was keine sagen konnte, ist, was es kostet.

Die Studie über abgeglichene Kategorien ist das Stärkste, was wir haben: fünf Kauffragen in sechs Märkten, mit einem Gefälle von Webhosting bei 1 Anbieterplatz von 27 bis zu Buchhaltungssoftware bei 14 von 37. Wenn dieses Gefälle eine Eigenschaft des Abrufs von AI Overview ist und nicht der Kategorien, dann ist der darauf gebaute praktische Rat ein Rat über ein einziges Google-Produkt.

Also: dieselben fünf Fragen, derselbe Markt, dieselben drei Durchläufe, dieselbe Anbieterregel, und nur die Oberfläche ändert sich.

Der Vergleich

KategorieAI OverviewAI ModeGeteilt
Webhosting0 von 50 von 20,40
Onlineshop-Plattformen0 von 40 von 40,00
CRM2 von 73 von 90,60
Lohnabrechnung5 von 11keine dauerhafte Mengenicht vergleichbar
Buchhaltungssoftware6 von 133 von 120,39

Die ersten beiden Spalten sind von Anbietern gehaltene Plätze von den dauerhaften Plätzen. Die letzte ist die Überschneidung zwischen den beiden Mengen dauerhafter Domains, und das ist die Zahl, auf die es ankommt, denn ein Anteil kann übereinstimmen, während die Quellen darunter komplett wechseln. Jede Zelle dieser und der nächsten Tabelle ist die erste Lesung dieser Frage, und das zählt vor allem für die als nicht vergleichbar markierten Zellen: sie wurden alle erneut gefragt, und was zurückkam, steht zwei Abschnitte weiter unten.

Sechs Zellen sind vergleichbar. Die Median-Überschneidung beträgt 0,40, die Spanne 0,00 bis 0,60.

Der zweite Markt, und der Befund, der keinen Median braucht

Vier vergleichbare Zellen sind dünn, also haben wir dasselbe Design in Spanien gefahren: die fünf spanischen Kauffragen, die auf AI Overview schon im Register standen, erneut auf AI Mode gestellt, am selben Tag, in drei Durchläufen.

KategorieAI OverviewAI ModeGeteilt
Webhosting0 von 3keine dauerhafte Mengenicht vergleichbar
Onlineshop-Plattformen1 von 3keine dauerhafte Mengenicht vergleichbar
CRM1 von 60 von 30,50
Lohnabrechnung2 von 6keine dauerhafte Mengenicht vergleichbar
Buchhaltungssoftware5 von 70 von 50,09

Spaniens eigener Median liegt bei 0,29 auf zwei Zellen, und beide Märkte zusammen lassen die Schlagzeile genau dort, wo sie war: 0,40 über sechs Zellen. Der zweite Markt hat den ersten reproduziert statt ihn zu retten.

Bei der ersten Lesung lieferten vier der zehn AI-Mode-Zellen gar keine dauerhafte Menge, gegenüber keiner auf AI Overview, und wir haben das als den Befund veröffentlicht, der keinen Median braucht. Wir haben alle vier erneut gefragt. Alle vier kamen mit einer dauerhaften Menge zurück, dieser Befund ist damit zurückgezogen. Die US-Lohnabrechnung ging von null auf zwölf, und diese zwölf sind genau die Domains, die beim ersten Mal in zwei von drei Durchläufen waren. Die spanische Lohnabrechnung ging von null auf fünf, spanisches Hosting auf zwei, spanische Onlineshops auf zwei.

Die leere Menge war also eine Eigenschaft eines Nachmittags und nicht der Oberfläche, und die ehrliche Fassung ist enger: AI Mode erreicht die strenge Latte weniger zuverlässig als AI Overview, und das ist eine Aussage darüber, es einmal zu lesen. Wer aus einer einzigen Lesung dieser Oberfläche eine leere Menge meldet, meldet die Lesung.

Was die Wiederholungen stattdessen taten, war die Zahl zu stärken, bei der wir vorsichtig waren. Nimmt man von jeder Zelle die bessere Lesung, gibt es zehn vergleichbare Zellen statt sechs, und die gebündelte Median-Überschneidung liegt bei 0,33, Spanne 0,00 bis 0,60. Niedriger als die 0,40 aus sechs Zellen, auf mehr Daten, und weiterhin weit unter den 0,63, die zwei Tage auf einer Oberfläche kosteten.

Und die schärfste einzelne Zelle ist die spanische Buchhaltung. Auf AI Overview ist sie die anbieterfreundlichste Zelle der ganzen Studie, 5 von 7 dauerhaften Plätzen in der Hand von Firmen, die Buchhaltungssoftware verkaufen. Auf AI Mode liefert dieselbe Frage am selben Tag fünf dauerhafte Domains, und keiner davon verkauft Buchhaltung: ein Rechnungsdaten-Extraktor, ein Software-Vergleichsportal, ein Hosting-Anbieter, ein ERP und YouTube. Die Überschneidung liegt bei 0,09.

Was diese Zahl neben denen bedeutet, die wir schon hatten

Wir haben zwei weitere Messungen derselben Form, und zum ersten Mal passen alle drei in eine Tabelle.

Was sich änderteMedian-Überschneidung
Nichts, zwei Lesungen am selben Nachmittag0,67 bis 0,70
Zwei Tage, dieselbe Oberfläche0,63
Die Oberfläche, derselbe Tag0,40

Eine Prüfung gehört neben diese Tabelle, denn ein Jaccard teilt durch die Vereinigung und stellt damit eine kleine Menge, die in einer großen steckt, als Uneinigkeit dar. Über die 6 Zellen, in denen beide Oberflächen eine dauerhafte Menge lieferten, liegt das mediane Größenverhältnis bei 1,3 und das größte bei 2,5, also sind das vergleichbare Mengen und die 0,40 sagt, was sie zu sagen scheint.

Die Oberfläche ist also die größte der drei, und sie ist genau die, die jedes Dashboard dieser Kategorie zusammenfaltet. Ein Produkt, das „deine KI-Sichtbarkeit“ als eine einzige Zahl meldet, mittelt über Quellen, die weniger miteinander übereinstimmen als dieselbe Quelle zwei Tage später mit sich selbst.

Die Kategorie, die nichts teilt, und die Kontrolle, die daraus einen Befund macht

Onlineshop-Plattformen liefern vier dauerhafte Domains auf AI Overview und vier auf AI Mode, und die Schnittmenge ist leer. AI Overview gibt Reddit, YouTube, Zapier und eine Design-Galerie. AI Mode gibt eine Nachkauf-Logistikplattform, einen Ratgeber zum Webseitenbau und zwei Entwicklungsagenturen.

Diese Null ist die Zahl dieser Studie, die am meisten Zweifel verdient, also haben wir die AI-Overview-Seite am selben Nachmittag noch einmal gelesen. Alle vier Domains des Registers kamen zurück, plus einer. Die Grundlinie war nicht veraltet, und die Null liegt zwischen Oberflächen und nicht zwischen Tagen.

Die Reihenfolge überträgt sich nicht, und das ist eine echte Korrektur

Unser Text über abgeglichene Kategorien veröffentlicht die Reihenfolge der Kategorien als den exportierbaren Befund, mit der Begründung, dass die Rate lokal ist und die Reihenfolge über sechs Märkte gereist ist. Über Oberflächen reist sie nicht.

Auf AI Overview ist Buchhaltung mit 6 von 13 die anbieterfreundlichste Kategorie. Auf AI Mode ist es CRM mit 3 von 9, und Buchhaltung fällt auf 3 von 12. Die Aussage, die beides übersteht, ist enger und weiterhin nützlich: die Kategorien, in denen Anbieter nichts bekommen, bekommen auf beiden Oberflächen nichts, und Webhosting und Onlineshops sind zweimal null.

Die leere Menge, die eine Stunde später nicht leer war

Dreizehn Domains wurden über die drei AI-Mode-Durchläufe zitiert, und keiner erschien in allen dreien. Das ist nicht die Oberfläche, die nicht antwortet, und deshalb lohnt es sich, es genau zu sagen: alle drei Durchläufe lieferten eine Antwort mit Zitaten darin, und keine Quelle war in jedem.

Wir haben genau diese Form schon gesehen. In unserer Arbeit über zwei Tage lieferte eine Frage zu E-Mail-Marketing an einem Nachmittag nichts Dauerhaftes und eine Stunde später sieben Domains, und diese sieben waren genau die Quellen, die in zwei von drei Durchläufen gewesen waren. Eine strenge Latte und ein wandernder Abruf erzeugen eine leere Menge, ohne dass etwas kaputt ist. Dieselbe Frage danach achtmal gelesen zeigt, was das Wandern tatsächlich ist: die Quellen flackern nicht, einer von fünf bis acht Durchläufen antwortet anders, und die strenge Latte lässt sie alle auf einmal fallen, sobald eine Stichprobe ihn enthält.

Warum es keine Gemini-Spalte gibt

Wir haben dieselben fünf Fragen auch auf Gemini gestellt, und die Zeilen stehen im Register. Sie tragen keinen Anbieteranteil, aus zwei Gründen, die man auseinanderhalten sollte.

Drei der fünf brachen vor drei Durchläufen ab, ihre Latte für „in jedem Durchlauf zitiert“ liegt also bei zwei statt bei drei, und sie sind mit nichts weiter oben vergleichbar.

Der schwerere Grund ist, dass wir eine kurze Zitatliste nicht von einer kurzen Erfassung unterscheiden können. Von diesem Messweg ist bereits bekannt, dass er für einen großen Assistenten überhaupt keine Quellen zurückgibt, eine kurze Liste hat hier also zwei mögliche Ursachen, die wir von außen nicht trennen können. Darauf einen Anbieteranteil zu veröffentlichen hieße, ein Artefakt mit Prozentzeichen zu veröffentlichen.

Ein Detail aus diesen Zeilen verdient trotzdem einen Namen, weil es überprüfbar ist. Die einzige Quelle, die auf der Hosting-Frage jeden Gemini-Durchlauf hielt, ist der Blog eines Hosting-Anbieters, auf einer Seite, die sich mit seinen Wettbewerbern vergleicht. Das ist das Muster aus unserer Arbeit darüber, wer die Tool-Ranglisten schreibt, das als dauerhafteste Quelle einer Oberfläche auftaucht.

Die Gemini-Spalte, eine Woche später, und warum die Liste kurz war

Der Abschnitt oben sagt, es gebe keine Gemini-Spalte, weil wir eine kurze Zitationsliste nicht von einer kurzen Erfassung unterscheiden konnten. Das war ehrlich und es war nicht das Ende, also sind wir mit einem anderen Aufruf zurückgegangen.

Es ist weder noch. Über den zwischengespeicherten Einzelaufruf statt über den wiederholten gefragt, liefert Gemini 9 bis 18 Zitationen je Antwort, was kein Erfassungsproblem ist. Es verteilt sie auf 2 bis 5 Domains.

Das ist die ganze Antwort. Gemini druckt 3,80 Zitationen je eigener Domain gegenüber 1,31 bei AI Overview, Mediane über sechs Fragen in drei Märkten am selben Tag, und Gemini liegt in 6 der 6 Zellen höher, ohne dass sich die beiden Spannen überschneiden. Die kurze Liste war echt und sie lag nicht am Instrument: Gemini zitiert mehrere Passagen derselben Seite, eine Handvoll Quellen trägt also eine Antwort, die gut belegt aussieht.

Man sieht es an den Zitationen selbst. Die von Gemini sind Textfragmente, verankert an einem bestimmten Satz der Seite. Die von AI Overview zeigen auf die Seite.

Das ergibt eine dritte Einheit, und es ist die, bei der ein Werkzeug danebengreift. Über die sechs Antworten druckte Gemini 77 Zitationen, die sich zu 23 Seiten und 22 Domains auflösen. Seine Seiten sind fast genau eine je Domain, und seine Zitationszahl beträgt mehr als das Dreifache von beiden. Wer Zitations-URLs als Quellen zählt, meldet eine Gemini-Antwort als dreimal besser belegt, als sie ist, und dieses Register hat bereits eine Korrektur dafür veröffentlicht, denselben Fehler in die andere Richtung gemacht zu haben, URLs als Seiten zu zählen, in unserer eigenen Arbeit.

Was das mit einem Vergleich macht

Mit einer Route, die erfasst, wird der Vergleich möglich, den dieser Artikel nicht führen konnte, und er landet dort, wo der Rest des Textes es vorhersagen würde. Über diese sechs Fragen teilen die beiden Oberflächen 8 von 47 Domains.

Zwei Google-Produkte, dieselben Fragen, derselbe Tag, und fünf Sechstel dessen, was die eine zitiert, zitiert die andere nicht.

Das ist der Oberflächenbefund vom Anfang dieses Artikels, gemessen zwischen zwei Produkten eines einzigen Anbieters statt zwischen Anbietern. Es ist die stärkste Fassung, die wir haben, denn diese kann niemand einem anderen Index oder einem anderen Crawler zuschreiben: Was auch immer AI Overview von Gemini trennt, es ist nicht, dass sie verschiedene Unternehmen wären.

Und eine Warnung zur Oberfläche, auf der dieser Artikel steht

Beim Prüfen, welche Oberfläche Seiten zitiert, fanden wir etwas, das bis zur Zahl am Anfang dieses Textes reicht.

Eine AI-Mode-Antwort druckt nummerierte Zitationsmarker in ihrem eigenen Körper, und die strukturierte Liste, die wir lesen, trägt nicht immer alle. Über 5 Fragen in 3 Märkten und drei Sprachen trug die Liste von AI Overview in allen 5 Zellen jeden gedruckten Marker, und die von AI Mode reichte von 21 Prozent davon bis zu allen. Wir haben das zuerst an zwei Zellen abgelesen und geschrieben, es sei die Art, wie jede Oberfläche geparst wird. Ein dritter Markt lieferte eine AI-Mode-Antwort, die jeden von ihr gedruckten Marker trug, es ist also nicht das: die Erfassung ist unregelmäßig, nicht halbiert, und eine AI-Mode-Zählung ist damit eine Untergrenze unbekannter Enge und keine, die man durch Verdoppeln korrigiert. Gemini, an 5 derselben Fragen am selben Tag gelesen, trug ebenfalls jeden Marker, den es druckte. Von den 3 Oberflächen, die wir so lesen können, geben 2 die Zitationsliste ihrer eigenen Antwort unversehrt zurück, und die Lücke gehört allein AI Mode.

Wohin das drückt, hängt von der Zahl ab. Wo wir berichten, dass AI Mode weit breiter zitiert als AI Overview, macht ein untererfasstes AI Mode die echte Lücke größer, diese Zahlen sind also Untergrenzen und der Befund hält.

Der Überschneidungsmedian am Anfang dieses Artikels ist der, den wir uns nicht herleiten konnten, also haben wir ihn gemessen. Für jede Zelle, in der uns die vollständige Markerliste beider Oberflächen vorliegt, haben wir den Jaccard zweimal berechnet, einmal aus der Liste, die das Werkzeug zurückgab, und einmal aus allen Markern, die die Antwort druckte. Das sind inzwischen 4 Zellen statt der 2 bei Veröffentlichung dieses Absatzes, und die damalige Korrektur übersteht die Erweiterung: 2 Zellen weisen die Übereinstimmung zu niedrig aus und 2 zu hoch, um einen Faktor von 1,4 bis 2,7.

ZelleAus der zurückgegebenen ListeAus allen gedruckten MarkernWeggefallene DomainsAuch von AI Overview zitiert
Reisekarten, USA0,070,19103
Buchhaltung, Spanien0,140,19112
Lohnabrechnung, USA0,430,2970
CRM, USA0,400,16150

Die letzte Spalte ist der ganze Mechanismus, und sie ist eher Arithmetik als Entdeckung. Eine weggefallene Domain zurückzugeben, die die andere Oberfläche ebenfalls zitiert, hebt die Schnittmenge; eine, die sie nicht zitiert, hebt stattdessen die Vereinigungsmenge. Die Überschneidung steigt also genau dann, wenn der Anteil der weggefallenen Domains, den die andere Oberfläche teilt, größer ist als die bereits gemessene Überschneidung, und das gilt in allen 4 Zellen, weil es nicht scheitern kann.

Gemessen ist, und dies macht das Vorzeichen in der Praxis unermittelbar, dass dieser Anteil von 0 bis 3 von 10 reicht, ohne dass irgendetwas ihn vorhersagt. Ob Ihre Zahl zu hoch oder zu niedrig liegt, entscheiden vollständig die Domains, die die Kürzung entfernt hat, also genau die Liste, die Ihnen fehlt. Wer eine Überschneidung zwischen Oberflächen berichtet, kann die Korrektur nur berechnen, indem er zuvor das Weggefallene zurückholt. 0,40 trägt also einen Fehler dieser Größe in einer Richtung, die im Prinzip kennbar und faktisch nicht verfügbar ist. Das ist schlechter als die Untergrenze, die wir hier anfangs behaupteten, und es ist das, was die Messung sagt statt das, was der Mechanismus nahelegte.

Eine der 4 Zellen braucht eine Angabe zur Herkunft, weil die beiden Seiten nicht symmetrisch sind. Die spanische AI-Overview-Antwort gab 5 Domains zurück und druckte keinen einzigen nummerierten Marker, sodass ihre Menge aus der zurückgegebenen Liste stammt, die von AI Mode dagegen aus dem Text. Sie ist enthalten, weil die Frage hier lautet, was die Kürzung von AI Mode bewirkt, und AI Overview nur die Vergleichsmenge liefert. Sie ist gekennzeichnet, weil wer die Arithmetik prüfen darf, dies auch wissen darf.

Was sich nicht bewegt, ist der Gemini-Vergleich in diesem Abschnitt. Geminis Liste trägt jeden Marker, den ihre Antworten drucken, genau wie die von AI Overview, die 8 von 47 sind also auf beiden Seiten mit einem Instrument gemessen.

Und es gibt eine zweite Eingabe, die wir nie variiert hatten. Jede Lesung dieser Studie ist eine Frage, weil diese Produkte das fragen; stattdessen als die Keyword-Phrase gestellt, die ein Käufer tippt, liefern 4 von 19 Kategorien eine deutlich andere Menge an Quellen.

Die Vorsicht, die dazugehört

Eine Lesung je Frage und Oberfläche, nichts davon ist also eine Rate. Eine Domain, die in einer Antwort fehlt, kann in der nächsten da sein, und dieses Register hat gemessen, dass eine einzelne Lesung eine Ziehung ist und keine Schätzung.

Das zählt vor allem wegen einer Versuchung, die wir hatten und nicht angenommen haben. Vier der Publisher aus unserer Crawler-Studie verbieten Google-Extended, die Kontrolle über die Nutzung für Gemini, und alle vier fehlen in diesen Gemini-Antworten, während sie in AI Overview zitiert werden. Das liest sich wie ein bestätigter Mechanismus. Es ist keiner: Nur 8 der 43 nicht blockierenden Domains kommen ebenfalls durch, bei dieser Grundrate war die erwartete Zahl anwesender Blockierer also kleiner als eins und beobachtet haben wir null. Null zu beobachten, wo man null erwartete, unterscheidet nichts, und die Registerzeilen tragen diese Arithmetik neben dem Ergebnis, damit die Zahl nicht ohne sie zitiert werden kann.

Was das nicht zeigt

2 Märkte, ein Tag, 10 Fragen, für den Median der Überschneidung. Das sind die Vereinigten Staaten auf Englisch und Spanien auf Spanisch am 12. August 2026, drei Durchläufe pro Oberfläche und Frage. Das ist die Reichweite der Zahl, die diesen Artikel eröffnet, und nicht die des ganzen Stücks: der Gemini-Abschnitt und der Abschnitt zur Erfassung weiter unten wurden später gemessen und reichen in einen dritten Markt, und jeder nennt seine eigene Reichweite dort, wo er steht. Es ist keine Zeitreihe, und nichts hier ist kausal.

6 vergleichbare Zellen sind immer noch wenig, und der Pool von 10 mit der besseren Lesung ist dieselbe Schwäche mit mehr Zeilen. Der Median aus sechs Überschneidungen ist eine schwache Statistik, und wir würden sie nicht allein veröffentlichen. Sie ist veröffentlichbar, weil sie neben zwei anderen, gleich gemessenen Medianen aus mehr Zeilen steht, weil der zweite Markt den ersten reproduziert hat, und weil die Richtung in fünf der sechs Zellen dieselbe ist.

Die Anbieterregel ist unsere und sie ist streng. Ein Domain zählt als Anbieter, wenn seine eigene Startseite das Produkt nennt, nach dem die Frage fragt. Zwei Seiten dieses Durchgangs, Salesforce und ADP, weisen automatische Anfragen komplett ab; Salesforce behält die Einstufung, die es im Register schon aus der Zeit hatte, als es lesbar war, und ADP ist in seiner Zeile als unentschieden markiert statt geraten.

Und eine Oberfläche ist kein Nutzer. AI Overview und AI Mode sind beide von Google, nur anders erreicht. Dass zwei Google-Oberflächen so weit auseinanderliegen, ist der Befund; wie viele Menschen jede sehen, ist eine andere Frage und keine, die das hier misst.

Häufige Fragen zum Messen über KI-Oberflächen hinweg

Sagt ein Sichtbarkeitswert auf einer Oberfläche die anderen voraus?

Nach dieser Evidenz nicht. Fünf identische Kauffragen auf AI Overview und auf AI Mode im selben Markt am selben Tag ergaben eine Median-Überschneidung von 0,40 zwischen den Mengen der in jedem Durchlauf zitierten Quellen, und eine Kategorie teilte gar keine Quelle. Das ist niedriger als die 0,63, die dieselben Fragen mit zwei Tagen Abstand auf einer einzigen Oberfläche ergaben.

Welche KI-Oberfläche sollte ich messen?

Die, die Ihre Käufer nutzen, jeweils getrennt gemessen, und die ehrliche Antwort ist, dass die Zahl der messbaren Oberflächen kleiner ist als die Zahl der existierenden. Wogegen diese Studie argumentiert, ist eine einzelne vermischte Zahl: Oberflächen zu mitteln, die sich zu 0,40 einig sind, erzeugt eine Zahl, die über keine von ihnen etwas sagt.

Ist meine Kategorie auf manchen Oberflächen anbieterfreundlicher?

Ja, und die Rangfolge ändert sich. Buchhaltungssoftware war auf AI Overview die anbieterfreundlichste von fünf Kategorien und CRM war es auf AI Mode. Was auf beiden hielt, war das untere Ende: Webhosting und Onlineshop-Plattformen gaben Anbietern auf keiner der beiden einen dauerhaften Platz.

Was bedeutet es, wenn eine Oberfläche Quellen zitiert und keine davon dauerhaft ist?

Es bedeutet, dass der Abruf sich zwischen den Durchläufen bewegt hat, nicht dass die Oberfläche versagt hat. Unsere Frage zur Lohnabrechnung auf AI Mode lieferte alle drei Male Antworten mit Zitaten, insgesamt dreizehn verschiedene Domains, und kein Domain erschien in allen dreien. Eine strenge Latte „in jedem Durchlauf zitiert“ meldet das als leere Menge, was korrekt ist und sich schlimmer liest, als es ist.

Warum nicht stattdessen eine durchschnittliche Zitatrate melden?

Weil ein Durchschnitt bei zwei oder drei Durchläufen vor allem eine umskalierte Fassung derselben Zählung ist und eine Toleranz kauft, die nur mehr Durchläufe wirklich liefern können. Wir veröffentlichen lieber die Menge der Domains, die jeder prüfen kann, als eine glattere Statistik, die auf denselben drei Lesungen ruht.

Wie wiederhole ich das gegen euch?

Nehmen Sie die fünf Fragen aus dem Register, stellen Sie jede dreimal auf zwei Oberflächen, in einem Markt an einem Tag, behalten Sie nur die Domains, die in jedem Durchlauf erscheinen, und berechnen Sie die Überschneidung zwischen den beiden Mengen. Das ganze Design steht im vorigen Satz, und die Domains, die wir bekamen, sind Zeile für Zeile abgedruckt.

Fragen Sie eine KI zu diesem Artikel

Öffnet Ihren Assistenten mit dieser Seite bereits geladen, damit Sie die Zahlen prüfen, die Methode hinterfragen oder fragen können, was das für Sie bedeutet.

Perplexity und Google antworten sofort. ChatGPT und Claude füllen das Feld und warten auf Ihr Enter, das ist ihr Verhalten und nichts, was wir einstellen können.

Geschrieben von

Maher El Ouahabi

CTO und Mitgründer von EchoWi

Baut die Software, die Marken zeigt, was KI wirklich über sie sagt, und was zu ändern ist, damit die nächste Antwort besser ausfällt. Zwölf Engines, vorher und nachher gemessen.

LinkedIn Maher El Ouahabi (öffnet in neuem Tab)