Wir haben 71 von einer KI zitierte Seiten gefragt, was sie über sich selbst erklären. Weniger als die Hälfte sagt, was sie ist.
Von 46 lesbaren Seiten, die KI-Antworten zitiert haben, tragen 93 % JSON-LD und 41 % erklären, was die Seite ist. Drei tragen gar nichts.
Jede Checkliste dieser Kategorie sagt Ihnen, Sie sollen Ihre Seiten auszeichnen. Fast niemand hat die Seiten, die KI-Antworten tatsächlich zitieren, gefragt, was sie erklären. Wir schon: 93 % tragen irgendein JSON-LD, 41 % tragen einen Typ, der sagt, was die Seite ist, und drei tragen gar nichts.
Das Interessante ist die Grundgesamtheit. Das sind keine Seiten, die wir als gute Beispiele ausgesucht haben. Jede URL hier wurde von einer KI-Antwort als Quelle zurückgegeben, in einer Messung, die wir bereits gemacht und eingefroren hatten. Die Stichprobe haben also die Maschinen gewählt.
Wie das gemessen wurde: 71 als Quelle zitierte URLs aus 9 Kategoriefragen in 4 Märkten, jede einmal mit einem gewöhnlichen HTTP-Client am 18. August 2026 abgerufen, mit einer zweiten Lesung für alles, was fehlschlug. Jeder JSON-LD-Block wurde geparst und seine
@type-Werte gesammelt. Seiten, die fast ohne Fließtext antworteten, zählen als Hülle und nicht als Seiten, die nichts erklären, und Seiten mit Bot-Abwehr oder ohne Antwort bleiben aus jeder Zählung heraus. Die vollständigen Zeilen stehen in unserem Messregister.
Offenlegung: EchoWi verkauft KI-Sichtbarkeitsmessung, und ein Befund, dass strukturierte Daten nicht das Unterscheidende sind, ist ein Befund gegen etwas, wofür mehrere Werkzeuge unserer Kategorie Sie benoten. Die URLs, die Eimer, das Datum und die Methode stehen alle hier, und die Grundgesamtheit kam aus unseren eigenen eingefrorenen Messungen statt aus einer Liste, die wir zusammengestellt hätten, also kann das jeder gegen uns wiederholen.
Die kurze Fassung
- 93 % der lesbaren zitierten Seiten tragen irgendein JSON-LD. Das Verlagsgerüst ist nahezu universell:
Organization,WebPage,BreadcrumbList,Article. - 41 % tragen einen Typ, der sagt, was die Seite ist. Ein Vergleich, eine Rezension, ein Produkt, ein Satz Fragen, eine Software. Der Rest erklärt nur, wer sie veröffentlicht hat.
FAQPageist der Typ, den diese Seiten wirklich tragen, auf 17 von 46.ItemListerscheint auf 6 undReviewauf 3.- Drei zitierte Seiten tragen überhaupt keine strukturierten Daten, und sie sind nicht leer: 29.724, 12.429 und 6.737 Zeichen sichtbarer Text.
- Jede unlesbare Seite der Menge ist eine Plattform. 17 YouTube-URLs, zwei Reddit und eine Facebook antworten fast ohne Fließtext, was eine Aussage darüber ist, wo diese Plattformen ihren Inhalt halten.
Was gezählt wurde und was abgelehnt
Die Einheit ist eine URL, die eine KI-Antwort als Quelle genannt hat. Neun Fragen haben sie erzeugt, in Buchhaltung, Lohnabrechnung, CRM, Reisekreditkarten und Kopfhörern, in den USA, Spanien, Frankreich und Deutschland.
Für jede URL wurde jedes <script type="application/ld+json"> geparst und die @type-Werte überall darin gesammelt, verschachtelte eingeschlossen. Dann wurden die Typen in zwei Gruppen geteilt, und diese Teilung ist der ganze Punkt der Studie.
Verlagstypen sagen, wer die Seite dorthin gestellt hat: Organization, WebSite, Person, BreadcrumbList, ImageObject, WebPage, Article. Jedes Redaktionssystem gibt sie aus, und ihre Anwesenheit sagt einer Maschine nichts darüber, was sie vor sich hat.
Seitenarttypen sagen, was das Ding ist: ItemList für einen Vergleich, Review für eine Rezension, Product für ein Produkt, SoftwareApplication für Software, FAQPage für einen Satz Fragen und Antworten. Das sind die, die eine Abrufschicht nutzen könnte, um zu entscheiden, dass eine Seite eine Vergleichsfrage beantwortet.
Drei Zustände bleiben getrennt statt vermischt, weil das Vermischen der häufigste Weg ist, wie eine solche Erhebung eine Zahl veröffentlicht, die etwas anderes bedeutet:
- Gelesen, also die Seite antwortete mit einem Körper, den ein gewöhnlicher Client lesen kann. Nur diese zählen.
- Hülle, also sie antwortete mit weniger als 500 Zeichen sichtbarem Text. Das ist eine Aussage darüber, wo sie ihren Inhalt hält, nicht darüber, ob sie welchen hat.
- Blockiert oder ohne Antwort, also wir haben die Seite nie gesehen. Vier lieferten Bot-Abwehr und eine antwortete nie.
Das Ergebnis
| Von 46 gelesenen | |
|---|---|
| Irgendein JSON-LD | 43 (93 %) |
| Ein Typ, der sagt, was die Seite ist | 19 (41 %) |
| Keine strukturierten Daten | 3 (7 %) |
Und die Aufschlüsselung nach Typ ist der Punkt, an dem der Standardrat und die Daten auseinandergehen:
| Typ | Seiten |
|---|---|
| FAQPage | 17 |
| ItemList | 6 |
| Product | 6 |
| Review | 3 |
| SoftwareApplication | 2 |
Der Rat, den alle zu Vergleichsinhalten geben, lautet, ihn als ItemList auszuzeichnen, weil das der Typ ist, der erklärt: „Diese Seite ist eine geordnete Menge von N Dingen.“ Unter den Seiten, die eine KI für diese neun Fragen wirklich zitiert hat, erscheint ItemList sechsmal. FAQPage erscheint fast dreimal so oft.
Einige der am stärksten ausgezeichneten Seiten sind genau die, die man erwartet: thepointsguy.com und lesnumeriques.com tragen FAQPage, ItemList, Product und Review zusammen. Aber bankrate.com, creditcards.com und nytimes.com stehen in denselben Antworten mit je zwei Typen, und frandroid.com und soundcore.com mit einem.
Die drei, die nichts erklären, und warum sie mehr zählen als der Rest
bakedwith.com, zoho.com und capitalone.com wurden jeweils von einer KI-Antwort zitiert und tragen weder JSON-LD noch Mikrodaten noch RDFa. Keine abgespeckte Seite, keine Weiterleitung: 29.724, 12.429 und 6.737 Zeichen lesbarer Text.
Das ist die Beobachtung, die begrenzt, was hier jemand behaupten kann. Wären strukturierte Daten eine Voraussetzung für Zitierung in dieser Kategorie, könnten diese Seiten nicht in der Menge sein. Sie sind es, also sind sie es nicht.
Die ehrliche Lesart ist eng, und sie lohnt genaue Formulierung gerade weil die weite so verlockend ist. Sie sagt nicht, Markup sei nutzlos. Sie sagt nicht, Schema hinzuzufügen helfe nicht. Sie sagt eines: Sie können eine Zitierung in dieser Kategorie nicht ansehen und daraus schließen, dass die Seite ausgezeichnet war, denn 7 % waren es überhaupt nicht und 59 % erklärten nicht, was sie sind.
Jede Hülle der Menge ist eine Plattform
Zwanzig der 71 URLs antworteten mit fast nichts, das ein gewöhnlicher Client lesen könnte. Alle zwanzig sind Plattformen: 17 YouTube-Videoseiten mit je 254 sichtbaren Zeichen, zwei Reddit-Fäden mit fünf Zeichen und eine Facebook-Seite mit 44.
Wir haben das schon an einer anderen Grundgesamtheit gemessen, und der Befund repliziert sich genau: Diese Plattformen halten das Material im Dokumentkopf und in ihrer eigenen Renderschicht, nicht im Körper. Eine YouTube-Seite trägt Titel, Beschreibung und ein vollständiges VideoObject in JSON-LD, während ihr Körper fast nichts sagt.
Die praktische Folge betrifft nicht YouTube. Sie betrifft, dass jede Erhebung, die „Seiten ohne sichtbaren Inhalt“ zählt, Plattform-URLs als leere Seiten meldet, sofern sie sie nicht trennt, und Plattform-URLs sind ein großer Teil dessen, was KI-Antworten zitieren. In dieser Menge sind sie 28 % von allem, was die Maschinen genannt haben.
Die Vergleichsgruppe, ergänzt
Der Abschnitt oben sagte, diese Studie könne nicht sagen, was nicht zitierte Seiten tragen, weil jede URL darin bereits zitiert war. Diese Lücke ist mit der billigstmöglichen Kontrolle geschlossen: dieselben neun Fragen an Googles organische Ergebnisse gestellt, und jede rankende URL, die die KI-Antwort nicht zitiert hat, mit demselben Client abgerufen und mit demselben Code geparst. 103 davon, 71 lesbar.
Die Richtung stand vor dem ersten Aufruf fest. Kämen die Kontrollen mehr als 15 Punkte unter der zitierten Seite heraus, bei den Typen, die sagen, was eine Seite ist, dann würde Markup die beiden Gruppen in dieser Stichprobe trennen, die von anderen berichtete Assoziation würde sich an unserer eigenen Grundgesamtheit replizieren, und genau das würden wir veröffentlichen.
| Zitiert | Rankt, nicht zitiert | |
|---|---|---|
| Gelesene Seiten | 46 | 71 |
| Irgendein JSON-LD | 93 % | 77 % |
| Ein Typ, der sagt, was die Seite ist | 41 % | 31 % |
| Keine strukturierten Daten | 7 % | 14 % |
Der Abstand bei den Typen, die sagen, was eine Seite ist, beträgt 10 Punkte, und die Schwelle lag bei 15. Die Überschrift kippt also nicht. Wahr ist, und das gehört ohne Aufblasen gesagt, dass alle drei Zeilen in dieselbe Richtung zeigen: Zitierte Seiten tragen etwas mehr Markup als nicht zitierte Seiten, die auf dieselbe Frage ranken, mit Abständen, die zu klein sind, um Markup zum Unterscheidenden zu machen.
Der Blick auf die Typen ist genauer als die Summen:
| Typ | Zitiert, von 46 | Nicht zitiert, von 71 |
|---|---|---|
| FAQPage | 17 | 17 |
| ItemList | 6 | 2 |
| Product | 6 | 11 |
FAQPage erscheint auf beiden Seiten gleich oft, was bei verschiedenen Nennern heißt, dass es unter den zitierten anteilig häufiger ist. ItemList ist unter den zitierten dreimal so häufig. Und Product läuft andersherum, häufiger bei Seiten, die rankten und nicht zitiert wurden, und das ist die Zeile, die verhindert, dass daraus eine Geschichte über Markup im Allgemeinen wird.
Ein weiterer Unterschied betrifft gar kein Schema: 12 der 103 Kontroll-URLs beantworteten unseren Abruf mit einer Bot-Abwehr, gegen 4 der 71 zitierten. Das sind 12 % gegen 6 %, auf kleinen Zahlen, und es deutet auf etwas Plausibleres als Markup als Mechanismus. Es ist auch kein Beleg über KI-Crawler, denn eine Seite, die den HTTP-Client dieser Erhebung abwehrt, wehrt nicht zwangsläufig GPTBot ab, und das haben wir hier nicht geprüft.
Was wir daraus mitnähmen, wenn wir kaufen würden
Kaufen Sie keine Note, die vor allem ein Markup-Audit ist. Mehrere Werkzeuge dieser Kategorie benoten Sie nach Markup-Abdeckung. Nach dieser Evidenz misst diese Note etwas Reales über Ihre Seite und etwas Schwaches über Ihre Chancen, zitiert zu werden, denn 59 % der Seiten, die zitiert wurden, tragen die Typen nicht, die die Note belohnt.
Wenn Sie einen Typ ergänzen, ergänzen Sie den, den diese Seiten tragen. FAQPage steht auf 17 von 46 und hat einen offensichtlichen Mechanismus dahinter: Eine Frage mit einer in sich geschlossenen Antwort ist die Einheit, die eine Abrufschicht ganz herausheben kann. Aus demselben Grund setzt unser eigenes Korpus eine FAQPage auf fast jede Seite, eine Praxis von vor dieser Messung und nicht wegen ihr.
Schließen Sie daraus nicht, dass Markup egal ist. Diese Studie kann das nicht tragen, und der Grund steht im nächsten Abschnitt.
Was das nicht zeigt
- Die Grundgesamtheit ist am Ergebnis ausgewählt. Jede URL hier wurde zitiert. Das macht die Studie billig und schlüssig, um eine Behauptung zu töten, nämlich dass die zitierten Seiten dieser Kategorie stark ausgezeichnet sind, und nutzlos für die Umkehrung. Oben wurde eine Kontrollgruppe ergänzt, aus denselben neun Fragen, und sie verkleinert den Abstand, statt die Frage zu schließen: Seiten, die ranken und nicht zitiert werden, tragen Markup in ähnlichem Maß. Die Studie mit dem weit größeren Vergleich ist die von AirOps, die 61 % der von ChatGPT zitierten Seiten mit drei oder mehr Schematypen gegen 25 % nicht zitierter Erstseitentreffer über mehr als 12.000 URLs berichtet. Unsere ist eine kleinere Stichprobe mit einer engeren Frage an eine von den Maschinen gewählte Grundgesamtheit, und beide stehen nicht im Widerspruch: ihre findet eine Assoziation über eine viel größere Menge, und der kontrollierte Test von Ahrefs an 1.885 Seiten fand keinen signifikanten Anstieg der Zitierungen durch hinzugefügtes Schema. Assoziation, kein gemessener Zuwachs und kein gemeinsames Markup unter den zitierten Seiten, die wir erreichen konnten: drei Messungen, die in dieselbe Richtung zeigen, was das Gewicht einer Markup-Note angeht.
- Eine Lesung, ein Client. Eine Seite, die ihr JSON-LD im Browser baut, wirkte auf uns nackt. Das drückt die echten Zahlen nach oben und nicht nach unten, also sind die 41 % eine Untergrenze und keine Schätzung.
- Neun Fragen, vier Märkte, ein Tag. Fünf Produktkategorien und eine Momentaufnahme. Ein anderer Satz Fragen ergäbe einen anderen Satz Verlage.
- Nichts hiervon ist kausal. Wir können sagen, was die zitierten Seiten erklären. Wir können nicht sagen, dass das Erklären der Grund ihrer Zitierung ist, und wir haben keine Intervention geprüft.
Häufige Fragen zu Markup und KI-Zitierung
Helfen strukturierte Daten einer Seite, von einer KI zitiert zu werden?
Diese Studie kann das nicht beantworten, und man sollte klar sagen warum: Jede Seite hier war bereits zitiert, es gibt also keine nicht zitierte Vergleichsgruppe. Beantworten kann sie die engere Frage, die Leute meist meinen, nämlich ob die Seiten, die in einer Kategorie Zitierungen gewinnen, die stark ausgezeichneten sind. Bei diesen neun Fragen sind sie es nicht: 41 % erklären, was die Seite ist, und 7 % tragen überhaupt keine strukturierten Daten.
Welchen Schematyp tragen zitierte Seiten wirklich?
FAQPage, auf 17 von 46 lesbaren Seiten, vor ItemList auf 6, Product auf 6, Review auf 3 und SoftwareApplication auf 2. Diese Reihenfolge läuft dem üblichen Rat für Vergleichsinhalte zuwider, der mit ItemList beginnt.
Warum werden YouTube-Seiten getrennt gezählt?
Weil eine YouTube-Videoseite einem gewöhnlichen HTTP-Client mit etwa 254 Zeichen sichtbarem Fließtext antwortet, während sie Titel, Beschreibung und ein VideoObject im Dokumentkopf trägt. Sie als Seite zu zählen, die nichts erklärt, wäre eine falsche Aussage über YouTube. 17 der 20 Hüllen dieser Menge sind YouTube.
Wie kann eine Seite ganz ohne Schema zitiert werden?
Wir wissen es nicht, und das ist die richtige Antwort und keine Ausflucht. Drei Seiten der Menge tragen keines und sind lange, gewöhnliche, lesbare Artikel. Was auch immer die Abrufschicht zur Auswahl benutzt hat, es war nicht ihr Markup, denn es gab keines zu lesen.
Wie führe ich das in meiner eigenen Kategorie aus?
Nehmen Sie die Antworten, die Sie ohnehin messen, behalten Sie die Quell-URLs, rufen Sie jede ab und parsen Sie ihr JSON-LD. Die einzigen zwei Entscheidungen, die zählen, sind, Seiten, die Sie nicht lesen konnten, von Seiten zu trennen, die nichts erklären, und Typen, die sagen, wer die Seite veröffentlicht hat, von Typen, die sagen, was sie ist. Genau dort geht eine solche Erhebung sonst schief.
Ändert das, was EchoWi empfiehlt?
Es verengt eine Empfehlung. Wir setzen weiterhin eine in sich geschlossene Antwort und eine FAQPage auf unsere eigenen Seiten, und unser geprüfter Werkzeugkatalog trägt weiterhin eine ItemList, die genau beschreibt, was er listet. Was wir nicht mehr sagen würden, ist, dass Markup-Abdeckung Zitierung vorhersagt, denn in der einzigen Stichprobe zitierter Seiten, die wir haben, trennt sie diese nicht.
Fragen Sie eine KI zu diesem Artikel
Öffnet Ihren Assistenten mit dieser Seite bereits geladen, damit Sie die Zahlen prüfen, die Methode hinterfragen oder fragen können, was das für Sie bedeutet.
- ChatGPT (öffnet in neuem Tab. die Frage steht schon da, mit Enter abschicken)
- Claude (öffnet in neuem Tab. die Frage steht schon da, mit Enter abschicken)
- Perplexity (öffnet in neuem Tab)
- Google AI Mode (öffnet in neuem Tab)
Perplexity und Google antworten sofort. ChatGPT und Claude füllen das Feld und warten auf Ihr Enter, das ist ihr Verhalten und nichts, was wir einstellen können.