Die meisten Domains, die KI-Zitierungen gewinnen, liefern keine llms.txt aus. Die meisten Anbieter, die das verkaufen, schon.
Wir haben 69 KI-Sichtbarkeitsanbieter und 122 zitierte Domains an einem Tag nach ihrer llms.txt gefragt. Die Anbieter liefern sie weit häufiger aus.
Am 14. August 2026 haben wir zwei Gruppen mit demselben Skript am selben Tag nach ihrer llms.txt gefragt: die 69 Anbieter in unserem Katalog von KI-Sichtbarkeitswerkzeugen und die 122 Domains, die unser Register drei Mal oder öfter als in KI-Antworten zitiert festgehalten hat. Von den erreichbaren Anbietern liefern 44 von 68 eine aus. Von den zitierten Domains 49 von 112.
Wer die Konvention verkauft, liefert sie zu rund zwei Dritteln aus. Die Seiten, die die Zitierungen tatsächlich gewinnen, zu weniger als der Hälfte.
Offenlegung: EchoWi verkauft Messung von KI-Sichtbarkeit und liefert selbst eine llms.txt aus, wir stehen also in der Anbieterzeile und haben ein Interesse daran, was diese Datei wert ist. Die Methode ist ein GET auf
/llms.txtbeim Origin jeder Domain, an einem Tag, wobei Bot-Prüfungen und Netzwerkfehler getrennt von fehlenden Dateien gezählt werden. Die Zählungen stehen in unserem Messregister, die Regel für die Grundgesamtheit steht unten, und das Ganze gegen uns zu wiederholen kostet einen Nachmittag.
Die kurze Fassung
- Anbieter liefern eine llms.txt bei 44 von 68 erreichbaren Domains aus. Das ist die Gruppe, deren Produkt darin besteht, Sie für Maschinen lesbar zu machen.
- Die von uns zitiert gesehenen Domains liefern sie bei 49 von 112 aus. Das ist die Gruppe, die die Maschinen tatsächlich zitieren.
- Der Abstand läuft gegen das Verkaufsargument. Wäre die Datei das, was Zitierungen einbringt, müsste die zitierte Gruppe vorn liegen, und sie liegt rund zwanzig Punkte zurück.
- Das ist kein Beleg dafür, dass die Datei schadet oder nichts bewirkt. Zwei Grundgesamtheiten, die sich in einer Konvention unterscheiden, sind kein Mechanismus, und wir tun nicht so.
- Für eine enge Aussage reicht es, und die ist nützlich: Zitierungen zu gewinnen setzt keine llms.txt voraus, denn die meisten Domains, die sie gewinnen, haben keine.
- Sechs Anbieterdateien liegen unter 2 KB, also vorhanden und zu klein, um irgendetwas zu indexieren.
Was eine llms.txt zu sein beansprucht
llms.txt ist eine vorgeschlagene Konvention: eine Markdown-Datei im Wurzelverzeichnis, die einem Sprachmodell eine kuratierte Karte dessen gibt, was zählt, in der Reihenfolge, die ein Mensch empfehlen würde. Das Argument ist einfach und nicht unvernünftig. Ein Crawler, der auf einer großen Seite landet, muss die Struktur aus Navigation und internen Links erschließen; eine Datei, die sagt „dies sind die zwölf Seiten, auf die es ankommt, und das tut jede davon”, nimmt ihm dieses Raten ab.
Sie hat keine Spezifikation hinter sich in dem Sinn, in dem Content Signals eine hat, kein Register, und keine veröffentlichte Aussage irgendeiner großen Maschine, dass sie gelesen wird. Dieser letzte Punkt zählt, und wir kommen darauf zurück, denn eine Konvention, deren Konsum niemand nachgewiesen hat, ist etwas anderes als eine, deren Konsument bekannt ist.
Was sie hat, ist Verbreitung in einer bestimmten Branche: den Werkzeugen, die KI-Sichtbarkeit verkaufen. Mit dieser Beobachtung fängt dieses Stück an.
Zwei Grundgesamtheiten, ein Tag, ein Instrument
Der Vergleich bedeutet nur etwas, wenn beide Hälften gleich und gleichzeitig gemessen wurden, also wurde es so gemacht.
Die Anbieter-Grundgesamtheit sind die 69 Werkzeuge in unserem geprüften Katalog von Software für KI-Sichtbarkeit und Answer Engine Optimisation. Sie schließt uns ein.
Die zitierte Grundgesamtheit ist jede Domain, die unser Messregister in drei oder mehr getrennten Sondenzeilen festgehalten hat: 122 der 1.019 verschiedenen Domains, die es gesehen hat. Die Schwelle ist willkürlich, und wir deklarieren sie, statt sie zu vergraben. Drei oder mehr heißt, dass eine Domain über mehrere Fragen hinweg aufgetaucht ist und nicht ein einziges Mal, was der Unterschied ist zwischen einer Seite, nach der die Antwortschicht greift, und einer, die zufällig da war. Senkt man die Latte auf zwei, sind es 286; hebt man sie auf fünf, sind es 44.
Das Instrument ist ein GET auf /llms.txt beim Origin jeder Domain, Weiterleitungen folgend. Drei seiner Entscheidungen entscheiden das Ergebnis:
GET, nie HEAD. Ein Server ist nicht verpflichtet, auf eine HEAD-Anfrage zu antworten. Ein früherer Link-Prüfer in diesem Projekt meldete zwei völlig lebendige Seiten aus genau diesem Grund als tot, deshalb fragt dieses Instrument nach dem, was es lesen will.
Eine Prüfung ist keine fehlende Datei. Die Status 401, 403, 429 und 999 heißen, dass eine Bot-Kontrolle im Weg stand, was ein Beleg über die Edge ist und nicht darüber, ob eine Datei existiert. Sieben zitierte Domains und ein Anbieter landen dort. Sie in „keine llms.txt” zu falten hätte eine Zahl in Richtung unserer eigenen Überschrift hergestellt, und genau dann ist Vorsicht am nötigsten.
Eine 200 ist keine Datei. Manche Hoster beantworten jeden Pfad mit ihrer Marketingseite. Ein Rumpf, der ein HTML-Dokument eröffnet, ist keine llms.txt, was auch immer die Statuszeile sagte, und neun zitierte Domains antworteten so.
Deshalb trägt die Tabelle unten zwei Nenner. Gefragt ist die ganze Grundgesamtheit. Erreichbar ist gefragt minus Prüfungen und Netzwerkfehler. Beide werden veröffentlicht, weil ein Leser prüfen können muss, ob die Wahl des Nenners die Arbeit macht.
Die Zahlen
| Anbieter | Von uns zitiert gesehene Domains | |
|---|---|---|
| Gefragt | 69 | 122 |
| Erreichbar | 68 | 112 |
| Liefern eine llms.txt | 44 | 49 |
| Anteil der Erreichbaren | 65 Prozent | 44 Prozent |
| Unter 2 KB | 6 | 3 |
| Median-Größe | 9.535 Bytes | 15.378 Bytes |
Zwei Dinge sind aus dieser Tabelle abzulesen, bevor jemand ein Argument darauf baut.
Das erste ist der Abstand selbst: 65 Prozent gegen 44. Wäre das Ausliefern dieser Datei das, was Zitierungen einbringt, müsste die zitierte Gruppe die Gruppe sein, die sie ausliefert, und das Verhältnis ist umgekehrt.
Das zweite ist die Median-Größe, die gegen die einfachste Abfertigung der Datei spricht. Unter den zitierten Domains, die eine ausliefern, liegt der Median über 15 KB: das sind keine symbolischen Gesten. Und sechs Anbieterdateien liegen unter 2 KB, vorhanden und zu klein, um Index von irgendetwas zu sein, die Anbieterzahl ist also etwas großzügig gegenüber den Anbietern.
Was das nicht zeigt
Dies ist der wichtigste Abschnitt, denn die Überschrift ist von der Sorte, die ohne ihn zitiert wird.
Es zeigt nicht, dass llms.txt nichts bewirkt. Zwei Grundgesamtheiten, die sich in einer Konvention unterscheiden, sind kein Mechanismus. Wir haben keine Intervention gefahren, es gibt kein Vorher und Nachher, und nichts hier isoliert die Datei von allem anderen an diesen Seiten.
Die beiden Grundgesamtheiten sind sich nicht ähnlich, aber die Zusammensetzung ist nicht die Erklärung. Die zitierte Menge enthält youtube.com, reddit.com, forbes.com und pcmag.com, große Publisher mit eigenen Publikationsstandards und eigener Rechtsprüfung, und die erste Fassung dieses Abschnitts sagte, ein unbekannter Teil des Abstands komme daher. Das stimmt nicht. Teilt man die zitierte Grundgesamtheit danach auf, wie oft wir sie zitiert gesehen haben, liefert die meistzitierte Schicht die Datei bei 8 von 17 erreichbaren aus und alles darunter bei 41 von 95, also derselben Rate, und beide weit unter den Anbietern. Der Abstand sind nicht die großen Namen.
Selektion läuft mitten hindurch. Die zitierte Grundgesamtheit definieren unsere eigenen Sonden, in unseren Märkten, mit unseren Fragen. Ein anderer Fragensatz ergäbe andere 122.
Eine Konvention ohne nachgewiesenen Konsumenten ist schwer zu prüfen. Keine große Maschine hat veröffentlicht, dass sie llms.txt liest. Wir haben keinen Abruf unserer eigenen durch einen benannten KI-Crawler beobachtet, den wir der Datei statt dem normalen Crawling zuschreiben könnten, und wir werden auch keinen behaupten.
Wir haben nicht gemessen, ob das Ausliefern für irgendjemanden etwas geändert hat. Das bräuchte dieselben Seiten vorher und nachher, mit Kontrolle, und das ist eine andere und viel langsamere Studie.
Was die Frage wirklich beantworten würde
Da wir sie nicht beantworten, gehört dazu zu sagen, was es täte.
Die saubere Fassung ist eine Intervention: eine Menge vergleichbarer Seiten nehmen, die die Datei nicht ausliefern, sie der Hälfte hinzufügen, die andere Hälfte festhalten und die Zitierraten über einen eingefrorenen Promptsatz beobachten, lange genug, um das Rauschen zu überdauern, das dieses Register in KI-Antworten bereits gemessen hat. Dieses Rauschen ist groß, der Zeitraum also lang und die Stichprobe nicht klein.
Die billige Fassung, die offenbar niemand veröffentlicht hat, liegt auf der Serverseite: schauen Sie in Ihre eigenen Logs und prüfen Sie, ob ein benannter KI-Crawler /llms.txt überhaupt anfragt, und in welchem Verhältnis zu /robots.txt. Das ist eine Abfrage gegen Zugriffslogs und würde die Konsumentenfrage für eine Seite klären. Uns wären zehn Seiten, die das veröffentlichen, lieber als eine weitere Verbreitungszählung, unsere eingeschlossen.
Häufige Fragen zu llms.txt
Was ist eine llms.txt-Datei?
llms.txt ist eine vorgeschlagene Konvention: eine Markdown-Datei im Wurzelverzeichnis einer Domain, die einem Sprachmodell einen kuratierten Führer durch die Seite gibt und die Seiten auflistet, auf die es ankommt, samt Zweck. Sie ist keine Spezifikation mit einem Register dahinter, und keine große Maschine hat veröffentlicht, dass sie die Datei liest.
Wie viele KI-Sichtbarkeitsanbieter liefern eine llms.txt aus?
44 der 68 Anbieter, die wir erreichen konnten, von 69 gefragten, gemessen am 14. August 2026. Einer schickte eine Bot-Prüfung zurück, die wir getrennt von einer fehlenden Datei zählen, weil eine Prüfung ein Beleg über die Edge ist und nicht darüber, ob die Datei existiert. Sechs der vorhandenen Dateien liegen unter 2 KB und sind zu klein, um eine Seite jeder Größe zu indexieren.
Liefern die Seiten, die in KI-Antworten zitiert werden, eine llms.txt aus?
Seltener als die Anbieter. Von 122 Domains, die unser Register drei Mal oder öfter zitiert festgehalten hat, waren 112 erreichbar und 49 liefern eine aus, das sind 44 Prozent gegen die 65 der Anbieter. Das ist ein Vergleich zweier Grundgesamtheiten und kein Mechanismus, und die beiden sind sich nicht ähnlich, es zeigt also nicht, dass die Datei nutzlos ist. Es zeigt, dass Zitierungen sie nicht voraussetzen.
Hilft llms.txt der Sichtbarkeit in KI-Antworten?
Niemand hat Belege in die eine oder andere Richtung veröffentlicht, die wir finden konnten, und diese Studie klärt es nicht. Was sie ausschließt, ist die stärkste Fassung der Behauptung: die Datei kann für Zitierung nicht notwendig sein, denn die meisten Domains, die Zitierungen gewinnen, haben keine. Ob sie am Rand hilft, bräuchte eine Intervention mit Kontrolle und keine Verbreitungszählung.
Sollte ich meiner Seite eine llms.txt hinzufügen?
Sie ist billig, sie schadet nicht, und wenn Ihre Seite groß und schlecht strukturiert ist, ist es vernünftig, einem Crawler so etwas in die Hand zu geben. Was wir nicht täten, wäre sie als Sichtbarkeitsprodukt zu kaufen oder sie die Arbeit an dem verdrängen zu lassen, was dieses Register tatsächlich mit Zitierung variieren sah, nämlich was eine Seite sagt und ob es sonst jemand auch sagt. Schauen Sie zuerst in Ihre eigenen Zugriffslogs: hat nie ein KI-Crawler nach der Datei gefragt, haben Sie in einer Abfrage mehr gelernt als jede Verbreitungszählung Ihnen sagen kann.
Wie prüfe ich, was eine Domain ausliefert?
Fordern Sie /llms.txt beim Origin der Domain mit einem GET an, nicht mit einem HEAD, und lesen Sie den Rumpf, bevor Sie dem Statuscode glauben. Öffnet er ein HTML-Dokument, hat man Ihnen eine Marketingseite gegeben und keine Datei. Ist die Antwort 401, 403, 429 oder 999, sind Sie auf eine Bot-Prüfung gestoßen und haben nichts darüber erfahren, ob eine Datei da ist.
Fragen Sie eine KI zu diesem Artikel
Öffnet Ihren Assistenten mit dieser Seite bereits geladen, damit Sie die Zahlen prüfen, die Methode hinterfragen oder fragen können, was das für Sie bedeutet.
- ChatGPT (öffnet in neuem Tab. die Frage steht schon da, mit Enter abschicken)
- Claude (öffnet in neuem Tab. die Frage steht schon da, mit Enter abschicken)
- Perplexity (öffnet in neuem Tab)
- Google AI Mode (öffnet in neuem Tab)
Perplexity und Google antworten sofort. ChatGPT und Claude füllen das Feld und warten auf Ihr Enter, das ist ihr Verhalten und nichts, was wir einstellen können.