La plupart des domaines qui obtiennent des citations IA ne publient pas de llms.txt. La plupart des fournisseurs qui vendent l'idée, si.
Nous avons demandé leur llms.txt à 69 fournisseurs de visibilité IA et à 122 domaines vus cités, le même jour. Les fournisseurs le publient bien plus souvent.
Le 14 août 2026 nous avons demandé leur llms.txt à deux groupes, avec le même script et le même jour : les 69 fournisseurs de notre catalogue d’outils de visibilité IA, et les 122 domaines que notre registre a notés comme cités trois fois ou plus dans des réponses IA. Parmi les fournisseurs joignables, 44 sur 68 en publient un. Parmi les domaines cités, 49 sur 112.
Ceux qui vendent la convention la publient à environ deux tiers. Les sites qui obtiennent vraiment les citations la publient à moins de la moitié.
Transparence : EchoWi vend de la mesure de visibilité IA et publie lui-même un llms.txt, nous sommes donc dans la ligne des fournisseurs et nous avons un intérêt dans ce que vaut ce fichier. La méthode est un GET sur
/llms.txtà l’origine de chaque domaine, un seul jour, en comptant les défis de bot et les échecs réseau à part des fichiers absents. Les comptes sont dans notre registre de mesures, la règle de population est écrite plus bas, et le refaire contre nous prend un après-midi.
La version courte
- Les fournisseurs publient un llms.txt sur 44 des 68 domaines joignables. C’est le groupe dont le produit consiste à vous rendre lisible pour les machines.
- Les domaines que nous avons vus cités le publient sur 49 sur 112. C’est le groupe que les machines citent réellement.
- L’écart va dans le sens contraire de l’argument de vente. Si le fichier était ce qui rapporte des citations, le groupe cité devrait être devant, et il est derrière d’une vingtaine de points.
- Ce n’est pas la preuve que le fichier nuit, ni qu’il ne fait rien. Deux populations qui diffèrent sur une convention ne sont pas un mécanisme, et nous n’allons pas prétendre le contraire.
- Cela suffit pour une affirmation étroite, et elle est utile : obtenir des citations n’exige pas de llms.txt, car la plupart des domaines qui en obtiennent n’en ont pas.
- Six fichiers de fournisseur font moins de 2 Ko, donc présents et trop petits pour indexer quoi que ce soit.
Ce qu’un llms.txt prétend être
llms.txt est une convention proposée : un fichier markdown à la racine d’un site qui donne à un modèle de langage une carte curatée de ce qui compte, dans l’ordre qu’un humain recommanderait. L’argument est simple et pas déraisonnable. Un robot qui atterrit sur un grand site doit déduire la structure de la navigation et des liens internes ; un fichier qui dit « voici les douze pages qui comptent et voici ce que fait chacune » lui enlève ce travail de devinette.
Il n’a pas de spécification derrière lui au sens où les Content Signals en ont une, pas de registre, et aucune déclaration publiée par un grand moteur disant qu’il le lit. Ce dernier point compte et nous y reviendrons, car une convention dont personne n’a démontré la consommation est autre chose qu’une convention dont le consommateur est connu.
Ce qu’il a, c’est une adoption dans une industrie précise : les outils qui vendent de la visibilité IA. C’est l’observation d’où part cette pièce.
Deux populations, un jour, un instrument
La comparaison ne veut dire quelque chose que si les deux moitiés ont été mesurées pareil et en même temps, alors c’est comme ça que ça a été fait.
La population de fournisseurs, ce sont les 69 outils de notre catalogue vérifié de logiciels de visibilité IA et d’optimisation pour moteurs de réponse. Elle nous inclut.
La population citée, c’est chaque domaine que notre registre de mesures a noté comme apparaissant dans trois lignes de sonde distinctes ou plus : 122 des 1 019 domaines distincts qu’il a vus. Le seuil est arbitraire et nous le déclarons plutôt que de l’enterrer. Trois ou plus veut dire qu’un domaine est ressorti sur plusieurs questions et pas une seule, ce qui est la différence entre un site vers lequel la couche de réponse se tourne et un site qui se trouvait là. En abaissant la barre à deux, la population fait 286 ; en la montant à cinq, 44.
L’instrument est un GET sur /llms.txt à l’origine de chaque domaine, en suivant les redirections. Trois de ses choix décident du résultat :
GET, jamais HEAD. Un serveur n’est pas tenu de répondre à une requête HEAD. Un vérificateur de liens antérieur de ce projet a signalé deux pages parfaitement vivantes comme mortes exactement pour cette raison, alors celui-ci demande la chose qu’il veut lire.
Un défi n’est pas un fichier absent. Les statuts 401, 403, 429 et 999 signifient qu’un contrôle anti-bot s’est mis en travers, ce qui est une preuve sur la bordure et non sur l’existence d’un fichier. Sept domaines cités et un fournisseur tombent là. Les ranger dans « pas de llms.txt » aurait fabriqué un chiffre dans le sens de notre propre titre, et c’est exactement le moment d’être prudent.
Un 200 n’est pas un fichier. Certains hébergeurs répondent à n’importe quel chemin par leur page marketing. Un corps qui ouvre un document HTML n’est pas un llms.txt quoi qu’ait dit la ligne de statut, et neuf domaines cités ont répondu ainsi.
C’est pourquoi le tableau ci-dessous porte deux dénominateurs. Interrogés, c’est la population entière. Joignables, c’est interrogés moins les défis et les échecs réseau. Les deux sont publiés parce qu’un lecteur a le droit de vérifier si le choix du dénominateur fait le travail.
Les chiffres
| Fournisseurs | Domaines vus cités | |
|---|---|---|
| Interrogés | 69 | 122 |
| Joignables | 68 | 112 |
| Publient un llms.txt | 44 | 49 |
| Part des joignables | 65 pour cent | 44 pour cent |
| Moins de 2 Ko | 6 | 3 |
| Taille médiane | 9 535 octets | 15 378 octets |
Deux choses sont à lire dans ce tableau avant de bâtir un argument dessus.
La première est l’écart lui-même : 65 pour cent contre 44. Si publier ce fichier était ce qui rapporte des citations, le groupe cité devrait être le groupe qui le publie, et la relation est inverse.
La seconde est la taille médiane, qui va contre la façon la plus facile de balayer le fichier. Parmi les domaines cités qui en publient un, la médiane dépasse 15 Ko : ce ne sont pas des gestes symboliques. Et six fichiers de fournisseur font moins de 2 Ko, présents et trop petits pour être l’index de quoi que ce soit, si bien que le chiffre des fournisseurs leur est un peu généreux.
Ce que ceci ne montre pas
C’est la section qui compte le plus, parce que le titre est du genre qu’on cite sans elle.
Cela ne montre pas que le llms.txt ne fait rien. Deux populations qui diffèrent sur une convention ne sont pas un mécanisme. Nous n’avons pas mené d’intervention, il n’y a pas d’avant et d’après, et rien ici n’isole le fichier de tout le reste de ces sites.
Les deux populations ne se ressemblent pas, mais la composition n’est pas l’explication. L’ensemble cité contient youtube.com, reddit.com, forbes.com et pcmag.com, de grands éditeurs avec leurs standards de publication et leur revue juridique, et la première version de cette section disait qu’une part inconnue de l’écart venait de là. Ce n’est pas le cas. En découpant la population citée selon la fréquence à laquelle nous l’avons vue citée, la tranche la plus citée publie le fichier à 8 sur 17 joignables et tout ce qui est en dessous à 41 sur 95, soit le même taux, et les deux bien en dessous des fournisseurs. L’écart, ce ne sont pas les grands noms.
La sélection passe au milieu. La population citée est définie par nos propres sondes, sur nos marchés, avec nos questions. Un autre jeu de questions donnerait d’autres 122.
Une convention sans consommateur démontré est difficile à tester. Aucun grand moteur n’a publié qu’il lit le llms.txt. Nous n’avons pas observé de requête du nôtre par un robot IA nommé que nous puissions attribuer au fichier plutôt qu’au crawl ordinaire, et nous n’allons pas en revendiquer une.
Nous n’avons pas mesuré si le publier a changé quoi que ce soit pour quiconque. Cela demanderait les mêmes sites avant et après, avec un contrôle, ce qui est une autre étude et bien plus lente.
Ce qui répondrait vraiment à la question
Puisque nous refusons d’y répondre, il est juste de dire ce qui le ferait.
La version propre est une intervention : prendre un ensemble de sites comparables qui ne publient pas le fichier, l’ajouter à la moitié, laisser l’autre moitié fixe, et observer les taux de citation sur un jeu de prompts gelé pendant une période assez longue pour survivre au bruit que ce registre a déjà mesuré dans les réponses IA. Ce bruit est grand, donc la période est longue et l’échantillon n’est pas petit.
La version bon marché, que personne ne semble avoir publiée, est côté serveur : regardez vos propres logs et voyez si un robot IA nommé demande /llms.txt tout court, et à quel rythme comparé à /robots.txt. C’est une requête contre les logs d’accès et cela trancherait la question du consommateur pour un site. Nous préférerions voir dix sites publier cela qu’un comptage d’adoption de plus, le nôtre compris.
Questions fréquentes sur llms.txt
Qu’est-ce qu’un fichier llms.txt ?
llms.txt est une convention proposée : un fichier markdown à la racine d’un domaine qui donne à un modèle de langage un guide curaté du site, listant les pages qui comptent et ce que fait chacune. Ce n’est pas une spécification avec un registre derrière, et aucun grand moteur n’a publié de déclaration disant qu’il lit le fichier.
Combien de fournisseurs de visibilité IA publient un llms.txt ?
44 des 68 fournisseurs que nous avons pu joindre, sur 69 interrogés, mesuré le 14 août 2026. Un a renvoyé un défi de bot, que nous comptons à part d’un fichier absent parce qu’un défi est une preuve sur la bordure et non sur l’existence du fichier. Six des fichiers qui existent font moins de 2 Ko, trop petits pour indexer un site de n’importe quelle taille.
Les sites cités dans les réponses IA publient-ils un llms.txt ?
Moins souvent que les fournisseurs. Sur 122 domaines que notre registre a notés comme cités trois fois ou plus, 112 étaient joignables et 49 en publient un, soit 44 pour cent contre 65 chez les fournisseurs. C’est une comparaison de deux populations et non un mécanisme, et les deux ne se ressemblent pas, donc cela ne montre pas que le fichier est inutile. Cela montre qu’obtenir des citations ne l’exige pas.
Le llms.txt aide-t-il la visibilité IA ?
Personne n’a publié de preuve dans un sens ou dans l’autre que nous ayons pu trouver, et cette étude ne tranche pas. Ce qu’elle exclut, c’est la version forte de l’affirmation : le fichier ne peut pas être nécessaire à la citation, puisque la plupart des domaines qui obtiennent des citations n’en ont pas. Savoir s’il aide à la marge demanderait une intervention avec contrôle, pas un comptage d’adoption.
Devrais-je ajouter un llms.txt à mon site ?
C’est peu coûteux, ce n’est pas nuisible, et si votre site est grand et mal structuré c’est une chose raisonnable à tendre à un robot. Ce que nous ne ferions pas, c’est l’acheter comme produit de visibilité, ni le laisser déplacer le travail sur ce que ce registre a vraiment mesuré varier avec la citation, c’est-à-dire ce qu’une page dit et si quelqu’un d’autre le dit aussi. Regardez d’abord vos propres logs d’accès : si aucun robot IA n’a jamais demandé le fichier, vous avez appris plus en une requête que n’importe quel comptage d’adoption.
Comment vérifier ce qu’un domaine publie ?
Demandez /llms.txt à l’origine du domaine avec un GET et non un HEAD, et lisez le corps avant de croire le code de statut. S’il ouvre un document HTML on vous a donné une page marketing, pas un fichier. Si la réponse est 401, 403, 429 ou 999, vous avez rencontré un défi de bot et n’avez rien appris sur la présence du fichier.
Interrogez une IA sur cet article
Ouvre votre assistant avec cette page déjà chargée, pour vérifier les chiffres, discuter la méthode ou demander ce que cela change pour vous.
- ChatGPT (ouvre un nouvel onglet. la question est pré-remplie, appuyez sur entrée pour l’envoyer)
- Claude (ouvre un nouvel onglet. la question est pré-remplie, appuyez sur entrée pour l’envoyer)
- Perplexity (ouvre un nouvel onglet)
- Google AI Mode (ouvre un nouvel onglet)
Perplexity et Google répondent directement. ChatGPT et Claude remplissent le champ et attendent que vous appuyiez sur entrée, ce qui relève de leur comportement et non du nôtre.