Saltar al contenido
AI VisibilityGEO
ES

La mayoría de dominios que se llevan citas de IA no publica un llms.txt. La mayoría de proveedores que venden la idea, sí.

Pedimos el llms.txt a 69 proveedores de visibilidad en IA y a 122 dominios que hemos visto citados, el mismo día. Los proveedores lo publican mucho más.

· 11 min de lectura

El 14 de agosto de 2026 pedimos su llms.txt a dos grupos con el mismo script y el mismo día: los 69 proveedores de nuestro catálogo de herramientas de visibilidad en IA, y los 122 dominios que nuestro registro tiene anotados como citados tres veces o más en respuestas de IA. De los proveedores que pudimos alcanzar, 44 de 68 lo publican. De los dominios citados, 49 de 112.

Quien vende la convención la publica en torno a dos tercios. Los sitios que de verdad se llevan las citas la publican en menos de la mitad.

Aviso: EchoWi vende medición de visibilidad en IA y publica un llms.txt, así que estamos dentro de la fila de proveedores y tenemos interés en lo que vale este fichero. El método es un GET a /llms.txt en el origen de cada dominio, un solo día, contando los retos de bot y los fallos de red aparte de los ficheros ausentes. Los recuentos están en nuestro registro de mediciones, la regla de población está escrita abajo, y repetirlo contra nosotros cuesta una tarde.


La versión corta

  1. Los proveedores publican un llms.txt en 44 de 68 dominios alcanzables. Ese es el grupo cuyo producto es hacerte legible para las máquinas.
  2. Los dominios que hemos visto citados lo publican en 49 de 112. Ese es el grupo al que las máquinas citan de verdad.
  3. La diferencia va en la dirección contraria al argumento de venta. Si el fichero fuera lo que gana citas, esperarías que el grupo citado fuera por delante, y va por detrás unos veinte puntos.
  4. Esto no es evidencia de que el fichero perjudique, ni de que no haga nada. Dos poblaciones que difieren en una convención no son un mecanismo, y no vamos a fingir lo contrario.
  5. Sí basta para una afirmación estrecha, y esa afirmación es útil: llevarse citas no exige un llms.txt, porque la mayoría de los dominios que se las llevan no lo tiene.
  6. Seis ficheros de proveedor están por debajo de 2 KB, o sea presentes y demasiado pequeños para indexar nada.

Qué dice ser un llms.txt

llms.txt es una convención propuesta: un fichero markdown en la raíz de un sitio que le da a un modelo de lenguaje un mapa curado de lo que importa, en el orden en que se lo recomendaría un humano. El argumento es sencillo y no es irrazonable. Un rastreador que aterriza en un sitio grande tiene que inferir la estructura desde la navegación y los enlaces internos; un fichero que dice «estas son las doce páginas que importan y esto hace cada una» le quita ese trabajo de adivinar.

No tiene detrás una especificación en el sentido en que sí la tiene Content Signals, ni registro, ni una declaración publicada por ningún motor grande de que lo lea. Ese último punto importa y volveremos a él, porque una convención de la que nadie ha demostrado que se consuma es otra cosa distinta de una cuyo consumidor se conoce.

Lo que sí tiene es adopción dentro de una industria concreta: las herramientas que venden visibilidad en IA. Esa es la observación con la que empieza esta pieza.

Dos poblaciones, un día, un instrumento

La comparación solo significa algo si las dos mitades se midieron igual y a la vez, así que así se hizo.

La población de proveedores son las 69 herramientas de nuestro catálogo verificado de software de visibilidad en IA y optimización para motores de respuesta. Nos incluye.

La población citada es cada dominio que nuestro registro de mediciones tiene anotado como aparecido en tres o más filas de sonda distintas: 122 de los 1.019 dominios distintos que ha visto. El umbral es arbitrario y lo declaramos en vez de enterrarlo. Tres o más significa que un dominio ha salido en varias preguntas y no en una, que es la diferencia entre un sitio al que la capa de respuesta acude y un sitio que estaba por ahí. Bajando el listón a dos, la población son 286; subiéndolo a cinco, son 44.

El instrumento es un GET a /llms.txt en el origen de cada dominio, siguiendo redirecciones. Tres de sus decisiones deciden el resultado:

GET, nunca HEAD. Un servidor no está obligado a responder a una petición HEAD. Un comprobador de enlaces anterior de este proyecto reportó dos páginas perfectamente vivas como muertas por ese mismo motivo, así que este pide la cosa que quiere leer.

Un reto no es un fichero ausente. Los estados 401, 403, 429 y 999 significan que una comprobación de bots se puso en medio, que es evidencia sobre el borde y no sobre si existe un fichero. Siete dominios citados y un proveedor caen ahí. Meterlos en «no tiene llms.txt» habría fabricado un número en la dirección de nuestro propio titular, que es justo cuando hay que tener más cuidado.

Un 200 no es un fichero. Algunos alojamientos responden cualquier ruta con su página de marketing. Un cuerpo que abre un documento HTML no es un llms.txt diga lo que diga la línea de estado, y nueve dominios citados respondieron así.

Por eso la tabla de abajo lleva dos denominadores. Preguntados es la población entera. Alcanzables es preguntados menos retos y fallos de red. Los dos se publican porque el lector tiene derecho a comprobar si la elección de denominador está haciendo el trabajo.

Los números

ProveedoresDominios que hemos visto citados
Preguntados69122
Alcanzables68112
Publican un llms.txt4449
Cuota de alcanzables65 por ciento44 por ciento
Menos de 2 KB63
Tamaño mediano9.535 bytes15.378 bytes

Dos cosas hay que leer en esa tabla antes de construir ningún argumento sobre ella.

La primera es la diferencia: 65 por ciento contra 44. Si publicar este fichero fuera lo que gana citas, el grupo citado debería ser el grupo que lo publica, y la relación va al revés.

La segunda es el tamaño mediano, que va en contra del descarte más fácil del fichero. Entre los dominios citados que sí lo publican, la mediana pasa de 15 KB: no son gestos simbólicos. Y seis ficheros de proveedor están por debajo de 2 KB, presentes y demasiado pequeños para ser el índice de nada, así que la cifra de proveedores es algo generosa con los proveedores.

Qué no enseña esto

Esta es la sección que más importa, porque el titular es de los que se citan sin ella.

No enseña que el llms.txt no haga nada. Dos poblaciones que difieren en una convención no son un mecanismo. No hemos corrido una intervención, no hay antes y después, y aquí nada aísla el fichero de todo lo demás que tienen estos sitios.

Las dos poblaciones no se parecen, aunque la composición resulta no ser la explicación. El conjunto citado contiene youtube.com, reddit.com, forbes.com y pcmag.com, editores grandes con sus estándares de publicación y su revisión legal, y la primera versión de esta sección decía que una parte desconocida de la diferencia era eso. No lo es. Partiendo la población citada por lo a menudo que la hemos visto citada, el tramo más citado publica el fichero en 8 de 17 alcanzables y todo lo de debajo en 41 de 95, que es la misma tasa y las dos muy por debajo de los proveedores. La diferencia no son los nombres grandes.

La selección pasa por el medio. La población citada la definen nuestras propias sondas, en nuestros mercados, con nuestras preguntas. Otro conjunto de preguntas daría otros 122.

Una convención sin consumidor demostrado es difícil de probar. Ningún motor grande ha publicado que lea el llms.txt. No hemos observado una petición del nuestro por parte de un rastreador de IA nombrado que podamos atribuir al fichero y no al rastreo normal, y no vamos a afirmar una.

No hemos medido si publicarlo cambió algo para nadie. Eso necesitaría los mismos sitios antes y después, con control, que es otro estudio y mucho más lento.

Qué contestaría de verdad la pregunta

Ya que nos negamos a contestarla, es justo decir qué lo haría.

La versión limpia es una intervención: coger un conjunto de sitios comparables que no publiquen el fichero, añadírselo a la mitad, dejar la otra mitad fija, y mirar las tasas de citación sobre un conjunto de prompts congelado durante un periodo lo bastante largo para sobrevivir al ruido que este registro ya ha medido en las respuestas de IA. Ese ruido es grande, así que el periodo es largo y la muestra no es pequeña.

La versión barata, que no parece haber publicado nadie, es del lado del servidor: mira tus propios logs y comprueba si algún rastreador de IA nombrado pide /llms.txt siquiera, y a qué ritmo comparado con /robots.txt. Eso es una consulta contra los logs de acceso y zanjaría la pregunta del consumidor para un sitio. Preferiríamos ver diez sitios publicando eso que ver otro recuento de adopción, el nuestro incluido.

Preguntas frecuentes sobre llms.txt

¿Qué es un fichero llms.txt?

llms.txt es una convención propuesta: un fichero markdown en la raíz de un dominio que le da a un modelo de lenguaje una guía curada del sitio, listando las páginas que importan y para qué es cada una. No es una especificación con un registro detrás, y ningún motor grande ha publicado una declaración de que lea el fichero.

¿Cuántos proveedores de visibilidad en IA publican un llms.txt?

44 de los 68 proveedores que pudimos alcanzar, de 69 preguntados, medido el 14 de agosto de 2026. Uno devolvió un reto de bot, que contamos aparte de un fichero ausente porque un reto es evidencia sobre el borde y no sobre si el fichero existe. Seis de los ficheros que existen están por debajo de 2 KB, demasiado pequeños para indexar un sitio de cualquier tamaño.

¿Los sitios que se llevan citas en respuestas de IA publican un llms.txt?

Menos que los proveedores. De 122 dominios que nuestro registro tiene anotados como citados tres veces o más, 112 eran alcanzables y 49 lo publican, que es el 44 por ciento contra el 65 de los proveedores. Es una comparación de dos poblaciones y no un mecanismo, y las dos no se parecen, así que no enseña que el fichero sea inútil. Sí enseña que llevarse citas no lo exige.

¿Ayuda el llms.txt a la visibilidad en IA?

Nadie ha publicado evidencia en un sentido ni en otro que hayamos podido encontrar, y este estudio no lo zanja. Lo que sí descarta es la versión fuerte de la afirmación: el fichero no puede ser necesario para la citación, porque la mayoría de los dominios que se llevan citas no lo tiene. Si ayuda en el margen necesitaría una intervención con control, no un recuento de adopción.

¿Debería añadir un llms.txt a mi sitio?

Es barato, no hace daño, y si tu sitio es grande y está mal estructurado es razonable dárselo a un rastreador. Lo que no haríamos es comprarlo como producto de visibilidad, ni dejar que desplace el trabajo sobre las cosas que este registro sí ha medido variando con la citación, que son qué dice una página y si alguien más lo dice también. Mira antes tus propios logs de acceso: si ningún rastreador de IA ha pedido nunca el fichero, has aprendido más en una consulta que con cualquier recuento de adopción.

¿Cómo compruebo qué publica un dominio?

Pide /llms.txt al origen del propio dominio con un GET y no con un HEAD, y lee el cuerpo antes de creerte el código de estado. Si abre con un documento HTML te han dado una página de marketing y no un fichero. Si la respuesta es 401, 403, 429 o 999 has topado con un reto de bot y no has aprendido nada sobre si el fichero está.

Pregúntale a la IA sobre este artículo

Abre tu asistente con esta página ya cargada, para comprobar las cifras, discutir el método o preguntar qué significa en tu caso.

Perplexity y Google responden directamente. ChatGPT y Claude dejan la pregunta escrita y esperan a que pulses intro, que es su comportamiento y no algo que podamos cambiar.

Escrito por

Maher El Ouahabi

CTO y cofundador de EchoWi

Construye el software que enseña a las marcas lo que la IA dice de ellas, y qué cambiar para que la siguiente respuesta sea mejor. Doce motores, medidos antes y después.

LinkedIn Maher El Ouahabi (se abre en una nueva pestaña)