Saltar al contenido
AI VisibilityGEO
ES

El rastreador se lleva tu portada y el asistente se lleva tus artículos. Un día de cada siete, ninguno de los dos.

Una semana de nuestro log de borde por agente y por ruta. Los asistentes gastan una mediana del 77% en artículos y los rastreadores el 4%.

· 13 min de lectura

Toda esta categoría discute si los rastreadores de IA pueden llegar a tu web. Casi nadie ha mirado qué hacen cuando llegan. Leímos una semana de nuestro log de borde agrupado por agente y por ruta, y los agentes se parten en dos grupos que se comportan al revés el uno del otro.

Los rastreadores se llevan tu portada y los asistentes se llevan tus artículos. Sobre 57 lecturas de 13 agentes durante 7 días, el grupo de asistentes gasta una mediana del 77% de sus peticiones en contenido y el 8% en la portada. El grupo de rastreadores lo invierte: una mediana del 4% en contenido y el 45% en la portada.

Y después hay un día de cada siete que borra la distinción entera, que es la parte de esto que sirve para tu web tanto si nuestra división se reproduce como si no.

Disclosure y método: EchoWi vende medición de visibilidad en IA, así que esto es una medición de nuestra propia categoría hecha con nuestros propios datos. La fuente es el log de borde de nuestro dominio del 13 al 19 de agosto de 2026, agrupado por ruta y por agente solicitante, con el tipo de página decidido por la URL y no por ningún juicio sobre la intención. Una lectura es un agente en un día; las lecturas por debajo de un listón de veinte peticiones se guardan en el registro y se excluyen de toda cuota, porque un porcentaje de un puñado es ruido. Aquí abajo solo aparecen cuotas y los denominadores se retiran a propósito. Cualquiera con un log de CDN puede correr esta consulta contra su propia web y comprobar si la forma se repite. Las filas están en nuestro registro de mediciones.


La versión corta

  1. Rastreadores y asistentes no son el mismo visitante. Vienen de las mismas empresas y van a sitios opuestos.
  2. La división es una mediana, no una regla. 5 lecturas de rastreador dedican la mitad o más de sus peticiones a artículos, la más alta el 77%.
  3. Un día de cada siete la anula, y es el día con más tráfico de la semana.
  4. Ni un agente pidió un gemelo en markdown en toda la semana, mientras que 11 de ellos sí pidieron los ficheros de texto legibles por máquina.
  5. El destino más grande del asistente mayor son nuestras reseñas de herramientas de otras empresas.

Lo que dice la semana

AgenteTipoContenido, por día
ChatGPT-Userasistente10, 84, 90, 92, 71, 82, 88
Claude-Userasistente69, 84, 59, 78, 81, 74, 82
PerplexityBotasistente22, 46, 83, 67, 36, 64, 77
GPTBotrastreador0, 4, 73, 0, 0, 0, 0
OAI-SearchBotrastreador4, 10, 0, 0, 6, 12, 0
ClaudeBotrastreador0, 0
Amazonbotrastreador4, 37, 58, 47, 35, 68
Applebotrastreador0, 18, 42, 9, 22, 16
Bytespiderrastreador3, 0, 0, 2, 15

Porcentajes de las peticiones de cada agente que cayeron en un artículo, una reseña, un estudio, un término del glosario o nuestro registro de mediciones. Los días van del 13 al 19 de agosto; un hueco es un día cuya lectura quedó por debajo del listón.

Lee las filas en vez de las medianas y hay dos cosas evidentes. Claude-User no baja nunca del 59%. OAI-SearchBot no sube nunca del 12%. Esos dos tienen la misma forma todos los días de la semana, vienen de empresas distintas, y ninguno de los dos tiene nada que ver con nuestra configuración.

La corrección, que es la razón entera de ampliar un estudio

Publicamos esto con dos días medidos. Aquella versión daba la mediana de asistentes en el 58% de contenido y la de rastreadores en el 2%, y sacaba la misma conclusión.

La semana dice 77% y 4%. La primera lectura se quedó corta en vez de inventarse la división, que es la dirección cómoda para nosotros y sigue siendo una corrección. Dos días de cualquier cosa son una forma vista dos veces.

Y mató una frase. La versión de dos días decía que tres lecturas de rastreador no pidieron ningún artículo, lo cual es cierto y un lector oye fácilmente como que los rastreadores no piden artículos. Sobre la semana eso es falso: 5 lecturas de rastreador dedican la mitad o más de sus peticiones a artículos, y GPTBot pasó un día en el 73% con un volumen holgadamente dentro del rango utilizable. Un rastreador que pide tus artículos no es raro, es un comportamiento minoritario con una cola larga, y hay una diferencia real entre esas dos frases para quien tenga que decidir qué permite.

El día en que la división desapareció

El 13 de agosto siete agentes se fueron a la portada a la vez. ChatGPT-User, que gasta entre el 71 y el 92 por ciento de sus peticiones en artículos todos los demás días de la semana, gastó el 10% en artículos y el 84% en la portada, con un volumen del orden de diez veces su norma semanal. GPTBot, ClaudeBot, Google-Extended, OAI-SearchBot y Amazonbot se pusieron todos cerca del 90% de portada el mismo día. Fue el día de más tráfico de la semana en este dominio.

Al día siguiente cada uno de ellos había vuelto a su forma de siempre.

No vamos a explicarlo, porque no podemos. Un rastreo coordinado y una ráfaga de tráfico llevando nombres de agente producen exactamente las mismas filas, y una cadena de agente es una afirmación y no una prueba. Lo que importa no es la causa:

Cualquiera que hubiera leído un solo día de logs el 13 de agosto habría concluido que todos los agentes de IA se comportan igual y que todos quieren únicamente tu portada. Habría estado leyendo el único día de siete en que eso es lo que dicen los datos. Ese es el aviso práctico de este estudio, y es más fuerte que la propia división, porque se aplica a tus logs salga lo que salga tu división.

Nadie pidió el markdown

Publicamos un gemelo legible por máquina de cada página: llms.txt, llms-full.txt, y un index.md al lado de cada index.html que la negociación de contenido sirve además bajo Accept: text/markdown. Es el montaje que recomienda toda esta categoría.

En una semana, sobre 57 lecturas, ningún agente pidió un solo gemelo en markdown. Ni uno.

Los ficheros de texto son otra historia. 11 de los 13 agentes pidieron los ficheros legibles por máquina, y una lectura les dedicó el 44% de sus peticiones. OAI-SearchBot, Claude-User y Bytespider son los que más, y Claude-User en concreto gasta entre el 9 y el 41 por ciento de su día en ellos según el día.

Así que la superficie de máquina sí se lee, y la convención concreta que más entusiasmo genera es la que no tocó nada. Nuestra conclusión no es quitarla: el fichero no cuesta nada de generar, una semana es una semana, y un agente que hoy no pregunta puede preguntar el trimestre que viene. Nuestra conclusión es que si alguien te vende los gemelos en markdown como palanca de visibilidad en IA, pídele el log de peticiones. Después le hicimos esa misma pregunta a la categoría, y 12 de 77 proveedores de nuestro catálogo sirven markdown mientras 63 contestan la petición con HTML.

Un robots.txt dice qué está permitido. Esto dice qué pasó

Casi todo lo que se escribe sobre el rastreo de IA es una lectura de declaraciones. Abres un robots.txt, ves qué agentes están nombrados, y concluyes algo sobre el acceso. Nosotros hemos corrido esa medición sobre dos poblaciones y merece la pena correrla, pero contesta una pregunta más estrecha de lo que parece.

Una declaración es una declaración de política. No puede decirte si el agente la obedeció, si llegó siquiera, ni qué se llevó. Son tres hechos distintos y sólo el log tiene los dos últimos.

Aquí divergen de una forma que importa. Nuestra web permite a todos estos agentes, por igual, sin una sola regla que separe a uno de otro. Bajo una política idéntica los agentes produjeron dos itinerarios opuestos, y un día un tercero. Lo que decida eso, no es nuestra configuración, porque nuestra configuración les dice lo mismo a todos.

Qué puede hacer con esto quien tiene una web

Deja de tratar un solo número como tu cobertura de rastreo. Si un panel te dice que los bots de IA pidieron N páginas esta semana, ese número suma dos poblaciones que hacen lo contrario, más lo que aporten los días anómalos. Desglosa por agente antes de leerlo. Es una dimensión más en la consulta.

No leas nunca un solo día. Nuestro peor día no es una lectura mala, es una lectura plausible que dice lo contrario que la semana. Si tu herramienta de logs te enseña ayer por defecto, ese es el número sobre el que vas a actuar.

Mira qué páginas tuyas se llevan los asistentes. Las nuestras se llevan nuestras reseñas de otras empresas, que es un hallazgo que no queríamos y que no habríamos sacado de ninguna herramienta de keywords. Las tuyas pueden llevarse tu documentación, tus precios, o una comparativa que escribiste hace un año. Esa lista está a una consulta de tus propios logs y no está en el planificador de palabras clave de nadie.

Lo que este estudio no demuestra

Una sola web. Esto es una forma, y una forma vista en un dominio durante una semana. Una segunda web diría si la división es general o nuestra.

Una cadena de agente es una afirmación y no una prueba. Cada cifra de aquí es lo que se identificó como ese agente. No puedes demostrar el acceso de un rastreador mandando una cadena de agente ni atribuir tráfico leyéndola. Lo que hace creíble la forma y no el volumen es que los dos grupos se diferencian entre sí de un modo que un suplantador no tiene motivo para reproducir, y que las rutas son artículos y portadas y no los ficheros de credenciales que pide un escáner. La anomalía del 13 de agosto es justo donde ese techo aprieta, y lo decimos en vez de elegir la explicación que nos gusta.

El tipo de página lo decide la URL. Una reseña es una ruta que acaba en -review/. Es una regla que cualquiera puede aplicar a nuestra web y comprobar, y clasificará mal cualquier página cuya URL no la describa.

Que te pidan la página no es que te citen. Este estudio mide solo lo primero. Las páginas más pedidas de nuestro dominio son las que menos probablemente nos nombran en la respuesta que sigue, porque son sobre otra empresa.

Y las cifras absolutas se retiran a propósito. Publicamos mediciones sobre el mercado y no nuestras cifras de tráfico, en ninguna dirección. La compensación es el método: la consulta son tres líneas y tus propios logs la contestan.


Preguntas frecuentes sobre el rastreo de los agentes de IA

¿Los rastreadores de IA visitan de verdad las webs pequeñas?

En estos siete días, 13 agentes de IA distintos lo hicieron, de al menos seis empresas, y llegaron todos los días en vez de en una ráfaga. La pregunta útil no es si llegan sino cuál de ellos llega, porque el rastreador que te indexa y el asistente que responde contigo son visitantes distintos con itinerarios distintos.

¿Qué diferencia hay entre GPTBot y ChatGPT-User?

GPTBot rastrea para entrenamiento e indexación con su propio calendario. ChatGPT-User pide una URL concreta porque alguien hizo una pregunta y un paso de recuperación eligió esa URL. En nuestra semana ChatGPT-User gastó una amplia mayoría de sus peticiones en artículos seis días de siete, mientras GPTBot casi ninguna en cinco de ellos. Bloquear uno y permitir el otro son decisiones completamente distintas.

¿Debería bloquear a los rastreadores de IA?

Es una decisión de negocio y esta medición no la toma por ti. Lo que sí dice es que bloquear no es un solo interruptor: el agente que podría citarte mañana y el que se entrena contigo esta noche llegan con nombres distintos, y una regla escrita para uno se aplica al otro solo si la escribes así. Medimos aparte que la categoría que vende visibilidad en IA no bloquea a ninguno, mientras que las plataformas donde el consejo te manda publicar bloquean a varios.

¿Merece la pena publicar llms.txt?

Los ficheros de texto sí se piden: 11 de los 13 agentes pidieron ficheros legibles por máquina en algún momento de la semana, y una lectura les dedicó el 44% de su día. Los gemelos en markdown de cada página son la parte que no tocó nada. Nos quedamos con los dos, porque generarlos es gratis y una semana es una ventana corta, pero no describiríamos ninguno de los dos como una palanca de visibilidad medida, y quien te los venda tampoco debería.

¿Por qué iba un asistente a pedir la reseña de un competidor?

Porque la pregunta que está contestando es probablemente sobre ese competidor. Una página que compara herramientas es una respuesta candidata para una pregunta de comparación, y las preguntas de comparación son la mayor parte de la demanda comercial de esta categoría. Es también por lo que el destino más grande de nuestros propios logs es un conjunto de páginas sobre otras empresas.

¿Cómo corro esto en mi propia web?

Agrupa tus logs de CDN o de servidor por agente y por ruta para un solo día, quédate con las filas cuyo agente nombre a un agente de IA conocido, y clasifica las rutas por el tipo de página que son. Después hazlo seis días más, porque el sentido entero de este estudio es que un solo día miente. El hallazgo es la diferencia entre dos columnas: la cuota que cae en tu portada y la que cae en tus artículos.

¿Que te pidan la página significa que te citan?

No, y la distancia entre las dos cosas se puede medir. Las páginas más pedidas de nuestro dominio son las que menos probablemente nos nombran en la respuesta que sigue. Pedir la página es el primer paso de una cadena y el único que observa este estudio.

Pregúntale a la IA sobre este artículo

Abre tu asistente con esta página ya cargada, para comprobar las cifras, discutir el método o preguntar qué significa en tu caso.

Perplexity y Google responden directamente. ChatGPT y Claude dejan la pregunta escrita y esperan a que pulses intro, que es su comportamiento y no algo que podamos cambiar.

Escrito por

Maher El Ouahabi

CTO y cofundador de EchoWi

Construye el software que enseña a las marcas lo que la IA dice de ellas, y qué cambiar para que la siguiente respuesta sea mejor. Doce motores, medidos antes y después.

LinkedIn Maher El Ouahabi (se abre en una nueva pestaña)