Le preguntamos a 71 páginas que citó una IA qué declaran de sí mismas. Menos de la mitad dice qué son.
De 46 páginas legibles que las respuestas de IA citaron, el 93% lleva algún JSON-LD y el 41% declara qué es la página. Tres no llevan nada.
Todas las listas de comprobación de esta categoría te dicen que marques tus páginas. Casi nadie le ha preguntado a las páginas que las respuestas de IA citan de verdad qué declaran. Nosotros sí: el 93% lleva algún JSON-LD, el 41% lleva un tipo que dice qué es la página, y tres no llevan nada.
Lo interesante es la población. No son páginas que hayamos elegido como buenos ejemplos. Cada URL de aquí la devolvió una respuesta de IA como fuente en una medición que ya habíamos hecho y congelado, así que la muestra la eligieron los motores.
Cómo se midió: 71 URLs citadas como fuente en 9 preguntas de categoría en 4 mercados, cada una pedida una vez con un cliente HTTP normal el 18 de agosto de 2026, con una segunda lectura para las que fallaron. Se parseó cada bloque de JSON-LD y se recogieron sus valores de
@type. Las páginas que contestaron casi sin texto en el cuerpo van contadas como armazón y no como páginas que no declaran nada, y las que devolvieron un reto de bot o ninguna respuesta quedan fuera de todos los recuentos. Las filas completas están en nuestro registro de mediciones.
Transparencia: EchoWi vende medición de visibilidad en IA, y un resultado que dice que los datos estructurados no son lo que separa a estas páginas es un resultado en contra de algo por lo que varias herramientas de nuestra categoría te puntúan. Las URLs, los cubos, la fecha y el método están todos aquí, y la población salió de nuestras propias mediciones congeladas y no de una lista que montáramos, así que cualquiera puede repetirlo en contra nuestra.
La versión corta
- El 93% de las páginas citadas legibles lleva algún JSON-LD. El armazón del editor es casi universal:
Organization,WebPage,BreadcrumbList,Article. - El 41% lleva un tipo que dice qué es la página. Una comparativa, una reseña, un producto, un conjunto de preguntas, una pieza de software. El resto solo declara quién la publicó.
FAQPagees el tipo que estas páginas llevan de verdad, en 17 de 46.ItemListsale en 6 yReviewen 3.- Tres páginas citadas no llevan ningún dato estructurado, y no están vacías: 29.724, 12.429 y 6.737 caracteres de texto visible.
- Todas las páginas ilegibles del conjunto son plataformas. 17 URLs de YouTube, dos de Reddit y una de Facebook contestan casi sin texto en el cuerpo, que es un hecho sobre dónde guardan su contenido esas plataformas.
Qué se contó y qué se rechazó
La unidad es una URL que una respuesta de IA nombró como fuente. Salieron de nueve preguntas, en contabilidad, nóminas, CRM, tarjetas de viaje y auriculares, en Estados Unidos, España, Francia y Alemania.
Para cada URL se parseó cada <script type="application/ld+json"> y se recogieron los @type que hubiera dentro, incluidos los anidados. Después se partieron los tipos en dos grupos, y esa partición es todo el estudio.
Los tipos de editor dicen quién puso ahí la página: Organization, WebSite, Person, BreadcrumbList, ImageObject, WebPage, Article. Los emite cualquier gestor de contenidos, y su presencia no le dice a una máquina nada sobre qué está mirando.
Los tipos de qué-es-la-página dicen qué es la cosa: ItemList para una comparativa, Review para una reseña, Product para un producto, SoftwareApplication para software, FAQPage para un conjunto de preguntas y respuestas. Son los que una capa de recuperación podría usar para decidir que una página contesta una pregunta comparativa.
Tres estados van separados en vez de mezclados, porque mezclarlos es la forma más habitual de que un barrido así publique un número que significa otra cosa:
- Leída, o sea que contestó con un cuerpo que un cliente normal puede leer. Solo estas cuentan.
- Armazón, o sea que contestó con menos de 500 caracteres de texto visible. Eso es un hecho sobre dónde guarda su contenido, no sobre si lo tiene.
- Bloqueada o sin respuesta, o sea que nunca vimos la página. Cuatro devolvieron un reto de bot y una no contestó nunca.
El resultado
| De 46 leídas | |
|---|---|
| Algún JSON-LD | 43 (93%) |
| Un tipo que dice qué es la página | 19 (41%) |
| Ningún dato estructurado | 3 (7%) |
Y el desglose por tipo es donde el consejo estándar y la evidencia se separan:
| Tipo | Páginas |
|---|---|
| FAQPage | 17 |
| ItemList | 6 |
| Product | 6 |
| Review | 3 |
| SoftwareApplication | 2 |
El consejo que todo el mundo da sobre contenido comparativo es marcarlo como ItemList, porque es el tipo que declara «esta página es un conjunto ordenado de N cosas». Entre las páginas que una IA citó de verdad para estas nueve preguntas, ItemList sale seis veces. FAQPage sale casi tres veces más.
Algunas de las páginas con el marcado más fuerte son exactamente quien esperarías: thepointsguy.com y lesnumeriques.com llevan FAQPage, ItemList, Product y Review a la vez. Pero bankrate.com, creditcards.com y nytimes.com están en las mismas respuestas con dos tipos cada una, y frandroid.com y soundcore.com con uno.
Las tres que no declaran nada, y por qué importan más que el resto
bakedwith.com, zoho.com y capitalone.com fueron citadas cada una por una respuesta de IA y no llevan JSON-LD, ni microdatos, ni RDFa. No son páginas recortadas ni redirecciones: 29.724, 12.429 y 6.737 caracteres de texto legible respectivamente.
Esa es la observación que limita lo que se puede afirmar aquí. Si los datos estructurados fueran un requisito para que te citen en esta categoría, esas páginas no podrían estar en el conjunto. Están, así que no lo son.
La lectura honesta de eso es estrecha, y merece decirse con precisión precisamente porque la ancha es muy tentadora. Esto no dice que el marcado no sirva. No dice que añadir esquema no vaya a ayudarte. Dice una cosa: no puedes mirar una citación en esta categoría y deducir que la página estaba marcada, porque el 7% no llevaba marcado ninguno y el 59% no declaraba qué era.
Todos los armazones del conjunto son plataformas
Veinte de las 71 URLs contestaron casi sin nada que un cliente normal pudiera leer. Las veinte son plataformas: 17 páginas de vídeo de YouTube con 254 caracteres visibles cada una, dos hilos de Reddit con cinco caracteres y una página de Facebook con 44.
Ya lo hemos medido antes sobre otra población, y el resultado se replica exacto: esas plataformas guardan el material en la cabecera del documento y en su propia capa de renderizado, no en el cuerpo. Una página de YouTube lleva su título, su descripción y un VideoObject entero en JSON-LD mientras su cuerpo no dice casi nada.
La consecuencia práctica no va sobre YouTube. Va sobre que cualquier barrido que cuente «páginas sin contenido visible» va a reportar URLs de plataforma como páginas vacías salvo que las separe, y las URLs de plataforma son una parte grande de lo que citan las respuestas de IA. En este conjunto son el 28% de todo lo que nombraron los motores.
El grupo de comparación, añadido
La sección anterior decía que este estudio no podía decirte qué llevan las páginas no citadas, porque todas las URLs de aquí ya habían sido citadas. Ese hueco está tapado con el control más barato posible: las mismas nueve preguntas puestas a los resultados orgánicos de Google, y cada URL que rankea y que la respuesta de IA no citó, pedida con el mismo cliente y parseada con el mismo código. 103 de ellas, 71 legibles.
La dirección estaba escrita antes de la primera llamada. Si los controles salían más de 15 puntos por debajo del lado citado en los tipos que dicen qué es una página, entonces el marcado separaría los dos grupos en esta muestra, la asociación que otros han reportado se replicaría en nuestra propia población, y eso es lo que estaríamos publicando.
| Citadas | Rankean, no citadas | |
|---|---|---|
| Páginas leídas | 46 | 71 |
| Algún JSON-LD | 93% | 77% |
| Un tipo que dice qué es la página | 41% | 31% |
| Ningún dato estructurado | 7% | 14% |
La diferencia en tipos que dicen qué es la página son 10 puntos, y el umbral eran 15. Así que el titular no cambia. Lo que sí es cierto, y merece decirse sin inflarlo, es que las tres filas apuntan igual: las páginas citadas llevan algo más de marcado que las no citadas que rankean para la misma pregunta, por márgenes demasiado pequeños para llamar al marcado lo que las separa. Qué páginas pide de verdad un asistente frente a las que enseña Google es otra pregunta, y necesita dos instrumentos sobre el mismo dominio a la vez.
El detalle por tipo es más concreto que los totales:
| Tipo | Citadas, de 46 | No citadas, de 71 |
|---|---|---|
| FAQPage | 17 | 17 |
| ItemList | 6 | 2 |
| Product | 6 | 11 |
FAQPage sale el mismo número de veces en los dos lados, lo que sobre denominadores distintos significa que es proporcionalmente más común entre las citadas. ItemList es tres veces más común entre las citadas. Y Product va al revés, más común entre las páginas que rankearon y no fueron citadas, que es la fila que impide que esto sea una historia sobre el marcado en general.
Hay otra diferencia que no va de esquema: 12 de las 103 URLs de control contestaron a nuestra petición con un reto de bot, frente a 4 de las 71 citadas. Eso es 12% contra 6%, sobre números pequeños, y apunta a algo más plausible que el marcado como mecanismo. Tampoco es evidencia sobre los rastreadores de IA, porque una página que reta al cliente HTTP de este barrido no está necesariamente retando a GPTBot, y eso no lo probamos aquí.
Qué nos llevaríamos de esto si fuéramos a comprar
No compres una puntuación que sea sobre todo una auditoría de esquema. Varias herramientas de esta categoría te califican por cobertura de marcado. Con esta evidencia esa nota mide algo real sobre tu página y algo débil sobre tus posibilidades de que te citen, porque el 59% de las páginas que sí fueron citadas no lleva los tipos que la nota premia.
Si vas a añadir un tipo, añade el que estas páginas llevan. FAQPage está en 17 de 46, y tiene un mecanismo evidente detrás: una pregunta con una respuesta autocontenida es la unidad que una capa de recuperación puede levantar entera. Es la misma razón por la que nuestro propio corpus pone un FAQPage en casi todas sus páginas, que es una práctica que adoptamos antes de esta medición y no por ella.
No concluyas que el marcado da igual. Este estudio no puede sostener eso, y el motivo está en la sección siguiente.
Qué no demuestra esto
- La población está seleccionada por el resultado. Todas las URLs de aquí fueron citadas. Eso hace el estudio barato y concluyente para matar una afirmación, que las páginas citadas de esta categoría van muy marcadas, e inútil para la contraria. Arriba se le ha añadido un grupo de control, de las mismas nueve preguntas, y estrecha la diferencia en vez de cerrar la pregunta: las páginas que rankean y no se citan llevan marcado a un ritmo parecido. El estudio con una comparación mucho mayor es el de AirOps, que reportó un 61% de páginas citadas por ChatGPT con tres o más tipos de esquema frente a un 25% de resultados de primera página no citados, sobre más de 12.000 URLs. El nuestro es una muestra más pequeña que hace una pregunta más estrecha sobre una población que eligieron los motores, y los dos no están en conflicto: el suyo encuentra una asociación sobre un conjunto mucho mayor, y la prueba controlada que corrió Ahrefs sobre 1.885 páginas no encontró un aumento significativo de citaciones al añadir esquema. Asociación, ninguna mejora medida y ningún marcado común entre las páginas citadas a las que llegamos: tres mediciones distintas apuntando igual sobre cuánto peso darle a una nota de marcado.
- Una lectura y un cliente. Una página que construya su JSON-LD en el navegador nos parecería desnuda. Eso empuja las cifras reales hacia arriba y no hacia abajo, así que el 41% es un suelo y no una estimación.
- Nueve preguntas, cuatro mercados, un día. Cinco categorías de producto y una foto. Otro conjunto de preguntas daría otro conjunto de editores.
- Nada de esto es causal. Podemos decir qué declaran las páginas citadas. No podemos decir que declararlo sea el motivo de que las citaran, y no probamos ninguna intervención.
Preguntas frecuentes sobre esquema y citación en IA
¿Los datos estructurados ayudan a que una IA cite una página?
Este estudio no lo puede contestar, y merece decirlo sin rodeos: todas las páginas de aquí ya estaban citadas, así que no hay grupo de comparación sin citar. Lo que sí puede contestar es la pregunta más estrecha que la gente suele querer decir, que es si las páginas que ganan citaciones en una categoría son las que van muy marcadas. En estas nueve preguntas no lo son: el 41% declara qué es la página y el 7% no lleva ningún dato estructurado.
¿Qué tipo de esquema llevan de verdad las páginas citadas?
FAQPage, en 17 de 46 páginas legibles, por delante de ItemList en 6, Product en 6, Review en 3 y SoftwareApplication en 2. Ese orden va en contra del consejo habitual para contenido comparativo, que lidera con ItemList.
¿Por qué se cuentan aparte las páginas de YouTube?
Porque una página de vídeo de YouTube le contesta a un cliente HTTP normal con unos 254 caracteres de texto visible en el cuerpo mientras lleva su título, su descripción y un VideoObject en la cabecera del documento. Contarla como una página que no declara nada sería una afirmación sobre YouTube que es falsa. 17 de los 20 armazones de este conjunto son de YouTube.
¿Cómo puede citarse una página que no lleva ningún esquema?
No lo sabemos, y esa es la respuesta correcta y no una evasiva. Tres páginas del conjunto no llevan ninguno y son artículos largos, corrientes y legibles. Sea lo que sea que usó la capa de recuperación para elegirlas, no fue su marcado, porque no había ninguno que leer.
¿Cómo corro esto en mi propia categoría?
Coge las respuestas que ya midas, guarda las URLs de las fuentes, pide cada una y parsea su JSON-LD. Las dos únicas decisiones que importan son separar las páginas que no pudiste leer de las que no declaran nada, y separar los tipos que dicen quién publicó la página de los que dicen qué es. Ahí es donde un barrido así se tuerce normalmente.
¿Esto cambia lo que recomienda EchoWi?
Estrecha una recomendación. Seguimos poniendo una respuesta autocontenida y un FAQPage en nuestras propias páginas, y nuestro catálogo verificado de herramientas sigue llevando un ItemList que describe exactamente lo que lista. Lo que ya no diríamos es que la cobertura de marcado predice la citación, porque en la única muestra que tenemos de páginas que sí fueron citadas, no las separa.
Pregúntale a la IA sobre este artículo
Abre tu asistente con esta página ya cargada, para comprobar las cifras, discutir el método o preguntar qué significa en tu caso.
- ChatGPT (se abre en una nueva pestaña. la pregunta va escrita, pulsa intro para enviarla)
- Claude (se abre en una nueva pestaña. la pregunta va escrita, pulsa intro para enviarla)
- Perplexity (se abre en una nueva pestaña)
- Google AI Mode (se abre en una nueva pestaña)
Perplexity y Google responden directamente. ChatGPT y Claude dejan la pregunta escrita y esperan a que pulses intro, que es su comportamiento y no algo que podamos cambiar.