Saltar al contenido
Visibilidad IAInvestigación
ES

Le hicimos la misma pregunta a cuatro superficies de IA. Volvieron 51 fuentes y ninguna apareció en las cuatro.

Misma pregunta, mismo mercado, mismo momento, cuatro superficies. 41 de 51 fuentes citadas salieron en una sola. Las tres de Google apenas se solapan.

· Actualizado · 11 min de lectura

Todos los estudios que publicamos llevan la misma limitación escrita: una superficie, Google AI Overview. Este mide lo que cuesta esa frase.

Lanzamos dos preguntas a cuatro superficies en el mismo momento: AI Overview, Google AI Mode, Gemini y ChatGPT. Entre las cuatro citaron 51 dominios distintos. Ninguno apareció en las cuatro. 41 aparecieron en una sola.

La parte incómoda para Google es que tres de esas cuatro superficies son suyas, y AI Overview y Gemini no compartieron ni una sola fuente en ninguna de las dos preguntas.

Cómo está medido: dos prompts, Estados Unidos, inglés, 7 de agosto de 2026, una pasada por superficie, las cuatro consultadas en la misma llamada. Una pasada es una foto y no una tasa, por eso este artículo cuenta el solapamiento entre superficies y no la frecuencia dentro de cada una. Solo dominios citados, nunca menciones de marca. Las dos mediciones están en nuestro registro con el detalle por superficie.


Pregunta uno: zapatillas de running

SuperficieDominios citados
ChatGPT11
AI Overview5
AI Mode4
Gemini3

20 dominios distintos. Uno apareció en tres superficies (runrepeat.com), otro en dos, y 18 en una sola.

Pregunta dos: plataformas de email para ecommerce

SuperficieDominios citados
ChatGPT16
AI Mode11
AI Overview8
Gemini5

31 dominios distintos. Uno apareció en tres (drip.com), siete en dos, y 23 en una sola.

Las dos preguntas juntas

Dominios que aparecen en…CuántosPorcentaje
Las cuatro superficies00%
Tres superficies24%
Dos superficies816%
Una sola superficie4180%
Las cuatro superficies0 (0%)Tres superficies2 (4%)Dos superficies8 (16%)Una sola superficie41 (80%)
Cincuenta y un dominios distintos en dos preguntas de compra. Ninguno apareció en las cuatro superficies y cuatro quintas partes aparecieron en una sola. EE.UU. en inglés, AI Overview, AI Mode, ChatGPT y Gemini, una pasada por superficie, que es un sorteo y no una tasa.
Cuántos de los 51 dominios citados aparecieron en una, dos, tres o las cuatro superficies
value
Las cuatro superficies0
Tres superficies2
Dos superficies8
Una sola superficie41

Cuatro quintas partes del web citado, para estas preguntas, son visibles en exactamente uno de los cuatro sitios donde un comprador puede preguntar.

Por qué esto es peor que «los motores son distintos»

Todo el mundo en esta categoría te dirá que los motores difieren. Lo que añaden estos números es cuánto, y un resultado concreto que nadie anuncia.

AI Overview y Gemini no citaron nada en común. En ninguna de las dos preguntas. Las dos son de Google. Pregúntale a la IA del buscador de Google y al asistente de Google lo mismo en el mismo minuto y las pruebas debajo de cada respuesta son disjuntas.

AI Mode, también de Google, comparte un dominio con AI Overview en la primera pregunta y cuatro en la segunda. Mejor, y aun así casi separado.

Si mides una superficie de Google y lo llamas «Google», estás midiendo una superficie de Google.

El resultado que va al lado de este

Esto es lo que hace el hallazgo afilado en vez de simplemente curioso.

Las zapatillas de running son la categoría más estable que hemos medido nunca. En nuestro estudio sobre cuánto varían las respuestas, tres pasadas de esa misma pregunta en AI Overview devolvieron cinco dominios y los cinco salieron en todas las pasadas. Reproducibilidad perfecta dentro de una superficie.

Esa misma pregunta, hecha a cuatro superficies, produjo veinte dominios de los cuales dieciocho aparecieron en una sola.

Que una medición se repita dentro de una superficie no dice nada sobre si las superficies coinciden entre sí. Un proveedor puede informarte con toda honestidad de que tu medición es sólida como una roca, repetirla todo el mes, y estar describiendo una cuarta parte del cuadro. Son dos propiedades distintas y este mercado vende la primera dando a entender la segunda.

ChatGPT cita más, Gemini menos

ChatGPT devolvió la lista de fuentes más larga en las dos preguntas, 11 y 16. Gemini la más corta, 3 y 5. AI Overview y AI Mode quedaron en medio.

No vamos a decirte qué significa eso sobre la calidad de la respuesta, porque no medimos calidad. Lo que significa en la práctica es que la superficie que midas cambia no solo qué fuentes ves sino cuántas, y un porcentaje de share of voice calculado sobre un denominador de tres dominios no es comparable con uno calculado sobre dieciséis.

Es un problema aritmético sencillo escondido dentro de muchos paneles.

Qué cambia esto a la hora de comprar

Un precio por motor es un precio por foto. Nuestro catálogo verificado tiene planes de entrada que cubren un motor (Surfer, y nuestro propio plan de 29 €), tres (Siftly, Writesonic), cuatro (Nightwatch) y seis (Promptmonitor a 29 $, Rank Prompt). Con estos datos, la diferencia entre un motor y cuatro no es un refinamiento. Es casi todo el dato.

No promedies entre motores. Con el 80% de las fuentes apareciendo en una sola superficie, una puntuación de visibilidad mezclada junta cuatro poblaciones en gran parte disjuntas en un número que no describe ninguna. Léelas por separado o no las leas.

Comprueba qué superficie usan de verdad tus compradores antes de optimizar para la que cubra tu herramienta. Esa es una pregunta sobre tu mercado, no sobre la IA.

Y acuérdate del otro eje. Cuántas pasadas necesita una categoría va de unas tres a unas treinta, y este artículo añade una segunda dimensión encima. Cobertura y repetición son compras separadas y casi todos los proveedores te venden una cantidad fija de las dos.

Replicado cinco veces más el 7 de agosto de 2026

Este artículo midió dos preguntas de consumo. Desde entonces hemos corrido el mismo instrumento cinco veces más, con preguntas que no tienen nada que ver con zapatillas. El titular aguantó en cuatro y se rompió en la quinta.

PreguntaMercadoDominios citadosEn dos superficiesEn tres o cuatro
Mejor agencia GEOEstados Unidos2050
Mejor agencia GEOFrancia1940
Mejor agencia GEOEspaña1640
Qué herramienta de visibilidad IAEstados Unidos2110
Mejor agencia GEOAlemania, añadida el 7 ago 20261822

Otra categoría, cuatro idiomas, y una de las tiradas es software de empresa y no un servicio. En las cuatro primeras réplicas, ni una sola fuente fue citada por tres de las cuatro superficies. Alemania, la última, rompió eso. Allí dos dominios llegaron a tres superficies, y los dos son webs de agencia: una de Aufgesang y otra de Suchhelden. Cuatro tiradas hacían que pareciera una regla y la quinta dice que no lo es, que es justo para lo que se replica. En la de herramientas, Google AI Overview devolvió un error de servidor, así que esa fila son tres superficies y no cuatro: falló nuestro instrumento, no se calló Google.

Suma las dos preguntas de este artículo y son siete conjuntos de preguntas, dos categorías y cuatro idiomas. Ninguno produjo una fuente citada por las cuatro superficies, y esa es la parte que ha aguantado siempre. En tres superficies el panorama es más fino pero no vacío: las dos preguntas de consumo de aquí lograron exactamente una fuente cada una, cuatro de las cinco tiradas nuevas ninguna, y Alemania dos. No llamamos ley a nada de esto, porque cada una es una sola pasada y sabemos lo que vale una sola pasada. Lo que sí podemos decir es que la columna de las cuatro superficies no se ha movido del cero en siete intentos, y que la de tres se mueve según si alguien en ese mercado ha publicado una página en la que valga la pena coincidir.

Y hay una división que este estudio no separa y que resultó ser más grande que la de superficies: la que hay entre preguntar qué comprar y preguntar qué significa un término. Medida aparte, la pregunta de compra citó ocho fuentes y la de definición ninguna, misma categoría, mismo mercado y mismo día, y el cero aguantó en nueve pasadas sin caché de tres categorías sin relación.

Qué no demuestra esto

Una de las cuatro superficies devuelve menos de lo que cita, y eso alcanza al titular. Medido el 15 de agosto de 2026: una respuesta de AI Mode imprime marcadores de cita numerados en su cuerpo y la lista estructurada que leemos trae más o menos la mitad, mientras que la de AI Overview los trae todos. Así que «ninguno apareció en las cuatro» es en parte una afirmación sobre la captura de AI Mode: un dominio presente en todas las superficies podría faltar en la columna de AI Mode y romper la racha sin haber faltado nunca en la respuesta.

Lo que queda intacto es la mitad más afilada. AI Overview y Gemini citaron cero dominios en común en las dos preguntas, y las dos listas traen todos los marcadores que imprimen sus respuestas, así que ese par está medido con un solo instrumento en los dos lados. La captura de ChatGPT no la podemos comprobar, porque esa llamada expira por esta ruta.

  • Una pasada por superficie. Dos preguntas, ocho respuestas de superficie. Mide lo poco que se solapan los cuatro conjuntos de fuentes en un momento. No mide con qué frecuencia aparece un dominio, y no puede: para eso hace falta repetición, que es un diseño distinto y mucho más caro.
  • Dos preguntas, un mercado, un idioma, un día. Las dos son software de consumo o de pyme, en Estados Unidos y en inglés.
  • Solaparse no es tener razón. Que cuatro superficies discrepen no hace que ninguna esté equivocada. Pruebas distintas pueden sostener la misma recomendación, y de hecho las cuatro nombraron productos coincidentes citando fuentes distintas.
  • Contamos dominios, no protagonismo. Un dominio citado una vez y un dominio en el que se apoya la respuesta cuentan igual.
  • Nada causal, y nada sobre menciones de marca. Esto son datos de citación.
  • Las superficies se mueven. Son cuatro productos en desarrollo activo, medidos una tarde.

Preguntas frecuentes sobre las diferencias entre motores de IA

¿Citan las mismas fuentes ChatGPT, Gemini y Google AI Overview?

Apenas. En dos preguntas hechas a cuatro superficies en el mismo momento se citaron 51 dominios distintos y ninguno apareció en las cuatro. 41 de los 51, alrededor del 80%, aparecieron en una sola superficie.

¿Coinciden entre sí las superficies de IA de Google?

Con nuestros datos, no. AI Overview y Gemini citaron cero dominios en común en las dos preguntas. AI Mode, también de Google, compartió un dominio con AI Overview en la primera pregunta y cuatro en la segunda. Medir una superficie de Google no te dice nada de las otras.

¿Qué motor de IA cita más fuentes?

ChatGPT, en las dos preguntas que probamos, con 11 y 16 dominios distintos. Gemini citó menos, con 3 y 5. Eso importa para cualquier porcentaje: un share of voice calculado sobre cinco fuentes no es comparable con uno calculado sobre dieciséis.

¿Merece la pena pagar por una herramienta que cubra más motores?

Con estos datos, la diferencia de cobertura es casi todo el dato y no un refinamiento, porque cuatro quintas partes de las fuentes citadas aparecieron en una sola superficie. Los planes de entrada de nuestro catálogo verificado van de un motor a seis a precios parecidos, así que la comparación merece hacerse a conciencia.

Si mi medición es estable, ¿estoy viendo el cuadro completo?

No, y aquí está la trampa. La pregunta de este estudio con reproducibilidad perfecta dentro de una superficie, cinco dominios citados en las tres pasadas, produjo dieciocho dominios de una sola superficie sobre veinte al preguntar a cuatro. Reproducibilidad y cobertura son propiedades distintas, y una herramienta puede ser excelente en la primera y no decir nada de la segunda.

¿Puedo reproducirlo?

Sí. Dos prompts, Estados Unidos, inglés, cuatro superficies, una pasada cada una, el 7 de agosto de 2026, con los dos prompts citados enteros arriba y el detalle por superficie en nuestro registro. Haz la misma pregunta a cuatro superficies en la misma sesión y anota qué dominios cita cada una.

Pregúntale a la IA sobre este artículo

Abre tu asistente con esta página ya cargada, para comprobar las cifras, discutir el método o preguntar qué significa en tu caso.

Perplexity y Google responden directamente. ChatGPT y Claude dejan la pregunta escrita y esperan a que pulses intro, que es su comportamiento y no algo que podamos cambiar.

Escrito por

Maher El Ouahabi

CTO y cofundador de EchoWi

Construye el software que enseña a las marcas lo que la IA dice de ellas, y qué cambiar para que la siguiente respuesta sea mejor. Doce motores, medidos antes y después.

LinkedIn Maher El Ouahabi (se abre en una nueva pestaña)