Epovest
← Todos los estudios

Estudio

Lo que las IA citan realmente: los perfiles de sitios detrás de las respuestas, motor por motor

Por Simon Vasconcelos Lee

Cuando una IA responde a una pregunta de su mercado, ¿sobre qué páginas se apoya? Los nombres que vienen a la mente son los grandes: medios consolidados, plataformas que todo el mundo conoce. Si eso fuera cierto, la puerta ya estaría cerrada para todos los demás. Así que lo medimos, en nuestros propios paneles: 923 respuestas archivadas con cada fuente citada, en cuatro motores y cinco mercados, en julio de 2026.

Dos resultados sostienen este estudio. La web citada es mucho más abierta de lo que sugiere la idea de "siempre los mismos grandes nombres". Y cada motor confía en una web visiblemente distinta, así que cada cifra de abajo se da por motor, nunca en promedio.

La medición

Entre el 10 y el 25 de julio de 2026, nuestros trackers plantearon 18 paneles fijos de preguntas a ChatGPT, Claude, Gemini y Perplexity a través de sus API oficiales, exactamente como funcionan para cualquier cuenta. Los paneles cubren cinco mercados: destinos de viaje (648 respuestas), SaaS y visibilidad en IA (208), servicios web en francés (27), datos de tipo de cambio (16) y preguntas de identidad de marca (24). Cada respuesta queda archivada con sus fuentes citadas: 6.991 citas en total, apuntando a 2.049 dominios raíz únicos.

Viaje y SaaS llevan el peso estadístico. Los tres paneles pequeños se leen como indicaciones, no como leyes, y así se señalan abajo.

Hallazgo 1: hoy ningún oligopolio sostiene las respuestas

Para cada motor, sumamos las citas que se llevan sus diez dominios más citados:

Motor Preguntas de viaje Preguntas SaaS
ChatGPT 43% 32%
Perplexity 28% 23%
Claude 25% 27%
Gemini 12% 16%

Incluso en el extremo más concentrado (ChatGPT en viajes), los diez primeros dominios dejan el 57% de las citas a todos los demás. En el extremo abierto, los diez dominios de viaje más citados de Gemini suman el 12% de sus citas, y hicieron falta 746 dominios distintos para sostener el resto. El conjunto de páginas sobre las que se apoyan las respuestas de las IA es una larga cola, y hay sitios modestos dentro.

Hallazgo 2: cada motor confía en una web distinta

ChatGPT se inclina hacia lo institucional. En viajes, sus tres fuentes más citadas son Lonely Planet (129 citas), National Geographic (102) y la UNESCO (51), con los dominios gubernamentales muy cerca. Su listón es una reputación construida en otra parte, lo que lo convierte en el conjunto más lento de entrar.

Gemini es el más repartido. Operadores especializados, blogs personales, YouTube y Reddit comparten su cima, y ninguna fuente domina. Un sitio enfocado con una página sólida sobre la pregunta exacta puede entrar en su conjunto citado: ahí es donde primero asoman los nuevos.

Perplexity lee primero las plataformas. En preguntas de viaje, YouTube es su fuente más citada (152 citas) y Reddit la segunda (138). El mismo patrón se mantiene en las preguntas SaaS, donde LinkedIn también entra entre sus primeras fuentes. Como medimos en nuestro estudio sobre YouTube, lo que el motor lee realmente allí es la transcripción.

Claude es el que menos cita y el que más lee. 466 citas en 233 respuestas, pero solo en las preguntas SaaS leyó 342 páginas sin citarlas, una cifra que solo Claude expone. Cuando cita, las respuestas se apoyan en blogs de consultores independientes y páginas de agencias: experiencia firmada por una persona o un despacho, más que medios masivos.

En las preguntas SaaS, un hecho más importa a cualquier proveedor: las propias páginas de los fabricantes de herramientas son citadas por todos los motores, junto a los terceros. Responder a la pregunta de su mercado en su propia página no es tinta perdida.

Hallazgo 3: cuando el motor no busca, responde su memoria

No toda respuesta dispara una búsqueda web. Medido en este corpus: Perplexity buscó en el 100% de sus respuestas, Gemini en el 96%, ChatGPT en el 73%, Claude en el 42%.

La cifra de Claude esconde el detalle más útil: busca según el tema. En preguntas de SaaS y visibilidad en IA buscó el 79% de las veces; en viajes, el 27%, y el resto respondió de memoria. Donde el motor cree que ya sabe, responde el corpus de entrenamiento, y ese corpus se congeló hace meses.

Hay, pues, dos juegos distintos en una misma pregunta de visibilidad. La recuperación en vivo premia a la página que responde a la pregunta exacta, y puede ganarse esta semana. El corpus congelado premia lo que existía, de forma estable y repetida, cuando se construyó, y solo se actualiza cuando sale el siguiente modelo. Publicar pronto y mantener URL y hechos estables es la manera en que una marca juega en ambos tableros.

Hallazgo 4: las preguntas de confianza se anclan en terceros modestos

Nuestro panel de identidad de marca es pequeño (24 respuestas, indicativo), pero su patrón es nítido y coincide con lo que medimos en nuestro estudio sobre backlinks: cuando los motores responden a "puedo confiar en esta empresa", las citas van a plataformas de reseñas (Trustpilot primero), a LinkedIn y a registros y sitios de verificación de terceros, no a la prensa. El expediente de terceros es lo que sostiene el veredicto, y esas páginas están al alcance de cualquier empresa.

Qué hace una marca con esto

  1. Cubra las preguntas de su mercado en sus propias páginas. Las páginas de proveedor son citadas cuando responden a la pregunta planteada, y son el único conjunto de páginas que usted controla por completo.
  2. Exista donde cada motor lee. Un vídeo bien titulado cuya transcripción responde a la pregunta, para Gemini y Perplexity. Un expediente de terceros limpio, para las preguntas de confianza. Páginas firmadas por un experto, para Claude.
  3. Mida por motor, nunca en promedio. Cada cifra de este estudio se divide en cuatro. Una estrategia ajustada al promedio optimiza para un motor que no existe.

Método

923 respuestas recogidas entre el 2026-07-10 y el 2026-07-25 por los trackers de Epovest a través de las API oficiales de los motores, sobre paneles fijos formulados como los plantean los clientes. Cada respuesta queda archivada con sus fuentes citadas; los dominios se normalizan a su raíz registrable (2.049 raíces únicas). Los tamaños de celda varían por mercado y motor y se dan en el texto. Las cifras pueden reutilizarse con atribución.