Perplexity: 59% de citas van a sitios fuera del top 100.000

El dato que incomoda: el 59,8% de las citas de Perplexity apuntan a sitios web con tráfico casi nulo

Un análisis publicado el 2 de septiembre de 2026 por Trellner sobre el comportamiento de Perplexity — el motor de respuestas con IA que muestra las fuentes que usó — midió 7.534 citas obtenidas al preguntar a dos modelos de Perplexity por «el mejor software» en 380 categorías. El resultado: el 59,8% de las citas caen en dominios peor rankeados que la posición 100.000 en la lista Tranco top-1M, y el 23,4% ni siquiera aparecen en el top 1 millón. La mediana de los 5.768 dominios rankeados está en la posición 71.611. Para un founder acostumbrado a pelear el top 10 de Google, la conclusión es incómoda: la base evidencial con la que la IA recomienda productos de software no se parece en nada a la web que realmente lee la gente.

Cómo se midió el experimento

Los autores consultaron dos variantes de Perplexity disponibles en OpenRouter — perplexity/sonar y perplexity/sonar-pro — sobre 380 categorías con intención de compra, desde «CRM software» hasta «museum collection management software». Cada modelo respondió con un top 5 en JSON, indicando el dominio oficial de cada producto recomendado. En total se hicieron 760 llamadas, que devolvieron 3.800 recomendaciones de 1.807 productos distintos y citaron 2.055 dominios únicos. Cada dominio se verificó después contra la lista diaria de Tranco del 1 de septiembre de 2026 y contra el Wayback Machine. Google quedó fuera del experimento porque enrutar Gemini por OpenRouter usa el plugin de búsqueda interno de OpenRouter, no el retrieval real de Google. El dataset completo (citas, recomendaciones, scripts y metodología) está publicado bajo CC BY 4.0 en la URL de Trellner que enlazamos al final.

Qué encontraron los números

La concentración arriba es razonable: los 10 dominios más citados absorben el 17,3% de las menciones. Pero el resto de la tabla es lo que cuenta la historia:

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad
  • g2.com lidera con 291 citas (3,86%), seguido de reddit.com con 261 (3,46%).
  • El tercer lugar lo ocupa guideflow.com, un vendor de demos interactivas que no compite en ninguna de las 380 categorías y aún así aparece en 96 de ellas con posts de blog de marketing.
  • Wikipedia, referencia histórica de la web, fue citada solo 3 veces en 7.534.
  • El 36,5% de los 2.055 dominios citados (751 sitios) no están siquiera en el top 1 millón.

Los sitios no rankeados también son más nuevos: la mediana de su primera captura en Wayback es 2020, contra 2011 para los rankeados. Y el 16,6% de los dominios archivados sin rango se capturaron por primera vez en 2025 o después, frente al 1,6% de los rankeados. La pista va claramente hacia sitios industriales montados recientemente.

Las 215.128 páginas «best software»

El caso más concreto está en tres sitios que el informe presenta como un mismo operador: wifitalents.com (71 citas), worldmetrics.org (60) y gitnux.org (50). Los tres suman 181 citas en 41 categorías distintas, pero lo importante es lo que producen:

  • Registrados en NameCheap entre diciembre de 2023 y mayo de 2024.
  • Delegan DNS al mismo par de nameservers de Cloudflare (pam.ns.cloudflare.com y sean.ns.cloudflare.com).
  • Comparten plantilla de página, navegación («Services, Market Data, Software Advice, Editorial Process, Company») y un blog de exactamente seis posts cada uno.
  • Sus sitemaps declaran 103.578, 107.083 y 105.541 URLs, de las cuales 70.731, 71.684 y 72.713 son páginas /best/<algo>-software/: en total 215.128 guías de compra generadas entre tres marcas.

No existen 215.128 categorías de software. worldmetrics.org vende además «investigación de mercado personalizada desde €5.000» e «informes listos desde €499» sobre la misma taxonomía de Best Lists que la IA recupera. Lo más revelador es lo que los propios sitios dicen de sí mismos en su metaetiqueta HTML: «Verified facts about Gitnux: an independent market research company publishing industry statistics, custom research, and software Best Lists. Company, legal, methodology, and compliance details in one machine-readable record.» El término «grounding» no lo usan compradores; es el nombre técnico del paso en el que un sistema de retrieval trae documentos para condicionar una respuesta. Una «página de grounding» no está escrita para lectores humanos, sino para el software que la va a leer.

Las firmas de la plantilla y los autores fantasma

El informe cruzó la misma categoría — «project estimation software» — en los tres sitios. Las tres páginas declaran su ranking en JSON-LD y muestran los mismos cinco productos en distinto orden:

  • worldmetrics.org: Float, Scoro, Teamwork.com, Procore, Wrike.
  • wifitalents.com: Float, Scoro, Teamwork.com, Buildertrend, Apropo.
  • gitnux.org: Saviom, Mosaic, Buildertrend, Float, Teamwork.com.

El ganador de Gitnux (Saviom) no aparece en el top 5 de Worldmetrics. Las tres páginas atribuyen su contenido a nueve personas distintas: Kathryn Blake, Alexander Schmidt y Victoria Marsh (Worldmetrics); Diana Reeves, Helena Kowalczyk y Olivia Thornton (Gitnux); Ryan Gallagher, Isabella Rossi y Natasha Ivanova (WifiTalents). Cada página asegura tener un proceso editorial; Gitnux rotula su resultado como «AI-verified · Expert reviewed». Las tres muestran además una variable de plantilla sin renderizar («Within the next 26 days» en dos, «Within the next 40 days» en la tercera).

¿Y las recomendaciones que dio la IA?

De los 1.502 dominios vendor que los modelos devolvieron como hogar oficial del producto, 17 (1,1%) están muertos o inalcanzables — ocho ni siquiera tienen nameserver delegado. Entre los ejemplos están graphiql.com ofrecido como casa de GraphiQL (que no existe), todo.com ofrecido para Microsoft To Do, y aquasecurity.io para Trivy. Otros 92 (6,1%) redirigen a otro dominio; la mayoría son adquisiciones o rebrands normales, pero dos llaman la atención porque los dos tiers de Perplexity discreparon:

  • Pedidos «research data management platforms», ambos nombraron a Dryad: sonar-pro devolvió el repositorio real (datadryad.org), sonar devolvió dryad.co, que redirige a un portal de juego online indonesio («BIGSLOT288»).
  • Pedidos «data quality tools», ambos nombraron a Monte Carlo: sonar devolvió montecarlodata.com (correcto), sonar-pro devolvió montecarlo.com, que redirige a Monte-Carlo Société des Bains de Mer, el grupo de hoteles y casinos de Mónaco.

Por qué importa a un founder

El experimento no demuestra que cambiar estas fuentes cambie las recomendaciones — los autores son explícitos en eso. Lo que sí demuestra es de qué están hechas las respuestas que tus clientes están leyendo ahora mismo cuando le preguntan a una IA qué software comprar. Y la respuesta es: en gran parte, de sitios nuevos, mal rankeados, sin auditoría editorial humana real y optimizados no para compradores sino para el paso de retrieval. El término técnico del sector ya tiene nombre: GEO (Generative Engine Optimization) o AEO (Answer Engine Optimization), la nueva frontera del SEO que consiste en diseñar contenido para ser citado por los modelos, no solo para rankear.

El contexto del mercado lo confirma: según un estudio de Ahrefs sobre 300.000 keywords, el CTR de la posición 1 cae del 1,41% al 0,64% — un 54% — cuando Google muestra un AI Overview encima, según recogió un comunicado de Redefine ROI de agosto de 2026 citando a Ahrefs y Pew Research. Una encuesta de Goodfirms de 2026 que cita el mismo comunicado estima que el 43% de los profesionales SEO ya considera la optimización para LLMs una estrategia central, pero solo el 14% mide su visibilidad en respuestas de IA. Estar citado dejó de ser un bonus: es el nuevo prime time.

Y el spam ya se industrializó: Google desplegó en agosto de 2026 su tercera actualización antispam del año y, según cobertura de Search Engine Journal, parte del golpe apuntó a «redes de spam AI mass-produced» tras la publicación del paper de Google sobre el sistema Scalable Cluster Termination System (S-CTS), diseñado para «terminar» redes de páginas generadas con IA para manipular rankings. El hecho de que las 215.128 páginas de Trellner sigan siendo recuperables hoy indica que ni el retrieval de Perplexity ni el de Google (al menos en su última oleada visible) las están filtrando por su origen.

Qué significa esto para tu startup

1. Audita qué dice la IA sobre tu categoría. Abre Perplexity, ChatGPT y Gemini en una pestaña limpia (sin login, sin historial), pregunta «best software» y anota qué sitios citan y en qué posición quedas tú. Hazlo con cinco prompts distintos por categoría. Si no apareces, el problema no es SEO tradicional: es que ninguna fuente que la IA considera confiable te está mencionando. El primer paso de GEO es saber dónde estás.

2. Deja de perseguir backlinks por backlinks; persigue menciones citadas. Como documenta The Verge, moderadores de subreddits como r/SkincareAddiction están detectando cuentas de marca que repiten menciones positivas con el mismo formato — y Reddit se ha vuelto el dominio más citado por ChatGPT, Perplexity y Gemini según datos compilados por Semrush para The Verge. Una mención de marca real, en una fuente que la IA ya cita, vale más que 50 backlinks de sitios desconocidos. Para una startup hispana, eso suele significar prensa especializada en español en portales que los modelos ya referencian, no granjas de enlaces.

3. No intentes ser una de las 215.128 páginas. El experimento de Trellner muestra exactamente el patrón que Google y los LLMs están entrenando detectores para desmontar: miles de páginas plantilla, mismo nameserver, autores fantasma, meta-descripción escrita para el crawler. Replicar este patrón funciona a corto plazo — los autores lo confirman al notar que las páginas siguen siendo citadas —, pero apuesta contra la dirección que toma el sector. Mejor competir por profundidad real en cinco temas que tu cliente busca, con autores identificables y datos propios citables.

4. Mide, no asumas. Si tu agencia o consultor SEO sigue reportándote solo rankings de Google clásico, estás viendo la película del año pasado. Pide explícitamente un dashboard de AI Search Visibility — quién te cita, en qué consultas y desde qué dominios — y trátalo como una métrica de adquisición al mismo nivel que el tráfico orgánico. La definición de «estar visible» cambió en 2025 y sigue cambiando en 2026.

Fuentes

¿te gustó o sirvió lo que leíste?, Por favor, comparte.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...