Glosario

Explore Meshline

Products Pricing Blog Support Log In

Ready to map the first workflow?

Book a Demo
Operaciones autónomas

Cómo encontrar páginas huérfanas: detectar URLs sin enlaces y decidir qué hacer

Aprende cómo encontrar páginas huérfanas combinando datos de rastreo con sitemaps, Analytics y Search Console, y luego decide si enlazar, redirigir o eliminar cada URL.

Ilustración editorial plana sobre un fondo neutro con textura que muestra un grupo central de formas rectangulares en azul marino y turquesa que representan la estructura de un sitio web, con una forma aislada en azul marino y naranja que representa una página huérfana.

Una página huérfana es una URL que no recibe ningún enlace interno.

Los rastreadores que siguen enlaces desde tu página de inicio nunca llegan a ella, por lo que tanto los visitantes como los buscadores tienen dificultades para encontrarla.

Screaming Frog define una página huérfana como cualquier URL sin una ruta de enlaces desde el punto de inicio del rastreo, normalmente la página de inicio. Screaming Frog

Las páginas huérfanas importan por dos razones.

Primero, los usuarios pueden tener problemas para llegar a ellas, lo que daña la experiencia que ofrece tu sitio.

Segundo, una página sin enlaces internos pierde las señales que estos transmiten.

Screaming Frog señala que las páginas huérfanas pueden seguir indexadas mediante enlaces históricos, sitemaps o enlaces externos. Screaming Frog

Sin enlaces internos, sin embargo, no reciben PageRank interno, lo que afecta su puntuación y su rendimiento orgánico.

Un número pequeño de páginas huérfanas es común y normalmente no es un problema.

A escala pueden causar exceso de indexación, desperdiciar presupuesto de rastreo, crear páginas que compiten entre sí o mostrar contenido desactualizado a usuarios. Screaming Frog

Por qué aparecen las páginas huérfanas

Las páginas huérfanas rara vez surgen por un único error grande.

Se acumulan a través de operaciones ordinarias:

  • Páginas antiguas pierden sus enlaces durante un rediseño, pero siguen publicadas.
  • La arquitectura del sitio cambia y una sección pierde su ruta de navegación.
  • Los productos dejan de tener stock, pero las páginas de producto siguen existiendo.
  • El CMS genera URLs adicionales como parte de las plantillas de página, de modo que existen páginas que nadie creó deliberadamente. Screaming Frog

Para los equipos de ingresos y marketing, el patrón es familiar: contenido de campaña, una landing fuera de la plantilla principal o un recurso creado por otro equipo.

La página se publicó, la campaña terminó y el enlace hacia ella desapareció junto con la página de la campaña.

El método central: comparar datos de rastreo con otras fuentes de URLs

No puedes encontrar páginas huérfanas rastreando solo enlaces, porque un rastreador que sigue enlaces nunca las verá.

El enfoque práctico es rastrear el sitio con normalidad y luego incorporar fuentes adicionales de URLs para comparar.

Screaming Frog identifica tres fuentes útiles: sitemaps XML, Google Analytics y Google Search Console. Screaming Frog

Cada fuente detecta un tipo distinto de huérfana:

  • Sitemaps XML detectan páginas que publicaste y listaste deliberadamente, pero olvidaste enlazar.
  • Google Analytics detecta páginas que reciben tráfico, incluidas las que la gente alcanza mediante marcadores, campañas o enlaces externos antiguos.
  • Search Console detecta páginas que generan impresiones en búsqueda, lo que significa que Google las conoce aunque tu propio sitio no las enlace.

Una URL que aparece en una de estas fuentes pero no en la estructura de enlaces de tu rastreo es una huérfana candidata.

Confírmalo verificando si algún enlace interno apunta a la página. Screaming Frog

Las páginas huérfanas pueden enlazarse entre sí, así que una página enlazada solo desde otra huérfana sigue estando efectivamente aislada.

Ejecutar la detección en Screaming Frog

Si usas el Screaming Frog SEO Spider, el flujo de trabajo documentado es el siguiente.

Se requiere una licencia para rastrear todo el sitio web con las integraciones de API habilitadas. Screaming Frog

  1. Habilita el rastreo de sitemaps. En Configuration, Spider, Crawl, selecciona 'Crawl Linked XML Sitemaps'. Puedes descubrir sitemaps automáticamente vía robots.txt, lo que requiere una entrada Sitemap allí, o indicar la URL del sitemap directamente.
  2. Conecta Google Analytics. En Configuration, API Access, conéctate a la API de Analytics y extrae datos de una cuenta, propiedad y vista específicas durante el rastreo. Elige el segmento 'Organic Traffic' para encontrar páginas huérfanas con tráfico de búsqueda orgánica y establece un rango de fechas de al menos un mes. Puedes cambiar el segmento a 'All Users' o 'Paid Traffic' si también quieres huérfanas alcanzadas por otros canales.
  3. Rastrea las URLs nuevas descubiertas en Analytics. En la pestaña General de la configuración de Analytics, habilita esta opción. Si la omites, las URLs descubiertas por Analytics aparecen solo en el informe Orphan Pages y no se añaden a la cola de rastreo ni se muestran en las demás pestañas y filtros.
  4. Conecta Search Console. En Configuration, API Access, conecta la API de Search Analytics y elige la propiedad correcta. Esto revela páginas con impresiones pero sin enlaces internos. De nuevo, establece un rango de fechas de al menos un mes.
  5. Rastrea las URLs nuevas descubiertas en Search Console. Habilita esto en la pestaña Search Analytics de la configuración de Search Console, por la misma razón que la opción de Analytics.
  6. Rastrea el sitio y espera a que termine. Introduce la URL del sitio e inicia el rastreo, supervisa el progreso en la pestaña API y espera hasta que llegue al 100%.
  7. Ejecuta el análisis del rastreo. Los tres filtros 'Orphan URLs', en las pestañas Sitemaps, Analytics y Search Console, solo se llenan después de ejecutar Crawl Analysis al final del rastreo.

El resultado son tres listas de URLs que existen fuera de tu grafo de enlaces internos, cada una etiquetada según cómo fue descubierta.

Esa etiqueta importa cuando decides qué hacer después.

Verificar el estado de indexación de las candidatas huérfanas

El descubrimiento es solo la mitad del trabajo.

Antes de decidir el destino de una página huérfana, conviene saber si Google la ha indexado.

La URL Inspection API devuelve los datos que Search Console tiene sobre la versión indexada de una URL: estado de indexación, cobertura y resultados enriquecidos. Screaming Frog

Se puede consultar de forma masiva.

Screaming Frog integra esta API y extrae datos de un número limitado de URLs por propiedad cada día junto con los datos normales del rastreo.

Si alcanzas el límite diario por propiedad, las opciones documentadas son esperar y volver a rastrear el siguiente lote de URLs. Screaming Frog

Como alternativa, verifica varios subdominios y subcarpetas como propiedades separadas, cada una con su propio límite diario, y habilita la opción 'Use Multiple Properties'.

Para la revisión de huérfanas en particular, el estado de indexación cambia la decisión.

Una página huérfana indexada y con impresiones es un activo vivo con un problema de descubribilidad.

Una página huérfana que no está indexada en absoluto puede ser candidata a limpieza en lugar de candidata a corrección.

Decidir qué hacer con cada página huérfana

Una vez que tienes tu lista, clasifica las candidatas en cuatro grupos.

La acción correcta difiere para cada uno.

Páginas valiosas: enlázalas

Si la página cumple un propósito real, añade enlaces internos desde páginas relevantes.

Esto aplica a una guía sólida, una página de servicio o una página de producto que perdió sus enlaces en una migración.

Esto restaura la ruta para los usuarios y permite que la página reciba las señales que transmiten los enlaces internos. Screaming Frog

Para un proceso sistemático, nuestra guía sobre cómo encontrar oportunidades de enlazado interno (en inglés) cubre cómo elegir un método que se ajuste a tu sitio.

Páginas desactualizadas: elimina o redirige

Las páginas de campañas antiguas, ofertas vencidas y productos retirados a menudo no deberían existir en absoluto.

Decide entre eliminar la página o redirigirla al destino relevante más cercano.

Comprueba si la página todavía genera tráfico o impresiones antes de eliminarla.

Una página con presencia de búsqueda continua puede merecer una redirección para preservar esa ruta en lugar de una eliminación simple.

Páginas duplicadas o que compiten: consolida

Screaming Frog señala las páginas que compiten entre sí como uno de los riesgos de las páginas huérfanas a escala. Screaming Frog

Si una huérfana cubre el mismo tema que una página enlazada, consolídalas con una redirección a la página canónica para evitar dividir la relevancia.

URLs generadas por plantillas: corrige el origen

Cuando el CMS crea URLs como subproducto de las plantillas, la corrección pertenece a la configuración del CMS, no a las páginas individuales.

De lo contrario, las huérfanas reaparecerán después de cada limpieza.

Prevención: hacer del enlazado parte de la publicación

La detección es un costo recurrente.

La prevención es un cambio de proceso que se hace una sola vez.

Dos hábitos reducen las huérfanas futuras:

  • Exige que cada página nueva tenga al menos un enlace interno desde una página existente antes de publicarse, y añade el enlace de la página nueva desde un hub relevante o un artículo relacionado al mismo tiempo.
  • Cuando despubliques o reestructures algo, audita los enlaces que apuntaban a ello, no solo la página en sí.

La guía inicial de Google incluye promover tu sitio web entre las formas de ayudar a los buscadores a descubrir tu contenido más rápido. Google Search Central

El enlazado interno es la mitad estructural de eso: indica a usuarios y rastreadores qué existe y qué importa.

Para páginas que están enlazadas pero aún rinden poco, la detección de huérfanas se combina bien con el análisis de impresiones.

Nuestro artículo sobre priorizar páginas de altas impresiones sin clics (en inglés) cubre el siguiente paso de diagnóstico una vez que una página es descubrible.

Si algunas candidatas huérfanas son contenido de referencia, hay un recurso adicional para ti.

Nuestra pieza sobre convertir páginas de glosario en soporte comercial de SEO (en inglés) muestra cómo conectar páginas informativas con páginas de ingresos.

Una cadencia práctica para la detección continua

Como las páginas huérfanas se acumulan en silencio, trata la detección como una revisión programada en lugar de un proyecto único.

Una cadencia razonable es repetir el proceso de rastrear y comparar tras cambios importantes en el sitio, como migraciones, rediseños o actualizaciones del CMS.

También repítela a intervalos regulares entre esos hitos.

El intervalo exacto depende de la frecuencia con la que tu equipo publica y de cuántas personas pueden crear páginas fuera de tu flujo de trabajo estándar.

Conserva el resultado de cada ejecución: una lista fechada de candidatas huérfanas, la fuente de descubrimiento de cada una y la acción tomada.

Tras unos pocos ciclos verás qué causas se repiten en tu sitio, como páginas de campañas, artefactos de plantillas o restos de migraciones.

Podrás entonces corregir el proceso que sigue produciéndolas.

Cómo puede ayudar Meshline.

Conecta la automatización, el Marketing Orgánico (generación de demanda) y la gestión del ciclo de vida del cliente (Revenue Intelligence).

Integra la planificación de temas, la publicación de contenido y la retroalimentación de rendimiento en la conversación sobre tu flujo de trabajo. Reserva una demo de Meshline.

Revenue Intel

Consúltanos sobre este flujo de trabajo.

Cuéntanos qué quieres mejorar o automatizar. Te responderemos con el siguiente paso más útil.

Agenda una demo

Decisiones de implementación

Lleva esta idea a tu operación

Antes de invertir en Cómo encontrar páginas huérfanas: detectar URLs sin enlaces y decidir qué hacer, define el problema, los datos disponibles y quién revisará el resultado.