Cómo encontrar páginas huérfanas: detectar URLs sin enlaces y decidir qué hacer
Aprende cómo encontrar páginas huérfanas combinando datos de rastreo con sitemaps, Analytics y Search Console, y luego decide si enlazar, redirigir o eliminar cada URL.

Una página huérfana es una URL que no recibe ningún enlace interno.
Los rastreadores que siguen enlaces desde tu página de inicio nunca llegan a ella, por lo que tanto los visitantes como los buscadores tienen dificultades para encontrarla.
Screaming Frog define una página huérfana como cualquier URL sin una ruta de enlaces desde el punto de inicio del rastreo, normalmente la página de inicio. Screaming Frog
Las páginas huérfanas importan por dos razones.
Primero, los usuarios pueden tener problemas para llegar a ellas, lo que daña la experiencia que ofrece tu sitio.
Segundo, una página sin enlaces internos pierde las señales que estos transmiten.
Screaming Frog señala que las páginas huérfanas pueden seguir indexadas mediante enlaces históricos, sitemaps o enlaces externos. Screaming Frog
Sin enlaces internos, sin embargo, no reciben PageRank interno, lo que afecta su puntuación y su rendimiento orgánico.
Un número pequeño de páginas huérfanas es común y normalmente no es un problema.
A escala pueden causar exceso de indexación, desperdiciar presupuesto de rastreo, crear páginas que compiten entre sí o mostrar contenido desactualizado a usuarios. Screaming Frog
Por qué aparecen las páginas huérfanas
Las páginas huérfanas rara vez surgen por un único error grande.
Se acumulan a través de operaciones ordinarias:
- Páginas antiguas pierden sus enlaces durante un rediseño, pero siguen publicadas.
- La arquitectura del sitio cambia y una sección pierde su ruta de navegación.
- Los productos dejan de tener stock, pero las páginas de producto siguen existiendo.
- El CMS genera URLs adicionales como parte de las plantillas de página, de modo que existen páginas que nadie creó deliberadamente. Screaming Frog
Para los equipos de ingresos y marketing, el patrón es familiar: contenido de campaña, una landing fuera de la plantilla principal o un recurso creado por otro equipo.
La página se publicó, la campaña terminó y el enlace hacia ella desapareció junto con la página de la campaña.
El método central: comparar datos de rastreo con otras fuentes de URLs
No puedes encontrar páginas huérfanas rastreando solo enlaces, porque un rastreador que sigue enlaces nunca las verá.
El enfoque práctico es rastrear el sitio con normalidad y luego incorporar fuentes adicionales de URLs para comparar.
Screaming Frog identifica tres fuentes útiles: sitemaps XML, Google Analytics y Google Search Console. Screaming Frog
Cada fuente detecta un tipo distinto de huérfana:
- Sitemaps XML detectan páginas que publicaste y listaste deliberadamente, pero olvidaste enlazar.
- Google Analytics detecta páginas que reciben tráfico, incluidas las que la gente alcanza mediante marcadores, campañas o enlaces externos antiguos.
- Search Console detecta páginas que generan impresiones en búsqueda, lo que significa que Google las conoce aunque tu propio sitio no las enlace.
Una URL que aparece en una de estas fuentes pero no en la estructura de enlaces de tu rastreo es una huérfana candidata.
Confírmalo verificando si algún enlace interno apunta a la página. Screaming Frog
Las páginas huérfanas pueden enlazarse entre sí, así que una página enlazada solo desde otra huérfana sigue estando efectivamente aislada.
Ejecutar la detección en Screaming Frog
Si usas el Screaming Frog SEO Spider, el flujo de trabajo documentado es el siguiente.
Se requiere una licencia para rastrear todo el sitio web con las integraciones de API habilitadas. Screaming Frog
- Habilita el rastreo de sitemaps. En Configuration, Spider, Crawl, selecciona 'Crawl Linked XML Sitemaps'. Puedes descubrir sitemaps automáticamente vía robots.txt, lo que requiere una entrada Sitemap allí, o indicar la URL del sitemap directamente.
- Conecta Google Analytics. En Configuration, API Access, conéctate a la API de Analytics y extrae datos de una cuenta, propiedad y vista específicas durante el rastreo. Elige el segmento 'Organic Traffic' para encontrar páginas huérfanas con tráfico de búsqueda orgánica y establece un rango de fechas de al menos un mes. Puedes cambiar el segmento a 'All Users' o 'Paid Traffic' si también quieres huérfanas alcanzadas por otros canales.
- Rastrea las URLs nuevas descubiertas en Analytics. En la pestaña General de la configuración de Analytics, habilita esta opción. Si la omites, las URLs descubiertas por Analytics aparecen solo en el informe Orphan Pages y no se añaden a la cola de rastreo ni se muestran en las demás pestañas y filtros.
- Conecta Search Console. En Configuration, API Access, conecta la API de Search Analytics y elige la propiedad correcta. Esto revela páginas con impresiones pero sin enlaces internos. De nuevo, establece un rango de fechas de al menos un mes.
- Rastrea las URLs nuevas descubiertas en Search Console. Habilita esto en la pestaña Search Analytics de la configuración de Search Console, por la misma razón que la opción de Analytics.
- Rastrea el sitio y espera a que termine. Introduce la URL del sitio e inicia el rastreo, supervisa el progreso en la pestaña API y espera hasta que llegue al 100%.
- Ejecuta el análisis del rastreo. Los tres filtros 'Orphan URLs', en las pestañas Sitemaps, Analytics y Search Console, solo se llenan después de ejecutar Crawl Analysis al final del rastreo.
El resultado son tres listas de URLs que existen fuera de tu grafo de enlaces internos, cada una etiquetada según cómo fue descubierta.
Esa etiqueta importa cuando decides qué hacer después.
Verificar el estado de indexación de las candidatas huérfanas
El descubrimiento es solo la mitad del trabajo.
Antes de decidir el destino de una página huérfana, conviene saber si Google la ha indexado.
La URL Inspection API devuelve los datos que Search Console tiene sobre la versión indexada de una URL: estado de indexación, cobertura y resultados enriquecidos. Screaming Frog
Se puede consultar de forma masiva.
Screaming Frog integra esta API y extrae datos de un número limitado de URLs por propiedad cada día junto con los datos normales del rastreo.
Si alcanzas el límite diario por propiedad, las opciones documentadas son esperar y volver a rastrear el siguiente lote de URLs. Screaming Frog
Como alternativa, verifica varios subdominios y subcarpetas como propiedades separadas, cada una con su propio límite diario, y habilita la opción 'Use Multiple Properties'.
Para la revisión de huérfanas en particular, el estado de indexación cambia la decisión.
Una página huérfana indexada y con impresiones es un activo vivo con un problema de descubribilidad.
Una página huérfana que no está indexada en absoluto puede ser candidata a limpieza en lugar de candidata a corrección.
Decidir qué hacer con cada página huérfana
Una vez que tienes tu lista, clasifica las candidatas en cuatro grupos.
La acción correcta difiere para cada uno.
Páginas valiosas: enlázalas
Si la página cumple un propósito real, añade enlaces internos desde páginas relevantes.
Esto aplica a una guía sólida, una página de servicio o una página de producto que perdió sus enlaces en una migración.
Esto restaura la ruta para los usuarios y permite que la página reciba las señales que transmiten los enlaces internos. Screaming Frog
Para un proceso sistemático, nuestra guía sobre cómo encontrar oportunidades de enlazado interno (en inglés) cubre cómo elegir un método que se ajuste a tu sitio.
Páginas desactualizadas: elimina o redirige
Las páginas de campañas antiguas, ofertas vencidas y productos retirados a menudo no deberían existir en absoluto.
Decide entre eliminar la página o redirigirla al destino relevante más cercano.
Comprueba si la página todavía genera tráfico o impresiones antes de eliminarla.
Una página con presencia de búsqueda continua puede merecer una redirección para preservar esa ruta en lugar de una eliminación simple.
Páginas duplicadas o que compiten: consolida
Screaming Frog señala las páginas que compiten entre sí como uno de los riesgos de las páginas huérfanas a escala. Screaming Frog
Si una huérfana cubre el mismo tema que una página enlazada, consolídalas con una redirección a la página canónica para evitar dividir la relevancia.
URLs generadas por plantillas: corrige el origen
Cuando el CMS crea URLs como subproducto de las plantillas, la corrección pertenece a la configuración del CMS, no a las páginas individuales.
De lo contrario, las huérfanas reaparecerán después de cada limpieza.
Prevención: hacer del enlazado parte de la publicación
La detección es un costo recurrente.
La prevención es un cambio de proceso que se hace una sola vez.
Dos hábitos reducen las huérfanas futuras:
- Exige que cada página nueva tenga al menos un enlace interno desde una página existente antes de publicarse, y añade el enlace de la página nueva desde un hub relevante o un artículo relacionado al mismo tiempo.
- Cuando despubliques o reestructures algo, audita los enlaces que apuntaban a ello, no solo la página en sí.
La guía inicial de Google incluye promover tu sitio web entre las formas de ayudar a los buscadores a descubrir tu contenido más rápido. Google Search Central
El enlazado interno es la mitad estructural de eso: indica a usuarios y rastreadores qué existe y qué importa.
Para páginas que están enlazadas pero aún rinden poco, la detección de huérfanas se combina bien con el análisis de impresiones.
Nuestro artículo sobre priorizar páginas de altas impresiones sin clics (en inglés) cubre el siguiente paso de diagnóstico una vez que una página es descubrible.
Si algunas candidatas huérfanas son contenido de referencia, hay un recurso adicional para ti.
Nuestra pieza sobre convertir páginas de glosario en soporte comercial de SEO (en inglés) muestra cómo conectar páginas informativas con páginas de ingresos.
Una cadencia práctica para la detección continua
Como las páginas huérfanas se acumulan en silencio, trata la detección como una revisión programada en lugar de un proyecto único.
Una cadencia razonable es repetir el proceso de rastrear y comparar tras cambios importantes en el sitio, como migraciones, rediseños o actualizaciones del CMS.
También repítela a intervalos regulares entre esos hitos.
El intervalo exacto depende de la frecuencia con la que tu equipo publica y de cuántas personas pueden crear páginas fuera de tu flujo de trabajo estándar.
Conserva el resultado de cada ejecución: una lista fechada de candidatas huérfanas, la fuente de descubrimiento de cada una y la acción tomada.
Tras unos pocos ciclos verás qué causas se repiten en tu sitio, como páginas de campañas, artefactos de plantillas o restos de migraciones.
Podrás entonces corregir el proceso que sigue produciéndolas.
Cómo puede ayudar Meshline.
Conecta la automatización, el Marketing Orgánico (generación de demanda) y la gestión del ciclo de vida del cliente (Revenue Intelligence).
Integra la planificación de temas, la publicación de contenido y la retroalimentación de rendimiento en la conversación sobre tu flujo de trabajo. Reserva una demo de Meshline.