Saltar al contenido
Aback Tools Logo

Cómo Realizar una Auditoría de Enlaces Rotos y Errores: Herramientas, Prioridades y Flujos

Cómo realizar una auditoría completa de enlaces rotos y errores: enlaces internos y externos, cadenas de redirección, conflictos canónicos, errores de sitemap y robots.txt — con la herramienta adecuada para cada uno y un flujo de corrección priorizado.

DH
Tutorials & How-Tos12 min de lectura2,750 palabras

Los enlaces rotos, anclas muertas, cadenas de redirección y conflictos canónicos están entre los problemas técnicos de SEO más comunes — y más pasados por alto — en sitios web consolidados. Se acumulan silenciosamente a medida que las páginas se renombran, eliminan o reestructuran, y te cuestan presupuesto de rastreo, link equity y experiencia de usuario simultáneamente. Esta guía recorre cada tipo de error que necesitas encontrar, la herramienta adecuada para cada uno y cómo priorizar las correcciones para que los problemas de mayor impacto se atiendan primero.

5Categorías de errorinterno, externo, redirecciones, canónico, sitemap
< 1sAnálisis por páginalocal en el navegador, sin rastreo
100%Privacidadno se sube HTML a servidores

Tipos de errores a auditar

Una auditoría completa de enlaces rotos y errores cubre cinco categorías de problemas distintas. Cada categoría requiere una herramienta diferente y produce tipos de corrección diferentes. Entender el alcance completo antes de empezar evita el error común de tratar una auditoría de enlaces rotos como simplemente "encontrar URLs muertas" — hay otros cuatro tipos de error igual de dañinos y a menudo pasados por alto.

Las cinco categorías de error

  • Enlaces internos rotos: enlaces entre páginas de tu propio sitio que apuntan a páginas eliminadas, renombradas o movidas, incluidos los enlaces de fragmento de ancla rotos (`#id-seccion`).
  • Enlaces externos rotos: enlaces salientes a URLs de terceros que devuelven errores, están malformados, usan HTTP en lugar de HTTPS o apuntan a dominios caducados.
  • Cadenas y bucles de redirección: URLs que redirigen a través de múltiples saltos intermedios (cadena) o que redirigen en ciclo (bucle), desperdiciando presupuesto de rastreo y degradando el link equity.
  • Conflictos canónicos: páginas con etiquetas canónicas que apuntan a la URL equivocada, usan rutas relativas, referencian objetivos no HTTPS o se autorreferencian incorrectamente.
  • Errores de sitemap y robots.txt: sitemaps que incluyen páginas noindex, XML malformado, URLs inválidas o elementos obligatorios ausentes; archivos robots.txt con directivas que bloquean páginas clave.
Tipo de errorImpacto SEOImpacto en el usuarioComplejidad de corrección
Enlaces internos rotosAlto — desperdicia rastreo, rompe PageRankAlto — se muestra página 404Bajo — actualizar href o añadir redirección
Anclas de fragmento rotasMedio — confunde a rastreadores, rompe el índiceMedio — carga la página, falla el scrollBajo — actualizar el ID del ancla
Enlaces externos rotosMedio — señal de calidad degradadaMedio — 404 externoMedio — encontrar URL de reemplazo
Cadenas de redirección (3+ saltos)Medio — dilución de PageRank por saltoBajo — normalmente transparenteMedio — consolidar a 301 directa
Conflictos canónicosAlto — puede indexarse la página incorrectaNinguno — invisible para usuariosBajo — corregir el href canónico
Errores de sitemapAlto — los rastreadores pueden perder páginasNinguno — invisible para usuariosBajo — corregir la estructura XML

Una auditoría de enlaces rotos no es una tarea única — es una comprobación de calidad recurrente que debería ejecutarse tras cada cambio de contenido significativo y cada despliegue.

- Fundamentos del SEO técnico

Cadenas de redirección y problemas canónicos

Las cadenas de redirección y los conflictos de etiquetas canónicas son dos de los errores técnicos de SEO de mayor impacto porque afectan directamente qué página decide Google indexar y cuánto link equity acumula cada página. Ninguno de los dos errores produce un problema visible para el usuario — ambos son invisibles para los visitantes — por lo que persisten en los sitios durante meses o años sin que se note.

Detectar y corregir cadenas de redirección

Una cadena de redirección se forma cuando una URL tiene una redirección que a su vez redirige, creando una secuencia de saltos antes de llegar al destino final. Los rastreadores de Google siguen las cadenas hasta un límite, pero cada salto adicional reduce el PageRank que pasa de la URL original al destino. Una cadena de tres redirecciones transmite mensurablemente menos equity que una única 301 directa.

El Verificador de Cadenas de Redirección analiza tu mapa de redirecciones o registros del servidor e identifica cadenas de más de un salto, bucles de redirección (URL A → B → A) y secuencias mixtas HTTP/HTTPS. La corrección para una cadena siempre es actualizar el origen para que redirija directamente a la URL de destino final, omitiendo todos los pasos intermedios.

Auditoría de etiquetas canónicas

Una etiqueta canónica dice a los buscadores qué versión de una página es la preferida para indexar. Los errores canónicos comunes incluyen: una página que canonicaliza a una URL que no existe, una etiqueta canónica que usa una ruta relativa en lugar de una URL absoluta, la canónica apuntando a una URL HTTP cuando el sitio es HTTPS, y una página que canonicaliza a otra página que a su vez canonicaliza de vuelta — un bucle canónico. Cualquiera de estos puede hacer que Google indexe la versión incorrecta de una página o desconfíe por completo de la señal canónica.

El Verificador de URL Canónica valida etiquetas canónicas y mapeos de URL para todos estos patrones de conflicto. Ejecútalo en cualquier página donde sospeches problemas de indexación, en todas las páginas de series paginadas (que comúnmente tienen canónicas mal configuradas) y en cualquier página migrada de una URL antigua.

Warning

Nunca pongas una etiqueta canónica en una página que tenga la directiva robots `noindex`. Las dos señales son contradictorias — estás diciendo simultáneamente "la versión canónica de esta página es X" y "no indexes esta página". Google lo trata como un conflicto y puede ignorar por completo la señal canónica, llevando a un comportamiento de indexación inesperado.

Auditoría de sitemap y robots.txt

Tu sitemap dice a los buscadores qué páginas existen y deberían rastrearse. Tu robots.txt dice a los rastreadores qué rutas pueden acceder. Ambos archivos son simples en principio pero sorprendentemente fáciles de configurar mal — y los errores en cualquiera pueden hacer que páginas importantes sean ignoradas o, peor, bloqueadas activamente.

Qué comprobar en tu sitemap

  • Páginas noindex incluidas: cualquier URL del sitemap que también tenga la directiva robots `noindex` envía una señal contradictoria. Elimina las páginas noindex del sitemap.
  • URLs HTTP en un sitio HTTPS: cada URL de tu sitemap debería usar el protocolo HTTPS. Una URL HTTP en un sitemap de un dominio HTTPS hace que el rastreador siga una redirección en cada rastreo de esa URL.
  • URLs 4xx y 5xx: los sitemaps solo deberían contener páginas vivas y accesibles. Una URL rota en el sitemap desperdicia presupuesto de rastreo cada vez que Googlebot la comprueba.
  • Elementos obligatorios ausentes: el protocolo sitemap requiere un envoltorio `<urlset>` y elementos `<loc>` para cada URL. Carecer de estos elementos hace el sitemap no analizable.
  • Superar el límite de 50.000 URLs: un único archivo sitemap no puede contener más de 50.000 URLs. Usa un archivo índice de sitemap y varios archivos de trozos para sitios más grandes.

El Validador XML de Sitemap comprueba todos estos problemas estructurales y de cumplimiento del protocolo a partir de una pega de tu archivo sitemap. No se obtiene ninguna URL — la validación es enteramente estructural, lo que lo hace seguro para sitemaps que contienen URLs internas que no quieres exponer. Para sitemaps por encima del límite de tamaño, el Divisor de Índices de Sitemap divide el archivo en piezas conformes y genera el archivo índice automáticamente.

Auditoría de robots.txt

La directiva Disallow de robots.txt es un instrumento contundente — una sola regla mal configurada puede bloquear una sección entera de tu sitio del rastreo. Los errores de robots.txt más comunes son: una directiva `Disallow: /` que bloquea todo el sitio (a menudo heredada de un entorno de staging), bloquear archivos CSS o JavaScript que Google necesita para renderizar páginas, y reglas Allow/Disallow en conflicto donde la regla más restrictiva toma precedencia inesperadamente.

El Validador de Robots.txt comprueba tu archivo robots.txt en busca de errores de sintaxis, directivas inválidas, problemas de ruta y buenas prácticas estructurales. Pega el contenido del archivo — nunca requiere una obtención en vivo de tu dominio — y el validador informa de cada problema con una descripción en lenguaje llano del impacto potencial.


Warning

Una regla `Disallow: /wp-admin/` destinada a bloquear el área de administración también bloqueará cualquier ruta de URL que empiece por `/wp-admin/` — incluidas URLs que quizá nombraste con ese prefijo para otros propósitos. Prueba cada regla Disallow contra tu estructura de URLs real usando el probador de robots.txt de Google Search Console o el Validador de Robots.txt de Aback Tools antes de desplegar cambios en producción.

Flujo de auditoría y priorización

Una auditoría de enlaces rotos y errores genera hallazgos en cinco categorías, y no todos los hallazgos son iguales. Intentar corregir todo simultáneamente es poco práctico en cualquier sitio mayor que unas pocas docenas de páginas. Un flujo de trabajo priorizado centra el esfuerzo primero en los errores con mayor impacto SEO y de experiencia de usuario, bajando hacia la limpieza de menor prioridad en sprints posteriores.

Orden de auditoría recomendado

  1. Corrige los enlaces internos rotos en páginas de alto tráfico y menús de navegación — afectan tanto a usuarios como a la distribución de PageRank de inmediato.
  2. Corrige los conflictos canónicos en tus páginas más importantes — las canónicas incorrectas hacen que se indexe la URL equivocada, desplazando directamente tu página objetivo de los rankings.
  3. Consolida las cadenas de redirección en 301 de un solo salto — esto recupera el PageRank que actualmente se diluye a lo largo de la cadena.
  4. Actualiza o elimina los enlaces externos rotos — menor urgencia que los problemas internos pero una señal de calidad medible.
  5. Corrige los errores de sitemap — asegura que las páginas recién publicadas se descubran eficientemente.
  6. Corrige los errores de robots.txt — crítico si se sospecha algún bloqueo; de lo contrario, menor urgencia que lo anterior.

Construir un calendario de auditoría recurrente

Para sitios que publican contenido regularmente, una cadencia de auditoría mensual detecta la acumulación antes de que se agrave. Para sitios en migración o rediseño, ejecuta una auditoría inmediatamente antes del cambio para establecer una línea base y otra inmediatamente después para verificar que cada redirección está en su sitio. Integrar comprobaciones automatizadas en tu pipeline de despliegue detecta los enlaces rotos recién introducidos antes de que lleguen a producción — la mayoría de los frameworks CI/CD soportan scripts simples de validación de URLs que pueden ejecutarse como paso posterior al despliegue.

Combinar auditorías de enlaces con una revisión SEO completa

Una auditoría de enlaces rotos es un componente de una revisión técnica de SEO más amplia. Una vez resueltos los problemas de enlaces y redirecciones, extiende la auditoría para cubrir metaetiquetas con las herramientas Analizador de Metaetiquetas, la validez de datos estructurados con el Validador de Datos Estructurados y la calidad HTML con el Validador de HTML. Estas cuatro comprobaciones juntas cubren los problemas técnicos de SEO más comunes que impiden que el contenido bien escrito ranque según su potencial.

Tip

Lleva un registro simple en hoja de cálculo de cada auditoría: fecha, páginas comprobadas, errores encontrados y correcciones aplicadas. Con el tiempo, este registro revela qué páginas acumulan enlaces rotos con más frecuencia — normalmente páginas que enlazan mucho a fuentes externas en un nicho de cambio rápido — y te permite priorizarlas para comprobaciones más frecuentes.

Key takeaways

  • Una auditoría completa de enlaces rotos cubre cinco tipos de error: enlaces internos, enlaces externos, cadenas de redirección, conflictos canónicos y errores de sitemap/robots.txt — cada uno requiere una herramienta diferente.
  • Los enlaces internos rotos desperdician presupuesto de rastreo e interrumpen el flujo de PageRank; corrígelos empezando por tus páginas de mayor tráfico y menús de navegación.
  • Usa el Verificador de Enlaces Internos Rotos para detectar fallos de anclas de fragmento (enlaces #id-seccion) que los rastreadores estándar pasan por alto.
  • Las cadenas de redirección de más de un salto diluyen el PageRank — usa el Verificador de Cadenas de Redirección y consolida cada cadena en una única 301 directa.
  • Los conflictos canónicos hacen que se indexe la versión incorrecta de la página — el Verificador de URL Canónica detecta rutas relativas, objetivos no HTTPS y bucles canónicos.
  • Valida tu sitemap con el Validador XML de Sitemap para eliminar páginas noindex, URLs HTTP y endpoints rotos antes de que desperdicien presupuesto de rastreo.
  • Ejecuta una auditoría de enlaces rotos tras cada cambio de contenido significativo, reestructura de URLs o migración de sitio — los errores se acumulan silenciosamente y es más barato corregirlos de inmediato.

Preguntas frecuentes

A broken link audit is a systematic review of every link on a website - both internal links between your own pages and external links pointing to third-party URLs - to identify any that return an error (typically a 404 Not Found), are malformed, or lead to a redirect chain rather than the intended destination. The audit also covers fragment anchors (#section-id links), which break silently in browsers and crawlers when the target ID has been removed or renamed.

Broken links hurt SEO in three ways. First, they waste crawl budget - Googlebot follows every link it finds, and each 404 response consumes crawl quota that could have been spent on indexable pages. Second, internal broken links break the PageRank flow across your site: link equity cannot pass through a dead endpoint. Third, a high density of broken links on a page is a quality signal that can depress the page's rankings, especially when the broken links point outward to important references.

A broken internal link points to another page or anchor on your own website that no longer exists or has a different ID. It is fully within your control to fix. A broken external link points to a third-party URL that returns an error - a site that went offline, a resource that was deleted, or a URL that was restructured without a redirect. External broken links are harder to fix because you depend on the third-party domain, but you can replace them with archived versions or updated sources.

A redirect chain occurs when a URL redirects to a second URL, which redirects to a third, and so on - rather than redirecting directly to the final destination. Each hop in the chain adds latency and causes Googlebot to spend additional crawl budget on intermediate URLs. Google generally follows redirect chains, but PageRank dilution has been observed across each additional hop. The rule of thumb is to limit redirect sequences to a single hop wherever possible, and never more than two.

For individual pages, paste the HTML into the Aback Tools Broken Internal Link Checker and Broken External Link Checker - both tools analyse links without any server-side processing. For a full-site crawl, tools like Screaming Frog SEO Spider (desktop), Ahrefs Site Audit, or the free Broken Link Check service crawl every page and report all 4xx and 5xx responses. For large sites, use a combination: a crawler for discovery and the Aback Tools validators for deep per-page analysis of fragment links.

Fix them where possible - find a replacement URL that serves the same reference purpose and update the link. If no replacement exists, removing the link is better than leaving a broken one. For high-authority sources that have gone offline, check the Wayback Machine (web.archive.org) for an archived version and link to that instead. Dead external links are not as damaging as dead internal links, but they are a quality signal, and fixing them also improves the user experience for visitors who click the link.

A sitemap audit should verify that every URL in the sitemap is accessible (not returning a 4xx or 5xx), that all URLs use the correct protocol (HTTPS), that the XML structure conforms to the sitemap protocol (urlset, loc, changefreq, priority, lastmod), and that the sitemap does not include pages with noindex directives. Including noindex pages in a sitemap sends a contradictory signal to crawlers. The Aback Tools Sitemap XML Validator checks all of these structural and protocol compliance issues from a paste of your sitemap file.

For active websites that publish new content regularly, a monthly audit is a reasonable minimum. For sites undergoing a migration, redesign, or URL restructure, run an audit immediately before and immediately after the change - before to create a baseline, and after to verify every redirect is in place. For large e-commerce or news sites with thousands of pages, integrate automated broken link checking into your CI/CD deployment pipeline so any newly introduced broken link is caught before it reaches production.

ShareXLinkedIn