Pular para o conteúdo
Aback Tools Logo

Como Executar uma Auditoria de Links Quebrados e Erros: Ferramentas, Prioridades e Fluxos

Como executar uma auditoria completa de links quebrados e erros: links internos e externos, cadeias de redirecionamento, conflitos canônicos, erros de sitemap e robots.txt — com a ferramenta certa para cada um e um fluxo de correção priorizado.

DH
Tutorials & How-Tos12 min de leitura2,750 palavras

Links quebrados, âncoras mortas, cadeias de redirecionamento e conflitos canônicos estão entre os problemas técnicos de SEO mais comuns — e mais negligenciados — em sites consolidados. Eles se acumulam silenciosamente à medida que páginas são renomeadas, excluídas ou reestruturadas, e custam simultaneamente orçamento de rastreamento, link equity e experiência do usuário. Este guia percorre cada tipo de erro que você precisa encontrar, a ferramenta certa para cada um e como priorizar as correções para que os problemas de maior impacto sejam tratados primeiro.

5Categorias de errointerno, externo, redirecionamentos, canônico, sitemap
< 1sAnálise por páginalocal no navegador, sem rastreamento
100%Privacidadenenhum HTML enviado a servidores

Tipos de erros para auditar

Uma auditoria completa de links quebrados e erros cobre cinco categorias de problemas distintas. Cada categoria requer uma ferramenta diferente e produz tipos de correção diferentes. Entender o escopo completo antes de começar evita o erro comum de tratar uma auditoria de links quebrados como simplesmente "encontrar URLs mortas" — há outros quatro tipos de erro igualmente danosos e frequentemente despercebidos.

As cinco categorias de erro

  • Links internos quebrados: links entre páginas do seu próprio site que apontam para páginas excluídas, renomeadas ou movidas, incluindo links de fragmento de âncora quebrados (`#id-da-secao`).
  • Links externos quebrados: links de saída para URLs de terceiros que retornam erros, estão malformados, usam HTTP em vez de HTTPS ou apontam para domínios expirados.
  • Cadeias e loops de redirecionamento: URLs que redirecionam por múltiplos saltos intermediários (cadeia) ou que redirecionam em ciclo (loop), desperdiçando orçamento de rastreamento e degradando o link equity.
  • Conflitos canônicos: páginas com tags canônicas apontando para a URL errada, usando caminhos relativos, referenciando destinos não HTTPS ou autorreferenciando-se incorretamente.
  • Erros de sitemap e robots.txt: sitemaps que incluem páginas noindex, XML malformado, URLs inválidas ou elementos obrigatórios ausentes; arquivos robots.txt com diretivas que bloqueiam páginas-chave.
Tipo de erroImpacto no SEOImpacto no usuárioComplexidade da correção
Links internos quebradosAlto — desperdiça rastreamento, quebra PageRankAlto — página 404 exibidaBaixo — atualizar href ou adicionar redirecionamento
Âncoras de fragmento quebradasMédio — confunde rastreadores, quebra o índiceMédio — página carrega, rolagem falhaBaixo — atualizar o ID da âncora
Links externos quebradosMédio — sinal de qualidade degradadoMédio — 404 externoMédio — encontrar URL substituta
Cadeias de redirecionamento (3+ saltos)Médio — diluição de PageRank por saltoBaixo — geralmente transparenteMédio — consolidar em 301 direta
Conflitos canônicosAlto — a página errada pode ser indexadaNenhum — invisível para usuáriosBaixo — corrigir o href canônico
Erros de sitemapAlto — rastreadores podem perder páginasNenhum — invisível para usuáriosBaixo — corrigir a estrutura XML

Uma auditoria de links quebrados não é uma tarefa única — é uma verificação de qualidade recorrente que deve rodar após cada mudança significativa de conteúdo e cada implantação.

- Fundamentos do SEO técnico

Cadeias de redirecionamento e problemas canônicos

Cadeias de redirecionamento e conflitos de tags canônicas são dois dos erros técnicos de SEO de maior impacto porque afetam diretamente qual página o Google decide indexar e quanto link equity cada página acumula. Nenhum dos dois erros produz um problema visível para o usuário — ambos são invisíveis aos visitantes —, razão pela qual persistem nos sites por meses ou anos sem serem notados.

Detectando e corrigindo cadeias de redirecionamento

Uma cadeia de redirecionamento se forma quando uma URL tem um redirecionamento que por si redireciona, criando uma sequência de saltos antes de chegar ao destino final. Os rastreadores do Google seguem cadeias até um limite, mas cada salto adicional reduz o PageRank transmitido da URL original para o destino. Uma cadeia de três redirecionamentos transmite mensuravelmente menos equity do que uma única 301 direta.

O Verificador de Cadeias de Redirecionamento analisa seu mapa de redirecionamentos ou logs do servidor e identifica cadeias com mais de um salto, loops de redirecionamento (URL A → B → A) e sequências mistas HTTP/HTTPS. A correção para uma cadeia é sempre atualizar a origem para redirecionar diretamente à URL de destino final, contornando todas as etapas intermediárias.

Auditoria de tags canônicas

Uma tag canônica diz aos mecanismos de busca qual versão de uma página é a preferida para indexação. Erros canônicos comuns incluem: uma página que canoniza para uma URL que não existe, uma tag canônica que usa caminho relativo em vez de URL absoluta, a canônica apontando para uma URL HTTP quando o site é HTTPS, e uma página que canoniza para outra página que por sua vez canoniza de volta — um loop canônico. Qualquer um desses casos pode fazer o Google indexar a versão errada de uma página ou desconfiar inteiramente do sinal canônico.

O Verificador de URL Canônica valida tags canônicas e mapeamentos de URL para todos esses padrões de conflito. Execute-o em qualquer página onde você suspeite de problemas de indexação, em todas as séries paginadas (comumente mal configuradas) e em qualquer página migrada de uma URL antiga.

Warning

Nunca defina uma tag canônica em uma página que tenha a diretiva robots `noindex`. Os dois sinais são contraditórios — você está dizendo simultaneamente "a versão canônica desta página é X" e "não indexe esta página". O Google trata isso como um conflito e pode ignorar inteiramente o sinal canônico, levando a um comportamento de indexação inesperado.

Auditoria de sitemap e robots.txt

Seu sitemap diz aos mecanismos de busca quais páginas existem e devem ser rastreadas. Seu robots.txt diz aos rastreadores quais caminhos podem acessar. Ambos os arquivos são simples em princípio, mas surpreendentemente fáceis de configurar errado — e erros em qualquer um deles podem resultar em páginas importantes sendo ignoradas ou, pior, ativamente bloqueadas.

O que verificar no seu sitemap

  • Páginas noindex incluídas: qualquer URL do sitemap que também tenha a diretiva robots `noindex` envia um sinal contraditório. Remova as páginas noindex do sitemap.
  • URLs HTTP em um site HTTPS: toda URL do seu sitemap deve usar o protocolo HTTPS. Uma URL HTTP em um sitemap de domínio HTTPS faz o rastreador seguir um redirecionamento a cada rastreamento dessa URL.
  • URLs 4xx e 5xx: sitemaps devem conter apenas páginas vivas e acessíveis. Uma URL quebrada no sitemap desperdiça orçamento de rastreamento toda vez que o Googlebot a verifica.
  • Elementos obrigatórios ausentes: o protocolo sitemap exige um invólucro `<urlset>` e elementos `<loc>` para cada URL. A ausência desses elementos torna o sitemap inanalisável.
  • Exceder o limite de 50.000 URLs: um único arquivo sitemap não pode conter mais de 50.000 URLs. Use um arquivo de índice de sitemap e vários arquivos de lote para sites maiores.

O Validador XML de Sitemap verifica todos esses problemas estruturais e de conformidade com o protocolo a partir de um colar do seu arquivo sitemap. Nenhuma URL é buscada — a validação é inteiramente estrutural, o que o torna seguro para sitemaps contendo URLs internas que você não quer expor. Para sitemaps acima do limite de tamanho, o Divisor de Índice de Sitemap divide o arquivo em pedaços conformes e gera o arquivo de índice automaticamente.

Auditoria de robots.txt

A diretiva Disallow do robots.txt é um instrumento bruto — uma única regra mal configurada pode bloquear uma seção inteira do seu site do rastreamento. Os erros de robots.txt mais comuns são: uma diretiva `Disallow: /` que bloqueia todo o site (geralmente herdada de um ambiente de staging), bloquear arquivos CSS ou JavaScript que o Google precisa para renderizar páginas, e regras Allow/Disallow conflitantes onde a regra mais restritiva prevalece inesperadamente.

O Validador de Robots.txt verifica seu arquivo robots.txt em busca de erros de sintaxe, diretivas inválidas, problemas de caminho e boas práticas estruturais. Cole o conteúdo do arquivo — nunca exige uma busca ao vivo do seu domínio — e o validador relata cada problema com uma descrição em linguagem simples do impacto potencial.


Warning

Uma regra `Disallow: /wp-admin/` destinada a bloquear a área de administração também bloqueará qualquer caminho de URL que comece com `/wp-admin/` — incluindo URLs que você possa ter nomeado com esse prefixo para outros fins. Teste cada regra Disallow contra sua estrutura real de URLs usando o testador de robots.txt do Google Search Console ou o Validador de Robots.txt da Aback Tools antes de implantar mudanças em produção.

Fluxo de auditoria e priorização

Uma auditoria de links quebrados e erros gera achados em cinco categorias, e nem todos os achados são iguais. Tentar corrigir tudo simultaneamente é impraticável em qualquer site maior do que algumas dezenas de páginas. Um fluxo priorizado concentra o esforço primeiro nos erros de maior impacto em SEO e experiência do usuário, descendo para a limpeza de menor prioridade em sprints subsequentes.

Ordem de auditoria recomendada

  1. Corrija os links internos quebrados em páginas de alto tráfego e menus de navegação — eles afetam imediatamente tanto usuários quanto a distribuição de PageRank.
  2. Corrija os conflitos canônicos nas suas páginas mais importantes — canônicas incorretas fazem a URL errada ser indexada, deslocando diretamente sua página-alvo dos rankings.
  3. Consolide as cadeias de redirecionamento em 301 de salto único — isso recupera o PageRank que está sendo diluído ao longo da cadeia.
  4. Atualize ou remova os links externos quebrados — urgência menor que os problemas internos, mas um sinal de qualidade mensurável.
  5. Corrija os erros de sitemap — garante que páginas recém-publicadas sejam descobertas com eficiência.
  6. Corrija os erros de robots.txt — crítico se algum bloqueio for suspeitado; caso contrário, urgência menor que o anterior.

Construindo um cronograma de auditoria recorrente

Para sites que publicam conteúdo regularmente, uma cadência mensal de auditoria detecta a acumulação antes que ela se agrave. Para sites em migração ou redesign, execute uma auditoria imediatamente antes da mudança para estabelecer uma linha de base e novamente imediatamente depois para verificar se cada redirecionamento está no lugar. Integrar verificações automatizadas ao seu pipeline de implantação detecta links quebrados recém-introduzidos antes que cheguem à produção — a maioria dos frameworks de CI/CD suporta scripts simples de validação de URL que rodam como etapa pós-implantação.

Uma auditoria de links quebrados é um componente de uma revisão técnica de SEO mais ampla. Uma vez resolvidos os problemas de links e redirecionamentos, estenda a auditoria para cobrir meta tags com as ferramentas Analisador de Meta Tags, a validade de dados estruturados com o Validador de Dados Estruturados e a qualidade de HTML com o Validador de HTML. Essas quatro verificações juntas cobrem os problemas técnicos de SEO mais comuns que impedem conteúdo bem escrito de ranquear em todo o seu potencial.

Tip

Mantenha um registro simples em planilha de cada auditoria: data, páginas verificadas, erros encontrados e correções aplicadas. Com o tempo, esse registro revela quais páginas acumulam links quebrados com mais frequência — geralmente páginas que apontam muito para fontes externas em um nicho de mudança rápida — e permite priorizá-las para verificações mais frequentes.

Key takeaways

  • Uma auditoria completa de links quebrados cobre cinco tipos de erro: links internos, links externos, cadeias de redirecionamento, conflitos canônicos e erros de sitemap/robots.txt — cada um requer uma ferramenta diferente.
  • Links internos quebrados desperdiçam orçamento de rastreamento e interrompem o fluxo de PageRank; corrija-os começando pelas suas páginas de maior tráfego e menus de navegação.
  • Use o Verificador de Links Internos Quebrados para detectar falhas de âncoras de fragmento (links #id-da-secao) que rastreadores padrão não percebem.
  • Cadeias de redirecionamento com mais de um salto diluem o PageRank — use o Verificador de Cadeias de Redirecionamento e consolide cada cadeia em uma única 301 direta.
  • Conflitos canônicos fazem a versão errada da página ser indexada — o Verificador de URL Canônica captura caminhos relativos, destinos não HTTPS e loops canônicos.
  • Valide seu sitemap com o Validador XML de Sitemap para remover páginas noindex, URLs HTTP e endpoints quebrados antes que desperdicem orçamento de rastreamento.
  • Execute uma auditoria de links quebrados após cada mudança significativa de conteúdo, reestruturação de URL ou migração de site — os erros se acumulam silenciosamente e são mais baratos de corrigir imediatamente.

Perguntas frequentes

A broken link audit is a systematic review of every link on a website - both internal links between your own pages and external links pointing to third-party URLs - to identify any that return an error (typically a 404 Not Found), are malformed, or lead to a redirect chain rather than the intended destination. The audit also covers fragment anchors (#section-id links), which break silently in browsers and crawlers when the target ID has been removed or renamed.

Broken links hurt SEO in three ways. First, they waste crawl budget - Googlebot follows every link it finds, and each 404 response consumes crawl quota that could have been spent on indexable pages. Second, internal broken links break the PageRank flow across your site: link equity cannot pass through a dead endpoint. Third, a high density of broken links on a page is a quality signal that can depress the page's rankings, especially when the broken links point outward to important references.

A broken internal link points to another page or anchor on your own website that no longer exists or has a different ID. It is fully within your control to fix. A broken external link points to a third-party URL that returns an error - a site that went offline, a resource that was deleted, or a URL that was restructured without a redirect. External broken links are harder to fix because you depend on the third-party domain, but you can replace them with archived versions or updated sources.

A redirect chain occurs when a URL redirects to a second URL, which redirects to a third, and so on - rather than redirecting directly to the final destination. Each hop in the chain adds latency and causes Googlebot to spend additional crawl budget on intermediate URLs. Google generally follows redirect chains, but PageRank dilution has been observed across each additional hop. The rule of thumb is to limit redirect sequences to a single hop wherever possible, and never more than two.

For individual pages, paste the HTML into the Aback Tools Broken Internal Link Checker and Broken External Link Checker - both tools analyse links without any server-side processing. For a full-site crawl, tools like Screaming Frog SEO Spider (desktop), Ahrefs Site Audit, or the free Broken Link Check service crawl every page and report all 4xx and 5xx responses. For large sites, use a combination: a crawler for discovery and the Aback Tools validators for deep per-page analysis of fragment links.

Fix them where possible - find a replacement URL that serves the same reference purpose and update the link. If no replacement exists, removing the link is better than leaving a broken one. For high-authority sources that have gone offline, check the Wayback Machine (web.archive.org) for an archived version and link to that instead. Dead external links are not as damaging as dead internal links, but they are a quality signal, and fixing them also improves the user experience for visitors who click the link.

A sitemap audit should verify that every URL in the sitemap is accessible (not returning a 4xx or 5xx), that all URLs use the correct protocol (HTTPS), that the XML structure conforms to the sitemap protocol (urlset, loc, changefreq, priority, lastmod), and that the sitemap does not include pages with noindex directives. Including noindex pages in a sitemap sends a contradictory signal to crawlers. The Aback Tools Sitemap XML Validator checks all of these structural and protocol compliance issues from a paste of your sitemap file.

For active websites that publish new content regularly, a monthly audit is a reasonable minimum. For sites undergoing a migration, redesign, or URL restructure, run an audit immediately before and immediately after the change - before to create a baseline, and after to verify every redirect is in place. For large e-commerce or news sites with thousands of pages, integrate automated broken link checking into your CI/CD deployment pipeline so any newly introduced broken link is caught before it reaches production.

ShareXLinkedIn