Aller au contenu
Aback Tools Logo

Comment Mener un Audit des Liens Cassés et des Erreurs : Outils, Priorités et Workflows

Comment mener un audit complet des liens cassés et des erreurs : liens internes et externes, chaînes de redirection, conflits canoniques, erreurs de sitemap et robots.txt — avec le bon outil pour chacun et un workflow de correction priorisé.

DH
Tutorials & How-Tos12 min de lecture2,750 mots

Les liens cassés, les ancres mortes, les chaînes de redirection et les conflits canoniques comptent parmi les problèmes SEO techniques les plus courants — et les plus négligés — des sites établis. Ils s'accumulent silencieusement à mesure que les pages sont renommées, supprimées ou restructurées, et ils vous coûtent simultanément du budget de crawl, du link equity et de l'expérience utilisateur. Ce guide passe en revue chaque type d'erreur à détecter, le bon outil pour chacun et la façon de prioriser les corrections pour traiter d'abord les problèmes au plus fort impact.

5Catégories d'erreursinterne, externe, redirections, canonique, sitemap
< 1sAnalyse par pagelocale au navigateur, sans crawl
100%Confidentialitéaucun HTML envoyé à des serveurs

Types d'erreurs à auditer

Un audit complet des liens cassés et des erreurs couvre cinq catégories de problèmes distinctes. Chaque catégorie requiert un outil différent et produit des types de corrections différents. Comprendre le périmètre complet avant de commencer évite l'erreur courante de traiter un audit de liens cassés comme un simple « trouver les URL mortes » — il existe quatre autres types d'erreurs tout aussi dommageables et souvent manqués.

Les cinq catégories d'erreurs

  • Liens internes cassés : liens entre les pages de votre propre site pointant vers des pages supprimées, renommées ou déplacées, y compris les liens de fragments d'ancre cassés (`#id-de-section`).
  • Liens externes cassés : liens sortants vers des URL tierces renvoyant des erreurs, malformés, utilisant HTTP au lieu de HTTPS, ou pointant vers des domaines expirés.
  • Chaînes et boucles de redirection : URL qui redirigent à travers plusieurs sauts intermédiaires (chaîne) ou qui redirigent en boucle (cycle), gaspillant le budget de crawl et dégradant le link equity.
  • Conflits canoniques : pages dont les balises canoniques pointent vers la mauvaise URL, utilisent des chemins relatifs, référencent des cibles non HTTPS ou s'auto-référencent incorrectement.
  • Erreurs de sitemap et robots.txt : sitemaps incluant des pages noindex, du XML malformé, des URL invalides ou des éléments obligatoires manquants ; fichiers robots.txt avec des directives bloquant des pages clés.
Type d'erreurImpact SEOImpact utilisateurComplexité de correction
Liens internes cassésÉlevé — gaspille le crawl, casse le PageRankÉlevé — page 404 affichéeFaible — mettre à jour le href ou ajouter une redirection
Ancres de fragment casséesMoyen — perturbe les crawlers, casse le sommaireMoyen — la page charge, le défilement échoueFaible — mettre à jour l'ID d'ancre
Liens externes cassésMoyen — signal de qualité dégradéMoyen — 404 externeMoyen — trouver une URL de remplacement
Chaînes de redirection (3+ sauts)Moyen — dilution du PageRank par sautFaible — généralement transparentMoyen — consolider en 301 directe
Conflits canoniquesÉlevé — la mauvaise page peut être indexéeAucun — invisible pour les utilisateursFaible — corriger le href canonique
Erreurs de sitemapÉlevé — les crawlers peuvent rater des pagesAucun — invisible pour les utilisateursFaible — corriger la structure XML

Un audit de liens cassés n'est pas une tâche ponctuelle — c'est un contrôle qualité récurrent qui devrait s'exécuter après chaque changement de contenu significatif et chaque déploiement.

- Fondamentaux du SEO technique

Chaînes de redirection et problèmes canoniques

Les chaînes de redirection et les conflits de balises canoniques sont deux des erreurs SEO techniques les plus impactantes car elles affectent directement la page que Google décide d'indexer et la quantité de link equity que chaque page accumule. Aucune de ces erreurs ne produit de problème visible pour l'utilisateur — toutes deux invisibles pour les visiteurs — c'est pourquoi elles persistent sur les sites pendant des mois ou des années sans être remarquées.

Détecter et corriger les chaînes de redirection

Une chaîne de redirection se forme quand une URL possède une redirection qui redirige elle-même, créant une séquence de sauts avant d'atteindre la destination finale. Les crawlers de Google suivent les chaînes jusqu'à une certaine limite, mais chaque saut supplémentaire réduit le PageRank transmis de l'URL d'origine vers la destination. Une chaîne de trois redirections transmet mesurablement moins d'equity qu'une seule 301 directe.

Le Vérificateur de Chaînes de Redirection analyse votre carte de redirections ou vos journaux serveur et identifie les chaînes de plus d'un saut, les boucles de redirection (URL A → B → A) et les séquences mixtes HTTP/HTTPS. La correction d'une chaîne consiste toujours à mettre à jour la source pour rediriger directement vers l'URL de destination finale, en contournant toutes les étapes intermédiaires.

Audit des balises canoniques

Une balise canonique indique aux moteurs de recherche quelle version d'une page est préférée pour l'indexation. Les erreurs canoniques courantes incluent : une page qui canonicalise vers une URL inexistante, une balise canonique utilisant un chemin relatif plutôt qu'une URL absolue, la canonique pointant vers une URL HTTP alors que le site est en HTTPS, et une page qui canonicalise vers une autre page qui elle-même canonicalise en retour — une boucle canonique. Chacun de ces cas peut amener Google à indexer la mauvaise version d'une page ou à se méfier entièrement du signal canonique.

Le Vérificateur d'URL Canonique valide les balises canoniques et les mappages d'URL pour tous ces motifs de conflit. Exécutez-le sur toute page où vous suspectez des problèmes d'indexation, sur toutes les séries paginées (couramment mal configurées) et sur toute page migrée depuis une ancienne URL.

Warning

Ne posez jamais de balise canonique sur une page comportant une directive robots `noindex`. Les deux signaux sont contradictoires — vous dites simultanément « la version canonique de cette page est X » et « n'indexe pas cette page ». Google traite cela comme un conflit et peut ignorer entièrement le signal canonique, conduisant à un comportement d'indexation inattendu.

Audit du sitemap et du robots.txt

Votre sitemap indique aux moteurs de recherche quelles pages existent et devraient être crawées. Votre robots.txt indique aux crawlers les chemins auxquels ils peuvent accéder. Les deux fichiers sont simples en principe mais étonnamment faciles à mal configurer — et des erreurs dans l'un comme dans l'autre peuvent faire que des pages importantes soient ignorées ou, pire, activement bloquées.

Ce qu'il faut vérifier dans votre sitemap

  • Pages noindex incluses : toute URL du sitemap portant aussi une directive robots `noindex` envoie un signal contradictoire. Retirez les pages noindex du sitemap.
  • URL HTTP sur un site HTTPS : chaque URL de votre sitemap devrait utiliser le protocole HTTPS. Une URL HTTP dans un sitemap d'un domaine HTTPS force le crawler à suivre une redirection à chaque crawl de cette URL.
  • URL 4xx et 5xx : les sitemaps ne devraient contenir que des pages vivantes et accessibles. Une URL cassée dans le sitemap gaspille du budget de crawl à chaque vérification par Googlebot.
  • Éléments obligatoires manquants : le protocole sitemap exige un enveloppeur `<urlset>` et des éléments `<loc>` pour chaque URL. Leur absence rend le sitemap inanalysable.
  • Dépassement de la limite de 50 000 URL : un seul fichier sitemap ne peut pas contenir plus de 50 000 URL. Utilisez un fichier d'index de sitemap et plusieurs fichiers fragmentaires pour les sites plus grands.

Le Validateur XML de Sitemap vérifie tous ces problèmes de structure et de conformité au protocole à partir d'un collage de votre fichier sitemap. Aucune URL n'est récupérée — la validation est entièrement structurelle, ce qui le rend sûr pour les sitemaps contenant des URL internes que vous ne souhaitez pas exposer. Pour les sitemaps dépassant la limite de taille, le Découpeur d'Index de Sitemap fragmente le fichier en morceaux conformes et génère automatiquement le fichier d'index.

Audit du robots.txt

La directive Disallow du robots.txt est un outil grossier — une seule règle mal configurée peut bloquer une section entière de votre site du crawl. Les erreurs robots.txt les plus courantes sont : une directive `Disallow: /` bloquant tout le site (souvent héritée d'un environnement de staging), le blocage de fichiers CSS ou JavaScript dont Google a besoin pour rendre les pages, et des règles Allow/Disallow contradictoires où la règle la plus restrictive prend le dessus de façon inattendue.

Le Validateur Robots.txt vérifie votre fichier robots.txt pour les erreurs de syntaxe, directives invalides, problèmes de chemins et bonnes pratiques structurelles. Collez le contenu du fichier — aucune récupération en direct de votre domaine n'est requise — et le validateur signale chaque problème avec une description en langage clair de l'impact potentiel.


Warning

Une règle `Disallow: /wp-admin/` destinée à bloquer la zone d'administration bloquera aussi tout chemin d'URL commençant par `/wp-admin/` — y compris des URL que vous auriez nommées avec ce préfixe à d'autres fins. Testez chaque règle Disallow contre votre structure d'URL réelle avec le testeur robots.txt de Google Search Console ou le Validateur Robots.txt d'Aback Tools avant de déployer en production.

Workflow d'audit et priorisation

Un audit de liens cassés et d'erreurs génère des constats dans cinq catégories, et tous les constats ne se valent pas. Tout corriger simultanément est impraticable sur tout site dépassant quelques dizaines de pages. Un workflow priorisé concentre l'effort d'abord sur les erreurs au plus fort impact SEO et expérience utilisateur, puis redescend vers le nettoyage de moindre priorité lors des sprints suivants.

Ordre d'audit recommandé

  1. Corrigez les liens internes cassés sur les pages à fort trafic et les menus de navigation — ils affectent à la fois les utilisateurs et la distribution du PageRank immédiatement.
  2. Corrigez les conflits canoniques sur vos pages les plus importantes — des canoniques incorrectes font indexer la mauvaise URL, déplaçant directement votre page cible hors des classements.
  3. Consolidez les chaînes de redirection en 301 à un seul saut — cela récupère le PageRank actuellement dilué le long de la chaîne.
  4. Mettez à jour ou retirez les liens externes cassés — urgence moindre que les problèmes internes mais un signal de qualité mesurable.
  5. Corrigez les erreurs de sitemap — garantit que les pages nouvellement publiées sont découvertes efficacement.
  6. Corrigez les erreurs de robots.txt — critique si un blocage est suspecté, sinon urgence moindre que ce qui précède.

Bâtir un calendrier d'audit récurrent

Pour les sites publiant régulièrement du contenu, une cadence d'audit mensuelle détecte l'accumulation avant qu'elle ne s'aggrave. Pour les sites en migration ou en refonte, exécutez un audit juste avant le changement pour établir une référence, puis immédiatement après pour vérifier que chaque redirection est en place. L'intégration de vérifications automatisées dans votre pipeline de déploiement détecte les liens cassés récemment introduits avant qu'ils n'atteignent la production — la plupart des frameworks CI/CD prennent en charge de simples scripts de validation d'URL exécutables en post-déploiement.

Combiner les audits de liens avec un bilan SEO complet

Un audit de liens cassés est une composante d'une revue SEO technique plus large. Une fois les problèmes de liens et de redirections résolus, étendez l'audit aux balises meta avec les outils Analyseur de Balises Meta, à la validité des données structurées avec le Validateur de Données Structurées, et à la qualité HTML avec le Validateur HTML. Ces quatre vérifications ensemble couvrent les problèmes SEO techniques les plus courants qui empêchent un contenu bien rédigé de se classer selon son potentiel.

Tip

Tenez un registre simple sous forme de feuille de calcul pour chaque audit : date, pages vérifiées, erreurs trouvées et corrections appliquées. Avec le temps, ce registre révèle quelles pages accumulent le plus souvent des liens cassés — généralement des pages liant massivement vers des sources externes dans une niche à évolution rapide — et vous permet de les prioriser pour des vérifications plus fréquentes.

Key takeaways

  • Un audit complet des liens cassés couvre cinq types d'erreurs : liens internes, liens externes, chaînes de redirection, conflits canoniques et erreurs de sitemap/robots.txt — chacun requiert un outil différent.
  • Les liens internes cassés gaspillent le budget de crawl et interrompent le flux de PageRank ; corrigez-les en commençant par vos pages les plus fréquentées et vos menus de navigation.
  • Utilisez le Vérificateur de Liens Internes Cassés pour détecter les échecs d'ancres de fragment (liens #id-de-section) que les crawlers standard manquent.
  • Les chaînes de redirection de plus d'un saut diluent le PageRank — utilisez le Vérificateur de Chaînes de Redirection et consolidez chaque chaîne en une seule 301 directe.
  • Les conflits canoniques font indexer la mauvaise version de la page — le Vérificateur d'URL Canonique repère les chemins relatifs, les cibles non HTTPS et les boucles canoniques.
  • Validez votre sitemap avec le Validateur XML de Sitemap pour retirer les pages noindex, les URL HTTP et les points d'entrée cassés avant qu'ils ne gaspillent le budget de crawl.
  • Menez un audit de liens cassés après chaque changement de contenu significatif, restructuration d'URL ou migration de site — les erreurs s'accumulent silencieusement et sont les moins chères à corriger immédiatement.

Questions fréquentes

A broken link audit is a systematic review of every link on a website - both internal links between your own pages and external links pointing to third-party URLs - to identify any that return an error (typically a 404 Not Found), are malformed, or lead to a redirect chain rather than the intended destination. The audit also covers fragment anchors (#section-id links), which break silently in browsers and crawlers when the target ID has been removed or renamed.

Broken links hurt SEO in three ways. First, they waste crawl budget - Googlebot follows every link it finds, and each 404 response consumes crawl quota that could have been spent on indexable pages. Second, internal broken links break the PageRank flow across your site: link equity cannot pass through a dead endpoint. Third, a high density of broken links on a page is a quality signal that can depress the page's rankings, especially when the broken links point outward to important references.

A broken internal link points to another page or anchor on your own website that no longer exists or has a different ID. It is fully within your control to fix. A broken external link points to a third-party URL that returns an error - a site that went offline, a resource that was deleted, or a URL that was restructured without a redirect. External broken links are harder to fix because you depend on the third-party domain, but you can replace them with archived versions or updated sources.

A redirect chain occurs when a URL redirects to a second URL, which redirects to a third, and so on - rather than redirecting directly to the final destination. Each hop in the chain adds latency and causes Googlebot to spend additional crawl budget on intermediate URLs. Google generally follows redirect chains, but PageRank dilution has been observed across each additional hop. The rule of thumb is to limit redirect sequences to a single hop wherever possible, and never more than two.

For individual pages, paste the HTML into the Aback Tools Broken Internal Link Checker and Broken External Link Checker - both tools analyse links without any server-side processing. For a full-site crawl, tools like Screaming Frog SEO Spider (desktop), Ahrefs Site Audit, or the free Broken Link Check service crawl every page and report all 4xx and 5xx responses. For large sites, use a combination: a crawler for discovery and the Aback Tools validators for deep per-page analysis of fragment links.

Fix them where possible - find a replacement URL that serves the same reference purpose and update the link. If no replacement exists, removing the link is better than leaving a broken one. For high-authority sources that have gone offline, check the Wayback Machine (web.archive.org) for an archived version and link to that instead. Dead external links are not as damaging as dead internal links, but they are a quality signal, and fixing them also improves the user experience for visitors who click the link.

A sitemap audit should verify that every URL in the sitemap is accessible (not returning a 4xx or 5xx), that all URLs use the correct protocol (HTTPS), that the XML structure conforms to the sitemap protocol (urlset, loc, changefreq, priority, lastmod), and that the sitemap does not include pages with noindex directives. Including noindex pages in a sitemap sends a contradictory signal to crawlers. The Aback Tools Sitemap XML Validator checks all of these structural and protocol compliance issues from a paste of your sitemap file.

For active websites that publish new content regularly, a monthly audit is a reasonable minimum. For sites undergoing a migration, redesign, or URL restructure, run an audit immediately before and immediately after the change - before to create a baseline, and after to verify every redirect is in place. For large e-commerce or news sites with thousands of pages, integrate automated broken link checking into your CI/CD deployment pipeline so any newly introduced broken link is caught before it reaches production.

ShareXLinkedIn