Un plan de site mal conçu n’aide personne. Ni les moteurs de recherche, ni les visiteurs, ni les technologies d’assistance. Nous observons régulièrement des sitemaps qui listent des centaines d’URL sans logique, mêlant pages orphelines, redirections et contenus dupliqués. Le résultat : un fichier que Googlebot parcourt sans en tirer de signal utile, et une page HTML que personne ne consulte.
Plan de site XML : filtrer les URL avant de les soumettre
Un sitemap XML ne doit contenir que des URL canoniques, indexables et en réponse HTTP 200. C’est la base, et pourtant la majorité des fichiers générés automatiquement par les CMS incluent des pages redirigées, des variantes de pagination ou des URL marquées noindex.
Ce bruit dégrade la qualité du signal transmis aux robots d’exploration. Quand un sitemap contient plusieurs milliers d’entrées dont une fraction significative renvoie des erreurs 301 ou 404, le budget de crawl est gaspillé sur des ressources inutiles.
Nous recommandons un audit trimestriel du sitemap XML avec un crawler dédié. Le contrôle porte sur trois points :
- Vérifier que chaque URL répond en 200 et n’est pas redirigée vers une autre adresse
- S’assurer que la balise canonical de chaque page pointe vers elle-même (pas vers une URL tierce)
- Exclure toute page portant une directive
noindexdans son en-tête HTTP ou sa balise meta
Ce nettoyage transforme le sitemap en un index fiable. Les moteurs de recherche y trouvent exactement ce que le site souhaite indexer, sans ambiguïté. Un exemple concret de structure bien organisée : le plan du site de Le Bon Sens regroupe ses contenus par catégories thématiques, ce qui facilite autant la lecture humaine que le crawl automatisé.

Plan de site HTML et accessibilité : un second parcours de navigation
Le plan de site HTML est souvent relégué au pied de page, traité comme une relique des années 2000. C’est une erreur. Les recommandations d’accessibilité préconisent de proposer au moins deux moyens généraux pour localiser une page sur un site : menu principal, recherche interne, fil d’Ariane ou plan du site.
L’European Accessibility Act renforce cette exigence pour le commerce en ligne. L’obligation couvre les menus, les filtres, les fenêtres contextuelles et les étapes de paiement. Un site dont la navigation repose uniquement sur un méga-menu complexe exclut les utilisateurs qui naviguent au clavier ou avec un lecteur d’écran.
Conception du plan HTML pour la navigation clavier
Un plan de site HTML accessible n’est pas une simple liste de liens. Chaque lien doit avoir un intitulé explicite (pas de « cliquez ici »), et la page doit être entièrement navigable sans souris. Cela implique un ordre de tabulation logique, un focus visible sur chaque élément interactif, et l’absence de pièges clavier.
La conformité ne se vérifie pas uniquement avec un outil automatisé. Les parcours clés (accéder à une fiche produit, atteindre la page contact, revenir à l’accueil) doivent être testés manuellement au clavier. Un audit visuel ne détecte pas un lien dont le focus est masqué par du CSS.
Hiérarchie des titres dans l’arborescence du site
La structure des titres Hn d’une page contribue directement à sa navigabilité pour les lecteurs d’écran. Un saut de niveau (h1 suivi d’un h4) casse le parcours et rend le contenu difficile à comprendre, même quand le menu visuel semble clair.
Pour le plan de site HTML, nous appliquons une règle simple : un h2 par catégorie principale, un h3 par sous-catégorie. Pas de h4 sauf arborescence à trois niveaux réels. Cette hiérarchie reflète la structure du menu de navigation et permet aux technologies d’assistance de sauter directement à la section pertinente.

Cohérence entre menu, plan de site et structure des pages
Un piège fréquent : le menu principal affiche des intitulés différents de ceux du plan de site, qui eux-mêmes ne correspondent pas aux balises title des pages. Cette incohérence désoriente l’utilisateur et dilue le maillage interne.
Chaque entrée du plan de site doit reprendre exactement l’intitulé utilisé dans le menu. Le texte du lien, le titre de la page cible et son h1 doivent partager le même champ lexical. Cette cohérence renforce à la fois l’expérience utilisateur et le signal sémantique envoyé aux moteurs de recherche.
Arborescence de site web : profondeur et maillage interne
Aucune page utile ne devrait nécessiter plus de trois clics depuis l’accueil. C’est une règle d’architecture de l’information, pas seulement un conseil SEO. Un plan de site bien conçu rend cette profondeur visible et vérifiable.
Quand une page se trouve à cinq niveaux de profondeur, elle reçoit peu de jus de lien interne et reste peu visitée. Le plan de site HTML permet d’identifier ces pages enfouies et de décider si elles méritent un raccourci direct ou une restructuration de l’arborescence.
- Lister toutes les pages à plus de trois niveaux de profondeur et évaluer leur utilité
- Créer des liens transversaux entre catégories liées plutôt que de multiplier les sous-niveaux
- Mettre à jour le plan de site à chaque ajout ou suppression de page, pas seulement lors de refontes
Un plan de site statique, figé depuis la mise en ligne, perd sa valeur en quelques mois. Les contenus évoluent, des pages sont supprimées, d’autres apparaissent. Le sitemap XML et le plan HTML doivent refléter l’état réel du site, pas une photographie datée de sa structure initiale.
L’entretien régulier du plan de site, qu’il soit XML ou HTML, reste le meilleur indicateur de la rigueur technique d’un projet web. Un site dont le sitemap est propre et à jour signale aux moteurs comme aux visiteurs que la navigation a été pensée, pas subie.



