Page orpheline : de quoi on parle exactement
Une page orpheline, c'est une URL publiée, souvent indexable, mais qu'aucune autre page de votre site ne lie. Pas un lien dans le menu, pas un lien dans un article, rien. Le seul moyen d'y arriver : connaître l'adresse, passer par le sitemap, ou tomber dessus via un lien externe.
Le souci est double. Google découvre et réévalue les pages principalement en suivant les liens, et il se sert du maillage pour comprendre quelles pages comptent. Une page sans lien entrant ne reçoit aucune autorité interne. Elle peut rester indexée (surtout si elle est dans le sitemap), mais elle a toutes les chances de végéter loin dans les résultats.
Et côté visiteur, c'est pareil : une page que personne ne peut atteindre en naviguant ne sert à rien, même si elle est excellente.
Pourquoi votre site en a (presque forcément)
En audit, j'en trouve sur quasiment tous les sites de plus de quelques dizaines de pages. Les causes reviennent toujours :
- une landing page de campagne créée pour Google Ads, jamais reliée au reste ;
- une refonte où l'on a changé le menu sans vérifier ce qui disparaissait avec ;
- des articles de blog anciens, poussés hors des pages de listing par la pagination ;
- des fiches produits retirées des catégories mais laissées en ligne ;
- des pages générées automatiquement par le CMS (tags, archives, pièces jointes WordPress).
Rien de dramatique en soi. Ce qui coûte, c'est de ne pas savoir qu'elles existent.
Comment trouver les pages orphelines : la méthode du croisement
Le principe tient en une phrase : un crawler qui suit uniquement vos liens internes ne trouvera jamais une page orpheline. Donc on liste d'un côté ce que le crawler atteint, de l'autre toutes les URL connues par d'autres canaux, et on fait la différence.
1. Crawler le site
Lancez un crawl complet depuis la page d'accueil avec un outil comme Screaming Frog (gratuit jusqu'à 500 URL), Sitebulb ou le module d'audit de votre suite SEO. Exportez la liste des URL HTML en code 200. C'est votre référence "pages reliées".
2. Rassembler les autres sources d'URL
- Le sitemap XML : tout ce que vous déclarez à Google.
- La Search Console : le rapport Pages (URL indexées) et l'export Performances, qui révèle des pages qui reçoivent des impressions. Si vous n'avez pas encore branché l'outil, voici à quoi sert concrètement la Search Console de Google.
- Google Analytics : les pages de destination ayant reçu au moins une session sur 12 mois.
- Les logs serveur, si vous y avez accès : les URL que Googlebot visite réellement. C'est la source la plus fiable, et la plus souvent oubliée.
3. Comparer
Mettez tout dans un tableur, dédoublonnez, normalisez les URL (même protocole, même slash final), puis repérez celles qui apparaissent dans les sources de l'étape 2 mais pas dans le crawl. Une simple RECHERCHEV suffit. La plupart des crawlers payants font ce croisement automatiquement si vous connectez le sitemap, GSC et GA à l'outil : c'est l'option "orphan pages" dans Screaming Frog, par exemple.
Petite astuce de terrain : vérifiez aussi les pages liées uniquement en JavaScript ou via un formulaire. Google recommande des liens en <a href> classiques pour qu'ils soient suivis (voir sa documentation sur les liens explorables). Une page accessible seulement par un bouton en JS est, pour un robot, quasiment orpheline.
Trier avant de corriger
Ne vous jetez pas sur le maillage tout de suite. Une liste de pages orphelines, c'est un mélange de pépites oubliées et de déchets. Pour chaque URL, posez trois questions : est-ce qu'elle a de la valeur (trafic, conversions, backlinks) ? Est-ce qu'elle cible une requête que personne d'autre ne cible sur le site ? Est-elle encore à jour ?
Selon les réponses, elle tombe dans l'un des quatre cas ci-dessous.
Les 4 façons de corriger une page orpheline
Relier la page (la bonne page oubliée)
Le cas le plus fréquent. La page est utile, elle a juste été perdue. Ajoutez-lui des liens depuis deux ou trois pages thématiquement proches, idéalement des pages qui ont elles-mêmes du trafic, avec une ancre descriptive. Si elle est importante, remontez-la dans une catégorie ou dans le menu. J'explique la logique complète dans mon guide du maillage interne pour le SEO.
Fusionner (le doublon qui s'ignore)
Souvent, la page orpheline traite le même sujet qu'une autre page, mieux reliée. Récupérez ce qu'elle a d'intéressant, intégrez-le dans la page principale, puis redirigez l'ancienne URL en 301 vers celle-ci.
Rediriger (la page obsolète qui a des backlinks)
Une ancienne offre, un événement passé, mais des liens externes pointent dessus ? Une 301 vers la page la plus proche conserve l'essentiel de ce signal. Ne redirigez pas tout vers la page d'accueil, c'est la solution de facilité et elle ne sert pas grand monde.
Supprimer ou désindexer (le déchet)
Page de test, archive de tag vide, pièce jointe WordPress sans intérêt : renvoyez un 404 ou 410, ou passez-la en noindex si elle doit rester accessible pour une raison technique. Et retirez-la du sitemap, sinon vous continuez à demander à Google de l'explorer.
La règle que je donne à mes clients : une page doit soit mériter des liens internes, soit ne plus exister.
Éviter que ça revienne
Les pages orphelines se recréent en permanence, à chaque campagne et à chaque refonte. Deux habitudes suffisent à limiter la casse. D'abord, aucune page ne se publie sans au moins un lien entrant depuis une page existante : mettez-le dans votre checklist de mise en ligne. Ensuite, refaites le croisement crawl vs sitemap vs Search Console tous les trimestres, ou au moindre changement de structure.
Si vous faites l'exercice pour la première fois, intégrez-le dans un diagnostic plus large : c'est l'un des points que je couvre dans la méthode pour faire gratuitement l'audit SEO de son site. Comptez une demi-journée pour un site de quelques centaines de pages, le plus long étant le tri, pas la détection.



