L’essentiel à retenir
- Ce que montre le rapport : le nombre de pages indexées et non indexées, et pour ces dernières le motif (erreur, exclusion volontaire, choix de Google).
- La règle de lecture : toutes les pages non indexées ne sont pas des problèmes ; les redirections, les pages en noindex volontaire et les doublons canoniques sont normaux.
- Les motifs à traiter : « Explorée, actuellement non indexée », « Détectée, actuellement non indexée », « Introuvable (404) », « Soft 404 », « Bloquée par robots.txt » si non voulu.
- La méthode : exporter, classer par motif et par valeur des pages, corriger, valider la correction dans le rapport.
Le rapport Pages de la Google Search Console, section Indexation, répond à la question de base du SEO : quelles pages de mon site sont dans l’index de Google, et pourquoi les autres n’y sont pas. Il est souvent mal lu : un grand nombre de pages « non indexées » affole alors que la plupart sont des exclusions normales, tandis que les vrais problèmes passent inaperçus. Cet article explique la structure du rapport, chaque motif, sa gravité et la méthode de correction.
La structure du rapport
Le graphique du haut montre l’évolution des pages indexées (vert) et non indexées (gris) sur 90 jours, avec le nombre d’impressions. En dessous, la liste des motifs de non-indexation, chacun avec le nombre d’URL, la source (site ou Google) et la tendance. Un filtre permet de restreindre aux URL du sitemap, ce qui isole les pages que vous voulez indexer des URL parasites. Le rapport se met à jour avec quelques jours de délai et les listes d’URL sont plafonnées à 1 000 par motif.
Les motifs, leur signification et leur gravité
| Motif | Signification | Gravité | Action |
|---|---|---|---|
| Explorée, actuellement non indexée | Google a lu la page et a choisi de ne pas l’indexer : contenu jugé faible, dupliqué ou peu utile | Élevée si pages importantes | Enrichir le contenu, le rendre unique, ajouter des liens internes ; voir le maillage interne |
| Détectée, actuellement non indexée | Google connaît l’URL mais ne l’a pas encore explorée (budget d’exploration, faible priorité) | Moyenne | Liens internes depuis des pages fortes, sitemap à jour, patience ; si massif, réduire les URL inutiles |
| Introuvable (404) | Page supprimée ou URL erronée | Élevée si la page recevait du trafic ou des liens | Redirection 301 vers la page équivalente, ou laisser en 404 si sans valeur ; voir les codes HTTP |
| Soft 404 | La page répond 200 mais Google la juge vide ou « introuvable » (résultat de recherche vide, produit épuisé sans contenu) | Moyenne | Renvoyer un vrai 404 ou 410, ou ajouter du contenu |
| Page avec redirection | L’URL redirige ailleurs | Normale | Rien, sauf chaînes de redirections à raccourcir |
| Exclue par la balise noindex | Vous avez demandé la non-indexation | Normale si volontaire | Vérifier qu’aucune page importante n’est en noindex par erreur ; voir noindex |
| Bloquée par le fichier robots.txt | L’exploration est interdite | Normale si volontaire, élevée sinon | Corriger le robots.txt si des pages utiles sont bloquées |
| Page en double, Google a choisi une autre page canonique | Google considère la page comme un doublon et en indexe une autre | Faible à moyenne | Vérifier que la canonique choisie est la bonne ; différencier les contenus sinon |
| Page en double sans URL canonique sélectionnée par l’utilisateur | Doublons sans balise canonical | Moyenne | Ajouter une balise canonical ; voir le contenu dupliqué |
| Autre page avec balise canonique correcte | La page pointe vers une canonique, comme prévu | Normale | Rien |
| Bloquée en raison d’un accès interdit (403) ou d’une autre erreur 4xx | Le serveur refuse Googlebot | Élevée | Pare-feu, protection anti-bot, authentification à corriger |
| Erreur de serveur (5xx) | Le serveur a échoué pendant l’exploration | Élevée si récurrent | Hébergement, ressources, plugins |
| URL inconnue de Google / non envoyée | URL du sitemap jamais vue, ou vue mais pas dans le sitemap | Faible | Sitemap à jour et cohérent |
| Page indexée malgré blocage par robots.txt | Google indexe l’URL sans contenu, à cause de liens | Faible | Utiliser noindex plutôt que robots.txt pour désindexer |
La méthode en cinq étapes
- Filtrer sur les URL du sitemap pour ne regarder que les pages que vous voulez indexer. Les URL hors sitemap (paramètres, archives, tags) sont souvent à exclure de toute façon.
- Exporter chaque motif significatif (Explorée non indexée, Détectée non indexée, 404, Soft 404, robots.txt, 403/5xx) dans un tableur.
- Croiser avec la valeur : trafic passé (GA4), liens entrants (rapport Liens), rôle de la page (service, catégorie, guide). Une page service « explorée, non indexée » est prioritaire ; une vieille actualité, non.
- Corriger par lot selon le motif : contenu et maillage pour les « explorées non indexées », redirections pour les 404, réglages pour robots.txt et noindex, serveur pour les 5xx.
- Valider : tester quelques URL avec l’inspection d’URL (« Tester l’URL en ligne », puis « Demander une indexation »), et suivre le motif dans le rapport ; le bouton « Valider la correction » lance un suivi sur deux à quatre semaines. Le bon moment pour cliquer est expliqué dans valider la correction : quand cliquer.
Le cas « Explorée, actuellement non indexée »
C’est le motif le plus préoccupant et le plus fréquent sur les sites de contenu : Google a lu la page et ne l’a pas jugée digne de l’index. Les causes habituelles : contenu court ou générique (fiches produits sans description, articles de 300 mots, pages villes dupliquées), contenu très proche d’autres pages du site ou du web, page orpheline ou profonde, site dont la qualité globale est jugée faible. La correction est éditoriale : enrichir avec des informations uniques, fusionner les pages proches, relier depuis des pages fortes, supprimer les pages sans valeur pour concentrer la qualité. Après correction, la réindexation prend de quelques jours à quelques semaines. C’est exactement le travail qui a conduit à la refonte de ces ressources ; la méthode complète est dans l’audit SEO complet.
Lire les tendances
- Une chute brutale des pages indexées signale un problème technique (noindex déployé par erreur, robots.txt, 5xx) : vérifiez le jour même.
- Une hausse des « détectées non indexées » après une mise en ligne massive est normale et se résorbe en quelques semaines si les pages sont liées.
- Une hausse des « explorées non indexées » signale un problème de qualité : Google désindexe les pages faibles.
- Un nombre de pages indexées très supérieur au nombre de pages utiles révèle des URL parasites (paramètres, filtres, archives) à canoniser ou bloquer.
Comment GreenRed vous aide
Plutôt que de jongler entre plusieurs outils, le module Santé du site de GreenRed réunit ces indicateurs dans un seul tableau de bord, les compare dans le temps et vous indique les actions prioritaires. Vous pouvez le tester gratuitement, sans carte bancaire, depuis la page Tarifs.
Questions fréquentes
Combien de pages non indexées est-ce normal ?
Il n’y a pas de seuil : un site peut avoir plus de pages non indexées qu’indexées sans problème si ce sont des redirections, des pages en noindex volontaire et des doublons canoniques. Regardez les motifs, filtrés sur le sitemap : seules les pages que vous voulez indexer et qui ne le sont pas comptent.
Que faire pour une page « Explorée, actuellement non indexée » ?
Améliorer la page : contenu unique et complet, informations que les autres pages n’ont pas, liens internes depuis des pages fortes, puis demander l’indexation via l’inspection d’URL. Si la page n’a pas de valeur propre, fusionnez-la avec une autre ou supprimez-la : moins de pages de meilleure qualité s’indexent mieux.
Combien de temps prend une réindexation ?
Après une demande via l’inspection d’URL, de quelques heures à quelques jours pour les pages importantes ; jusqu’à plusieurs semaines pour les pages profondes. Le rapport Pages se met à jour avec un décalage de quelques jours. La validation d’une correction en masse est suivie sur 28 jours environ.
Faut-il bloquer par robots.txt ou mettre noindex pour désindexer une page ?
Noindex. Le robots.txt empêche l’exploration, donc Google ne voit pas la balise noindex et peut garder l’URL indexée sans contenu si des liens y pointent. Pour retirer une page de l’index : la laisser explorable avec une balise noindex, puis éventuellement la bloquer une fois désindexée.