Décrypter la page « Indexation » de la Google Search Console

Pages indexées et non indexées, les quinze motifs les plus fréquents et leur gravité, la méthode de correction et la lecture des tendances

L’essentiel à retenir

  • Ce que montre le rapport : le nombre de pages indexées et non indexées, et pour ces dernières le motif (erreur, exclusion volontaire, choix de Google).
  • La règle de lecture : toutes les pages non indexées ne sont pas des problèmes ; les redirections, les pages en noindex volontaire et les doublons canoniques sont normaux.
  • Les motifs à traiter : « Explorée, actuellement non indexée », « Détectée, actuellement non indexée », « Introuvable (404) », « Soft 404 », « Bloquée par robots.txt » si non voulu.
  • La méthode : exporter, classer par motif et par valeur des pages, corriger, valider la correction dans le rapport.

Le rapport Pages de la Google Search Console, section Indexation, répond à la question de base du SEO : quelles pages de mon site sont dans l’index de Google, et pourquoi les autres n’y sont pas. Il est souvent mal lu : un grand nombre de pages « non indexées » affole alors que la plupart sont des exclusions normales, tandis que les vrais problèmes passent inaperçus. Cet article explique la structure du rapport, chaque motif, sa gravité et la méthode de correction.

La structure du rapport

Le graphique du haut montre l’évolution des pages indexées (vert) et non indexées (gris) sur 90 jours, avec le nombre d’impressions. En dessous, la liste des motifs de non-indexation, chacun avec le nombre d’URL, la source (site ou Google) et la tendance. Un filtre permet de restreindre aux URL du sitemap, ce qui isole les pages que vous voulez indexer des URL parasites. Le rapport se met à jour avec quelques jours de délai et les listes d’URL sont plafonnées à 1 000 par motif.

Les motifs, leur signification et leur gravité

MotifSignificationGravitéAction
Explorée, actuellement non indexéeGoogle a lu la page et a choisi de ne pas l’indexer : contenu jugé faible, dupliqué ou peu utileÉlevée si pages importantesEnrichir le contenu, le rendre unique, ajouter des liens internes ; voir le maillage interne
Détectée, actuellement non indexéeGoogle connaît l’URL mais ne l’a pas encore explorée (budget d’exploration, faible priorité)MoyenneLiens internes depuis des pages fortes, sitemap à jour, patience ; si massif, réduire les URL inutiles
Introuvable (404)Page supprimée ou URL erronéeÉlevée si la page recevait du trafic ou des liensRedirection 301 vers la page équivalente, ou laisser en 404 si sans valeur ; voir les codes HTTP
Soft 404La page répond 200 mais Google la juge vide ou « introuvable » (résultat de recherche vide, produit épuisé sans contenu)MoyenneRenvoyer un vrai 404 ou 410, ou ajouter du contenu
Page avec redirectionL’URL redirige ailleursNormaleRien, sauf chaînes de redirections à raccourcir
Exclue par la balise noindexVous avez demandé la non-indexationNormale si volontaireVérifier qu’aucune page importante n’est en noindex par erreur ; voir noindex
Bloquée par le fichier robots.txtL’exploration est interditeNormale si volontaire, élevée sinonCorriger le robots.txt si des pages utiles sont bloquées
Page en double, Google a choisi une autre page canoniqueGoogle considère la page comme un doublon et en indexe une autreFaible à moyenneVérifier que la canonique choisie est la bonne ; différencier les contenus sinon
Page en double sans URL canonique sélectionnée par l’utilisateurDoublons sans balise canonicalMoyenneAjouter une balise canonical ; voir le contenu dupliqué
Autre page avec balise canonique correcteLa page pointe vers une canonique, comme prévuNormaleRien
Bloquée en raison d’un accès interdit (403) ou d’une autre erreur 4xxLe serveur refuse GooglebotÉlevéePare-feu, protection anti-bot, authentification à corriger
Erreur de serveur (5xx)Le serveur a échoué pendant l’explorationÉlevée si récurrentHébergement, ressources, plugins
URL inconnue de Google / non envoyéeURL du sitemap jamais vue, ou vue mais pas dans le sitemapFaibleSitemap à jour et cohérent
Page indexée malgré blocage par robots.txtGoogle indexe l’URL sans contenu, à cause de liensFaibleUtiliser noindex plutôt que robots.txt pour désindexer

La méthode en cinq étapes

  1. Filtrer sur les URL du sitemap pour ne regarder que les pages que vous voulez indexer. Les URL hors sitemap (paramètres, archives, tags) sont souvent à exclure de toute façon.
  2. Exporter chaque motif significatif (Explorée non indexée, Détectée non indexée, 404, Soft 404, robots.txt, 403/5xx) dans un tableur.
  3. Croiser avec la valeur : trafic passé (GA4), liens entrants (rapport Liens), rôle de la page (service, catégorie, guide). Une page service « explorée, non indexée » est prioritaire ; une vieille actualité, non.
  4. Corriger par lot selon le motif : contenu et maillage pour les « explorées non indexées », redirections pour les 404, réglages pour robots.txt et noindex, serveur pour les 5xx.
  5. Valider : tester quelques URL avec l’inspection d’URL (« Tester l’URL en ligne », puis « Demander une indexation »), et suivre le motif dans le rapport ; le bouton « Valider la correction » lance un suivi sur deux à quatre semaines. Le bon moment pour cliquer est expliqué dans valider la correction : quand cliquer.

Le cas « Explorée, actuellement non indexée »

C’est le motif le plus préoccupant et le plus fréquent sur les sites de contenu : Google a lu la page et ne l’a pas jugée digne de l’index. Les causes habituelles : contenu court ou générique (fiches produits sans description, articles de 300 mots, pages villes dupliquées), contenu très proche d’autres pages du site ou du web, page orpheline ou profonde, site dont la qualité globale est jugée faible. La correction est éditoriale : enrichir avec des informations uniques, fusionner les pages proches, relier depuis des pages fortes, supprimer les pages sans valeur pour concentrer la qualité. Après correction, la réindexation prend de quelques jours à quelques semaines. C’est exactement le travail qui a conduit à la refonte de ces ressources ; la méthode complète est dans l’audit SEO complet.

Lire les tendances

  • Une chute brutale des pages indexées signale un problème technique (noindex déployé par erreur, robots.txt, 5xx) : vérifiez le jour même.
  • Une hausse des « détectées non indexées » après une mise en ligne massive est normale et se résorbe en quelques semaines si les pages sont liées.
  • Une hausse des « explorées non indexées » signale un problème de qualité : Google désindexe les pages faibles.
  • Un nombre de pages indexées très supérieur au nombre de pages utiles révèle des URL parasites (paramètres, filtres, archives) à canoniser ou bloquer.
Conseil : exportez la liste « Explorée, actuellement non indexée », filtrée sur le sitemap, et triez par type de page. Si vos pages services ou vos guides y figurent, c’est votre chantier prioritaire ; tout le reste du SEO attend.

Comment GreenRed vous aide

Plutôt que de jongler entre plusieurs outils, le module Santé du site de GreenRed réunit ces indicateurs dans un seul tableau de bord, les compare dans le temps et vous indique les actions prioritaires. Vous pouvez le tester gratuitement, sans carte bancaire, depuis la page Tarifs.

Questions fréquentes

Combien de pages non indexées est-ce normal ?

Il n’y a pas de seuil : un site peut avoir plus de pages non indexées qu’indexées sans problème si ce sont des redirections, des pages en noindex volontaire et des doublons canoniques. Regardez les motifs, filtrés sur le sitemap : seules les pages que vous voulez indexer et qui ne le sont pas comptent.

Que faire pour une page « Explorée, actuellement non indexée » ?

Améliorer la page : contenu unique et complet, informations que les autres pages n’ont pas, liens internes depuis des pages fortes, puis demander l’indexation via l’inspection d’URL. Si la page n’a pas de valeur propre, fusionnez-la avec une autre ou supprimez-la : moins de pages de meilleure qualité s’indexent mieux.

Combien de temps prend une réindexation ?

Après une demande via l’inspection d’URL, de quelques heures à quelques jours pour les pages importantes ; jusqu’à plusieurs semaines pour les pages profondes. Le rapport Pages se met à jour avec un décalage de quelques jours. La validation d’une correction en masse est suivie sur 28 jours environ.

Faut-il bloquer par robots.txt ou mettre noindex pour désindexer une page ?

Noindex. Le robots.txt empêche l’exploration, donc Google ne voit pas la balise noindex et peut garder l’URL indexée sans contenu si des liens y pointent. Pour retirer une page de l’index : la laisser explorable avec une balise noindex, puis éventuellement la bloquer une fois désindexée.

Centralisez vos outils marketing

GreenRed connecte vos outils Google et sociaux et vous offre une vue unifiée de vos performances.

Essayer GreenRed

Articles connexes