L’essentiel à retenir
- Définition : noindex est une directive (balise meta robots ou en-tête HTTP) qui interdit aux moteurs d’indexer une page ; ils peuvent l’explorer mais ne l’affichent pas dans les résultats.
- Quand : pages de remerciement, résultats de recherche interne, espaces clients, archives et tags vides, contenus minces ou en double.
- Quand pas : pages paginées, catégories utiles, pages que vous voulez positionner ; et jamais en combinaison avec un blocage robots.txt.
- Erreur la plus coûteuse : un noindex global oublié après la mise en production.
Noindex est une instruction donnée aux moteurs de recherche pour qu’une page, bien qu’accessible et explorable, ne soit pas enregistrée dans leur index et n’apparaisse donc jamais dans les résultats. C’est la façon propre de retirer une page de Google : plus fiable qu’un blocage dans le robots.txt, qui empêche l’exploration mais pas forcément l’indexation. La directive se place dans la balise meta robots ou, pour les fichiers non HTML, dans l’en-tête HTTP X-Robots-Tag.
Comment l’écrire
| Support | Syntaxe |
|---|---|
| Page HTML | <meta name="robots" content="noindex"> dans le <head> |
| Page HTML, Google seulement | <meta name="googlebot" content="noindex"> |
| PDF, image, fichier | En-tête HTTP X-Robots-Tag: noindex, configuré côté serveur |
| WordPress | Réglage « Ne pas indexer » par page ou par type de contenu dans Yoast, Rank Math ; case « Demander aux moteurs de ne pas indexer ce site » pour tout le site |
Par défaut, noindex conserve follow : les liens de la page sont suivis. Avec le temps, Google finit néanmoins par ignorer les liens d’une page en noindex durable.
Quand utiliser noindex
- Pages de remerciement après un formulaire ou une commande : leur indexation fausse les conversions et expose des parcours internes.
- Résultats de recherche interne et combinaisons de filtres sans valeur propre (voir aussi la canonical dans duplicate content).
- Espaces privés : compte client, panier, tableau de bord.
- Archives et pages de tags vides ou quasi identiques sur les CMS.
- Pages minces ou en double que l’on ne peut ni enrichir ni rediriger.
- Versions imprimables, PDF de documents internes.
- Pages temporaires (offre expirée, événement passé) en attendant leur suppression ou leur redirection.
Quand ne pas l’utiliser
- Pages paginées (page 2, 3 d’une catégorie) : elles aident Google à trouver les produits ; laissez-les indexables avec une canonical vers elles-mêmes.
- Catégories et pages de navigation qui reçoivent du trafic.
- Pour cacher du contenu dupliqué qu’une redirection 301 ou une canonical traiterait mieux, en transférant l’autorité.
- En même temps qu’un blocage robots.txt : Google ne peut plus lire la balise et la page reste indexée.
- Sur un site en préproduction : préférez un mot de passe, qu’on ne risque pas d’oublier de retirer.
Noindex, robots.txt, canonical, 301 : quel outil pour quel cas
| Besoin | Outil |
|---|---|
| Retirer une page des résultats, la garder accessible | Noindex |
| Empêcher l’exploration d’une section (économie de crawl) | Robots.txt |
| Désigner la version de référence entre doublons | Canonical |
| Déplacer ou fusionner une page | Redirection 301 (voir codes HTTP) |
| Supprimer définitivement une page | Code 410 ou 404 |
Vérifier et détecter les erreurs
La Search Console, rapport Pages, liste les URL « exclues par la balise noindex » ; si des pages stratégiques y figurent, c’est une erreur. L’outil d’inspection d’URL indique la directive lue par Google pour une page donnée. Un crawl avec Screaming Frog filtré sur « noindex » révèle en une minute un noindex global oublié, cause classique de disparition brutale d’un site des résultats après une refonte.
Ce contrôle fait partie du point 1 de notre audit SEO complet.
Comment GreenRed vous aide
Plutôt que de jongler entre plusieurs outils, le module Santé du site de GreenRed réunit ces indicateurs dans un seul tableau de bord, les compare dans le temps et vous indique les actions prioritaires. Vous pouvez le tester gratuitement, sans carte bancaire, depuis la page Tarifs.
Questions fréquentes
Quelle est la différence entre noindex et nofollow ?
Noindex empêche l’indexation de la page ; nofollow empêche les moteurs de suivre ses liens et de leur transmettre de l’autorité. Une page peut être noindex et follow (non indexée mais ses liens comptent), ce qui est le réglage habituel. Le nofollow global d’une page est rarement utile.
Peut-on mettre noindex dans le robots.txt ?
Non. Google a cessé de prendre en compte la directive Noindex dans le robots.txt en 2019. Le robots.txt sert à bloquer l’exploration ; pour empêcher l’indexation, utilisez la balise meta robots ou l’en-tête X-Robots-Tag, sans bloquer la page dans le robots.txt.
Une page en noindex transmet-elle encore de l’autorité par ses liens ?
Au début oui, si la directive est noindex sans nofollow. Mais Google a indiqué qu’à la longue, une page en noindex durable finit par être traitée comme noindex, nofollow : ses liens ne sont plus suivis. Ne comptez pas sur une page en noindex pour mailler des pages importantes.
Comment retirer rapidement une page de Google ?
Posez un noindex sur la page, puis utilisez l’outil de suppression temporaire de la Search Console, qui masque l’URL des résultats en quelques heures pendant six mois. Le noindex prend le relais à la prochaine exploration. Si la page doit disparaître définitivement, renvoyez un code 410.