L’essentiel
- Deux emplacements :
<meta name="robots" content="noindex">ou l’en-tête X-Robots-Tag: noindex - Google doit pouvoir explorer la page pour lire la directive
- Bloquer une page dans le robots.txt empêche donc Google de voir son noindex
- La page sort de l’index après le prochain passage de Googlebot
- Les liens d’une page en noindex continuent d’être suivis au début
Comment mettre une page en noindex#
La méthode la plus courante est une balise dans la section head de la page :
<meta name="robots" content="noindex">
Pour cibler uniquement Google, on remplace robots par googlebot. Pour un PDF ou une image, où l’on ne peut pas ajouter de balise, on passe par l’en-tête HTTP renvoyé par le serveur :
X-Robots-Tag: noindex
Sur WordPress, Shopify ou PrestaShop, la plupart des extensions et modules SEO proposent une case à cocher par page ou par type de page.
Le piège du robots.txt#
C’est l’erreur que je rencontre le plus. Une page est à la fois en noindex et bloquée dans le robots.txt. Résultat : Googlebot n’a pas le droit de l’explorer, il ne voit jamais la directive noindex, et l’URL peut rester dans l’index avec la mention « aucune information disponible pour cette page ».
La bonne séquence pour sortir des pages de l’index :
- Ajouter le noindex.
- Laisser la page accessible au crawl jusqu’à sa désindexation (visible dans la Search Console).
- Ensuite seulement, bloquer l’exploration si c’est utile pour le crawl budget.
Quelles pages passer en noindex ?#
- Les résultats de recherche interne.
- Les pages de filtres et de tri sans demande de recherche réelle.
- Les pages de panier, de compte client, de confirmation de commande.
- Les pages de remerciement, les mentions légales dans certains cas.
- Les archives d’auteur ou de tags sans contenu propre sur un blog.
À l’inverse, une page qui a des backlinks ou du trafic organique mérite réflexion avant d’être mise en noindex. Une redirection 301 vers une page proche conserve mieux ses signaux.
Noindex, canonical ou nofollow ?#
- Noindex : la page ne doit pas apparaître dans Google.
- Balise canonique : la page peut exister, mais une autre version est la référence. C’est une indication, pas une directive.
- Nofollow : concerne les liens, pas l’indexation de la page elle-même.
Une page ne doit pas cumuler un noindex et une canonique qui pointe vers une autre URL : les deux signaux se contredisent. Ces contrôles font partie de mon audit SEO technique.
Questions fréquentes#
Combien de temps pour qu’une page en noindex disparaisse de Google ?
Elle sort de l’index après le prochain passage de Googlebot, de quelques jours à plusieurs semaines selon la fréquence d’exploration. L’outil d’inspection d’URL de la Search Console permet de demander une nouvelle exploration.
Peut-on mettre un noindex dans le robots.txt ?
Non. Google ne prend plus en charge la directive noindex dans le robots.txt depuis 2019.
Une page en noindex transmet-elle ses liens ?
Au début, oui. Google a indiqué qu’une page restée longtemps en noindex finit par être traitée comme un noindex, nofollow, et que ses liens sont alors moins suivis.
Comment vérifier qu’une page est en noindex ?
Avec l’outil d’inspection d’URL de la Google Search Console, en affichant le code source de la page, ou avec un crawl qui liste la colonne Indexabilité.