Noindex
Noindex est la directive qui demande aux moteurs de recherche de ne pas conserver une page dans leur index : elle reste accessible aux visiteurs et aux robots, mais n'apparaît plus dans les résultats. Elle se place dans une balise meta robots ou dans l'en-tête HTTP X-Robots-Tag, et ne fonctionne que si la page n'est pas bloquée par le robots.txt.
Qu'est-ce que NoIndex ?
NoIndex est une directive indiquant aux moteurs de recherche, tels que Google, de ne pas indexer une page spécifique. En d'autres termes, cette directive empêche la page d'apparaître dans les résultats de recherche. Les robots d'exploration des moteurs de recherche lisent cette directive et obéissent en conséquence.
Comment Implémenter NoIndex ?
Balise Meta Robots
Pour ajouter NoIndex à une page, vous pouvez utiliser la balise meta robots dans la section `` du code HTML de la page. Par exemple :
<meta name="robots" content="noindex">
Cette balise indique aux moteurs de recherche de ne pas indexer cette page.
En-tête de Réponse HTTP
Pour les fichiers non HTML, tels que les PDF, vous pouvez utiliser l'en-tête de réponse HTTP pour implémenter NoIndex. Par exemple :
```
X-Robots-Tag: noindex
```
Ajoutez cet en-tête à la réponse HTTP du serveur pour que les moteurs de recherche ne l'indexent pas.
Plugins SEO
Pour les utilisateurs de WordPress, des plugins SEO tels que Yoast SEO facilitent l'ajout de la directive NoIndex à vos pages.
Quand utiliser NoIndex ?
Il est recommandé d'utiliser NoIndex sur les pages suivantes :
- Pages de résultats de recherche internes
- Pages de connexion et d'inscription
- Pages de profils d'utilisateurs
- Pages avec du contenu dupliqué ou de faible qualité
- Pages archivées ou obsolètes
- Pages de produits indisponibles
Le NoIndex en SEO
Optimisation du Budget Crawl
Le budget crawl désigne les ressources que Google consacre à l'exploration d'un site. Le noindex ne l'économise pas directement, puisque la page doit rester explorable pour que la directive soit lue ; mais Google espace progressivement ses visites sur les pages en noindex durable, ce qui reporte l'exploration vers les pages utiles.
Gestion du contenu dupliqué
NoIndex peut être utilisé pour gérer les problèmes de contenu dupliqué en empêchant l'indexation des pages qui présentent des contenus similaires. Cela aide à éviter les pénalités de Google pour le contenu dupliqué.
Prévention des pénalités de Google
Google évalue la qualité à l'échelle du site : une masse de pages minces ou obsolètes pèse sur l'ensemble. Retirer ces pages de l'index par un noindex (ou les supprimer, ou les fusionner) fait partie des réponses classiques à une baisse liée à une core update.
NoIndex VS autres directives
NoIndex se distingue des autres directives telles que Disallow et NoFollow.
- Disallow : utilisé dans le fichier robots.txt, il bloque l'accès des robots d'exploration aux pages, tandis que NoIndex permet aux robots de consulter le contenu sans l'indexer.
- NoFollow : cette directive indique aux moteurs de recherche de ne pas suivre les liens d'une page, tandis que NoIndex concerne uniquement l'indexation de la page.
Recommandations
- Utilisez NoIndex avec discernement pour ne pas bloquer l'indexation des pages importantes.
- Vérifiez régulièrement les pages marquées avec NoIndex pour éviter les erreurs.
- N'utilisez pas NoIndex pour masquer du contenu de mauvaise qualité, travaillez plutôt à l'améliorer.
Erreurs à éviter avec NoIndex
Lors de l'utilisation de la balise NoIndex, assurez-vous d'éviter les erreurs courantes suivantes :
- Bloquer l'indexation de pages importantes : Vérifiez que vous n'appliquez pas la directive NoIndex aux pages qui devraient être indexées et générer du trafic organique.
- Oublier de retirer NoIndex : Si vous avez utilisé NoIndex temporairement sur une page, n'oubliez pas de le retirer une fois que la page est prête à être indexée à nouveau.
- Utiliser NoIndex au lieu de résoudre les problèmes : Ne comptez pas sur NoIndex pour masquer les problèmes de contenu dupliqué ou de faible qualité. Travaillez plutôt à résoudre ces problèmes pour offrir un meilleur contenu à vos utilisateurs.
On parle aussi de Noindex ici :
- Google recommande l’attribut noindex pour les contenus d’actualités syndiqués (2023)
- Goossips SEO : Noindex + canonical, WebP, Coming back soon, désaveu… (2023)
- Goossips : Render Javascript, Noindex & Redirection, Core Web Vitals (2023)
Sources :
- Block Search indexing with noindex (Google Search Central)
- Robots meta tag, data-nosnippet, and X-Robots-Tag specifications (Google Search Central)
- Robots.txt introduction and guide (Google Search Central)
- Robots meta tags and attributes that Bing supports (Bing Webmaster Tools)
- December 2023 Google SEO office hours : Why is Google indexing URLs with noindex and blocked by robots.txt? (Martin Splitt (Google), Google SEO office hours)
FAQ
Quelle est la différence entre noindex et Disallow ?
Noindex retire la page des résultats mais laisse les robots la visiter ; Disallow (robots.txt) interdit la visite mais n'empêche pas l'indexation de l'URL si elle reçoit des liens. Les deux combinés sont contradictoires : la page bloquée ne peut pas faire lire son noindex.
Combien de temps faut-il pour qu'une page en noindex disparaisse ?
Jusqu'à la prochaine exploration de la page par Google, de quelques jours à plusieurs semaines. L'outil d'inspection d'URL de la Search Console permet de demander une nouvelle exploration, et l'outil de suppression masque l'URL en quelques heures en attendant.
Le noindex bloque-t-il la transmission des liens de la page ?
À terme, oui : Google a indiqué qu'une page en noindex durable finit par être traitée comme noindex, nofollow, ses liens n'étant plus suivis ni pris en compte. C'est pourquoi il déconseille le noindex sur les pages paginées ou les pages de navigation.
Noindex et canonical sur la même page, est-ce cohérent ?
Non. La canonical dit « cette page est un doublon de celle-là », le noindex dit « ne garde pas cette page » : Google peut alors ignorer la canonical. Pour un doublon, on choisit la canonical seule ; pour une page sans valeur, le noindex seul.
Comment savoir quelles pages sont en noindex sur mon site ?
Le rapport Pages de la Search Console liste les URL « exclues par une balise noindex ». Un crawler comme Screaming Frog remonte la directive pour chaque page, y compris dans les en-têtes HTTP.
En résumé
- Noindex : la directive qui retire une page des résultats tout en la laissant accessible.
- Deux emplacements : balise meta robots dans le head, ou en-tête HTTP X-Robots-Tag pour les fichiers.
- Jamais avec un Disallow : la page doit rester explorable pour que la directive soit lue.
- Cibles : recherche interne, connexion, profils, pages techniques, contenus obsolètes ou en doublon sans canonical possible.
- À éviter sur les pages paginées et de navigation, dont les liens finiraient par ne plus compter.
Abondance c'est aussi des audits SEO, un service de contenus et des formations en e-learning !
Publié le Mis à jour le
Autres définitions :
Les outils SEO pour vous aider



