X-Robots-Tag
Le X-Robots-Tag est un en-tête HTTP qui porte les mêmes directives que la balise meta robots (noindex, nofollow, nosnippet, max-snippet, unavailable_after...) mais s'applique depuis la configuration du serveur, à n'importe quel type de fichier. Il est la seule façon de contrôler l'indexation des PDF, images, vidéos et documents, et permet d'appliquer une règle à toute une section du site sans toucher aux pages.
Définition du X-Robots-Tag
Le X-Robots-Tag est une partie de l'en-tête HTTP envoyée par le serveur lorsqu'une page ou un fichier est demandé. Il fournit des instructions aux robots des moteurs de recherche sur la façon de traiter les pages et les fichiers d'un site web. Il est particulièrement utile pour les fichiers non-HTML, comme les images et les documents PDF, pour lesquels les balises meta robots ne peuvent pas être utilisées.
Utilité dans le contexte SEO
Le X-Robots-Tag aide à optimiser le budget de crawl en dirigeant les robots des moteurs de recherche loin du contenu non pertinent ou sensible. Cela permet de s'assurer que les moteurs de recherche se concentrent sur le contenu important et améliorent la visibilité du site dans les résultats de recherche.
Comparaison avec robots.txt et meta robots
Contrairement au fichier robots.txt, qui donne des instructions générales pour le site, et à la balise meta robots, qui s'applique au niveau de la page HTML, le X-Robots-Tag offre une granularité plus fine et peut être appliqué même lorsque le contenu n'est pas accessible via le HTML standard.
Comment fonctionne le X-Robots-Tag ?
Structure et exemples de directives
Le X-Robots-Tag peut contenir les mêmes directives que la balise meta robots, telles que `noindex`, `nofollow`, `nosnippet`, `max-snippet`, `max-image-preview` ou `unavailable_after`. Il est également possible de spécifier des directives pour des robots spécifiques, comme `googlebot` ou `bingbot`. Voici quelques exemples de directives :
- `X-Robots-Tag: noindex`: Empêche l'indexation de la page ou du fichier par les moteurs de recherche.
- `X-Robots-Tag: nofollow`: Indique aux robots de ne pas suivre les liens présents sur la page ou dans le fichier.
- `X-Robots-Tag: nosnippet`: Interdit l'affichage d'un extrait ou d'un aperçu du fichier dans les résultats (la directive noarchive n'a plus d'objet chez Google depuis la suppression de son cache en 2024).
Cas d'utilisation pour les fichiers non-HTML
Le X-Robots-Tag est particulièrement pertinent pour les sites qui contiennent une grande quantité de contenu multimédia ou de documents téléchargeables, où le contrôle de l'indexation au niveau des fichiers individuels est crucial. Par exemple, si vous souhaitez empêcher l'indexation d'un fichier PDF spécifique, vous pouvez utiliser la directive `X-Robots-Tag: noindex` dans l'en-tête HTTP du fichier.
Directives du X-Robots-Tag et leurs effets
Explication des directives noindex, nofollow, et autres
Les directives courantes du X-Robots-Tag comprennent :
- `noindex` : Empêche l'indexation de la page ou du fichier par les moteurs de recherche.
- `nofollow` : Indique aux robots de ne pas suivre les liens présents sur la page ou dans le fichier.
- `none` : Raccourci pour `noindex, nofollow`.
- `noarchive` : Demande aux moteurs de recherche de ne pas mettre en cache la page ou le fichier.
- `nosnippet` : Indique aux moteurs de recherche de ne pas afficher d'extraits dans les résultats de recherche.
Impact sur l'indexation et le crawl
L'utilisation des directives du X-Robots-Tag permet de contrôler l'indexation et l'exploration des pages et des fichiers d'un site web. En empêchant l'indexation de contenu non pertinent ou sensible et en guidant les robots vers le contenu important, le X-Robots-Tag aide à optimiser le budget de crawl et améliore la visibilité du site dans les résultats de recherche.
Mise en place du X-Robots-Tag
Guide étape par étape pour Apache et NGINX
Pour configurer le X-Robots-Tag, il est nécessaire de modifier les fichiers de configuration du serveur web, comme `.htaccess` pour Apache ou les fichiers `.conf` pour NGINX. Voici les étapes de base pour chaque serveur :
- Apache : Ajoutez les directives nécessaires dans le fichier `.htaccess` du répertoire concerné. Par exemple, pour empêcher l'indexation de tous les fichiers PDF, ajoutez la ligne suivante :
```
Header set X-Robots-Tag "noindex"
```
- NGINX : Ajoutez les directives nécessaires dans le fichier de configuration approprié (généralement situé dans `/etc/nginx/sites-available`). Par exemple, pour empêcher l'indexation de tous les fichiers PDF, ajoutez le bloc suivant :
```
location ~* \.pdf$ {
add_header X-Robots-Tag "noindex";
}
```
Conseils pour éviter les erreurs communes
La mise en place des directives du X-Robots-Tag nécessite une compréhension technique des configurations de serveur et doit être effectuée avec prudence pour éviter de bloquer accidentellement l'indexation de contenu important. Voici quelques conseils pour éviter les erreurs courantes :
- Testez toujours les modifications apportées aux fichiers de configuration avant de les déployer sur un serveur de production.
- Utilisez des outils tels que l'Inspecteur d'URL de Google Search Console pour vérifier l'effet des directives du X-Robots-Tag sur les pages ou les fichiers concernés.
- Assurez-vous de bien comprendre l'impact des directives utilisées et de les appliquer uniquement sur le contenu qui doit être exclu des moteurs de recherche.
- Vérifiez régulièrement les logs du serveur et les rapports de Google Search Console pour détecter d'éventuelles erreurs d'indexation ou de crawl causées par une mauvaise configuration du X-Robots-Tag.
X-Robots-Tag et stratégie SEO globale
Intégration dans une stratégie SEO
Le X-Robots-Tag peut être un élément essentiel de votre stratégie SEO globale en aidant à optimiser le budget de crawl et à gérer l'indexation des pages et des fichiers de votre site. Voici quelques éléments à considérer lors de l'intégration du X-Robots-Tag dans votre stratégie SEO :
- Identifiez les types de contenu qui nécessitent un contrôle d'indexation spécifique, comme les fichiers non-HTML ou les pages avec des paramètres d'URL complexes.
- Évaluez l'efficacité de votre budget de crawl en analysant les rapports d'exploration de la Google Search Console et en surveillant l'évolution de l'indexation de votre contenu.
- Adaptez votre stratégie en fonction des résultats obtenus, en ajustant les directives du X-Robots-Tag si nécessaire pour améliorer la visibilité de votre site dans les résultats de recherche.
Gestion du budget de crawl et optimisation de la visibilité
Le X-Robots-Tag joue un rôle clé dans la gestion du budget de crawl, qui est la quantité de ressources allouée par les moteurs de recherche pour explorer et indexer votre site. En guidant les robots des moteurs de recherche vers le contenu important et en évitant l'indexation du contenu non pertinent ou sensible, vous pouvez optimiser l'utilisation de votre budget de crawl et améliorer la visibilité de votre site dans les résultats de recherche.
Cas pratiques et études de cas
Exemples concrets d'utilisation du X-Robots-Tag
Voici quelques exemples d'utilisation du X-Robots-Tag dans différents contextes :
- Un site e-commerce avec des fichiers PDF contenant des catalogues de produits pourrait utiliser le X-Robots-Tag pour empêcher l'indexation de ces fichiers et ainsi éviter la duplication de contenu avec les pages de produits.
- Un site d'actualités qui publie des articles en plusieurs langues pourrait utiliser le X-Robots-Tag pour empêcher l'indexation des versions traduites automatiquement et ainsi privilégier les versions manuellement traduites.
- Un site d'entreprise avec des documents internes accessibles en ligne pourrait utiliser le X-Robots-Tag pour empêcher l'indexation de ces documents et ainsi protéger les informations sensibles.
Analyse des résultats et meilleures pratiques
L'évaluation des résultats obtenus grâce à l'utilisation du X-Robots-Tag doit être réalisée régulièrement pour s'assurer de son efficacité et de son adéquation avec les objectifs SEO. Les meilleures pratiques pour analyser les résultats incluent :
- La surveillance des rapports d'exploration et d'indexation dans la Google Search Console pour détecter les améliorations ou les problèmes liés à l'utilisation du X-Robots-Tag.
- L'utilisation d'outils d'analyse de logs pour identifier les tendances et les anomalies dans le comportement des robots des moteurs de recherche sur votre site.
- La comparaison des performances SEO de votre site avant et après l'application des directives du X-Robots-Tag afin de mesurer l'impact sur votre visibilité dans les résultats de recherche.
Sources :
- Spécifications des balises Meta pour les robots, data-nosnippet et X-Robots-Tag (Google Search Central)
- Bloquer l'indexation dans la recherche avec "noindex" (Google Search Central)
- Which robots metatags does Bing support? (Bing Webmaster Tools)
- Meta tags (robots meta tag and X-Robots-Tag header) (Yandex Webmaster, aide)
- mod_headers (Apache HTTP Server, documentation 2.4)
FAQ
Quand utiliser le X-Robots-Tag plutôt que la balise meta robots ?
Pour les fichiers qui n'ont pas de HTML (PDF, images, vidéos, documents bureautiques), pour appliquer une directive à un répertoire ou à un motif d'URL entier depuis le serveur, ou quand on ne peut pas modifier les gabarits du CMS. Pour une page HTML isolée, la balise meta suffit.
Le X-Robots-Tag fonctionne-t-il si la page est bloquée dans le robots.txt ?
Non, comme pour la balise meta : le robot doit pouvoir demander la ressource pour lire l'en-tête de réponse. Une URL bloquée en robots.txt ne peut pas être désindexée par X-Robots-Tag.
Peut-on cibler un robot précis avec le X-Robots-Tag ?
Oui, en préfixant la directive par le nom du robot : X-Robots-Tag: googlebot: noindex. Sans préfixe, la directive s'applique à tous les robots qui la reconnaissent.
Comment vérifier qu'un X-Robots-Tag est bien envoyé ?
En lisant les en-têtes de réponse : outils de développement du navigateur (onglet Réseau), commande curl -I, ou un crawler comme Screaming Frog qui remonte la directive pour chaque URL. L'outil d'inspection d'URL de la Search Console indique si Google a vu un noindex, quelle qu'en soit la source.
En résumé
- X-Robots-Tag : les directives robots (noindex, nofollow, nosnippet...) dans l'en-tête HTTP.
- Pour les fichiers non HTML et les règles globales, depuis la configuration du serveur (Apache, NGINX).
- Même logique que la meta robots : la ressource doit rester explorable pour que la directive soit lue.
- Ciblage possible d'un robot précis par préfixe.
- Contrôle : en-têtes de réponse, crawler, inspection d'URL.
Abondance c'est aussi des audits SEO, un service de contenus et des formations en e-learning !
Publié le Mis à jour le
Autres définitions :
Les outils SEO pour vous aider



