Générateur de balise Robots
DévAssemble la balise <meta name="robots"> et l'en-tête X-Robots-Tag à partir des directives index/noindex/follow/noarchive, etc.
Sur cette page
Qu’est-ce qu’une directive robots meta ?#
Une directive robots meta indique aux robots des moteurs de recherche ce qu’ils peuvent faire d’une page : l’indexer ou non, suivre ses liens ou non, conserver une copie en cache, afficher un extrait dans les résultats, etc. C’est le levier au niveau page que vous actionnez quand une URL doit rester publique (une page de staging, une page de remerciement, un PDF légal) mais ne doit pas apparaître dans les résultats de Google, ou quand vous voulez modeler l’apparence d’un extrait de résultat.
Une directive peut vivre à deux endroits. La balise meta robots se trouve dans le <head> HTML de la page et s’applique à ce seul document HTML. L’en-tête HTTP X-Robots-Tag voyage dans la réponse elle-même et s’applique à tout ce qu’un serveur renvoie — un PDF, une image, une vidéo, un fichier JSON — y compris des ressources qui n’ont pas de <head> où placer une balise. Les moteurs de recherche honorent les deux ; cet outil génère les deux formes depuis le même jeu d’interrupteurs, pour que vous copiiez celle dont votre pile a besoin.
La règle la plus importante à retenir : l’absence de directive signifie « aucune restriction ». Une page sans aucune balise robots est traitée comme index, follow — totalement explorable. Les directives que cet outil émet sont toutes des restrictions opt-in par-dessus ce défaut. La référence de Google définit le jeu standard, et c’est exactement à cela que correspondent les interrupteurs ici.
Comment l’utiliser#
- Cochez les cases Options à gauche. Les deux premières sont spéciales — cochées par défaut :
- index / follow — décochez pour émettre
noindex/nofollow. - noarchive — empêche Google d’afficher un lien « En cache ».
- nosnippet — supprime l’extrait texte sous le résultat.
- noimageindex — empêche les images de cette page d’être indexées comme pages référentes.
- notranslate — décline l’offre « Traduire cette page » dans les résultats.
- noodp — hérité ; ignore le titre DMOZ/ODP obsolète.
- nositelinkssearchbox — supprime le champ de recherche sitelinks.
- index / follow — décochez pour émettre
- Choisissez facultativement une date et une heure sous unavailable_after — la page sera retirée des résultats de recherche après cet instant. Utile pour faire expirer une promotion ou un document limité dans le temps.
- Lisez les deux sorties à droite :
- Meta tag — l’élément
<meta name="robots" content="...">complet, prêt à coller dans un<head>. - X-Robots-Tag — la forme d’en-tête HTTP, prête à ajouter à votre config de réponse serveur ou CDN.
- Meta tag — l’élément
- Cliquez sur Copier à côté de l’une ou l’autre sortie pour la récupérer.
Fonctionnalités clés#
- Les deux formes depuis une source. Balise meta et en-tête
X-Robots-Tagsont générées ensemble, donc pages HTML et ressources non HTML (PDF, images) reçoivent la même directive. - Conscient du défaut.
indexetfollowsont cochés par défaut, ce qui correspond au défaut réel du web « aucune restriction si non déclaré ». - Jeu de directives standard complet. Couvre toutes les directives documentées par Google —
noindex,nofollow,noarchive,nosnippet,noimageindex,notranslate,noodp,nositelinkssearchboxetunavailable_after. - Prise en charge d’
unavailable_after. La seule directive qui prend une valeur ; elle est assemblée commeunavailable_after: <date>et passée telle quelle, pour que vous contrôliez le format exact. - 100 % côté client. Pas de config à téléverser, pas de serveur à solliciter — générez et copiez, puis appliquez le résultat dans votre CMS, votre gabarit ou votre config nginx vous-même.
Exemple commenté#
Laissez les défauts (seuls index et follow cochés) et les deux sorties affichent :
<meta name="robots" content="index, follow">
X-Robots-Tag: index, follow
C’est la forme explicite de « aucune restriction » — utile quand vous voulez être délibéré sur le fait qu’une page est totalement explorable.
Décochez maintenant index (pour garder une page de remerciement hors de l’index tout en continuant de transmettre le jus de lien à travers ses liens) et les sorties deviennent :
<meta name="robots" content="noindex, follow">
X-Robots-Tag: noindex, follow
Un troisième cas : une page de destination pour une campagne saisonnière qui doit disparaître après sa fin. Gardez index et follow cochés, réglez unavailable_after sur la fin de la campagne, et la balise devient :
<meta name="robots" content="index, follow, unavailable_after: 2025-12-31T00:00">
Google cessera d’afficher la page dans les résultats après cet horodatage. La valeur de date est émise exactement comme vous l’avez sélectionnée, donc confirmez qu’elle correspond à un format que votre moteur de recherche cible accepte.
FAQ#
Quelle est la différence entre noindex dans une balise meta et disallow dans robots.txt ?#
Elles travaillent à des couches différentes et ne doivent pas être mélangées à la légère. noindex est une directive que le robot lit après avoir récupéré la page. Si vous bloquez l’URL dans robots.txt, le robot ne la récupère jamais, ne voit jamais le noindex, et peut quand même indexer l’URL d’après les liens qui pointent vers elle. Pour garder une page hors de l’index de façon fiable, autorisez l’exploration mais ajoutez noindex — ne cachez pas la page au robot entièrement.
Quand dois-je utiliser l’en-tête X-Robots-Tag plutôt que la balise meta ?#
Chaque fois que la ressource n’est pas du HTML — un PDF, une image, une vidéo, un tableur — il n’y a pas d’élément <head> où placer une balise meta, donc l’en-tête est la seule option. C’est aussi le bon choix pour appliquer une règle à de nombreux fichiers à la fois via votre config serveur ou CDN, plutôt que d’éditer chaque document.
noindex, follow transmet-il encore le jus de lien ?#
Oui. noindex contrôle si la page apparaît dans les résultats ; follow contrôle si le robot suit les liens de la page. noindex, follow garde la page hors de l’index mais laisse le jus de lien circuler à travers les liens sortants de la page. C’est la recette standard pour les pages de remerciement, les résultats de recherche internes et les pages de filtres à facettes.
Pourquoi l’outil émet-il index, follow alors que c’est le défaut ?#
Parce qu’être explicite peut être utile : cela documente l’intention dans la source de la page, cela peut primer sur une règle héritée plus restrictive, et certaines équipes traitent la présence de la balise comme un signal que la page a été revue. Si vous préférez vous fier au défaut implicite, contentez-vous d’omettre la balise — l’omettre entièrement équivaut à index, follow.