Herramientas
Guías

Generador de meta Robots

Dev

Ensambla la etiqueta <meta name="robots"> y la cabecera X-Robots-Tag a partir de directivas index/noindex/follow/noarchive, etc.

100 % del lado del cliente Sin backend
Opciones
Etiqueta meta
Cabecera X-Robots-Tag
En esta página

¿Qué es una directiva meta robots?#

Una directiva meta robots indica a los rastreadores de los motores de búsqueda qué pueden hacer con una página: indexarla o no, seguir sus enlaces o no, conservar una copia en caché, mostrar un fragmento en los resultados, etc. Es la palanca a nivel de página que tiras cuando una URL debe seguir siendo pública (una página de staging, una página de agradecimiento, un PDF legal) pero no debería aparecer en los resultados de Google, o cuando quieres moldear cómo se ve el fragmento de un resultado.

Una directiva puede vivir en dos sitios. La etiqueta meta robots se encuentra en el <head> del HTML de la página y se aplica a ese único documento HTML. La cabecera HTTP X-Robots-Tag viaja en la propia respuesta y se aplica a cualquier cosa que devuelva un servidor (un PDF, una imagen, un vídeo, un archivo JSON), incluidos recursos que no tienen un <head> donde poner una etiqueta. Los motores de búsqueda respetan ambas; esta herramienta genera ambas formas a partir del mismo conjunto de conmutadores, así puedes copiar la que tu pila necesite.

La regla más importante a recordar: la ausencia de directiva significa «sin restricción». Una página sin ninguna etiqueta robots se trata como index, follow: rastreable por completo. Las directivas que emite esta herramienta son todas restricciones opt-in por encima de ese valor por defecto. La referencia de Google define el conjunto estándar, y es justo a lo que corresponden los conmutadores de aquí.

Cómo se usa#

  1. Marca las casillas de Opciones de la izquierda. Las dos primeras son especiales: están marcadas por defecto.
    • Permitir indexación / Seguir enlaces: desmárcalas para emitir noindex / nofollow.
    • noarchive: impide que Google muestre un enlace «En caché».
    • nosnippet: suprime el fragmento de texto bajo el resultado.
    • noimageindex: impide que las imágenes de esta página se indexen como páginas de referencia.
    • notranslate: rechaza la oferta de «Traducir esta página» en los resultados.
    • noodp: heredado; ignora el título obsoleto de DMOZ/ODP.
    • nositelinkssearchbox: suprime la casilla de búsqueda de sitelinks.
  2. Opcionalmente, elige fecha y hora bajo unavailable_after: la página dejará de aparecer en los resultados de búsqueda a partir de ese momento. Útil para caducar una promoción o un documento limitado en el tiempo.
  3. Lee las dos salidas de la derecha:
    • Etiqueta meta: el elemento completo <meta name="robots" content="...">, listo para pegar en un <head>.
    • Cabecera X-Robots-Tag: la forma de cabecera HTTP, lista para añadir a la configuración de respuesta de tu servidor o CDN.
  4. Pulsa Copiar junto a cualquiera de las dos salidas para llevártela.

Características clave#

  • Ambas formas de un mismo origen. La etiqueta meta y la cabecera X-Robots-Tag se generan a la vez, así que las páginas HTML y los recursos no HTML (PDF, imágenes) reciben la misma directiva.
  • Consciente del valor por defecto. index y follow están marcados por defecto, conforme al valor real de la web de «sin restricción salvo que se indique».
  • Conjunto estándar completo de directivas. Cubre todas las directivas que documenta Google: noindex, nofollow, noarchive, nosnippet, noimageindex, notranslate, noodp, nositelinkssearchbox y unavailable_after.
  • Admite unavailable_after. La única directiva que toma un valor; se ensambla como unavailable_after: <fecha> y se pasa tal cual, de modo que tú controlas el formato exacto.
  • 100 % del lado del cliente. Sin configuración que subir, sin servidor con el que ir y volver: genera y copia, y luego aplica el resultado en tu CMS, tu plantilla o tu configuración de nginx por tu cuenta.

Ejemplo práctico#

Deja los valores por defecto (solo Permitir indexación y Seguir enlaces marcados) y ambas salidas rezan:

<meta name="robots" content="index, follow">
X-Robots-Tag: index, follow

Esa es la forma explícita de «sin restricción», útil cuando quieres ser deliberado sobre que una página sea totalmente rastreable.

Ahora desmarca Permitir indexación (para mantener fuera del índice una página de agradecimiento dejando pasar la linkage equity por sus enlaces) y las salidas pasan a:

<meta name="robots" content="noindex, follow">
X-Robots-Tag: noindex, follow

Un tercer caso: una landing page para una campaña estacional que debe desaparecer al terminar. Mantén Permitir indexación y Seguir enlaces marcados, pon unavailable_after al final de la campaña y la etiqueta se convierte en:

<meta name="robots" content="index, follow, unavailable_after: 2025-12-31T00:00">

Google dejará de mostrar la página en los resultados tras esa marca de tiempo. El valor de la fecha se emite exactamente como lo seleccionaste, así que confirma que coincide con un formato que tu motor de búsqueda destino acepte.

Preguntas frecuentes#

¿Cuál es la diferencia entre noindex en una etiqueta meta y disallow en robots.txt?#

Trabajan en capas distintas y no deben mezclarse a la ligera. noindex es una directiva que el rastreador lee después de obtener la página. Si bloqueas la URL en robots.txt, el rastreador nunca la obtiene, nunca ve el noindex y puede aun así indexar la URL a partir de los enlaces que apuntan a ella. Para mantener una página fuera del índice de forma fiable, permite el rastreo pero añade noindex: no ocultes la página al rastreador por completo.

¿Cuándo debo usar la cabecera X-Robots-Tag en vez de la etiqueta meta?#

Siempre que el recurso no sea HTML (un PDF, una imagen, un vídeo, una hoja de cálculo): no hay elemento <head> donde poner una etiqueta meta, así que la cabecera es la única opción. Es también la elección correcta para aplicar una misma regla a muchos archivos a la vez mediante la configuración de tu servidor o CDN, en vez de editar cada documento.

¿noindex, follow sigue pasando linkage equity?#

Sí. noindex controla si la página aparece en los resultados; follow controla si el rastreador sigue los enlaces de la página. noindex, follow mantiene la página fuera del índice pero sigue dejando fluir la linkage equity a través de los enlaces salientes de la página. Es la receta estándar para páginas de agradecimiento, resultados de búsqueda internos y páginas de filtros facetados.

¿Por qué la herramienta emite index, follow en absoluto si ese es el valor por defecto?#

Porque ser explícito puede ser útil: documenta la intención en el fuente de la página, puede sobrescribir una regla heredada más restrictiva y algunos equipos tratan la presencia de la etiqueta como una señal de que la página se revisó. Si prefieres fiarte del valor implícito por defecto, simplemente omite la etiqueta: omitirla por completo equivale a index, follow.