Gerador de meta Robots
DevMonta a etiqueta <meta name="robots"> e o cabeçalho X-Robots-Tag a partir de diretrizes index/noindex/follow/noarchive, etc.
Nesta página
O que é uma diretriz robots meta?#
Uma diretriz robots meta diz aos crawlers dos motores de pesquisa o que podem fazer com uma página: indexá-la ou não, seguir os seus links ou não, guardar uma cópia em cache, mostrar um excerto nos resultados, e por ai fora. É a alavanca ao nível de página que se puxa quando um URL tem de ficar público (uma página de staging, uma página de agradecimento, um PDF legal) mas não deve aparecer nos resultados do Google, ou quando se quer moldar como aparece um excerto de resultado.
Uma diretriz pode viver em dois sítios. A etiqueta meta robots fica no <head> HTML da página e aplica-se a esse documento HTML. O cabeçalho HTTP X-Robots-Tag viaja na própria resposta e aplica-se a tudo o que um servidor devolve — um PDF, uma imagem, um vídeo, um arquivo JSON — incluindo recursos que não têm <head> onde pôr uma etiqueta. Os motores de pesquisa honram ambos; esta ferramenta gera ambas as formas a partir do mesmo conjunto de interruptores para que se possa copiar aquela de que a sua stack precisa.
A regra mais importante a lembrar: a ausência de diretriz significa “sem restrição”. Uma página sem nenhuma etiqueta robots é tratada como index, follow — totalmente rastreável. As diretrizes que esta ferramenta emite são todas restrições opt-in por cima desse padrão. A referência do Google define o conjunto padrão, e é exatamente ao que os interruptores aqui correspondem.
Como usar#
- Marque as caixas de Opções à esquerda. As duas primeiras são especiais — estão marcadas por padrão:
- Permitir indexação (desmarcado = noindex) / Seguir ligações (desmarcado = nofollow).
- noarchive — impede o Google de mostrar um link “Em cache”.
- nosnippet — suprime o excerto de texto sob o resultado.
- noimageindex — impede as imagens desta página de serem indexadas como páginas de referência.
- notranslate — recusa a oferta “Traduzir esta página” nos resultados.
- noodp — legado; ignora o título DMOZ/ODP obsoleto.
- nositelinkssearchbox — suprime a caixa de pesquisa de sitelinks.
- Opcionalmente escolha data e hora em unavailable_after (data) — a página será retirada dos resultados de pesquisa após esse momento. Útil para expirar uma promoção ou um documento limitado no tempo.
- Leia as duas saídas à direita:
- Etiqueta meta — o elemento completo
<meta name="robots" content="...">, pronto a colar num<head>. - Cabeçalho X-Robots-Tag — a forma de cabeçalho HTTP, pronta a juntar à configuração de resposta do seu servidor ou CDN.
- Etiqueta meta — o elemento completo
- Clique em Copiar ao lado de qualquer saída para a recolher.
Principais recursos#
- Ambas as formas de uma só fonte. Etiqueta meta e cabeçalho
X-Robots-Tagsão gerados em conjunto, pelo que páginas HTML e recursos não-HTML (PDFs, imagens) recebem a mesma diretriz. - Sensível ao padrão.
Permitir indexaçãoeSeguir ligaçõesestão marcados por padrão, correspondendo ao padrão real da web de “sem restrição a menos que declarado”. - Conjunto padrão completo de diretrizes. Cobre todas as diretrizes que o Google documenta —
noindex,nofollow,noarchive,nosnippet,noimageindex,notranslate,noodp,nositelinkssearchboxeunavailable_after. - Suporte a
unavailable_after. A única diretriz que leva um valor; é montada comounavailable_after: <data>e passada verbatim para que se controle o formato exato. - 100% do lado do cliente. Sem configuração para enviar, sem servidor para ida e volta — gere e copie, depois aplique o resultado no seu CMS, template ou configuração nginx você mesmo.
Exemplo detalhado#
Deixe os padrões (só Permitir indexação e Seguir ligações marcados) e ambas as saídas mostram:
<meta name="robots" content="index, follow">
X-Robots-Tag: index, follow
Essa é a forma explícita de “sem restrição” — útil quando se quer ser deliberado acerca de uma página ser totalmente rastreável.
Agora desmarque Permitir indexação (para manter uma página de agradecimento fora do índice mas ainda passar link equity através dos seus links) e as saídas passam a:
<meta name="robots" content="noindex, follow">
X-Robots-Tag: noindex, follow
Um terceiro caso: uma landing page de uma campanha sazonal que tem de desaparecer depois de acabar. Mantenha Permitir indexação e Seguir ligações marcados, defina unavailable_after para o fim da campanha, e a etiqueta passa a:
<meta name="robots" content="index, follow, unavailable_after: 2025-12-31T00:00">
O Google vai parar de mostrar a página nos resultados após esse carimbo. O valor da data é emitido exatamente como o selecionou, pelo que confirme que corresponde a um formato que o motor de pesquisa de destino aceita.
Perguntas frequentes#
Qual é a diferença entre noindex numa etiqueta meta e disallow no robots.txt?#
Trabalham em camadas diferentes e não devem ser misturados descuidadamente. noindex é uma diretriz que o crawler lê depois de ir buscar a página. Se bloquear o URL em robots.txt, o crawler nunca o vai buscar, nunca vê o noindex, e pode ainda indexar o URL com base em links que apontam para ele. Para manter uma página fora do índice de forma fiável, permita o rastreio mas adicione noindex — não esconda a página do crawler inteiramente.
Quando devo usar o cabeçalho X-Robots-Tag em vez da etiqueta meta?#
Sempre que o recurso não é HTML — um PDF, uma imagem, um vídeo, uma folha de cálculo — não há elemento <head> onde pôr uma etiqueta meta, pelo que o cabeçalho é a única opção. É também a escolha certa para aplicar uma regra a muitos arquivos de uma só vez via configuração do servidor ou CDN, em vez de editar cada documento.
noindex, follow ainda passa link equity?#
Sim. noindex controla se a página aparece nos resultados; follow controla se o crawler segue os links da página. noindex, follow mantém a página fora do índice mas ainda deixa o link equity fluir pelos links de saída da página. É a receita padrão para páginas de agradecimento, resultados de pesquisa interna e páginas de filtros facetados.
Porque é que a ferramenta emite index, follow de todo quando isso é o padrão?#
Porque ser explícito pode ser útil: documenta a intenção no código-fonte da página, pode sobrepor-se a uma regra herdada mais restritiva, e algumas equipas tratam a presença da etiqueta como sinal de que a página foi revista. Se prefere depender do padrão implícito, simplesmente omita a etiqueta — omiti-la inteiramente é equivalente a index, follow.