Robots Meta Tag e X-Robots-Tag: Tutorial Completo (noindex, nofollow, e mais)

Robots Meta Tag e X-Robots-Tag: Tutorial Completo (noindex, nofollow, e mais)

Domine controle de indexação no Google: meta robots, X-Robots-Tag HTTP, diretrizes index/noindex/follow/nofollow/noimageindex e casos práticos.

Categoria: SEO Técnico · Por Equipe Domain Hunter · Publicado em 12/05/2026 · 10 min de leitura

## Por que controle de indexação é vital Indexar tudo é **errado**. Páginas internas, filtros, paginação, áreas duplicadas, drafts — se aparecem no Google sem controle, **diluem autoridade** e geram canibalização. A diferença entre `robots.txt` e meta robots é frequentemente confundida. Vamos esclarecer e dar tutorial passo a passo. ## robots.txt vs meta robots: quando usar cada um | Diretiva | O que faz | Quando usar | |---|---|---| | `robots.txt Disallow` | Impede o **crawl** | Áreas que nem devem ser visitadas | | `meta robots noindex` | Permite crawl, **bloqueia indexação** | Páginas que existem mas não ranqueiam | | `X-Robots-Tag` (header HTTP) | Igual meta, mas para **arquivos não-HTML** | PDFs, imagens, vídeos | ⚠️ **Erro clássico**: bloquear via `robots.txt` uma página que tem `noindex`. Como o Google nem visita, **não vê o noindex** e mantém a URL no índice. Use **um OU outro**. ## Tutorial: configure meta robots passo a passo ### Sintaxe básica Adicione no `` da página: ```html ``` ### As diretrizes principais | Diretiva | Significado | |---|---| | `index` | Pode indexar (padrão) | | `noindex` | Não indexar | | `follow` | Pode seguir links (padrão) | | `nofollow` | Não seguir links | | `noimageindex` | Não indexar imagens da página | | `noarchive` | Não mostrar versão em cache | | `nosnippet` | Não mostrar snippet na SERP | | `max-snippet:[N]` | Limita snippet a N caracteres | | `max-image-preview:[setting]` | Tamanho da imagem (`none`, `standard`, `large`) | | `max-video-preview:[N]` | Limita preview de vídeo | | `unavailable_after:[date]` | Remover do índice após data | Documentação completa: [Google Search Central](https://developers.google.com/search/docs/crawling-indexing/robots-meta-tag). ### Combinações úteis **Discover-friendly (recomendado para qualquer site público):** ```html ``` **Página interna (filtros, busca):** ```html ``` **Página de agradecimento (thank-you):** ```html ``` **PDF que deve ranquear, mas sem aparecer em "imagens":** Header HTTP: ``` X-Robots-Tag: index, noimageindex ``` ## X-Robots-Tag: indexação para arquivos não-HTML PDFs, imagens, vídeos não suportam ``. Para controlá-los, use o header HTTP. Em Nginx: ```nginx location ~* \.pdf$ { add_header X-Robots-Tag "noindex, nofollow"; } ``` Em Apache (`.htaccess`): ```apache Header set X-Robots-Tag "noindex, nofollow" ``` Em Cloudflare Workers: ```javascript addEventListener('fetch', event => { event.respondWith(handleRequest(event.request)); }); async function handleRequest(request) { const response = await fetch(request); const newResponse = new Response(response.body, response); if (request.url.endsWith('.pdf')) { newResponse.headers.set('X-Robots-Tag', 'noindex, nofollow'); } return newResponse; } ``` ## Casos práticos: o que fazer em cada cenário ### Caso 1: site em desenvolvimento (staging) ```html ``` + proteção HTTP Basic Auth + `Disallow: /` no robots.txt apenas após retirar a meta (uma estratégia por vez). ### Caso 2: páginas de filtro em e-commerce ```html ``` `follow` é importante: o crawl ainda passa pelos links de produtos, distribuindo equity. ### Caso 3: paginação `/categoria?page=2` em diante — debate em aberto. Recomendação 2026: - **Indexar todas as páginas** se cada uma tem produtos únicos - Com `rel="canonical"` apontando para si mesma - Sem `rel="next/prev"` (Google deprecou em 2019) ### Caso 4: conteúdo duplicado entre regiões Use `hreflang` (veja nosso [tutorial completo de hreflang](/blog/hreflang-tutorial-seo-multilingue-internacional)) — não use `noindex`. ### Caso 5: artigo desatualizado Em vez de `noindex`, atualize ou faça **301 para versão atualizada**. `noindex` é desperdício de equity. Veja nosso [guia de redirect 301](/blog/como-fazer-redirect-301-corretamente-tutorial-htaccess-nginx). ## Como verificar se o noindex está aplicado 1. Inspecione o HTML (View Source) — busque por `meta name="robots"` 2. Use o **URL Inspection Tool** do [Search Console](https://search.google.com/search-console) 3. Para X-Robots-Tag, abra DevTools > Network > Headers 4. Use a extensão [SEO Pro Extension](https://chrome.google.com/webstore) para ver indexação rápida ## Vídeo recomendado No YouTube, pesquise por "Google Search Central robots meta" — Martin Splitt do Google tem episódios em "JavaScript SEO Office Hours" cobrindo casos avançados. ## Erros que matam SEO 1. **`noindex` na home** por engano após deploy → site some do Google em horas 2. **`Disallow` no robots.txt + `noindex`** simultâneos → URL indexada sem snippet, eternamente 3. Aplicar `noindex` em páginas que recebem backlinks → desperdício gigante 4. Esquecer de remover `noindex` do staging ao subir produção 5. Usar `nofollow` interno por padrão → desperdiça PageRank interno ## Conclusão `noindex` é uma **ferramenta cirúrgica**, não uma solução genérica. Use com critério, audite uma vez por trimestre, e nunca confunda com `Disallow` do robots.txt. Próximo passo: revise nosso [tutorial de sitemap.xml e robots.txt](/blog/sitemap-xml-robots-txt-tutorial) para fechar o controle completo de crawl. ## Perguntas frequentes **Posso usar Disallow no robots.txt e noindex ao mesmo tempo na mesma página?** Não é recomendado. Se o robots.txt bloqueia o crawl, o Google nunca vê a tag noindex, e a URL pode ficar indexada sem snippet indefinidamente. Use um mecanismo por vez. **X-Robots-Tag funciona em imagens e PDFs?** Sim, é justamente para isso que ele existe — arquivos não-HTML não suportam a tag , então o controle de indexação precisa vir do header HTTP. **Páginas de paginação (page=2, page=3) devem ter noindex?** A recomendação de 2026 é indexar todas se cada uma tiver produtos ou conteúdo únicos, usando canonical apontando para si mesma, em vez de usar noindex ou rel=next/prev, já descontinuado. **noindex é a melhor solução para conteúdo desatualizado?** Não. Nesses casos, atualizar o conteúdo ou fazer um redirect 301 para uma versão atual preserva a autoridade acumulada, enquanto noindex simplesmente desperdiça esse equity.

Tags: robots meta tag, noindex, nofollow, x-robots-tag, seo técnico

Ver todos os artigos · DomainHunter Pro