Robots Meta Tag e X-Robots-Tag: Tutorial Completo (noindex, nofollow, e mais)
Domine controle de indexação no Google: meta robots, X-Robots-Tag HTTP, diretrizes index/noindex/follow/nofollow/noimageindex e casos práticos.
Categoria: SEO Técnico ·
Por Equipe Domain Hunter ·
Publicado em 12/05/2026 ·
10 min de leitura
## Por que controle de indexação é vital
Indexar tudo é **errado**. Páginas internas, filtros, paginação, áreas duplicadas, drafts — se aparecem no Google sem controle, **diluem autoridade** e geram canibalização.
A diferença entre `robots.txt` e meta robots é frequentemente confundida. Vamos esclarecer e dar tutorial passo a passo.
## robots.txt vs meta robots: quando usar cada um
| Diretiva | O que faz | Quando usar |
|---|---|---|
| `robots.txt Disallow` | Impede o **crawl** | Áreas que nem devem ser visitadas |
| `meta robots noindex` | Permite crawl, **bloqueia indexação** | Páginas que existem mas não ranqueiam |
| `X-Robots-Tag` (header HTTP) | Igual meta, mas para **arquivos não-HTML** | PDFs, imagens, vídeos |
⚠️ **Erro clássico**: bloquear via `robots.txt` uma página que tem `noindex`. Como o Google nem visita, **não vê o noindex** e mantém a URL no índice. Use **um OU outro**.
## Tutorial: configure meta robots passo a passo
### Sintaxe básica
Adicione no `` da página:
```html
```
### As diretrizes principais
| Diretiva | Significado |
|---|---|
| `index` | Pode indexar (padrão) |
| `noindex` | Não indexar |
| `follow` | Pode seguir links (padrão) |
| `nofollow` | Não seguir links |
| `noimageindex` | Não indexar imagens da página |
| `noarchive` | Não mostrar versão em cache |
| `nosnippet` | Não mostrar snippet na SERP |
| `max-snippet:[N]` | Limita snippet a N caracteres |
| `max-image-preview:[setting]` | Tamanho da imagem (`none`, `standard`, `large`) |
| `max-video-preview:[N]` | Limita preview de vídeo |
| `unavailable_after:[date]` | Remover do índice após data |
Documentação completa: [Google Search Central](https://developers.google.com/search/docs/crawling-indexing/robots-meta-tag).
### Combinações úteis
**Discover-friendly (recomendado para qualquer site público):**
```html
```
**Página interna (filtros, busca):**
```html
```
**Página de agradecimento (thank-you):**
```html
```
**PDF que deve ranquear, mas sem aparecer em "imagens":**
Header HTTP:
```
X-Robots-Tag: index, noimageindex
```
## X-Robots-Tag: indexação para arquivos não-HTML
PDFs, imagens, vídeos não suportam ``. Para controlá-los, use o header HTTP. Em Nginx:
```nginx
location ~* \.pdf$ {
add_header X-Robots-Tag "noindex, nofollow";
}
```
Em Apache (`.htaccess`):
```apache
Header set X-Robots-Tag "noindex, nofollow"
```
Em Cloudflare Workers:
```javascript
addEventListener('fetch', event => {
event.respondWith(handleRequest(event.request));
});
async function handleRequest(request) {
const response = await fetch(request);
const newResponse = new Response(response.body, response);
if (request.url.endsWith('.pdf')) {
newResponse.headers.set('X-Robots-Tag', 'noindex, nofollow');
}
return newResponse;
}
```
## Casos práticos: o que fazer em cada cenário
### Caso 1: site em desenvolvimento (staging)
```html
```
+ proteção HTTP Basic Auth + `Disallow: /` no robots.txt apenas após retirar a meta (uma estratégia por vez).
### Caso 2: páginas de filtro em e-commerce
```html
```
`follow` é importante: o crawl ainda passa pelos links de produtos, distribuindo equity.
### Caso 3: paginação
`/categoria?page=2` em diante — debate em aberto. Recomendação 2026:
- **Indexar todas as páginas** se cada uma tem produtos únicos
- Com `rel="canonical"` apontando para si mesma
- Sem `rel="next/prev"` (Google deprecou em 2019)
### Caso 4: conteúdo duplicado entre regiões
Use `hreflang` (veja nosso [tutorial completo de hreflang](/blog/hreflang-tutorial-seo-multilingue-internacional)) — não use `noindex`.
### Caso 5: artigo desatualizado
Em vez de `noindex`, atualize ou faça **301 para versão atualizada**. `noindex` é desperdício de equity.
Veja nosso [guia de redirect 301](/blog/como-fazer-redirect-301-corretamente-tutorial-htaccess-nginx).
## Como verificar se o noindex está aplicado
1. Inspecione o HTML (View Source) — busque por `meta name="robots"`
2. Use o **URL Inspection Tool** do [Search Console](https://search.google.com/search-console)
3. Para X-Robots-Tag, abra DevTools > Network > Headers
4. Use a extensão [SEO Pro Extension](https://chrome.google.com/webstore) para ver indexação rápida
## Vídeo recomendado
No YouTube, pesquise por "Google Search Central robots meta" — Martin Splitt do Google tem episódios em "JavaScript SEO Office Hours" cobrindo casos avançados.
## Erros que matam SEO
1. **`noindex` na home** por engano após deploy → site some do Google em horas
2. **`Disallow` no robots.txt + `noindex`** simultâneos → URL indexada sem snippet, eternamente
3. Aplicar `noindex` em páginas que recebem backlinks → desperdício gigante
4. Esquecer de remover `noindex` do staging ao subir produção
5. Usar `nofollow` interno por padrão → desperdiça PageRank interno
## Conclusão
`noindex` é uma **ferramenta cirúrgica**, não uma solução genérica. Use com critério, audite uma vez por trimestre, e nunca confunda com `Disallow` do robots.txt.
Próximo passo: revise nosso [tutorial de sitemap.xml e robots.txt](/blog/sitemap-xml-robots-txt-tutorial) para fechar o controle completo de crawl.
## Perguntas frequentes
**Posso usar Disallow no robots.txt e noindex ao mesmo tempo na mesma página?**
Não é recomendado. Se o robots.txt bloqueia o crawl, o Google nunca vê a tag noindex, e a URL pode ficar indexada sem snippet indefinidamente. Use um mecanismo por vez.
**X-Robots-Tag funciona em imagens e PDFs?**
Sim, é justamente para isso que ele existe — arquivos não-HTML não suportam a tag , então o controle de indexação precisa vir do header HTTP.
**Páginas de paginação (page=2, page=3) devem ter noindex?**
A recomendação de 2026 é indexar todas se cada uma tiver produtos ou conteúdo únicos, usando canonical apontando para si mesma, em vez de usar noindex ou rel=next/prev, já descontinuado.
**noindex é a melhor solução para conteúdo desatualizado?**
Não. Nesses casos, atualizar o conteúdo ou fazer um redirect 301 para uma versão atual preserva a autoridade acumulada, enquanto noindex simplesmente desperdiça esse equity.
Tags: robots meta tag, noindex, nofollow, x-robots-tag, seo técnico