SEO TÉCNICO

Crawl e Indexação.

Antes de ranquear, uma página precisa ser encontrada e guardada. Entenda as duas etapas que decidem se o seu conteúdo sequer entra na disputa.

01 — O QUE SÃO

Duas etapas, um só objetivo: existir para o Google.

Crawl (rastreamento) é o processo em que robôs como o Googlebot seguem links de página em página, descobrindo URLs novas e revisitando as que já conhece. Indexação é a decisão seguinte: das páginas rastreadas, quais entram no índice do Google — a base de dados gigantesca consultada a cada busca.

Uma página pode ser rastreada e ainda assim não indexada — o inverso nunca acontece. Por isso o diagnóstico técnico sempre começa checando rastreamento antes de investigar por que uma página não ranqueia.

02 — DIAGNÓSTICO

Onde checar cada etapa.

  • Relatório de Cobertura (Search Console). Mostra exatamente quais URLs estão indexadas e por que as demais não estão.
  • Inspeção de URL. Testa uma página específica em tempo real e mostra a última vez que foi rastreada.
  • Estatísticas de rastreamento. Revela quantas requisições o Googlebot faz por dia e se esse volume está caindo sem motivo aparente.
  • Logs de servidor. A fonte mais precisa — mostra exatamente quais URLs o Googlebot acessou e quando, sem depender de amostragem.

Sinais que prejudicam crawl e indexação: cadeias longas de redirecionamento, páginas órfãs (sem links internos apontando para elas), erros 5xx recorrentes, e paginação ou filtros gerando milhares de URLs de baixo valor.

FAQ

Perguntas frequentes.

Minha página foi rastreada mas não indexada. Por quê?

As causas mais comuns são conteúdo considerado duplicado ou de baixo valor, uma tag noindex esquecida, um canonical apontando para outra URL, ou a página simplesmente ainda não ter sido priorizada — o Search Console mostra o motivo exato em "Cobertura".

O que é orçamento de rastreamento (crawl budget)?

É o número de páginas que o Googlebot está disposto a rastrear num site em um período — relevante principalmente para sites grandes. Desperdiçar esse orçamento com páginas de baixo valor (filtros infinitos, parâmetros duplicados) atrasa a descoberta de conteúdo novo.

Bloquear uma página no robots.txt garante que ela não seja indexada?

Não necessariamente — se outras páginas linkam para ela, o Google pode indexar a URL sem rastrear o conteúdo, exibindo-a sem descrição. Para garantir que uma página não seja indexada, use a tag noindex, não o robots.txt.

CONTINUE NO SEO KNOWLEDGE HUB

Sitemap e robots.txt são os dois arquivos que mais influenciam como o Google rastreia seu site.

Ver o guia de Sitemap