Pular para o conteúdo

Artigo 6 min de leitura

Sessenta e oito por cento do que o Google faz no seu site é reconferir o que já existe

por Daniel Sócrates publicado em

Quando alguém fala em orçamento de rastreamento, a conversa costuma parar em “o Google visita o seu site tantas vezes”.

Falta a parte que interessa: para quê ele visita. E existe uma tela que separa isso em duas colunas.

As duas perguntas que o Google responde ao rastrear

No relatório de Estatísticas de rastreamento existe um bloco chamado Por finalidade. Ele divide tudo em dois, e as duas definições são oficiais.

Detecção, ou discovery: “a URL solicitada nunca havia sido rastreada pelo Google antes”. 1

Atualização, ou refresh: “um novo rastreamento de uma página já conhecida”. 2

Achar coisa nova, e reconferir coisa velha. Todo o rastreamento do seu site cabe nessas duas.

A divisão do site do exemplo, em 30 de agosto de 2026:

bloco para copiar
Atualização   68%
Detecção      32%

3

Dois terços do esforço foram para reconferir páginas que o Google já conhecia.

Isso é o normal de um site que já foi descoberto. Mas vira informação em uma situação específica. Você publicou quarenta páginas novas e a detecção não subiu. Aí o material novo não está sendo encontrado, e o motivo costuma ser link interno ou sitemap.

O que é orçamento de rastreamento, na definição de quem inventou o termo

O Google define assim: crawl budget é “the set of URLs that Google can and wants to crawl”. 4

Repare nos dois verbos. Pode e quer. São duas coisas separadas, e o Google as nomeia.

A primeira é capacidade. O documento chama de crawl capacity limit, também conhecido como hostload, e ela limita “the total amount of time your server spends holding connections open”. Se o seu servidor demora ou falha, o Google reduz o ritmo sozinho. 5

A segunda é vontade. O documento chama de crawl demand, e ela varia conforme tamanho do site, frequência de atualização, qualidade e relevância. 5

Servidor rápido resolve a primeira. Não resolve a segunda.

O aviso que o próprio Google dá, e quase ninguém repete

O guia de orçamento de rastreamento se declara “advanced guide intended primarily for” sites de mais de um milhão de páginas com mudança semanal, ou de mais de dez mil páginas com mudança diária. 6

E é explícito sobre quem não precisa dele: “you don’t need to read this guide” se as suas páginas são rastreadas no mesmo dia em que você publica. 7

Guardo isso aqui porque orçamento de rastreamento virou assunto de venda. Se o seu site tem duzentas páginas e elas aparecem no Google no dia seguinte, você não tem um problema de orçamento de rastreamento. Tem outro problema, e vale descobrir qual antes de comprar solução para esse.

Quem está rastreando, e por que isso importa

Outro bloco da mesma tela divide as requisições por tipo de Googlebot. No exemplo:

bloco para copiar
Smartphone           38%
Outro tipo de agente 28%
Imagem               19%
Computador           13%
AdsBot                2%

8

Três leituras saem daí.

Smartphone na frente do computador, com 38% contra 13%. É o comportamento esperado desde a indexação móvel. Ver o número confirma que o seu site está sendo lido como a maioria.

Imagem com 19%. Quase um quinto do rastreamento indo para arquivo de imagem. Num site com muitas fotos pesadas, esse número sobe e come espaço que iria para conteúdo.

AdsBot com 2%, num site que não roda anúncio. E aqui tem uma informação que muda o que você faz com o robots.txt.

As três categorias de rastreador, e a regra de cada uma

O Google separa os próprios rastreadores em três grupos. Cada um se comporta de um jeito diante do robots.txt. 9

CategoriaExemplo que o Google dárobots.txt
Common crawlersGooglebotrespeitam
Special-case crawlersAdsBotpodem não respeitar
User-triggered fetchersGoogle Site Verifierignoram

O AdsBot que apareceu no exemplo é da segunda categoria. Bloquear no robots.txt não garante que ele pare.

Uma observação de precisão. Os nomes que aparecem no painel do Search Console são rótulos de interface. Eles não são necessariamente os nomes técnicos da documentação de rastreadores, e por isso cito cada um como o que é. 10

O que fazer com isso na segunda-feira

Abra a tela e responda três perguntas.

Qual é a sua divisão entre atualização e detecção? Se você publicou muita coisa nova recentemente e a detecção está baixa, o problema é de descoberta, não de conteúdo.

Qual fatia vai para imagem? Se passar de um quarto num site que não é de fotografia, vale olhar peso de arquivo.

Aparece algum agente que você não esperava? AdsBot em site sem anúncio, por exemplo, é pergunta legítima para quem cuida da infraestrutura.

E antes de tudo isso, a pergunta que decide se o resto importa: as suas páginas novas aparecem no Google em quanto tempo? Se aparecem rápido, o Google já respondeu que você não precisa otimizar isso.

Perguntas frequentes

O que é orçamento de rastreamento, em uma frase?

Na definição oficial, é o conjunto de URLs que o Google pode e quer rastrear. Capacidade e vontade, duas coisas separadas. 4 5

Meu site pequeno precisa se preocupar com isso?

O guia oficial diz que não, se as páginas são rastreadas no mesmo dia da publicação. Ele é dirigido a sites acima de dez mil páginas com mudança diária, ou acima de um milhão com mudança semanal. 6 7

Bloquear o AdsBot no robots.txt funciona?

O AdsBot é um special-case crawler, e a documentação declara que essa categoria pode não respeitar o robots.txt. 9

Servidor mais rápido aumenta meu rastreamento?

Pode aumentar a capacidade, que é metade da conta. A outra metade é demanda, e ela depende de tamanho, frequência de atualização, qualidade e relevância. 5

Notas e fontes

  1. Definição de Detecção (discovery): Search Console Help, “Crawl Stats report”, support.google.com/webmasters/answer/9679690, consultado em 1º de setembro de 2026.
  2. Definição de Atualização (refresh): mesma fonte da nota 1.
  3. Google Search Console, propriedade seodeentidade.com, Estatísticas de rastreamento, bloco “Por finalidade”. Captura de 1º de setembro de 2026, relatório atualizado em 30 de agosto de 2026.
  4. Google Search Central, “Large site owner’s guide to managing your crawl budget”, developers.google.com/search/docs/crawling-indexing/large-site-managing-crawl-budget, consultado em 1º de setembro de 2026. Citação literal reproduzida no corpo.
  5. Componentes do orçamento na mesma fonte da nota 4: crawl capacity limit, também chamado hostload, e crawl demand. Citação literal do limite de capacidade reproduzida no corpo.
  6. Público declarado do guia, mesma fonte da nota 4.
  7. Declaração de quem não precisa do guia, mesma fonte da nota 4. Citação literal reproduzida no corpo.
  8. Google Search Console, mesma propriedade e captura da nota 3, bloco “Por tipo de Googlebot”.
  9. Categorias de rastreador: Google Search Central, documentação de crawlers e verificação do Googlebot, developers.google.com/search/docs/crawling-indexing/verifying-googlebot, consultada em 1º de setembro de 2026. Common crawlers respeitam o robots.txt, special-case crawlers podem não respeitar, e user-triggered fetchers ignoram.
  10. Delimitação declarada: os rótulos exibidos no painel do Search Console não são necessariamente os nomes técnicos da documentação de rastreadores. A lista nominal de agentes não abriu na fonte consultada em 1º de setembro de 2026.

Daniel Sócrates

Fundador e CEO da SEO Genome

Autor de SEO de Entidade. Escreve sobre o que a casa aplica em cliente.

danielsocrates.com.br

Vamos ver o que a máquina entende da sua empresa

Uma conversa de diagnóstico, sem apresentação de slides. Você traz o endereço do seu site. A gente traz o que o Google e as IAs já sabem sobre ele hoje.

Falar no WhatsApp