PT
Criar meu site
Início›Ferramentas de SEO com IA›Testador de robots.txt
Ferramenta de SEO gratuita · sem cadastro

Testador de robots.txt: os mecanismos de busca podem rastrear esta página?

Digite o endereço de uma página e escolha um rastreador. O testador lê o robots.txt do site, encontra a regra que decide e diz se a página pode ser rastreada.

Grátis · resultados em segundos · só lemos páginas públicas

Esta ferramenta verifica uma coisa só. O Verificador de SEO de sites com IA analisa seu site inteiro: 23 verificações, todas as páginas públicas, três páginas lidas em profundidade e as palavras-chave que você pode conquistar.

Analise o SEO do seu site com IA →

Para que serve o robots.txt

O robots.txt é um arquivo de texto simples na raiz de um site (suaempresa.com.br/robots.txt). Os rastreadores o leem antes de qualquer outra coisa para saber quais partes do site podem visitar. É um pedido, não uma tranca: rastreadores bem-comportados, como o Googlebot e o Bingbot, obedecem, enquanto bots mal-intencionados o ignoram, então nunca conte com ele para esconder páginas privadas.

Como este testador decide

  1. Ele encontra o grupo certo. O robots.txt é dividido em grupos, cada um começando com uma ou mais linhas User-agent. Um rastreador segue o grupo cujo nome corresponde a ele com mais precisão (o Googlebot-Image segue um grupo Googlebot-Image, na falta dele um grupo Googlebot e, por último, o grupo de todos os rastreadores, *).
  2. Ele encontra as regras que correspondem ao endereço. Uma regra corresponde quando o endereço começa com o caminho dela. Um asterisco (*) representa qualquer texto e um cifrão ($) marca o fim do endereço.
  3. A regra mais específica vence. De todas as regras que correspondem, decide a que tem o caminho mais longo. Quando um Allow e um Disallow têm o mesmo tamanho, o Allow vence. Se nenhuma regra corresponder, a página pode ser rastreada.

Essas são as regras que o Google publica e segue, então a resposta aqui é a mesma que o Googlebot recebe.

Erros comuns

  • Disallow: / esquecido do site de desenvolvimento, o que tira o site inteiro da busca.
  • Bloquear as pastas de CSS e JavaScript, o que impede o Google de renderizar a página como os visitantes a veem.
  • Usar o robots.txt para tirar uma página do Google. Uma página bloqueada ainda pode aparecer, sem descrição, se outros sites tiverem links para ela. Use uma tag noindex no lugar e deixe a página ser rastreada para que o Google veja a tag.
  • Um robots.txt que responde com erro do servidor. Nesse caso, o Google pausa o rastreamento do site inteiro.

O robots.txt também é o melhor lugar para indicar o seu sitemap, com uma linha Sitemap. Confira o sitemap com o verificador de sitemap e veja como o Google lê o seu site inteiro com o Verificador de SEO de sites com IA.

Perguntas

Testador de robots.txt: perguntas e respostas

Para que serve o robots.txt?

Ele diz aos rastreadores quais partes de um site eles podem visitar. Ele não remove páginas do Google: uma página bloqueada ainda pode aparecer se outros sites tiverem links para ela. Para manter uma página fora dos resultados, use uma tag noindex e deixe-a rastreável.

Qual regra vale quando duas regras se aplicam?

O Google usa a regra mais específica, a que tem o caminho mais longo. Quando uma regra Allow e uma Disallow têm o mesmo tamanho, a Allow vence. Este testador segue as mesmas regras.

O que acontece quando um site não tem robots.txt?

Se o robots.txt retorna "não encontrado", os rastreadores podem rastrear tudo. Se o servidor responde com um erro (um código 5xx), o Google para de rastrear o site por um tempo, então um robots.txt com defeito é pior do que nenhum.

Devo bloquear rastreadores de IA como o GPTBot?

É uma decisão de negócio. Bloqueá-los mantém seu conteúdo fora de alguns treinamentos e respostas de IA, mas também pode deixar seu negócio fora das respostas que as pessoas leem nos assistentes de IA.

Mais ferramentas de SEO gratuitas

Analise o resto do seu SEO

🔧
Ferramenta de prévia da SERPDigite um título e uma meta description, ou leia os de qualquer página, e veja como o Google os mostra no comp...
🔧
Verificador de sitemapDigite o endereço de um site. O verificador encontra os sitemaps dele (pelo robots.txt e pelos endereços padrã...
🔧
Verificador de redirecionamentosDigite um endereço. O verificador segue cada redirecionamento, uma etapa por vez, e mostra o código de status;...
🔧
Verificador de links quebradosDigite o endereço de uma página. O verificador lista todos os links da página, testa cada um e mostra quais es...
🔧
Verificador de títulosDigite o endereço de uma página para ver os títulos dela como os mecanismos de busca os leem: o título princip...
🔧
Verificador de Open GraphDigite o endereço de uma página para ver a prévia que aparece quando alguém a compartilha no Facebook, LinkedI...
🔧
Verificador de marcação SchemaDigite o endereço de uma página. O verificador lê os dados estruturados da página (JSON-LD, microdados e RDFa)...
🔧
Verificador de dificuldade de palavras-chaveDigite uma palavra-chave e escolha um país. O verificador estima quantas pessoas a buscam por mês, quão difíci...
🔧
Verificador de tempo de resposta do servidorDigite o endereço de uma página. O verificador a carrega três vezes e mede a rapidez com que o servidor começa...
🔧
Verificador de texto alternativoDigite o endereço de uma página. O verificador lista cada imagem da página com seu texto alternativo e aponta...