Controla o rastreamento
Cada regra diz a um robô se ele pode ou não baixar um caminho. É assim que se poupa o orçamento de rastreamento em áreas que não interessam à busca, como carrinho, filtros e páginas de login.
Descubra o que o seu robots.txt está bloqueando de verdade, teste qualquer URL contra as regras do Googlebot e monte um arquivo novo, correto, em menos de um minuto.
Analisamos o arquivo que está no ar agora, com as mesmas regras de leitura que o Googlebot usa.
Clique em cada item para ver o detalhe e o que fazer.
É exatamente o que o robô lê quando pede /robots.txt no seu domínio.
Cole o endereço de uma página e veja se ela está liberada para cada robô, e qual linha do arquivo decide isso.
Preencha o que quiser bloquear. O arquivo é montado aqui no seu navegador, em tempo real, e nada é enviado para os nossos servidores.
Separados pelo que cada grupo faz com o seu conteúdo.
Bloquear os buscadores com IA tira o seu site das respostas que eles mostram, com link e citação. Na dúvida, deixe desmarcado.
Salve como robots.txt em UTF-8 sem BOM e envie para a raiz do site, onde fica a página inicial. Depois confira em seusite.com.br/robots.txt.
Ele é a portaria do site: diz quais robôs entram e por onde. Não é cadeado, e não tira nada do índice sozinho.
Cada regra diz a um robô se ele pode ou não baixar um caminho. É assim que se poupa o orçamento de rastreamento em áreas que não interessam à busca, como carrinho, filtros e páginas de login.
A linha Sitemap entrega a lista completa de páginas a qualquer buscador, sem depender do Search Console. É o jeito mais barato de acelerar a descoberta de conteúdo novo.
O arquivo é público e qualquer pessoa pode lê-lo. Listar uma pasta secreta ali é o mesmo que apontar para ela. Conteúdo sensível se protege com senha, nunca com Disallow.
Todos aparecem no relatório da aba Verificar, com a linha exata do arquivo.
Vem do ambiente de teste e sobe junto com o site novo. Bloqueia tudo, e o site inteiro sai do Google em poucos dias. É o erro mais caro e o mais comum.
O Google renderiza a página antes de avaliar. Sem o CSS, ele vê um layout quebrado e pode julgar o site como não responsivo, o que derruba o desempenho no celular.
O Google parou de obedecer essa diretiva em 2019. Quem a usa acha que tirou a página do índice, e ela continua aparecendo na busca.
Não. Ele impede o rastreamento, não a indexação. Uma URL bloqueada pode continuar aparecendo na busca, só que sem descrição, quando outros sites apontam para ela. Para tirar do índice, use a meta tag robots com noindex na própria página e deixe a URL liberada aqui, senão o Google nunca chega a ler a meta tag.
Não é obrigatório. Sem o arquivo, os robôs entendem que tudo está liberado e o site continua sendo indexado normalmente. Ainda assim vale ter: é nele que se declara o sitemap, se bloqueiam áreas administrativas e se decide quais robôs de IA podem ler o conteúdo.
Sempre na raiz do domínio, na mesma pasta da página inicial, acessível em seusite.com.br/robots.txt. Um arquivo dentro de uma subpasta é ignorado. Cada subdomínio precisa do seu próprio arquivo, e a versão com www e sem www são endereços diferentes para essa finalidade.
Depende do objetivo. Os robôs de busca com IA alimentam respostas que citam o seu site com link, e bloqueá-los significa sumir dessas citações. Já os robôs de treinamento apenas coletam texto para treinar modelos, sem devolver visita nenhuma, e bloqueá-los é uma decisão de negócio que não afeta a busca. A ferramenta separa os dois grupos.
O Googlebot guarda o robots.txt em cache por cerca de 24 horas. Depois de publicar o arquivo novo, a mudança costuma valer no dia seguinte. Em caso de urgência, peça a releitura pelo relatório de robots.txt do Search Console.
Rode a auditoria gratuita e receba uma nota de 0 a 100 em mais de 70 verificações, com o plano de correção em ordem de prioridade.
Fazer auditoria gratuita