Testador de robots.txt
Escreva um domínio e um caminho e veja se um rastreador o pode ir buscar, com a regra que decidiu e o ficheiro inteiro de onde ela vem.
Como um rastreador decide
Um rastreador não para na primeira linha que corresponde. Compara todas as regras do seu grupo e escolhe a do padrão de caminho mais longo, pelo que Allow /blog/public ganha a Disallow /blog num URL que começa por ambos. Quando dois padrões correspondentes têm exatamente o mesmo comprimento, ganha Allow.
Um rastreador lê exatamente um grupo. Escolhe o grupo cujo agente de utilizador o nomeia com mais precisão, recorre ao grupo indicado com um asterisco e não segue nada se não houver nenhum dos dois. As regras dos outros grupos são invisíveis para ele, e é por isso que uma regra que parece certa está muitas vezes num grupo que o rastreador nunca lê.
Porque existe esta página
A Google retirou o testador de robots.txt da Search Console, e o que o substituiu diz muito menos, apenas se um URL está bloqueado, numa propriedade verificada, sem nomear a regra. Quase sempre a pergunta não é se um caminho está bloqueado mas que linha o bloqueou, e num site gerido por outra pessoa.
Uma regra no robots.txt impede um rastreador de ir buscar um URL. Não o retira dos resultados de pesquisa nem esconde a página de quem saiba o endereço. O que tiver de ficar privado precisa de autenticação, e o que tiver de ficar fora dos resultados precisa de uma tag noindex numa página que um rastreador ainda possa ler.
Perguntas sobre robots.txt
Comunique o erro, não uma descrição dele
O Session Replay captura a página, a consola, o registo de rede e os detalhes do navegador num único link, para que a pessoa seguinte já tenha tudo à frente.