Probador de robots.txt
Escribe un dominio y una ruta y comprueba si un rastreador puede pedirla, con la regla que lo decidió y el archivo entero del que sale.
Cómo decide un rastreador
Un rastreador no se detiene en la primera línea que coincide. Compara todas las reglas de su grupo y toma la del patrón de ruta más largo, de modo que Allow /blog/public gana a Disallow /blog en una URL que empieza por ambos. Cuando dos patrones coincidentes miden exactamente lo mismo, gana Allow.
Un rastreador lee exactamente un grupo. Toma el grupo cuyo agente de usuario lo nombra con más precisión, recurre al grupo nombrado con un asterisco y no sigue nada si no hay ninguno de los dos. Las reglas de los demás grupos le son invisibles, y por eso una regla que parece correcta suele estar en un grupo que el rastreador nunca lee.
Por qué existe esta página
Google retiró el probador de robots.txt de Search Console, y lo que lo sustituyó informa de mucho menos, solo de si una URL está bloqueada, en una propiedad verificada y sin nombrar la regla. Casi siempre la pregunta no es si una ruta está bloqueada sino qué línea la bloqueó, y en un sitio que lleva otra persona.
Una regla de robots.txt impide que un rastreador pida una URL. No la retira de los resultados de búsqueda ni oculta la página a quien conozca la dirección. Lo que deba seguir siendo privado necesita autenticación, y lo que deba quedar fuera de los resultados necesita una etiqueta noindex en una página que el rastreador aún pueda leer.
Preguntas sobre robots.txt
Informa del fallo, no de una descripción
Session Replay captura la página, la consola, el registro de red y los datos del navegador en un solo enlace, así la siguiente persona ya lo tiene todo delante.