Тестер robots.txt
Введите домен и путь и посмотрите, разрешено ли роботу его запрашивать, вместе с решающим правилом и всем файлом, из которого оно взято.
Как робот принимает решение
Робот не останавливается на первой подходящей строке. Он сравнивает все правила своей группы и берёт то, у которого шаблон пути длиннее, поэтому Allow /blog/public побеждает Disallow /blog для адреса, начинающегося с обоих. Когда два подходящих шаблона одинаковой длины, побеждает Allow.
Робот читает ровно одну группу. Он берёт группу, чей user agent называет его точнее всего, откатывается к группе со звёздочкой и не следует ничему, если нет ни того, ни другого. Правила остальных групп для него невидимы, поэтому правильно выглядящее правило часто оказывается в группе, которую робот никогда не читает.
Зачем нужна эта страница
Google убрал тестер robots.txt из Search Console, а то, что пришло ему на смену, сообщает куда меньше и говорит лишь, заблокирован ли адрес, на подтверждённом ресурсе и без указания правила. Чаще всего вопрос не в том, закрыт ли путь, а в том, какая строка его закрыла, и на чужом сайте.
Правило в robots.txt мешает роботу запросить адрес. Оно не убирает адрес из выдачи и не прячет страницу от того, кто знает адрес. Тому, что должно остаться закрытым, нужна аутентификация, а тому, что должно остаться вне выдачи, нужен тег noindex на странице, которую роботу по-прежнему разрешено читать.
Вопросы про robots.txt
Сообщайте об ошибке, а не о её описании
Session Replay собирает страницу, консоль, сетевой журнал и данные браузера в одну ссылку, так что следующему человеку сразу видно всё целиком.