Начать бесплатноНачать
Бесплатный инструмент

Проверка robots.txt

Откроем /robots.txt сайта, разберём директивы User-agent: * и покажем, не закрыт ли весь сайт. Регистрация не нужна.

Как пользоваться

  1. 1Вставьте адрес сайта — файл ищем по корню домена.
  2. 2Дождитесь ответа: читаем статус и текст, который реально отдал сервер.
  3. 3Сверьте Disallow, Allow и строки Sitemap.
  4. 4Если закрыт весь «/» — сначала уберите запрет, потом гоните аудит.

Зачем проверять robots.txt

robots.txt — первое, что читает робот поисковой системы. Одна лишняя строка Disallow: / прячет весь сайт из обхода. Запрос «проверка robots txt» обычно значит: убедиться, что каталог, блог и фильтры не закрыты случайно после переноса, смены CMS или правок разработчика.

Файл не ранжирует страницы и не заменяет noindex. Он говорит роботу, куда ходить. Если раздел закрыт здесь, контент на этих URL робот может не увидеть — даже если в Search Console карта сайта стояла правильно.

Что смотрит этот инструмент

Мы запрашиваем https://ваш-домен/robots.txt тем же маршрутом, что и остальные публичные проверки SEOSCANUM. Показываем код ответа, сырой текст, список Disallow/Allow для User-agent: * и указанные Sitemap. Если файла нет или сервер отдал 404 — так и пишем, без «скорее всего всё хорошо».

Правила других агентов (AdsBot, спецдирективы Битрикса) в этой быстрой проверке не разбираем по отдельности: для этого нужен полный краул. Конфликт Allow и Disallow на одном пути считаем по длине совпадения: более длинное правило сильнее, при равенстве Allow побеждает.

  • Код ответа файла и факт, что текст не пустой
  • Запрет всего сайта директивой Disallow: /
  • Указание Sitemap: в файле
  • Список путей, которые робот не должен обходить

Частые ошибки в robots.txt

Закрывают /catalog/ вместе с карточками товара. Пишут Disallow: /wp-admin и случайно режут /wp-content/themes — Google не рендерит CSS. Ставят Crawl-delay для Googlebot: Google его игнорирует, Яндекс — нет. Указывают Sitemap на HTML-страницу или на старый домен после переезда.

Отдельная ловушка — отдавать robots.txt с 301 на главную или с заголовком noindex. Робот может перестать доверять файлу. Проверка статуса здесь как раз для этого: 200 и текст директив, не редирект на лендинг.

Чем проверка файла отличается от аудита

Один robots.txt не покажет noindex в HTML, X-Robots-Tag и страницы, которые закрыты только в шаблоне CMS. Аудит SEOSCANUM обходит URL, сверяет карту сайта и — если подключены Search Console и Вебмастер — фактическую индексацию.

Инструмент бесплатный и без кабинета. Результат можно скопировать и отправить разработчику. Если нужно понять масштаб по всему сайту — запустите технический модуль.

Частые вопросы

Нужна ли регистрация?
Нет. Вставьте адрес и получите разбор файла.
Вы смотрите индекс Google?
Нет. Мы читаем сам robots.txt. Попадание URL в индекс проверяют Search Console и Вебмастер — это уже полный аудит.
Disallow запрещает индексацию?
Он запрещает обход. URL иногда всё равно появляется в выдаче по внешней ссылке, но без сниппета со страницы.
Почему нет правил для Yandex?
В быстрой проверке разбираем группу User-agent: *. Отдельные агенты смотрите в тексте файла или в тестере путей.
Файл 404 — это ошибка?
Для робота это «запретов нет». Ошибкой бывает только если вы считали, что файл на месте, а сервер его не отдаёт.

Проверьте свой сайт за пару минут

Запустите бесплатное демо-аудита — увидите главные проблемы без оплаты и без подписки.

Платный аудит — от 99 ₽ за запуск. Все тарифы