Проверка индексации: все ли нужные страницы в поиске
Индексация — путь от обнаружения URL до появления в поиске. Разбираем блокировки, soft 404, конфликты canonical и расхождения с отчётами GSC и Яндекс.Вебмастера.
«Страница не в индексе» — симптом, не диагноз. Причина может быть в robots, noindex, каноникале на другой URL, отсутствии внутренних ссылок, ошибке сервера или оценке качества (тонкий/дублированный контент). Модуль индексации в SEOSCANUM собирает цепочку сигналов по URL из краула и, при подключении, из консолей — без угадываний «скорее всего duplicate».
Карта причин: от hard-блока до soft-исключения
Hard-блок: Disallow, meta robots noindex, x-robots-tag, авторизация, 4xx/5xx. Soft-сценарии: canonical на другой документ, тонкий контент и дубли (риск pandaDemotion / LOW_DEMAND), сирота без ссылок, переизбыток параметрических URL.
- Согласованность robots ↔ meta robots ↔ canonical
- Страницы в sitemap, но закрытые от индекса
- Индексируемые URL вне перелинковки (сироты)
- Пагинация и фильтры без политики index/noindex
- Расхождения «должна индексироваться» vs статус в GSC/Вебмастере
Как доказательный подход меняет приоритеты
Имеет смысл чинить индексацию там, где есть спрос: запросы и показы в Search Console. URL без спроса и без коммерческой роли часто правильнее сознательно оставить вне индекса (приём 4), чем насильно «протолкнуть» тонкую страницу.
Так вы защищаете Q* сайта: меньше малоценных документов в индексе — чище topicality и меньше риска массовых DELETE по LOW_DEMAND.
Дубли и каноникал как индексационный фактор
Несколько почти одинаковых URL (www/non-www, слэш, параметры, сортировки) конкурируют друг с другом. ContentChecksum-подобная логика поисковиков склеивает близкие документы; без явного canonical/301 вы теряете фокус релевантности.
В отчёте группируем кластеры дублей и рекомендуем стратегию: 301 при слиянии навсегда, canonical когда вариант нужен пользователю, noindex для бесконечных комбинаций фильтров.
Crawl budget на больших сайтах
На каталогах от десятков тысяч URL лишние комбинации отнимают обход у карточек и категорий с деньгами. Модуль показывает «шумные» шаблоны и предлагает политику: что индексировать, что закрыть, что оставить для UX без индекса.
После исправлений
Индексация не мгновенна. Операционный цикл: fix → повторный краул → запрос переобхода важных URL в консолях → контроль покрытия через 1–4 недели. Повторный аудит фиксирует, какие блокировки сняты и не появились ли новые.
Частые вопросы
Без Search Console модуль бесполезен?
Сколько ждать индекса после правок?
Нужно ли индексировать все страницы пагинации?
Страница в индексе, но не ранжируется — это модуль индексации?
Читайте также
Проверка технических ошибок сайта
Технический модуль отвечает на вопрос: может ли робот стабильно обойти и понять сайт. Коды ответов, редиректы, robots, sitemap, canonical — с URL и приоритетом по трафику.
Поиск дублей страниц и контента
Дубли размывают релевантность и приводят к каннибализации. Находим технические и содержательные дубли и подсказываем, как их склеить.
Проверка robots.txt и sitemap.xml
robots.txt и sitemap.xml управляют тем, как робот обходит сайт. Одна ошибка здесь способна закрыть от индексации целый раздел.
Проверьте свой сайт за пару минут
Запустите бесплатное демо-аудита — увидите главные проблемы без оплаты и без подписки.
Платный аудит — от 99 ₽ за запуск. Все тарифы