Проверка Индексации

Чек-лист перед публикацией: что проверить, чтобы страница попала в индекс с первого раза

Чек-лист перед публикацией: что проверить, чтобы страница попала в индекс с первого раза
Содержание

Самая частая причина, по которой страница не индексируется месяцами — не «Google медленный» и не «сайт молодой». Это техническая ошибка, которую не заметили до публикации: лишний noindex в шаблоне категории, canonical, указывающий на другой URL, страница-дубль без разницы в содержании. Всё это лечится за пять минут — если найти до того, как страница ушла в очередь на сканирование, а не после того, как она две недели провисела в статусе «Обнаружено, не проиндексировано».

Ниже — рабочий чек-лист, который стоит прогонять перед каждой публикацией на PBN-сайте или в блоге, плюс три сценария из практики: конкретный статус в Search Console → что он означает → что делать.

Технический чек-лист перед публикацией

ПроверкаКак сделатьЧто смотреть
Индексируемость страницыCtrl+U → поиск по noindexВ <meta name="robots"> не должно быть noindex,nofollow
CanonicalCtrl+U → поиск по rel="canonical"URL в теге совпадает с реальным адресом страницы, без ?utm_ и лишних слэшей
Ответ сервераcurl -IL https://site.ru/page/Первый код — 200 OK, не 301/302 на другой адрес
Sitemapsite.ru/sitemap.xmlНовый URL появился в файле в течение часа после публикации
robots.txtsite.ru/robots.txtРаздел с этой страницей не в Disallow
Внутренние ссылкиПросмотр раздела и 2–3 похожих статейМинимум одна живая ссылка на новую страницу с уже проиндексированной
Дубли контентаПоиск по фрагменту заголовка через site:site.ruНет второй страницы с тем же ответом на тот же запрос
JSON-LDRich Results Test или просмотр Ctrl+UРазметка Article/Product валидна, без ошибок в консоли

Каждая строка — не формальность, а конкретная причина, по которой страницы годами не попадают в индекс. Разберём по пунктам.

Разбор по пунктам: что именно ломается

Индексируемость. Самый частый баг после миграции темы или обновления CMS — шаблон категории или тега случайно наследует noindex от страницы-черновика. Проверяется за 10 секунд: Ctrl+U, Ctrl+F, ищем noindex. Если нашли на боевой странице — не публикуйте, пока не пересоберёте шаблон.

Canonical. Частая ошибка автогенерации: canonical страницы обзора товара указывает на родительскую категорию, потому что шаблон унаследовал его от раздела. Итог — в блоке «Покрытие» появится статус «Страница является копией. Выбранная пользователем каноническая страница отличается от Google», и материал не попадёт в индекс, сколько бы вы его ни пересылали.

Ответ сервера. curl -IL https://site.ru/page/ показывает всю цепочку редиректов. Если видите 301 → 301 → 200 — это два лишних прыжка, которые режут вес ссылки и замедляют обход. На новых PBN-доменах после смены CMS такие цепочки — обычное дело, и в браузере их не видно, потому что браузер сам «доезжает» до финального адреса.

Sitemap. Если через час после публикации URL не появился в sitemap.xml, значит либо генератор карты не подхватывает новые страницы, либо URL попал в исключения по регулярке в конфиге. Для массовой проверки, что все свежие адреса реально попали в карту и проиндексированы, удобно прогнать список URL через Rush Analytics — сервис пачкой показывает статус индексации и подсвечивает, какие страницы выпали.

robots.txt. Разовая, но болезненная ошибка: черновой Disallow: /2026/ остаётся в файле после тестового окружения и режет целый раздел. Проверяйте не саму страницу, а её директорию целиком — баг обычно не в конкретном URL, а в правиле уровнем выше.

Внутренние ссылки. Страница без единой входящей ссылки с уже проиндексированного раздела живёт только в sitemap, а sitemap — это список «вот что есть», а не команда «зайди сюда обязательно». Добавьте минимум одну ссылку с ближайшей по теме статьи до публикации, а не после. Подробнее о том, как правильно формировать такие ссылки, читайте в нашем Чек-листе перед индексацией сайта: что реально проверяют Google, Яндекс и Bing .

Дубли. Запрос site:site.ru "фраза из заголовка" за 30 секунд покажет, если похожая страница уже существует. Если нашли — либо склеивайте материалы через 301, либо чётко разводите разными подзапросами в заголовках. Иначе Google сам решит, какую из двух показывать, и не обязательно ту, что нужна вам.

JSON-LD. Ошибка в разметке сама по себе индексацию не блокирует, но лишает страницу расширенных сниппетов в выдаче — а это прямая потеря кликов. Проверяйте перед публикацией, а не когда через месяц заметите пропавшие звёздочки рейтинга в выдаче.

Три сценария из практики: статус в GSC → диагноз → действие

Сценарий 1. Страница висит в статусе «Обнаружено, не проиндексировано» уже три недели, хотя в sitemap она есть. Почти всегда это значит одно: Google видит URL, но при обходе счёл контент недостаточно ценным на фоне уже проиндексированных похожих страниц (либо бюджет сканирования сайта уходит на другие разделы). Действие: не ждите дальше — усильте страницу внутренними ссылками с 2–3 уже проиндексированных материалов, затем зайдите в Search Console → «Проверка URL» → вставьте адрес → нажмите «Запросить индексирование». Если статус не сдвигается ещё неделю — контент действительно слабый, и его нужно переписывать, а не переотправлять. Подробнее о причинах такого статуса читайте в статье Google просканировал страницу, но не проиндексировал: пошаговый разбор статуса «Crawled - currently not indexed» .

Сценарий 2. Статус «Страница является копией. Google выбрал другую каноническую страницу, а не пользовательскую» — Google нашёл вашу страницу похожей на другую и решил показывать не её. Откройте блок «Покрытие» → раздел «Исключено» → посмотрите, какой URL указан как выбранный канонический. Если это чужой сайт — контент, скорее всего, недостаточно переработан под уникальный угол, и здесь поможет не техника, а переписывание. Если это ваша же страница — объединяйте материалы или явно разводите темы через разные H1 и разные вступительные абзацы.

Сценарий 3. «Просканировано, не проиндексировано» держится больше месяца на новом домене, при этом на сайте меньше 20 статей. Типичная ситуация для молодого PBN-сайта: доверие к домену ещё не сформировалось, и Google не спешит индексировать всё подряд. Здесь бессмысленно бесконечно жать «запросить индексирование» — это не ускоряет процесс на молодых доменах. Нужно наращивать объём (обычно ситуация меняется после 30+ проиндексированных страниц) и подтягивать внешние сигналы: если у сайта уже есть беклинки, ускорьте их попадание в индекс через SpeedyIndex — тогда сам факт наличия ссылки на ваш сайт быстрее становится виден поисковику, и это добавляет доверия домену в целом.

После публикации: что проверить в первые 48 часов

Через сутки-двое откройте Search Console → «Проверка URL» → вставьте адрес страницы. Смотрите блок «Покрытие»: если статус «URL отправлен в Google» держится больше 3 дней без изменений — это нормально для новых доменов, паниковать рано. Если статус сменился на «Проиндексировано, но есть предупреждения» — раскройте список предупреждений: там почти всегда либо проблема с мобильной версткой, либо конфликт canonical.

Для Яндекса и Bing быстрее работает IndexNow — не нужно ждать очереди сканирования, сайт сам сообщает поисковику о новом URL в момент публикации. Если публикуете обзор партнёрского сервиса, ведите переход через внутренний /go/, а не прямой внешней ссылкой из текста — так адрес партнёра меняется в одном месте, а не в каждой статье вручную, если у сервиса поменяется программа.

Если материал — обзор с наращиванием ссылочной массы под статью (например, закупили размещения), заранее проверьте трастовость доноров через Checktrust — ссылка с токсичного донора иногда не просто не помогает, а тормозит индексацию всей страницы из-за подозрительного окружения.

Типичные ошибки, которые дешевле поймать до публикации

  1. Canonical «по наследству» — шаблон подставил URL родительского раздела вместо реального адреса. Проверяется в Ctrl+U за 10 секунд, чинится за 5 минут, а без проверки съедает недели ожидания индексации.
  2. Молчаливый noindex после копирования шаблона черновика — страница физически недоступна поиску, при этом для человека выглядит опубликованной и рабочей.
  3. Страница-сирота без единой входящей ссылки — живёт только в sitemap, и Google не спешит к ней возвращаться просто потому, что она где-то в списке.
  4. Разметка JSON-LD с ошибкой — индексацию не блокирует, но убивает расширенные сниппеты, а это прямые потери в CTR из выдачи.

Короткий вывод

Публикация — это не финал работы, а начало проверки. Прогоните Ctrl+U-чеклист и curl -IL до нажатия «опубликовать» — это трёхминутная привычка, которая экономит недели ожидания в статусе «Обнаружено, не проиндексировано». А если статус всё же завис — сверьтесь со сценариями выше: там почти всегда конкретная техническая причина, а не «Google просто медленный». Для более подробного разбора причин падения страниц из индекса см. статью Страница выпала из индекса: как найти причину за 10 минут и вернуть её обратно .