Тонкий контент — это не про количество слов, а про добавленную ценность. Статья на тысячу слов может быть тонкой, если пересказывает то, что уже есть в топ-10. А карточка товара из 50 слов с точными характеристиками, фото и честным описанием состояния — полезной. Google в собственных рекомендациях использует формулировку «thin content of little or no added value» и относит сюда: автогенерацию без редактуры, дорвеи, аффилиат-страницы без своих обзоров, скрапинг чужих текстов, поверхностные пересказы. Если хотите понять, как такие страницы могут выпасть из индекса, читайте «Страница выпала из индекса: как найти причину за 10 минут и вернуть её обратно ». Общий признак один: пользователь прочитал страницу и не получил ничего, чего не было бы у десяти конкурентов в выдаче.
Как найти тонкий контент на своём сайте за 10 минут
- Открой Search Console → раздел «Страницы» (в левом меню — «Индексирование → Страницы»).
Если нужен более детальный разбор статуса, смотри Google просканировал страницу, но не проиндексировал: пошаговый разбор статуса «Crawled - currently not indexed» . - В блоке «Не проиндексировано» найди строку
Просканировано, в настоящее время не проиндексировано— это самый частый статус именно для тонкого контента. - Нажми на строку → справа список URL → кнопка «Экспорт» → CSV.
- В таблице отсортируй URL по папке/шаблону:
/tag/,/category/,/city/{name}/,/product/. Если 70–80% списка из одной папки — это не разовая проблема отдельной статьи, а системная генерация по шаблону. - Возьми 5–10 URL из списка и прогони каждый через инструмент «Проверка URL» (URL Inspection). Смотри блок «Покрытие»:
Duplicate without user-selected canonical— это дубликат, чинится через canonical, а не переписыванием текста.Crawled - currently not indexedбез указания на дубликат — вот это уже вопрос ценности контента.
Если сайт больше 50–100 страниц, вручную по одному URL не находишься. Для массовой проверки статуса индексации по списку — Rush Analytics: загружаешь список URL, он возвращает статус по каждому и техническую SEO-сводку, вместо часов ручного прогона через URL Inspection.
Почему страница не попала в индекс: диагностика по шагам, а не наугад→Сначала — техника, потом контент
Прежде чем переписывать текст, исключи техническую причину.
curl -IL https://example.com/page
Если видишь чистый 200 OK без редиректов, а Google при этом показывает Soft 404 — с точки зрения бота страница технически жива, но выглядит пустой: мало текста, нет уникальных блоков, шаблон повторяется один в один с соседними URL. Если в конце цепочки 404 или бесконечный редирект — это не тонкий контент, а битая ссылка, чинится отдельно (301 на релевантную страницу или честный 404/410).
Второе — открой исходный код страницы (Ctrl+U) и посмотри, сколько текста реально отдаётся в HTML до рендера JavaScript. Если в исходнике 40 слов, а на экране кажется, что текста много, потому что скрипт дорисовывает блоки после загрузки — Google на первом проходе рендеринга может увидеть именно тонкую версию. Частая причина у SPA-каталогов и товарных агрегаторов.
Soft 404: как найти и вылечить на практике (2026)→Признаки тонкого контента — что искать в статьях
- Текст пересказывает первую выдачу по запросу без своих примеров, цифр, скриншотов, наблюдений.
- Заголовок обещает «полное руководство», внутри — список общих фраз без конкретики.
- Один и тот же скелет H2 повторяется в десятках статей сайта: введение → проблема → шаги → заключение.
- Нет признаков автора: ни байлайна, ни даты обновления, ни источников.
- Аффилиат-страница — чистый список ссылок без отзыва и методики выбора.
- Страницы вида «X в городе Y» с подстановкой параметра и одинаковым текстом вокруг.
Перед публикацией черновика полезно прогнать текст через анализатор воды и уникальности — например, TurboText: он показывает объём «воды», тошноту текста и уникальность относительно уже проиндексированных материалов. Дешевле поймать проблему на этапе черновика, чем чинить её после того, как страница уже попала в Crawled - currently not indexed. Для систематической проверки можно воспользоваться Чек-листом перед индексацией сайта: что реально проверяют Google, Яндекс и Bing
.
Для оценки конкретной уже опубликованной страницы против того, что реально ранжируется по её запросу, — экспресс-анализ через PR‑CY: вставляешь URL, смотришь базовые SEO‑параметры страницы и её соответствие тому, что обычно нужно для темы. Быстро понятно, действительно ли материал слабее конкурентов или проблема в другом месте.
Сценарии по статусам: что значит и что делать
| Ситуация в Search Console | Что это значит | Что делать |
|---|---|---|
Crawled - currently not indexed держится 2–3 недели, страница не менялась | Бот прочитал, ценности не увидел | Добавь 1–2 уникальных блока (кейс, цифры, скриншот), запроси переиндексацию только после правки |
Тот же статус — на 50+ URL одного шаблона (/city/{name}/) | Массовая генерация без ценности | Не чинить по одной — объединить в одну страницу с фильтром или удалить весь шаблон целиком |
Soft 404 на карточке товара | Только характеристики из фида поставщика, нет своего текста | Добавить 2–3 абзаца собственного обзора, фото/видео, разметку schema.org Product |
Discovered - currently not indexed (бот даже не заходил) | Вопрос не в качестве текста, а в приоритете обхода | Не трогай текст — проверь внутреннюю перелинковку и sitemap, это про краулинговый бюджет |
| Пометка «Thin content with little or no added value» в разделе «Меры вручную» | Ручная санкция | Массово переработать или удалить весь затронутый сегмент, Reconsideration Request отправлять только после фактической правки |
Сколько тонких страниц допустимо
Точного порога Google не публикует, но по косвенным наблюдениям: если меньше 10% страниц сайта попадает в Crawled, currently not indexed или Soft 404 — проект выглядит здоровым. Выше 30% — это уже системный сигнал, и ближайший алгоритмический апдейт может срезать трафик на 30–60%.
Лечится не точечно. «Допишу пару статей и всё ок» не работает при системной проблеме — нужен список всех проблемных URL (см. массовую проверку выше), распределение по трём корзинам: дописать, объединить с 301, удалить (404/410). Если сталкиваешься с одинаковыми шаблонными страницами, смотри Похожие страницы плохо индексируются: как это выявить и починить .
После того как сегмент переработан, не жди недели естественного повторного обхода — отправь список исправленных URL через индексатор, например SpeedyIndex, чтобы Google быстрее заметил изменения и пересмотрел статус.
ИИ и тонкий контент в 2026 году
Google по-прежнему официально не запрещает контент, написанный с помощью ИИ. Запрет — про другое: про массовое производство страниц низкого качества (scaled content abuse). Статья, которую вы продумали и в которой ИИ помог с черновиком, — не то же самое, что тысяча шаблонных страниц без редактуры. Практически: если ИИ стал частью редакционной цепочки, проверяйте каждый материал на оригинальность угла и наличие конкретных деталей до публикации — тонкий контент остаётся тонким независимо от того, кто его написал.
Итоговый чеклист
- Экспортировать список непроиндексированных URL из GSC → сгруппировать по шаблону.
- Для крупных списков — массовая проверка индексации (Rush Analytics).
- Отделить техническую причину (
curl -IL, Ctrl+U) от контентной. - По таблице сценариев выше определить действие для каждой группы URL.
- Перед публикацией новых материалов — проверка воды и уникальности (TurboText).
- После правок — ускорить переобход (SpeedyIndex) и проверить статус повторно через 1–2 недели, а не сразу.
Связанные термины
- Crawled, currently not indexed — статус GSC, чаще всего связанный именно с тонким контентом.
- Soft 404 — страница технически жива, фактически пуста.
- Discovered - currently not indexed — бот ещё не дошёл, вопрос краулингового бюджета, а не качества текста.
- Helpful Content Update — серия алгоритмов Google, прицельно бьющая по тонкому контенту.
- E‑E‑A‑T — Experience/Expertise/Authoritativeness/Trustworthiness; у thin content этот показатель почти всегда низкий.
