Экспертиза

Что такое тонкий контент и почему Google его не любит

Что такое тонкий контент и почему Google его не любит
Содержание

Тонкий контент — это не про количество слов, а про добавленную ценность. Статья на тысячу слов может быть тонкой, если пересказывает то, что уже есть в топ-10. А карточка товара из 50 слов с точными характеристиками, фото и честным описанием состояния — полезной. Google в собственных рекомендациях использует формулировку «thin content of little or no added value» и относит сюда: автогенерацию без редактуры, дорвеи, аффилиат-страницы без своих обзоров, скрапинг чужих текстов, поверхностные пересказы. Если хотите понять, как такие страницы могут выпасть из индекса, читайте «Страница выпала из индекса: как найти причину за 10 минут и вернуть её обратно ». Общий признак один: пользователь прочитал страницу и не получил ничего, чего не было бы у десяти конкурентов в выдаче.

Как найти тонкий контент на своём сайте за 10 минут

  1. Открой Search Console → раздел «Страницы» (в левом меню — «Индексирование → Страницы»).
    Если нужен более детальный разбор статуса, смотри Google просканировал страницу, но не проиндексировал: пошаговый разбор статуса «Crawled - currently not indexed» .
  2. В блоке «Не проиндексировано» найди строку Просканировано, в настоящее время не проиндексировано — это самый частый статус именно для тонкого контента.
  3. Нажми на строку → справа список URL → кнопка «Экспорт» → CSV.
  4. В таблице отсортируй URL по папке/шаблону: /tag/, /category/, /city/{name}/, /product/. Если 70–80% списка из одной папки — это не разовая проблема отдельной статьи, а системная генерация по шаблону.
  5. Возьми 5–10 URL из списка и прогони каждый через инструмент «Проверка URL» (URL Inspection). Смотри блок «Покрытие»: Duplicate without user-selected canonical — это дубликат, чинится через canonical, а не переписыванием текста. Crawled - currently not indexed без указания на дубликат — вот это уже вопрос ценности контента.

Если сайт больше 50–100 страниц, вручную по одному URL не находишься. Для массовой проверки статуса индексации по списку — Rush Analytics: загружаешь список URL, он возвращает статус по каждому и техническую SEO-сводку, вместо часов ручного прогона через URL Inspection.

По темеПочему страница не попала в индекс: диагностика по шагам, а не наугад

Сначала — техника, потом контент

Прежде чем переписывать текст, исключи техническую причину.

curl -IL https://example.com/page

Если видишь чистый 200 OK без редиректов, а Google при этом показывает Soft 404 — с точки зрения бота страница технически жива, но выглядит пустой: мало текста, нет уникальных блоков, шаблон повторяется один в один с соседними URL. Если в конце цепочки 404 или бесконечный редирект — это не тонкий контент, а битая ссылка, чинится отдельно (301 на релевантную страницу или честный 404/410).

Второе — открой исходный код страницы (Ctrl+U) и посмотри, сколько текста реально отдаётся в HTML до рендера JavaScript. Если в исходнике 40 слов, а на экране кажется, что текста много, потому что скрипт дорисовывает блоки после загрузки — Google на первом проходе рендеринга может увидеть именно тонкую версию. Частая причина у SPA-каталогов и товарных агрегаторов.

По темеSoft 404: как найти и вылечить на практике (2026)

Признаки тонкого контента — что искать в статьях

  • Текст пересказывает первую выдачу по запросу без своих примеров, цифр, скриншотов, наблюдений.
  • Заголовок обещает «полное руководство», внутри — список общих фраз без конкретики.
  • Один и тот же скелет H2 повторяется в десятках статей сайта: введение → проблема → шаги → заключение.
  • Нет признаков автора: ни байлайна, ни даты обновления, ни источников.
  • Аффилиат-страница — чистый список ссылок без отзыва и методики выбора.
  • Страницы вида «X в городе Y» с подстановкой параметра и одинаковым текстом вокруг.

Перед публикацией черновика полезно прогнать текст через анализатор воды и уникальности — например, TurboText: он показывает объём «воды», тошноту текста и уникальность относительно уже проиндексированных материалов. Дешевле поймать проблему на этапе черновика, чем чинить её после того, как страница уже попала в Crawled - currently not indexed. Для систематической проверки можно воспользоваться Чек-листом перед индексацией сайта: что реально проверяют Google, Яндекс и Bing .

Для оценки конкретной уже опубликованной страницы против того, что реально ранжируется по её запросу, — экспресс-анализ через PR‑CY: вставляешь URL, смотришь базовые SEO‑параметры страницы и её соответствие тому, что обычно нужно для темы. Быстро понятно, действительно ли материал слабее конкурентов или проблема в другом месте.

Сценарии по статусам: что значит и что делать

Ситуация в Search ConsoleЧто это значитЧто делать
Crawled - currently not indexed держится 2–3 недели, страница не меняласьБот прочитал, ценности не увиделДобавь 1–2 уникальных блока (кейс, цифры, скриншот), запроси переиндексацию только после правки
Тот же статус — на 50+ URL одного шаблона (/city/{name}/)Массовая генерация без ценностиНе чинить по одной — объединить в одну страницу с фильтром или удалить весь шаблон целиком
Soft 404 на карточке товараТолько характеристики из фида поставщика, нет своего текстаДобавить 2–3 абзаца собственного обзора, фото/видео, разметку schema.org Product
Discovered - currently not indexed (бот даже не заходил)Вопрос не в качестве текста, а в приоритете обходаНе трогай текст — проверь внутреннюю перелинковку и sitemap, это про краулинговый бюджет
Пометка «Thin content with little or no added value» в разделе «Меры вручную»Ручная санкцияМассово переработать или удалить весь затронутый сегмент, Reconsideration Request отправлять только после фактической правки

Сколько тонких страниц допустимо

Точного порога Google не публикует, но по косвенным наблюдениям: если меньше 10% страниц сайта попадает в Crawled, currently not indexed или Soft 404 — проект выглядит здоровым. Выше 30% — это уже системный сигнал, и ближайший алгоритмический апдейт может срезать трафик на 30–60%.

Лечится не точечно. «Допишу пару статей и всё ок» не работает при системной проблеме — нужен список всех проблемных URL (см. массовую проверку выше), распределение по трём корзинам: дописать, объединить с 301, удалить (404/410). Если сталкиваешься с одинаковыми шаблонными страницами, смотри Похожие страницы плохо индексируются: как это выявить и починить .

После того как сегмент переработан, не жди недели естественного повторного обхода — отправь список исправленных URL через индексатор, например SpeedyIndex, чтобы Google быстрее заметил изменения и пересмотрел статус.

ИИ и тонкий контент в 2026 году

Google по-прежнему официально не запрещает контент, написанный с помощью ИИ. Запрет — про другое: про массовое производство страниц низкого качества (scaled content abuse). Статья, которую вы продумали и в которой ИИ помог с черновиком, — не то же самое, что тысяча шаблонных страниц без редактуры. Практически: если ИИ стал частью редакционной цепочки, проверяйте каждый материал на оригинальность угла и наличие конкретных деталей до публикации — тонкий контент остаётся тонким независимо от того, кто его написал.

Итоговый чеклист

  1. Экспортировать список непроиндексированных URL из GSC → сгруппировать по шаблону.
  2. Для крупных списков — массовая проверка индексации (Rush Analytics).
  3. Отделить техническую причину (curl -IL, Ctrl+U) от контентной.
  4. По таблице сценариев выше определить действие для каждой группы URL.
  5. Перед публикацией новых материалов — проверка воды и уникальности (TurboText).
  6. После правок — ускорить переобход (SpeedyIndex) и проверить статус повторно через 1–2 недели, а не сразу.

Связанные термины

  • Crawled, currently not indexed — статус GSC, чаще всего связанный именно с тонким контентом.
  • Soft 404 — страница технически жива, фактически пуста.
  • Discovered - currently not indexed — бот ещё не дошёл, вопрос краулингового бюджета, а не качества текста.
  • Helpful Content Update — серия алгоритмов Google, прицельно бьющая по тонкому контенту.
  • E‑E‑A‑T — Experience/Expertise/Authoritativeness/Trustworthiness; у thin content этот показатель почти всегда низкий.