Тонкий контент: почему страницы есть, а трафика нет

Тонкий контент: почему страницы есть, а трафика нет

Знакомая картина: в индексе 8 400 страниц, а органический трафик идёт на 120 из них. Остальные существуют, отдают 200-й код, красиво свёрстаны — и молчат. В отчётах Яндекс.Вебмастера половина из них помечена как «Малополезная страница, контент дублируется или отсутствует». Это и есть тонкий контент — thin content. Он не про количество знаков и не про «мало текста»: страница может содержать 6 000 символов и всё равно считаться пустой. В этой статье разберём, как поисковик оценивает ценность, откуда тонкий контент берётся у нормальных коммерческих сайтов, как найти его на своём проекте за пару часов и что делать дальше — от точечной доработки до массовой чистки тысяч URL.

Что такое тонкий контент на самом деле

Тонкий контент — это страница, которая не решает задачу пользователя, пришедшего по запросу. Всё. Никакого порога в «300 слов» или «2 000 знаков» не существует и никогда не существовало. Существует другое: поисковая система сравнивает вашу страницу с десятком других по тому же интенту и оценивает, добавляет ли она хоть что-то к тому, что уже есть в выдаче.

Отсюда следуют неочевидные вещи:

  • Страница из 200 знаков может быть отличной. Карточка товара «Подшипник SKF 6205-2RS» с точными габаритами, ценой, наличием, сроком доставки и аналогами закрывает запрос лучше, чем статья на 15 000 знаков про историю подшипников.
  • Страница из 10 000 знаков может быть тонкой. Если это переписанный своими словами текст конкурента, набор общих фраз и «в современном мире всё большую популярность приобретает» — ценности ноль, независимо от объёма.
  • Тонкость — свойство относительное. В нише, где у всех пустые карточки, ваша пустая карточка ранжируется. Как только один конкурент выкатил нормальные описания и фото — тонкими стали все остальные, включая вашу, хотя вы ничего не меняли.

Формулировка, которую я использую в аудитах: тонкая страница — это страница, ради которой пользователю не стоило открывать сайт. Он мог получить то же самое из сниппета, из карточки конкурента или вообще не получить ничего.

Дело не в морали. У поисковика есть краулинговый бюджет — конечное количество запросов, которое робот готов потратить на ваш сайт. Каждая пустая страница — это потраченный обход, который не принёс индексу ничего. Когда доля таких страниц переваливает за половину, робот начинает обходить сайт реже и хуже: новые нужные страницы попадают в индекс неделями вместо часов. Это первый, механический удар.

Второй удар — хостовый. Яндекс оценивает качество сайта целиком, а не постранично. Если у хоста большая доля страниц, которые пользователи открывают и тут же закрывают, это влияет на оценку всего домена. Тонкий контент утягивает вниз и те страницы, которые сделаны хорошо. Именно поэтому вопрос «почему у нас просели нормальные посадочные, мы их не трогали» часто имеет ответ «потому что вы выкатили 4 000 теговых страниц». Механику хостовой оценки я подробнее разбирал в материале про поисковые фильтры Яндекса.

Третий удар — прямой алгоритмический. У Яндекса есть фильтр «Малополезный контент» (в народе — «Баден-Баден» в его хостовой ипостаси), у Google — Panda, растворённая в основном алгоритме. Оба реагируют на массовый бессодержательный контент.

Статус «малополезная страница» в Яндекс.Вебмастере: как читать

Самый прямой источник данных — Вебмастер, раздел Индексирование → Страницы в поиске → Исключённые. Там есть статус «Малополезная страница». Формулировки бывают разные, и это важно, потому что за одним статусом прячутся три принципиально разные ситуации:

  1. «Малополезная страница, контент дублируется» — Яндекс нашёл другую страницу (вашу или чужую) с тем же содержимым и выбросил вашу как избыточную. Часто указывается каноническая страница, которую он выбрал вместо вашей. Это не тонкий контент в чистом виде, это дубли.
  2. «Малополезная страница, контент отсутствует» — на странице нечего индексировать: пустая категория, страница фильтра без товаров, заглушка «раздел в разработке».
  3. «Недостаточно качественная страница» — самый неприятный вариант. Контент есть, он уникален, но алгоритм счёл его не заслуживающим места в выдаче. Здесь виноват не объём, а бесполезность.

Что важно понимать при чтении этого отчёта:

  • Статус — это решение робота, а не приговор навсегда. После доработки страница возвращается в индекс, обычно за 2–6 недель, иногда быстрее после переобхода через «Переобход страниц».
  • Отчёт запаздывает. Данные могут отражать состояние сайта месячной давности. Не паникуйте, если исправили страницу вчера.
  • Массовость важнее единичных случаев. 30 малополезных из 5 000 — норма. 3 000 из 5 000 — системная проблема архитектуры, а не контента.
  • Выгружайте архив целиком. В интерфейсе видно только часть; берите XLS/CSV-выгрузку и работайте с ней в таблице — там сразу видны паттерны по URL (все на /filter/, все на /tag/, все на /gorod-*).

Полезно параллельно смотреть раздел «Качество сайта» и ИКС: резкое проседание на фоне выкатки нового пула страниц — сильный сигнал, что вы выкатили мусор. Если сайт уже провалился, порядок действий описан в разборе как выйти из-под фильтра.

Источник №1: карточки товаров с описанием производителя

Классика интернет-магазинов. Прайс поставщика выгружается в YML, описания копируются как есть — и точно такие же описания стоят ещё у 40 магазинов, торгующих тем же товаром. Плюс у маркетплейсов, которые в этой борьбе выигрывают по хостовым факторам всегда.

Результат: карточка либо не индексируется, либо индексируется и не ранжируется. При этом текста на ней может быть 3 000 знаков — просто он не ваш и не уникален для выдачи.

Что реально работает вместо переписывания описаний:

  • Заполненные характеристики. Не 4 поля, а 20–30. Табличные данные уникальны по составу и полезны для фильтрации и для сниппетов.
  • Свои фото и видео. Даже посредственное фото товара на складе ценнее студийного рендера от производителя, который есть у всех.
  • Отзывы и вопросы-ответы. Самый дешёвый источник уникального контента, который ещё и работает на конверсию. Про механику — в статье о влиянии отзывов на SEO.
  • Блок «чем отличается от аналогов» — 3–5 предложений от вашего товароведа. Это то, чего нет ни у производителя, ни у конкурентов.
  • Наличие, срок, цена, условия доставки в регион пользователя. Это коммерческая информация, и она напрямую влияет на ранжирование — см. коммерческие факторы ранжирования.

Практический приоритет: не пытайтесь оживить все 20 000 карточек. Возьмите 300–500 товаров, дающих 80% выручки и спроса, доведите их до ума, остальное закройте от индексации или оставьте в индексе как есть — они всё равно живут за счёт категории.

Источник №2: страницы фильтров

Самая массовая фабрика тонкого контента. Комбинаторика фильтров множит URL экспоненциально: 5 фильтров по 10 значений — это уже сотни тысяч возможных комбинаций. Из них спрос есть у десятков.

Правило, которого я придерживаюсь: страница фильтра открывается для индексации только тогда, когда под неё есть частотный запрос и хотя бы 5–7 товаров в выдаче фильтра. «Красные кроссовки Nike 42 размера» — есть спрос, открываем, пишем свой Title, свой H1, короткий текст. «Красные кроссовки Nike 42 размера с доставкой за 2 дня дешевле 8000» — спроса нет, закрываем.

Технически это делается так:

  1. Из семантического ядра вытаскиваете все запросы, соответствующие комбинациям фильтров, с частотностью выше порога (например, 30 по «!» в Wordstat).
  2. Для этих комбинаций создаёте статические SEO-URL вида /krossovki/nike/krasnye/ с уникальными метатегами по шаблону + ручной доработкой топ-100.
  3. Все остальные комбинации отдаются через GET-параметры и закрываются: Clean-param в robots.txt для Яндекса, canonical на родительскую категорию, meta noindex для особо мусорных.
  4. Фильтровые URL, не попавшие в белый список, не должны быть доступны роботу по ссылкам — иначе он их найдёт независимо от canonical.

Ошибка, которую вижу постоянно: открывают всё подряд «пусть Яндекс сам разберётся». Яндекс разбирается — помечает 90% как малополезные и заодно снижает частоту обхода всего сайта. Подробнее о том, как правильно проектировать разделы и фильтры, — в материале про структуру сайта для SEO.

Источник №3: теговые страницы, пустые категории и заглушки

Теги в блогах и каталогах плодятся сами: редактор добавил тег «новинки» к одной статье — родилась страница /tag/novinki/ с единственным анонсом. Через год таких страниц 800, и на 700 из них по 1–2 материала.

Что делать:

  • Тег живёт в индексе, если под ним минимум 5–8 материалов и есть поисковый спрос на формулировку тега.
  • Тег с одним материалом — либо удалить, либо не выводить как отдельную страницу (сделать его просто атрибутом фильтрации без URL).
  • Теговая страница, оставленная в индексе, должна иметь свой текст-введение на 500–1 500 знаков — не «сеотекст», а реальное объяснение, что здесь собрано и кому это нужно.
  • Регулярная ревизия: раз в квартал выгружаете теги с числом материалов и убиваете хвост.

Рядом с тегами живёт вторая разновидность пустоты — пустые категории и заглушки. Категория «Гидроциклы» есть в меню, потому что «мы планируем их продавать». Товаров ноль. Страница в индексе, у неё Title, H1 и надпись «Товары не найдены». Это идеальный кандидат в малополезные — и одновременно репутационный минус для пользователя, который пришёл по запросу и увидел пустоту.

То же самое с:

  • страницами «Раздел в разработке»;
  • служебными страницами вроде «Спасибо за заказ», корзины, сравнения, личного кабинета;
  • результатами внутреннего поиска (/search?q=...) — их вообще никогда не должно быть в индексе;
  • страницами пагинации с пустыми списками;
  • архивами по датам в CMS, которые никто не отключил.

Все они закрываются на уровне шаблона, а не вручную. И этот блок правил должен быть частью базовой внутренней оптимизации сайта, а не разовой чистки.

Источник №4: региональные копии

Отдельный жанр. Берётся посадочная «Натяжные потолки», размножается на 60 городов подстановкой топонима: «Натяжные потолки в Самаре», «...в Казани», «...в Уфе». Текст идентичен на 98%, отличается только город и телефон. Иногда даже телефон не отличается.

Для Яндекса это одновременно и дубли, и малополезный контент. Работает такая схема только в одном случае: если региональная страница действительно региональная — со своим адресом офиса/склада, своими ценами, своими сроками доставки, своими работами в этом городе, своим телефоном с местным кодом, своей привязкой в Яндекс Бизнесе.

Если ничего из этого нет — вы не продвигаетесь в регионах, вы генерируете мусор. Как делать это правильно, разбирается в статьях про мультирегиональное SEO и локальное SEO-продвижение. Короткий вывод оттуда: лучше 5 честных региональных поддоменов с реальным присутствием, чем 60 клонов на папках.

Источник №5: автогенерация и ИИ-тексты

Автогенерация никуда не делась, она просто сменила инструмент. Раньше страницы клепали шаблонизатором с подстановкой переменных, теперь — нейросетью. Результат для поисковика одинаковый: текст, который формально уникален по шинглам и абсолютно вторичен по содержанию.

Яндекс не борется с «текстами от ИИ» как таковыми — он борется с текстами без ценности. Сгенерированный текст, проверенный экспертом, дополненный вашими данными, цифрами и опытом, проблемой не является. Сгенерированный и залитый пачкой по 200 статей в неделю — является, и это ловится с высокой точностью, потому что у такого контента характерная статистика: одинаковая структура, одинаковая длина абзацев, нулевые поведенческие. Тему подробно разбираем в материале ИИ-тексты на сайте и Яндекс.

Проверочный вопрос перед публикацией любого текста: есть ли в нём хотя бы один факт, которого нет ни у кого из конкурентов? Своя цифра, свой кейс, свой замер, своя таблица, своё «мы попробовали и вот что вышло». Если нет — это тонкий контент, сколько бы знаков в нём ни было. Практические принципы — в статье о том, как писать SEO-тексты правильно.

Как поисковик определяет ценность страницы

Упрощая, работают четыре группы сигналов.

1. Текстовые и структурные. Соответствие запросу, полнота раскрытия темы относительно конкурентов, наличие сущностей, которые Яндекс ожидает увидеть на странице этого типа (цена, характеристики, условия — для коммерческой; определения, примеры, шаги — для информационной). Отсутствие ожидаемых сущностей — красный флаг.

2. Поведенческие. Главный детектор тонкости. Пользователь пришёл, за 8 секунд закрыл вкладку и вернулся в выдачу кликать следующий результат — это «шортклик», и он для страницы приговор. Обратная ситуация — «последний клик» по вашему сайту, после которого сессия поиска закончилась, — сильнейший сигнал полезности. Механика описана в разборе поведенческих факторов.

3. Хостовые. Общее качество домена, доля мусорных страниц, экспертность источника, коммерческие атрибуты. Тонкая страница на сильном хосте может ранжироваться; сильная страница на замусоренном хосте — нет.

4. Сравнительные. Алгоритм смотрит не на страницу в вакууме, а на её место в наборе кандидатов. Если 9 конкурентов дают калькулятор, таблицу и фото работ, а вы — три абзаца, вы тонкий по сравнению с ними.

Диагностика: как найти тонкие страницы на своём сайте

Рабочая последовательность, которая занимает 2–4 часа на среднем сайте.

  1. Свести три источника данных. Выгрузка всех URL из краулера (Screaming Frog, Netpeak Spider, Comparser), выгрузка «Страниц в поиске» из Вебмастера, выгрузка страниц входа с органическим трафиком за 6–12 месяцев из Яндекс.Метрики. Склеиваете по URL в одной таблице.
  2. Посчитать базовые метрики для каждого URL: объём текста в основном контенте (не считая меню и футер — краулер умеет считать по CSS-селектору), число внутренних входящих ссылок, статус в индексе, визиты из органики за период, отказы, время на странице.
  3. Выделить зомби-страницы: в индексе есть, органических визитов за 12 месяцев — 0. Это ваш основной пул подозреваемых. На типовом интернет-магазине их 40–70%.
  4. Проверить дубли по контенту. Краулеры считают хеши текста — ищите группы страниц с почти идентичным основным контентом. Сразу вылезут региональные копии и карточки-близнецы.
  5. Сегментировать по паттернам URL. Разложите зомби по маскам: /tag/, ?filter=, /page/, /gorod-. Почти всегда 90% мусора укладывается в 3–5 паттернов — и лечится не поштучно, а правилом.
  6. Проверить руками выборку. Возьмите по 10 страниц из каждого сегмента и откройте глазами. Половина «мусора» может оказаться нормальными страницами, которые просто не получают трафик по другой причине — например, у них нет входящих ссылок или они каннибализируют друг друга.

Отдельно проверьте каннибализацию: две-три ваши страницы конкурируют за один запрос, Яндекс не может выбрать, обе висят на 15–25 позициях. Формально они не тонкие, но лечатся так же — объединением. Это часть полноценного SEO-аудита сайта.

Что делать: пять решений и как выбрать между ними

Для каждой тонкой страницы есть ровно пять исходов. Выбор зависит от двух параметров: есть ли под страницу поисковый спрос и есть ли внешние ссылки / трафик из других источников.

1. Дополнить (Improve). Спрос есть, страница нужна, просто она плохая. Дорабатываете: расширяете фактуру, добавляете таблицы, фото, характеристики, отзывы, FAQ, микроразметку. Правило: доработка должна давать конкурентное преимущество, а не догонять конкурентов «до среднего». Средним быть недостаточно.

2. Объединить (Consolidate). Есть 5 полупустых статей про одно и то же — «как выбрать насос», «какой насос выбрать», «выбор насоса для дачи». Сливаете в один сильный материал, остальные — 301 на него. Суммарная ценность и ссылочный вес складываются. Это же лечение каннибализации.

3. Закрыть от индексации (Noindex). Страница нужна пользователю, но не нужна поиску: корзина, сравнение, фильтры вне белого списка, служебные разделы. Ставите meta name="robots" content="noindex, follow". Важно: закрытие в robots.txt не удаляет страницу из индекса Яндекса надёжно — робот просто перестаёт её видеть. Для гарантированного вывода нужен noindex в мета-теге или X-Robots-Tag, и страница должна быть доступна роботу, чтобы он этот тег прочитал.

4. Удалить с 410. Страница не нужна никому: тег с одним материалом, пустая категория без планов, старая акция 2019 года. Отдаёте 410 Gone, а не 404. Разница практическая: 410 — явный сигнал «удалено навсегда», робот выкидывает страницу из индекса быстрее и реже возвращается проверять. 404 он будет перепроверять месяцами. Обязательно уберите все внутренние ссылки на удалённое — иначе робот продолжит ходить.

5. Редирект 301. Страница удаляется, но у неё есть ссылочный вес, трафик из закладок или близкий по смыслу «наследник». Редиректите на максимально релевантную страницу — не на главную. Массовый редирект сотен страниц на главную Яндекс трактует как soft 404 и просто игнорирует передачу веса.

Схема выбора коротко: спрос есть + страница слабая → дополнить; спрос есть, но страниц несколько → объединить; спроса нет, но страница нужна людям → noindex; не нужна никому и веса нет → 410; не нужна, но вес есть → 301.

Как решать на масштабе: тысячи и десятки тысяч страниц

Если тонких страниц 8 000, ручной разбор невозможен — и не нужен. На масштабе работают правила, а не решения по каждому URL.

  1. Правила на уровне шаблона. Одно условие в коде — «если в категории 0 товаров, отдавать noindex; если товаров нет 90 дней — 410» — убирает тысячи страниц разом и не даёт им появиться снова.
  2. Белые списки вместо чёрных. Не «закрываем плохие фильтры», а «открываем только те, что в списке». Чёрный список всегда отстаёт от комбинаторики, белый — нет.
  3. Пороговая логика по данным. Заведите вычисляемый признак «страница индексируема», который зависит от числа товаров/материалов, заполненности характеристик и наличия спроса. Пусть CMS сама решает.
  4. Приоритизация по деньгам. Ручную доработку получают только страницы, попадающие в топ-20% по потенциальному трафику и марже. Всё остальное обрабатывается шаблонно.
  5. Волнами, а не залпом. Удалять 8 000 страниц за один день — стресс для сайта и повод для просадки. Разбейте на 4–6 недель, следите за динамикой обхода и позиций после каждой волны.
  6. Фиксируйте базовую линию. До начала чистки снимите: количество страниц в поиске, органический трафик по сегментам, позиции по ядру, частоту обхода. Без этого вы не поймёте, помогло или навредило.

Отдельно про ожидания: после массового удаления мусора количество страниц в индексе упадёт — иногда вдвое. Это нормально и это цель. Трафик при этом не падает (мусор его и не давал), а через 1–3 месяца растёт за счёт улучшения обхода и хостовой оценки. Собственнику этот график надо показать заранее, иначе первое же «у нас страниц стало меньше» превратится в панику. Похожая динамика описана в разборе, почему сайт выпал из индекса.

Типичные ошибки при борьбе с тонким контентом

  • Наливать воду вместо ценности. Дописать к пустой карточке 2 000 знаков «о преимуществах нашей компании» — значит превратить тонкую страницу в тонкую и раздражающую. Объём не лечит.
  • Закрывать всё подряд в robots.txt. Классика: закрыли /catalog/ вместе с фильтрами, потеряли весь каталог. Robots.txt — грубый инструмент, для управления индексацией используйте noindex и canonical.
  • Ставить canonical на нерелевантную страницу. Canonical — рекомендация, а не команда. Если контент отличается, Яндекс её проигнорирует, и вы получите обе страницы в индексе с непредсказуемым выбором.
  • Удалять страницы с внешними ссылками. Проверьте ссылочный профиль перед чисткой — иначе выкинете в 410 страницу, на которую пять лет ссылались отраслевые СМИ. Про учёт веса — в статье про ссылочный профиль.
  • Игнорировать внутреннюю перелинковку. Страница может быть неплохой, но не получать веса — на неё ведут 0 внутренних ссылок. Иногда «тонкость» лечится внутренней перелинковкой, а не текстом.
  • Ждать результата за неделю. Переиндексация массива страниц — это 3–8 недель. Никакой «Переобход» не ускорит 5 000 URL, лимит на переобход конечен.
  • Чистить контент и не трогать техничку. Если сайт медленный и с битой вёрсткой, доработанные тексты не спасут — см. технические ошибки сайта.

Профилактика: как не наплодить тонкий контент заново

Чистка без профилактики — это уборка в комнате, где продолжают сорить. Через год всё вернётся. Что должно быть зашито в процессы:

  1. Definition of Done для страницы. Страница выходит в индекс, только если: есть запрос с частотностью выше порога, заполнены обязательные поля (характеристики, цена, фото ≥3), написан уникальный Title и Description, есть основной контент от N знаков с фактурой. Не выполнено — страница создаётся, но с noindex.
  2. Запрет на автосоздание индексируемых URL. Любая новая сущность (тег, фильтр, регион) по умолчанию noindex. Открытие индексации — осознанное действие с обоснованием.
  3. Ежеквартальная ревизия зомби. Отчёт «в индексе, 0 визитов за 6 месяцев» — раз в квартал, автоматически. Разбор по сегментам, решение по каждому.
  4. Контроль после релизов. Каждый релиз CMS проверяется на предмет новых типов URL. Число страниц в индексе — метрика, которую надо мониторить как выручку.
  5. Контент-план на основе спроса, а не «надо публиковать». Публикация ради регулярности — прямая дорога к тонкому блогу. Логика планирования — в материале про контент-стратегию.
  6. Проверка метатегов на шаблонность. Тысяча одинаковых Description — тоже сигнал малополезности. Про правильные шаблоны — в статье про эффективные метатеги.

Мини-кейс из практики. Интернет-магазин отделочных материалов, 26 000 страниц в индексе, органика 4 800 визитов в месяц, стагнация полтора года. Разбор показал: 19 400 страниц — фильтровые комбинации, открытые «на всякий случай», 3 100 — карточки с описаниями производителя, 900 — теги с 1–2 товарами.

Что сделали за 3 месяца: белый список из 240 фильтровых посадочных под реальный спрос (остальные — Clean-param и canonical), 410 для тегов с хвоста, заполнение характеристик и своих фото у 600 карточек-локомотивов, региональные страницы сократили с 40 до 6 — по городам, где реально есть склад.

Результат к 5-му месяцу: страниц в индексе 2 900 (падение в 9 раз), органика 11 200 визитов в месяц (рост в 2,3 раза), частота обхода новых страниц — с 9 дней до 1–2 суток. Ни одного нового текста «для SEO» при этом не написали. Похожие сценарии есть в наших кейсах.

Вывод

Тонкий контент — это не про знаки, а про ответ на вопрос «зачем эта страница существует». Если ответа нет ни у вас, ни у пользователя — его нет и у поисковика. Лечится это не наращиванием текста, а честной ревизией: найти зомби-страницы, сегментировать по паттернам, для каждого сегмента выбрать одно из пяти решений — дополнить, объединить, закрыть, удалить с 410 или редиректить, — а затем зашить правила в шаблоны, чтобы мусор не появился заново.

Работа эта неблагодарная с виду: страниц становится меньше, «объём сайта» падает, а эффект приходит через месяц-два. Зато она даёт то, чего не даёт ни один текст на 15 000 знаков, — здоровый хост, который начинает ранжироваться целиком. Ошибка здесь стоит дорого: закрыли лишнее — потеряли трафик, удалили не то — потеряли ссылочный вес, и восстанавливаться придётся полгода. Поэтому чистку индекса на масштабе стоит делать руками тех, кто уже проходил этот путь. В SEO ПРОГРЕСС мы начинаем с аудита индекса и внутренней оптимизации, а дальше выстраиваем систему, при которой сайт не плодит мусор сам по себе — как в проектах по продвижению интернет-магазинов. Если в вашем Вебмастере сотни «малополезных» — напишите нам, разберём ваш случай и покажем, что именно и в каком порядке чинить.

Закажите SEO-продвижение в SEO ПРОГРЕСС

20 лет опыта, 250+ успешных кейсов. Бесплатный аудит и консультация.

Получить консультацию

Комментарии

Марина_К

«Малополезная страница» в Вебмастере — самый бесящий статус. Он ничего не объясняет, а страниц с ним 4000. Спасибо, что разложили, как его хотя бы читать.

Александр

Про описания от производителя. У нас 12к карточек с копипастой из прайса поставщика. Переписать нереально ни по деньгам, ни по срокам. Что делать честно?

Admin

Александр, переписывать все 12 тысяч не нужно и не окупится. Возьмите выгрузку по трафику и спросу: обычно 10-15% карточек дают почти весь коммерческий смысл — их пишите руками. Для остального работает добавление уникального обвеса вокруг описания: отзывы, вопросы-ответы, реальные фото, характеристики в сравнимом виде, наличие в магазинах. Страница перестаёт быть копией не только за счёт текста.

Виктор

Страницы фильтров — вечная война с маркетологами. Они хотят посадочную под каждое пересечение «красные кроссовки 42 размера скидка».

Роман

Новичок, простой вопрос: тонкий контент — это про количество символов или нет? Сколько знаков надо, чтобы страница считалась нормальной?

Admin

Роман, не про количество. Страница на 300 знаков, которая точно отвечает на запрос, — нормальная. Страница на 6000 знаков воды вокруг ключей — тонкая. Поисковик смотрит, решает ли страница задачу пользователя: есть ли на ней то, ради чего он пришёл, и не уходит ли он обратно в выдачу через 5 секунд. Знаки — плохой ориентир, забудьте про них.

dev_anton

История провала: закрыли 8к теговых страниц в robots.txt, ждали чуда. Через полгода они всё так же в поиске, а трафик просел, потому что часть из них, оказывается, приносила заявки. Читайте раздел про типичные ошибки внимательно.

Ольга П.

Региональные копии — прямо про нас. 60 городов, отличается только название в title и телефон. Вебмастер половину пометил малополезными.

Екатерина

Спасибо за раздел про масштаб. Обычно советы уровня «перепишите тексты», а когда страниц 30 тысяч, это просто не совет.

maks_88

А ИИ-тексты правда так однозначно плохо? Если генерить по хорошему промпту с реальными данными о товаре и потом вычитывать — это всё ещё автогенерация?

Admin

maks_88, проблема не в инструменте, а в том, добавляет ли текст информацию, которой не было. Сгенерённый по реальным характеристикам и вычитанный текст — нормальный контент. Сгенерённый пересказ того же самого другими словами — тонкий, независимо от того, человек его написал или модель. Тест простой: если после прочтения покупатель узнал что-то, чего нет в характеристиках, — работает.

Сергей

Пять решений и матрица выбора — забрал целиком. Особенно ценно, что склейка и удаление разведены, обычно всё валят в одну кучу.

Наталья

Пустые категории. У нас в каталоге 200 разделов, в 40 из них по одному товару или ноль. Никто не хотел их трогать, «вдруг завезём».

Артём

Как искать тонкие страницы массово? Screaming Frog по word count даёт кучу ложных срабатываний, потому что считает и меню, и футер.

Admin

Артём, в Screaming Frog есть Content Area — в настройках укажите, какие блоки исключить из подсчёта (footer, nav, header по классам), и word count станет осмысленным. Но надёжнее считать не слова, а пересечение двух списков: страницы без трафика за полгода из Метрики и страницы с высокой долей повторяющегося текста через Near Duplicates. На пересечении и лежат настоящие кандидаты.

Юлия

Спасибо. Единственное — хотелось бы примеров, как выглядит карточка «до» и «после» на реальном товаре.

Дмитрий

Не соглашусь, что фильтры — источник тонкого контента по умолчанию. У нас как раз фильтровые посадочные дают 30% трафика. Вопрос в том, есть ли под них спрос, а не в самом факте фильтра.

Павел

Профилактика — самый недооценённый раздел. Все борются с тонким контентом раз в два года героическими усилиями, вместо того чтобы просто не давать контент-менеджеру публиковать пустую карточку.

Анна

Вопрос про удаление: если страницу удалять, то 404 или 410? И что делать со ссылками на неё изнутри сайта?

Admin

Анна, разница между 404 и 410 на практике минимальна — 410 чуть быстрее выкидывает страницу из индекса, но оба работают. Гораздо важнее второе: внутренние ссылки надо убрать обязательно, иначе робот будет ходить по ним годами и тратить бюджет на заведомые ошибки. И проверьте, что удаляемые URL исчезли из sitemap.xml — это второй источник вечных 404 в логах.

Оставить комментарий

Спасибо! Ваш комментарий отправлен на модерацию и появится после проверки.