SEO для агрегатора и каталога: как расти на чужом контенте

Откройте выдачу Яндекса почти по любому коммерческому запросу с географией или параметром — «снять квартиру в Казани на длительный срок», «купить бу камаз», «мастер по ремонту стиральных машин Новосибирск» — и в топ-10 вы увидите не сайты исполнителей, а агрегаторы. Циан, Авито, Дром, Профи, Zoon, Яндекс.Услуги. Они выигрывают не потому, что у них лучше тексты, а потому, что их бизнес-модель совпадает с задачей поисковика: дать пользователю максимум вариантов в одном месте. Если вы строите агрегатор или большой каталог, у вас на руках сильная карта — но разыграть её можно только через архитектуру, дисциплину в индексации и работу с масштабом. В этой статье разберу механику: почему агрегаторы забирают топ, как проектировать дерево категорий и фильтров, какие комбинации открывать в индекс, что делать с тонкими и пустыми страницами и как не убить проект краулинговым бюджетом.
Почему Яндекс любит агрегаторы: разбор по факторам
Есть распространённая обида: «мы производитель, у нас реальный товар, а в топе перекупщики-агрегаторы». Обида понятная, но она о справедливости, а не о том, как работает ранжирование. Яндекс не оценивает моральное право сайта на топ — он оценивает, насколько страница закрывает интент. И вот в чём агрегатор объективно сильнее одиночного сайта.
Широта ответа. Запрос «купить кондиционер» — это не запрос на конкретную модель. Это запрос на выбор. Пользователь хочет увидеть диапазон цен, бренды, характеристики, сравнить. Страница агрегатора с 400 предложениями от 30 продавцов закрывает интент полнее, чем карточка одного магазина с 12 моделями. Это не хитрость, это реальная польза, и поведенческие метрики её подтверждают.
Поведенческие факторы. На агрегаторе пользователь совершает много действий: фильтрует, сортирует, открывает карточки, возвращается к списку, добавляет в избранное. Глубина сессии в 5–8 страниц против 1,5 на обычном сайте. Показатель «последний клик» — когда пользователь после посещения сайта не возвращается в выдачу — у агрегаторов исторически высокий, потому что человек находит нужное внутри и не идёт искать дальше. Именно поэтому важно понимать как поведенческие факторы влияют на ранжирование и проектировать интерфейс листинга под них, а не под красоту.
Коммерческие факторы. Цены, наличие, фото, контакты продавцов, отзывы, условия доставки, возможность связаться прямо со страницы — у агрегатора всего этого объективно больше просто по природе модели. Разнообразие ассортимента — прямой коммерческий фактор, и агрегатор берёт его без усилий.
Свежесть и частота обновления. Листинг агрегатора меняется ежедневно: появляются новые объявления, уходят старые, меняются цены. Робот видит живой документ и наращивает частоту обхода. Статичная страница категории интернет-магазина, которая не менялась полгода, такого сигнала не даёт.
Масштаб семантики. Агрегатор физически может закрыть десятки тысяч низкочастотных запросов страницами фильтров, куда одиночный сайт просто не дотягивается по ассортименту. Это накопительный эффект: тысяча страниц по 3–5 визитов в день — это уже 3–5 тысяч визитов.
Важный вывод для стратегии: ваши сильные стороны — это не тексты. Ваши сильные стороны — данные, покрытие и интерфейс. На них и надо ставить.
Архитектура: дерево категорий проектируется от спроса, а не от базы данных
Главная ошибка разработчиков агрегаторов — построить структуру сайта как отражение схемы базы данных. Есть таблица «объекты», у неё есть поля — вот вам категории по полям. Так делать нельзя. Структура должна отражать то, как люди ищут, а не то, как вы храните.
Рабочая последовательность:
- Собрать спрос до того, как рисовать структуру. Выгрузка из Вордстата по всей тематике, парсинг подсказок, сбор структуры конкурентов-агрегаторов (у них уже проверенная деньгами архитектура), выгрузка поисковых запросов из внутреннего поиска, если проект работает. Это классическая работа с семантическим ядром сайта, только объём в 10–50 раз больше обычного.
- Кластеризовать по выдаче, а не по словам. На агрегаторах особенно важно: «снять квартиру» и «аренда квартир» — один кластер, а «снять квартиру посуточно» — другой, потому что выдача разная. Кластеризация по топ-10 с порогом пересечения 3–4 URL даёт честную картину того, что Яндекс считает разными сущностями.
- Разложить кластеры по уровням. Уровень 1 — раздел (недвижимость). Уровень 2 — тип (квартиры / дома / коммерческая). Уровень 3 — операция (купить / снять). Уровень 4 — гео (город, район, метро). Уровень 5 — параметр (комнатность, цена, площадь).
- Определить, что живёт как категория, а что как фильтр. Категория — это то, что имеет собственный жирный кластер спроса и стабильно присутствует в структуре конкурентов. Фильтр — уточнение внутри категории.
Ключевая мысль: у агрегатора нет границы между «категорией» и «фильтром» на уровне пользователя — она есть только на уровне SEO. Технически «двухкомнатные квартиры в Химках» — это применение двух фильтров. Но для поиска это должна быть полноценная посадочная с ЧПУ, своим Title, своим H1 и своим текстом. Общие принципы разбираю в материале про структуру сайта для SEO, но для агрегаторов там появляется отдельный слой сложности — комбинаторика.
Комбинаторный взрыв: почему нельзя открыть все фильтры
Посчитайте на пальцах. Допустим, у вас 8 фильтров: тип объекта (5 значений), комнатность (6), район (25), цена — диапазоны (8), площадь (6), этаж (4), ремонт (4), срок (2). Полный перебор комбинаций — 5 × 6 × 25 × 8 × 6 × 4 × 4 × 2 = 1 152 000 страниц. И это без сортировок и пагинации. С ними — миллионы.
Что произойдёт, если открыть всё:
- Робот утонет. Обход миллиона URL при типичной скорости 5–20 страниц в секунду — это недели на один полный проход. Новые нужные страницы будут ждать индексации месяцами.
- 90% этих страниц будут пустыми или содержать 1–3 объявления. Это тонкий контент в чистом виде.
- Начнутся массовые дубли: «квартиры от 3 до 5 млн» и «квартиры от 3.1 до 5 млн» — разные URL, один и тот же список.
- Сервер ляжет или начнёт тормозить под нагрузкой краулера, что ударит по реальным пользователям.
- Яндекс с высокой вероятностью применит санкции за малополезный контент — и накроет не отдельные страницы, а раздел или весь домен. Про механику таких историй писал в разборе поисковых фильтров Яндекса.
Поэтому единственная рабочая стратегия — whitelist: по умолчанию закрыто всё, открывается только то, что прошло отбор. Не наоборот. Blacklist на агрегаторе не работает никогда: вы физически не перечислите все плохие комбинации.
Методика отбора: какие фильтры открывать в индекс
Вот критерии, по которым я принимаю решение по каждой потенциальной посадочной. Комбинация открывается, только если выполняются все условия.
- Есть частотный спрос. Точная частотность («!запрос» в кавычках) — минимум 5–10 в месяц по региону. Ниже — не окупает вес страницы в индексе. Для крупных тематик планку можно поднять до 20–30.
- Есть достаточное наполнение. Порог зависит от ниши, но ориентир — не менее 10–15 живых предложений на странице. Если меньше — страница не закрывает интент «выбрать».
- Наполнение стабильно. Проверяем не на текущий момент, а по истории: держалось ли количество выше порога последние 60–90 дней. Иначе получите качели «страница есть — страница пустая».
- Глубина не более 2–3 фильтров. Комбинации из 4+ параметров почти никогда не имеют внятного спроса. Исключение — гео, оно часто «бесплатный» уровень.
- Комбинация имеет естественную формулировку. «Двухкомнатные квартиры в Строгино» — люди так говорят. «Квартиры с ремонтом на 5-9 этаже площадью 50-60 м» — так не говорит никто.
- Порядок параметров зафиксирован. /kvartiry/2-komnatnye/strogino/ и /kvartiry/strogino/2-komnatnye/ не должны существовать одновременно. Один канонический порядок, остальное — 301.
Практический результат такого отбора: из потенциального миллиона комбинаций в индекс уходит 3–15 тысяч. Это и есть здоровая пропорция. Если после отбора у вас осталось 200 тысяч страниц — вы отбирали плохо.
Что закрывается всегда, без обсуждения:
- сортировки (?sort=price_asc) — canonical на базовую страницу;
- переключатели вида (список / плитка / карта);
- произвольные ползунки цены и площади — открываем только заранее заданные «человеческие» диапазоны («до 3 млн», «до 5 млн»);
- любые UTM и служебные параметры;
- результаты внутреннего поиска (/search?q=...) — это классический генератор мусора;
- комбинации из 4+ фильтров;
- страницы «избранное», «сравнение», личный кабинет.
Техника реализации: как физически закрывать и открывать
Тут много путаницы, поэтому разложу по инструментам.
Открытые посадочные — статический ЧПУ-адрес, без GET-параметров: /kvartiry/2-komnatnye/strogino/. Уникальные Title, Description, H1, вхождение в sitemap.xml, ссылки из перелинковки. Полноценная страница.
Закрытые комбинации — GET-параметры (?rooms=2&floor=5) плюс:
- директива
Clean-paramв robots.txt — это специфичная фишка Яндекса, и она работает лучше, чем Disallow: робот понимает, что параметр не меняет содержимое, и склеивает URL, не тратя обход; rel="canonical"на базовую страницу категории;<meta name="robots" content="noindex, follow">— follow обязательно, чтобы вес не запирался.
Важный момент: Disallow в robots.txt не удаляет страницу из индекса, он запрещает обход. Если на закрытую страницу ведут ссылки, она может попасть в индекс как «страница закрыта в robots.txt». Логика такая: если страница уже в индексе и её надо убрать — сначала noindex, дождаться выпадения, потом при желании Disallow. Если страница ещё не индексировалась — сразу Disallow, чтобы не тратить обход.
Пагинация. Не ставьте canonical со второй страницы на первую — это ошибка, из-за которой карточки с глубоких страниц выпадают из обхода. Правильно: каждая страница пагинации self-canonical, уникальный Title с указанием страницы («Квартиры в Строгино — страница 3»), noindex не ставим (или ставим noindex,follow начиная с 4-5 страницы, если листинг гигантский). Главное — чтобы робот дошёл до всех карточек. Смежные технические вопросы подробно разбирал в материале про технические ошибки сайта.
Дубли и тонкий контент на масштабе
На обычном сайте дубли — это неприятность. На агрегаторе — это системный риск, потому что дубли генерируются автоматически и тысячами.
Типовые источники дублей на агрегаторе:
- Пересекающиеся выборки. «Квартиры до 4 млн» и «квартиры от 3 до 4 млн» показывают почти одинаковые списки. Решение — не открывать перекрывающиеся диапазоны, использовать только непересекающуюся сетку.
- Гео-матрёшка. «Квартиры в Митино» и «квартиры у метро Митино» — если объекты те же, оставляем одну страницу.
- Синонимы в URL. /2-komnatnye/ и /dvuhkomnatnye/ — выберите одно, второе 301-редиректом.
- Слеш / без слеша, upper/lower case, index.php. Банально, но на самописных агрегаторах встречается постоянно. Приводим к одному виду 301-редиректом на уровне сервера.
- Одно объявление в нескольких категориях. Карточка доступна по /kvartiry/id-123 и /novostroyki/id-123. Решение — одна каноническая карточка, вход из любой категории на неё.
- Шаблонные тексты. Самый частый дубль на агрегаторах — сгенерированный по маске текст, где меняется только город. 300 страниц с текстом «Купить {товар} в {город} по выгодной цене» — это 300 дублей, а не 300 посадочных.
Про тонкий контент. Страница агрегатора тонкая не тогда, когда на ней мало текста, а тогда, когда на ней мало ценности. Страница с 40 объявлениями, ценами, фото и фильтрами — не тонкая, даже если текста на ней 0 знаков. Страница с 2 объявлениями и SEO-простынёй на 3000 знаков — тонкая. Яндекс это различает: он смотрит на объём полезных данных и на поведение, а не на счётчик символов.
Отсюда практический вывод, который многих удивляет: на агрегаторе не нужно писать много текста в листинги. Нужно наполнять листинги предложениями. Если не хватает предложений — надо решать проблему с базой, а не компенсировать текстом. Текст не спасёт пустую страницу, он только сделает её пустой и с текстом.
Уникальная ценность: чем страница агрегатора отличается от таблицы с данными
Вот главный вопрос стратегии: если ваши объявления — это чужие объявления, которые есть ещё у пяти агрегаторов, то что уникального на вашей странице? Ответ — надстройка над данными. Данные общие, а вот что вы с ними делаете — ваше.
Что реально добавляет ценность и хорошо работает в Яндексе:
- Агрегированная статистика. Средняя цена по выборке, медиана, динамика за 3/6/12 месяцев, количество предложений, распределение по параметрам. «Средняя цена двухкомнатной квартиры в Строгино — 14,2 млн, за год +6,3%, сейчас 87 предложений». Такого нет ни у кого, кроме вас, потому что это ваш срез вашей базы. Это же отличный контент для попадания в нулевую выдачу и расширенные сниппеты.
- Умные сортировки и метрики. «Выгодные предложения» (цена ниже медианы по выборке), «недавно подешевело», «долго висит». Это не просто UI — это причина, по которой пользователь выберет вас, а не соседа.
- Отзывы и рейтинги. На объекты, продавцов, исполнителей. Даже несколько сотен реальных отзывов радикально меняют картину — и в поведении, и в коммерческих факторах. Механику разбирал в статье про влияние отзывов на SEO.
- UGC. Вопросы-ответы, обсуждения, оценки. Дёшево в производстве, работает на свежесть и глубину.
- Карта и гео-контекст. Инфраструктура рядом, время до центра, транспортная доступность.
- Сравнение. Возможность выбрать 3–4 позиции и посмотреть параметры рядом.
- Микроразметка. ItemList для листинга, Product/Offer с AggregateOffer (lowPrice, highPrice, offerCount), AggregateRating, BreadcrumbList. Для агрегаторов микроразметка критична: она позволяет вытащить диапазон цен и количество предложений прямо в сниппет, а это плюс к CTR.
Заметьте: ни один пункт не про «написать уникальный текст». Уникальность агрегатора — в данных и в их обработке.
Контент вокруг листингов — но не внутри них
Текст на агрегаторе нужен, но не в том месте и не в том виде, как обычно делают. Правила такие.
В листинге — коротко и по делу. 300–600 знаков после списка, а не перед ним. Никогда не отодвигайте предложения текстом вниз: первый экран должен быть занят товаром, а не SEO-простынёй. Текст должен отвечать на конкретный вопрос по этой выборке: сколько сейчас предложений, какой ценовой диапазон, на что смотреть при выборе именно этой категории. Если текст можно скопировать в соседнюю категорию, заменив два слова, — он не нужен вообще.
Вокруг листинга — полноценный контент отдельными сущностями:
- гайды («как проверить квартиру перед покупкой», «на что смотреть при аренде спецтехники»);
- аналитические обзоры на базе своих же данных — самый сильный формат для агрегатора, потому что вы единственный источник;
- справочник по параметрам (что означают характеристики, как выбирать);
- блог с ответами на информационные запросы, которые ведут в коммерческие листинги.
Информационный слой решает две задачи: забирает верхнюю часть воронки и даёт естественные точки для внутренней перелинковки в нужные посадочные. Как выстраивать такой контур системно — в материале про контент-стратегию для SEO.
Краулинговый бюджет: главное техническое ограничение агрегатора
На сайте в 200 страниц про краулинговый бюджет можно не думать. На агрегаторе это ограничивающий фактор номер один. Робот выделяет вам конечный ресурс обхода, и он зависит от скорости ответа сервера, качества уже проиндексированных страниц и авторитетности домена.
Как перестать сливать бюджет:
- Сократить множество URL. Всё, что выше про whitelist, — это в первую очередь про краулинговый бюджет. Меньше мусорных URL — больше обхода нужных.
- Ускорить сервер. Время ответа (TTFB) прямо конвертируется в количество обойденных страниц: при 200 мс робот успевает в 5 раз больше, чем при 1 секунде. Для агрегатора это не про удобство, это про объём индекса. Отсюда — кеширование листингов, индексы в БД под все фильтруемые поля, вынос поиска в Elasticsearch/Sphinx, CDN на статику. Тема шире раскрыта в разборе влияния скорости загрузки на SEO.
- Правильно отдавать заголовки. Last-Modified и ETag с корректной обработкой If-Modified-Since: робот получает 304 и не качает неизменившуюся страницу заново. На масштабе это экономит десятки процентов бюджета.
- Sitemap как приоритизация. Разбейте на файлы: sitemap-categories.xml, sitemap-landings.xml, sitemap-items-2026-07.xml. Индексный файл сверху. lastmod — честный, не «сегодня для всех», иначе теряете доверие робота. В карту кладём только каноничные, открытые, отвечающие 200 URL.
- Смотреть логи сервера. Это единственный способ узнать, что робот делает на самом деле. Регулярно выгружайте обращения YandexBot и считайте: какая доля обхода уходит на карточки, какая на листинги, какая на мусор (сортировки, параметры, 404). Типичная картина на непричёсанном агрегаторе — 60–70% обхода уходит в никуда.
- Чистить мёртвые URL. Удалённые объявления — не 404 бесконечно. 410 Gone для окончательно удалённых, 301 на релевантную категорию для устаревших, если есть куда.
Пустые выдачи: что делать со страницами без предложений
Это боль любого агрегатора. Вчера на странице «аренда экскаваторов в Твери» было 14 предложений, сегодня 0. Страница в индексе, трафик идёт, пользователь приходит и видит «ничего не найдено». Это худший из возможных исходов: человек мгновенно возвращается в выдачу, а Яндекс фиксирует неудовлетворённый интент.
Рабочая логика по порогам:
- 0 предложений. Никогда не отдавайте голое «ничего не найдено» с кодом 200. Варианты: (а) отдать расширенную выборку — «в Твери нет, но есть в радиусе 100 км: 23 предложения» с честной пометкой; (б) 301 на родительскую категорию, если пустота постоянная; (в) 404/410, если категория умерла окончательно. Худший вариант — оставить как есть.
- 1–5 предложений. Страница живёт, но снимаем с неё noindex-запрет только если предложения есть стабильно. Обязательно добавляем блок «похожие» и «расширить поиск» — чтобы у пользователя был следующий шаг, а не тупик.
- Сезонная пустота. Не удаляйте страницу, если предложения вернутся через 3 месяца — вы потеряете накопленные позиции и будете начинать заново. Держите страницу, показывайте прошлогодние данные, среднюю цену за сезон, форму подписки «сообщить о появлении». Логику сезонных колебаний разбирал в статье про сезонный трафик в SEO.
Ключевой принцип: пустая страница должна давать выход, а не тупик. Любой альтернативный контент лучше, чем пустой экран.
И системная мера — мониторинг наполнения. Ежедневный скрипт, который проверяет все открытые посадочные и алертит, если количество предложений упало ниже порога. На агрегаторе с 5 тысячами посадочных вручную это не отследить никогда.
Модерация чужого контента и ответственность
Тема, которую SEO-специалисты обычно игнорируют, а потом внезапно ловят фильтр. Если на вашей площадке публикуются чужие объявления, вы отвечаете за их качество перед поиском — и всё чаще перед законом.
Что нужно контролировать:
- Спам и накрутка со стороны продавцов. Одно и то же объявление, размноженное по 15 категориям с разными заголовками. Классика Авито. Если не чистить, вы получаете тысячи дублей, которые сгенерировали не вы, но отвечать за них будете.
- Скопированные описания. Продавцы копируют тексты друг у друга и с сайтов производителей. Дедупликация по шинглам на входе — минимальная гигиена.
- Фейки и мошенничество. Убивают репутацию и поведенческие. Отзывы «меня обманули на вашем сайте» в интернете — прямой удар по E-A-T факторам и по конверсии. Работа с репутацией для агрегатора — не опция, а часть SEO.
- Юридические требования. Возрастные ограничения, запрещённые к обороту категории, маркировка рекламы, обработка персональных данных. За реализацией — к юристам, но SEO-специалист должен понимать: удаление раздела по требованию регулятора — это ещё и минус трафик, и надо заранее знать, какой.
- Актуальность. Объявление, которое висит год и давно неактуально, — это ложь пользователю. Автоархивация неподтверждённых объявлений через 30–60 дней — стандартная практика, которая улучшает и данные, и поведение.
Хорошая модерация — это не издержка, это SEO-фактор. Чистая база = релевантные страницы = хорошее поведение = позиции.
Коммерческие факторы для агрегатора: чек-лист
У агрегатора коммерческие факторы ранжирования считаются иначе, чем у магазина. Вот что должно быть на месте:
- цена у каждого предложения, без «уточняйте» и «договорная» массово;
- фото у большинства позиций — карточки без фото режут CTR в листинге и портят поведение;
- ассортимент: количество предложений на странице — прямой фактор, чем шире выбор, тем лучше;
- контакты продавца / кнопка связи прямо из листинга, без лишних шагов;
- фильтры и сортировки, которые реально работают и не перезагружают страницу по 4 секунды;
- отзывы и рейтинги продавцов;
- прозрачные правила площадки, условия размещения, разделы «о проекте», «гарантии», «как это работает»;
- реальные реквизиты юрлица — для агрегатора, который посредничает между людьми и деньгами, это критично;
- работающий поиск по сайту (и логи этого поиска — бесплатный источник семантики);
- мобильная версия, в которой можно реально пользоваться фильтрами. Проверьте: на агрегаторах доля мобильного трафика обычно 65–80%, и мобильная оптимизация тут не «желательно», а базовое условие.
Типичные ошибки, которые убивают агрегаторы
- Открыть все фильтры «на всякий случай». Самая дорогая ошибка. Приводит к миллионам мусорных URL, съеденному краулинговому бюджету и фильтру за малополезный контент. Лечится месяцами.
- Компенсировать тонкие страницы текстом. Не работает. Пустая страница с текстом остаётся пустой.
- Генерировать посадочные без проверки спроса. «Давайте сделаем страницы под все районы всех городов» — и вот у вас 40 тысяч страниц, из которых трафик получают 600.
- Не считать наполнение перед открытием. Страница открылась в индекс с 3 объявлениями, попала в топ на неделю, отдала ужасное поведение и вылетела. Плюс потянула вниз оценку раздела.
- Медленный сервер. Агрегатор с TTFB в 1,5 секунды не проиндексируется целиком никогда. Про метрики и пороги — в материале о скорости сайта и Core Web Vitals.
- Canonical со страниц пагинации на первую. Робот не доходит до карточек с глубоких страниц, половина базы вне индекса.
- Фильтры на JS без ЧПУ. Красивый SPA-листинг, где применение фильтра не меняет URL, — это агрегатор без посадочных. Весь низкочастотный спрос проходит мимо.
- Отсутствие мониторинга. На масштабе в тысячи страниц вы узнаёте о проблеме через месяц по падению трафика вместо того, чтобы узнать в день возникновения. Настройте сегменты в Яндекс.Метрике по типам страниц — листинги, карточки, посадочные фильтров — и следите за каждым отдельно.
- Игнорировать логи. Без анализа обхода вы управляете вслепую.
- Пытаться конкурировать текстами. Агрегатор выигрывает данными и интерфейсом. Ставка на копирайтинг — это ставка не на ту лошадь.
Порядок работ: с чего начинать
Если вы берёте агрегатор в работу с нуля или разгребаете существующий, последовательность такая:
- Аудит текущего состояния. Сколько URL всего, сколько в индексе, сколько получают трафик. Разрыв между «в индексе» и «получают трафик» — это ваш мусор. Методику разбирал в полном гайде по SEO-аудиту.
- Анализ логов. Куда реально ходит робот. Отсюда — приоритеты по зачистке.
- Сбор и кластеризация семантики. Полный охват тематики, не «топ-100 запросов».
- Проектирование дерева и whitelist фильтров. Матрица «комбинация × частотность × наполнение × решение». Это документ, а не устная договорённость.
- Зачистка. Закрытие всего, что не в whitelist. Обычно даёт первый эффект через 6–10 недель — просто потому, что робот перестаёт тратиться на мусор.
- Открытие посадочных волнами. Не 5000 сразу, а по 300–500 в неделю, с контролем индексации и поведения. Если волна зашла плохо — вы это увидите на 500 страницах, а не на 5000.
- Наращивание ценности. Статистика, отзывы, UGC, разметка, аналитический контент.
- Мониторинг и итерации. Автопроверка наполнения, алерты, ежемесячный пересмотр whitelist по свежей частотности.
Это не проект на месяц. Агрегатор — это система, и SEO в нём — постоянный процесс, а не разовая настройка.
Вывод
Агрегатор — это самая сильная модель в органическом поиске, но и самая требовательная к дисциплине. Ваше преимущество — широта ответа, живые данные и поведение, которое из них следует. Ваш главный риск — масштаб: та же комбинаторика, которая даёт тысячи посадочных, за неделю генерирует миллион мусорных URL и топит проект. Разница между агрегатором в топе и агрегатором под фильтром — не в бюджете и не в текстах, а в том, есть ли жёсткая методика отбора страниц в индекс, мониторинг наполнения и контроль краулингового бюджета.
Собрать эту систему на коленке не получается: нужны семантика на десятки тысяч запросов, работа с логами, техническая связка с разработкой и постоянный контроль сотен показателей. Мы в SEO ПРОГРЕСС ведём такие проекты и знаем, где именно они ломаются — посмотрите наши кейсы, там есть примеры работы с крупными каталогами и товарными базами. Если у вас агрегатор, большой каталог или интернет-магазин с тысячами SKU, начните с двух шагов: закажите аудит внутренней оптимизации — он покажет реальный масштаб мусора в индексе — или сразу обсудите стратегию продвижения каталога с нами. Напишите нам через форму на странице контактов: посмотрим ваш проект, посчитаем потенциал и скажем честно, что даст рост в первую очередь.
Закажите SEO-продвижение в SEO ПРОГРЕСС
20 лет опыта, 250+ успешных кейсов. Бесплатный аудит и консультация.
Получить консультациюКомментарии
Иван_SEO
Комбинаторный взрыв — главная ловушка. У нас 8 фильтров, открыли все комбинации, получили 2 миллиона URL на сайте с 40 тысячами объявлений. Робот утонул, индекс встал.
Дмитрий
Как определить, какой фильтр открывать в индекс? Спрос есть почти на всё, если копать WordStat достаточно глубоко.
Admin
Дмитрий, спрос — необходимое, но недостаточное условие. Рабочий фильтр отбора из трёх условий: есть частотность (хотя бы 30-50 в месяц по WordStat), на странице стабильно не меньше 10-15 предложений, и страница отвечает на запрос целиком, а не является пересечением ради пересечения. Если хотя бы одно не выполняется — фильтр в noindex. Практика: из тысячи потенциальных комбинаций в индекс уходит 5-8%, и это нормальная пропорция.
Марина_К
Пустые выдачи! У нас на страницах фильтров сплошное «ничего не найдено», потому что база живая и предложения кончаются. Поведенческие убиты полностью.
Александр
«Архитектура проектируется от спроса, а не от базы данных» — надо повесить над столом каждого разработчика. У нас дерево категорий один в один повторяет справочник в админке. Никто так не ищет.
Виктор
Спорный тезис про «Яндекс любит агрегаторы». Мне кажется, он любит крупные агрегаторы с брендом, а маленький нишевый каталог всё так же никому не нужен.
Екатерина
Краулинговый бюджет реально главное ограничение. Посмотрели в Вебмастере статистику обхода — робот 70% времени ходил по мусорным сортировкам и пагинации, а новые карточки не индексировал неделями.
Роман
Вопрос по технике: canonical или noindex для закрытия фильтров? Читал противоположные мнения.
Admin
Роман, это разные инструменты под разные задачи, а не альтернативы. Canonical — для страниц, которые дублируют содержимое другой (сортировки, utm, представления). Noindex, follow — для страниц с уникальной, но не нужной в поиске выборкой (редкие пересечения фильтров), чтобы робот шёл дальше по ссылкам, но не индексировал. А параметры, которые вообще не должны обходиться, лучше закрывать в robots.txt — canonical их обход не экономит.
Ольга П.
Модерация чужого контента — недооценённый риск. У нас пользователи заливали описания с копипастой, весь сайт превратился в дубли чужих текстов. Пришлось вводить премодерацию.
maks_88
Контент вокруг листингов, но не внутри — спасибо. Мы напихали SEO-текст на 3000 знаков прямо над карточками. Конверсия упала на 20%, позиции не выросли.
Наталья
«Чем страница агрегатора отличается от таблицы с данными» — вот это ключевой раздел. Мы годами думали, что наша ценность в объёме базы. А она в том, как мы её режем и сравниваем.
Артём
Тонкий контент на масштабе — как вообще с этим бороться, если у тебя 200 тысяч страниц и нет редакции?
Admin
Артём, редакция на 200 тысяч страниц не нужна и невозможна — задача решается не текстом, а данными. Уникальность страницы агрегатора создают сами предложения, агрегаты по выборке (диапазон цен, количество, статистика, топ по параметру) и блоки перелинковки — всё это генерится из базы. Текстом вручную закрывают только верхние 200-300 страниц, которые дают основной трафик, остальное живёт на структуре.
Павел
Коммерческие факторы для агрегатора — а они вообще применимы? У нас нет корзины, нет цены, мы просто сводим людей.
Admin
Павел, применимы, просто читаются иначе. Для агрегатора коммерческие факторы — это полнота базы, актуальность (дата обновления предложения, отсутствие мёртвых карточек), прозрачность условий, контакты и реквизиты, правила работы площадки, отзывы. Яндекс оценивает не наличие корзины, а способность страницы завершить задачу пользователя — у вас она завершается контактом с исполнителем, вот этот путь и должен быть очевидным и коротким.
Юлия
У нас каталог мастеров, база маленькая — 800 карточек. По вашей методике почти нечего открывать в индекс, везде меньше 10 предложений. Что делать с такой ситуацией?
Admin
Юлия, при 800 карточках вы не агрегатор в поисковом смысле — вам нечем выигрывать полноту, и стратегия должна быть другой. Открывайте только верхний уровень (категория и категория+город), а вглубь по фильтрам не ходите вообще: тонкие страницы принесут больше вреда, чем трафика. Сила маленького каталога — в качестве карточки и информационном контенте вокруг ниши, а не в комбинаторике фильтров.
Сергей
Порядок работ в конце очень пригодился. Обычно все начинают с фильтров, а вы ставите дерево категорий первым — и это логично, иначе фильтруешь неправильную структуру.
Анна
Прочитала список типичных ошибок и поняла, почему наш агрегатор три года стоит на месте. Мы сделали шесть из восьми.
Оставить комментарий