Почему каталог разрастается незаметно
Одна категория с четырьмя фильтрами уже даёт множество сочетаний. Если каждый выбор добавляет параметр к URL, робот видит новые адреса: цвет, размер, бренд, сортировка, цена, наличие, несколько фильтров сразу. Для пользователя это нормальная навигация. Для поиска часть таких страниц не содержит самостоятельного ответа и конкурирует с основной категорией.
Google прямо отмечает риск бесконечного пространства URL: робот сначала должен запросить новые комбинации, чтобы понять, полезны ли они. Из-за этого сервер получает лишнюю нагрузку, а новые важные страницы могут обнаруживаться медленнее. Поэтому управлять нужно не только метатегами, но и самим способом создания и связывания адресов.
Сначала разделите URL по роли, а не по «индексировать / не индексировать»
До настройки robots, canonical или шаблона полезно собрать реестр паттернов. В нём фиксируют, что именно меняет страница, кто ею пользуется, есть ли у неё независимый спрос и как она связана с каталогом. Только после этого выбирают техническое правило.
| Тип страницы | Роль для посетителя | Что проверить до решения |
|---|---|---|
| Основная категория | Общий вход в ассортимент. | Один понятный URL, доступные внутренние ссылки, ассортимент и содержание страницы. |
| Согласованная подкатегория | Отдельный товарный спрос или тип задачи. | Независимая ценность, наличие товаров, текст и связь с родительской категорией. |
| Один полезный фильтр | Узкий, но понятный выбор: например, товар определённого бренда в категории. | Стабильный набор товаров, спрос, единый формат URL и отсутствие конкуренции с существующей страницей. |
| Комбинация фильтров, сортировка, служебный параметр | Удобство конкретного сеанса пользователя. | Нужна ли такая комбинация за пределами текущего выбора; порождает ли она варианты, дубли и пустые результаты. |
Важен именно реестр: одинаковый параметр в двух CMS может вести себя по-разному. Например, «бренд» иногда заслуживает отдельной страницы, а иногда лишь меняет вид уже существующей выдачи. Автоматически открывать или закрывать все URL по имени параметра — слишком грубое правило.
Четыре правила, которые нужно зафиксировать до разработки
- Канонический вид адреса. Для индексируемой комбинации должен существовать один стабильный URL. Если фильтры записываются в путь, их порядок не должен самопроизвольно меняться; не должно появляться повторов одного фильтра.
- Граница между полезной страницей и интерфейсом. Команда заранее утверждает ограниченный список типов фильтров и комбинаций, которые действительно являются посадочными. Остальные остаются способом выбора товара, а не новой страницей контента.
- Поведение бессмысленных URL. Комбинации без результатов, дублирующие условия и несуществующая пагинация требуют отдельного сценария. В рекомендациях Google для таких случаев указан корректный HTTP 404 на исходном URL, а не редирект на общую страницу ошибки.
- Источник ссылок. Робот узнаёт о важности страниц в том числе по обычным внутренним ссылкам. Значимые категории и согласованные посадочные должны быть найдены через навигацию и контент; произвольные сочетания фильтров не стоит массово превращать в сквозные ссылки.
Почему canonical — не единственное решение
Canonical может подсказать предпочтительную версию и со временем уменьшить обход неканонических вариантов. Но он не отменяет появление самих ссылок, не делает из пустой комбинации полезную страницу и не исправляет хаотичный порядок параметров. Поэтому ставить один canonical на весь фильтр-каталог без карты URL — это не стратегия, а предположение.
Для страниц, которые не нужны в поиске, Google рекомендует в первую очередь не допускать их обхода подходящими правилами, например через robots.txt; также возможна модель с фрагментами URL, если она отвечает требованиям интерфейса. Это инфраструктурные изменения: перед ними нужно проверить существующую индексацию, рекламные и партнёрские ссылки, логи сервера и логику CMS. Нельзя переносить правило из чужого магазина вслепую.
Как проверить текущий каталог без рискованных изменений
- Выгрузить фактические URL из sitemap, внутренних ссылок, Search Console, логов и CMS; отметить параметры и паттерны пути.
- Сгруппировать страницы по роли: категория, согласованная посадочная, навигационная комбинация, сортировка, пагинация, пустой результат.
- Для каждой группы проверить код ответа, indexability, canonical, метаданные, товары на странице и источник внутренних ссылок.
- Найти адреса, где один и тот же набор товаров открывается разными способами, а также пустые и бесконечно комбинируемые варианты.
- Согласовать карту целевых URL и только потом подготовить preview: какие правила, шаблоны и ссылки изменятся; какие расходы, риск и ответственный есть у работы.
- После подтверждения внедрять поэтапно и повторно проверить серверные ответы, ссылки, sitemap и данные обхода.
Чего не обещает такая настройка
- она не гарантирует индексацию, позиции, трафик или продажи конкретной категории;
- она не даёт права автоматически менять robots.txt, шаблоны, редиректы или каталог без preview и подтверждения владельца;
- она не означает, что каждый фильтр нужно сделать SEO-посадочной страницей;
- она не заменяет проверку наличия товара, спроса, контента и качества самих карточек.
С чего начать интернет-магазину
Если каталог уже работает, первым артефактом должна быть карта URL и приоритетов, а не массовое закрытие адресов. В SEO для интернет-магазина мы разбираем структуру категорий, фильтры, карточки, внутренние связи и технические ограничения в одном контуре. Для более сложной модели с несколькими типами сущностей и шаблонов полезен отдельный разбор ролей URL в каталогах и агрегаторах. Сначала показываем план работ, стоимость и риск изменений; публикация и любые внешние расходы запускаются только после вашего подтверждения.
Первичные источники
- Google: managing crawling of faceted navigation URLs — фасетная навигация, управление обходом, canonical, параметры и пустые комбинации.
- Google Search Central: ecommerce website navigation structure — внутренняя перелинковка, категории и относительная важность страниц.
- Google Search Central: ecommerce URL structure — стабильная структура URL и работа с вариантами адресов.
Частые вопросы
Нужно ли закрывать от обхода все фильтры?
Нет универсального правила. Сначала определяют, какие фильтры создают отдельную полезную страницу для человека и бизнеса, а какие нужны только для удобства выбора. Для второй группы ограничивают появление бесконечных комбинаций URL; способ зависит от CMS, логики каталога и уже существующей индексации.
Достаточно ли поставить canonical на все фильтры?
Canonical — только один из сигналов. Он может помочь консолидировать варианты, но не заменяет проектирование правил URL, ссылок, статусов ответа и проверку фактического обхода. Решение принимают после инвентаризации конкретного каталога.
Что делать со страницей фильтра без товаров?
Для несуществующей комбинации фильтров или пагинации Google рекомендует возвращать корректный HTTP 404 по этому адресу, а не перенаправлять пользователя на общую страницу ошибки. Реализацию нужно проверить на конкретной CMS и не применять к временно пустой категории без бизнес-решения.