Посчитать комбинации
Сколько URL создаёт одна категория с параметрами.
Практическая диагностика · интернет-магазин
Фасетная навигация полезна пользователю, но CMS может превратить каждую комбинацию характеристик в отдельный URL. Если поисковый робот начинает обходить сортировки, пустые сочетания и дубли параметров, технический хвост растёт быстрее полезного каталога.
Быстрый маршрут
Сначала определяем масштаб: сколько уникальных URL создаёт фильтр и какие из них реально имеют поисковую ценность.
Сколько URL создаёт одна категория с параметрами.
Какие фасеты 200/indexable и какие служебные.
Создаёт ли интерфейс обычные href на все комбинации.
Не конфликтуют ли параметры с основной категорией.
Тратит ли робот обход на технические URL.
Шаг 1
Пять характеристик по десять значений уже дают огромное число комбинаций, особенно если порядок параметров влияет на URL. Реально существующих товаров может быть несколько тысяч, а адресов — сотни тысяч.
Краулер и логи помогают увидеть шаблоны: ?color=, ?size=, ?sort=, разные порядки параметров и пустые страницы.
Шаг 2
Популярный бренд внутри категории или ключевой технический признак может иметь устойчивый спрос и ассортимент. Такой фасет можно оформить как нормальную страницу: стабильный URL, H1, Title, внутренние ссылки и контент.
Редкая комбинация пяти параметров, сортировка по цене или изменение количества товаров на странице не создают нового интента.
Шаг 3
Если каждый checkbox генерирует обычный href и новые комбинации можно выбирать последовательно, робот способен уходить всё глубже в пространство параметров. Noindex не обязательно уменьшает сам обход.
Управляем не только meta robots, но и архитектурой ссылок, порядком параметров и логикой генерации URL.
Шаг 4
?brand=x&color=y и ?color=y&brand=x могут показывать один набор товаров, но технически быть разными URL. Нормализуем порядок, убираем бессмысленные параметры и согласуем canonical.
Для индексируемого SEO-фасета canonical обычно должен подтверждать саму страницу, а не всегда вести на родительскую категорию.
Шаг 5
Robots.txt запрещает обход и не позволяет роботу прочитать canonical/noindex на странице. Поэтому закрывать весь параметрический раздел первым движением не всегда правильно.
Сначала классифицируем URL: индексируемая посадочная, функциональный фильтр, сортировка, дубль или бессмысленная комбинация. Затем выбираем нормализацию, noindex, robots или прекращение генерации.
Практический пример
Фильтры имеют параметры brand, color, size, sort и view. Каждый клик создаёт обычную ссылку, порядок параметров не нормализован, а пустые комбинации тоже отвечают 200.
Краулер и логи показывают, что робот тратит большую часть запросов на сортировки и перестановки одинаковых параметров. Оставляем выбранные SEO-фасеты, нормализуем URL и прекращаем генерацию ссылок на технические состояния.
| До | После |
|---|---|
| 80 000 обнаруженных URL | ограниченный набор полезных фасетов |
| sort/view индексируемы | служебные состояния не являются посадочными |
| порядок параметров разный | одна нормализованная форма |
| пустые комбинации 200 | не создаются как постоянные страницы |
Типовые сценарии
Само число адресов ничего не доказывает: важна доля бесполезного обхода и количество дублей.
| Ситуация | Оценка | Действие |
|---|---|---|
| 100 фасетов со спросом и товарами | может быть нормально | оформить как устойчивые посадочные |
| 100 000 сортировок и параметров | технический хвост | убрать индексируемость/генерацию ссылок |
| Один набор доступен в разном порядке параметров | дубли | нормализовать URL |
| Пустые комбинации отвечают 200 | soft 404/мусор | не генерировать или корректно отвечать |
| Логи забиты ?sort и ?view | неэффективный обход | исправить источники href и правила параметров |
Чего не делать
Можно скрыть полезные посадочные и не дать прочитать canonical.
Красивый URL не превращает технический фильтр в полезную страницу.
Получается огромное число слабых и конкурирующих URL.
Даже noindex-фасеты могут забирать значительную долю обхода.
Чек-лист
Когда нужен доступ к проекту
Для большого каталога нужны crawl и серверные логи, иначе видно только индекс, но не объём фактического обхода технических комбинаций.
Вопросы
Нет. Проблема возникает, когда большинство URL не имеет самостоятельной ценности и создаёт дубли или лишний обход.
Да в некоторых случаях, но только после классификации: робот не увидит директивы внутри запрещённого URL.
Это удобно, но не является главным условием; важнее стабильность, интент и содержание.
По серверным логам и статистике обхода: группируем запросы по параметрам и сравниваем их долю с каноническими страницами.