Обсудить проект

Коротко опишите задачу — этого достаточно для первого контакта.

Практическая диагностика · интернет-магазин

Фильтры каталога создают тысячи страниц: когда это проблема и что делать

Фасетная навигация полезна пользователю, но CMS может превратить каждую комбинацию характеристик в отдельный URL. Если поисковый робот начинает обходить сортировки, пустые сочетания и дубли параметров, технический хвост растёт быстрее полезного каталога.

Быстрый маршрут

Что проверить за первые 5 минут

Сначала определяем масштаб: сколько уникальных URL создаёт фильтр и какие из них реально имеют поисковую ценность.

01

Посчитать комбинации

Сколько URL создаёт одна категория с параметрами.

02

Проверить indexability

Какие фасеты 200/indexable и какие служебные.

03

Проверить ссылки

Создаёт ли интерфейс обычные href на все комбинации.

04

Проверить canonical

Не конфликтуют ли параметры с основной категорией.

05

Посмотреть логи

Тратит ли робот обход на технические URL.

Проблема не в самом наличии параметров, а в бесконтрольном пространстве URL.Полезные фасеты выбираются осознанно, а сортировки и бессмысленные комбинации не должны становиться отдельной поисковой архитектурой.

Шаг 1

Посчитайте не фильтры, а возможные сочетания

Пять характеристик по десять значений уже дают огромное число комбинаций, особенно если порядок параметров влияет на URL. Реально существующих товаров может быть несколько тысяч, а адресов — сотни тысяч.

Краулер и логи помогают увидеть шаблоны: ?color=, ?size=, ?sort=, разные порядки параметров и пустые страницы.

Обход и crawl budget

Шаг 2

Отдельной посадочной становится только комбинация с самостоятельной задачей

Популярный бренд внутри категории или ключевой технический признак может иметь устойчивый спрос и ассортимент. Такой фасет можно оформить как нормальную страницу: стабильный URL, H1, Title, внутренние ссылки и контент.

Редкая комбинация пяти параметров, сортировка по цене или изменение количества товаров на странице не создают нового интента.

Какие фильтры открывать для поиска

Шаг 4

Одинаковые наборы параметров не должны создавать разные канонические адреса

?brand=x&color=y и ?color=y&brand=x могут показывать один набор товаров, но технически быть разными URL. Нормализуем порядок, убираем бессмысленные параметры и согласуем canonical.

Для индексируемого SEO-фасета canonical обычно должен подтверждать саму страницу, а не всегда вести на родительскую категорию.

Canonical для технических URL

Шаг 5

Выбирайте механизм после понимания, зачем роботу нужен URL

Robots.txt запрещает обход и не позволяет роботу прочитать canonical/noindex на странице. Поэтому закрывать весь параметрический раздел первым движением не всегда правильно.

Сначала классифицируем URL: индексируемая посадочная, функциональный фильтр, сортировка, дубль или бессмысленная комбинация. Затем выбираем нормализацию, noindex, robots или прекращение генерации.

Robots.txt и noindexЧто реально обходит робот

Практический пример

Одна категория с 600 товарами породила 80 тысяч URL

Фильтры имеют параметры brand, color, size, sort и view. Каждый клик создаёт обычную ссылку, порядок параметров не нормализован, а пустые комбинации тоже отвечают 200.

Краулер и логи показывают, что робот тратит большую часть запросов на сортировки и перестановки одинаковых параметров. Оставляем выбранные SEO-фасеты, нормализуем URL и прекращаем генерацию ссылок на технические состояния.

ДоПосле
80 000 обнаруженных URLограниченный набор полезных фасетов
sort/view индексируемыслужебные состояния не являются посадочными
порядок параметров разныйодна нормализованная форма
пустые комбинации 200не создаются как постоянные страницы

Типовые сценарии

Когда тысячи URL действительно становятся проблемой

Само число адресов ничего не доказывает: важна доля бесполезного обхода и количество дублей.

СитуацияОценкаДействие
100 фасетов со спросом и товарамиможет быть нормальнооформить как устойчивые посадочные
100 000 сортировок и параметровтехнический хвостубрать индексируемость/генерацию ссылок
Один набор доступен в разном порядке параметровдублинормализовать URL
Пустые комбинации отвечают 200soft 404/мусорне генерировать или корректно отвечать
Логи забиты ?sort и ?viewнеэффективный обходисправить источники href и правила параметров

Чего не делать

Типичные действия, которые мешают диагностике

Закрыть все фильтры robots.txt сразу

Можно скрыть полезные посадочные и не дать прочитать canonical.

Сделать ЧПУ для всех комбинаций

Красивый URL не превращает технический фильтр в полезную страницу.

Открывать всё ради НЧ-запросов

Получается огромное число слабых и конкурирующих URL.

Смотреть только индекс

Даже noindex-фасеты могут забирать значительную долю обхода.

Чек-лист

Проверка фасетной навигации

  1. Собрать типы параметров: Фильтры, сортировки, вид, пагинация.
  2. Оценить число комбинаций: Понять масштаб пространства URL.
  3. Выбрать SEO-фасеты: Спрос, ассортимент и самостоятельный интент.
  4. Нормализовать порядок: Один набор параметров — один URL.
  5. Проверить canonical: Сигналы не конфликтуют.
  6. Проверить href: Интерфейс не создаёт бесконечный обход.
  7. Проверить пустые сочетания: Нет пустых 200.
  8. Очистить Sitemap: Только выбранные индексируемые фасеты.
  9. Посмотреть логи: Доля технических параметров.
  10. Повторить crawl: Подтвердить сокращение хвоста.

Когда нужен доступ к проекту

Какие данные ускоряют диагностику

Для большого каталога нужны crawl и серверные логи, иначе видно только индекс, но не объём фактического обхода технических комбинаций.

Передавать пароли в текст статьи или публичную переписку не нужно. Для рабочей диагностики доступы выдаются отдельно и только к тем системам, которые действительно нужны для проверки.

Вопросы

Короткие ответы

Тысячи фильтров всегда плохо?

Нет. Проблема возникает, когда большинство URL не имеет самостоятельной ценности и создаёт дубли или лишний обход.

Можно ли закрыть параметры robots.txt?

Да в некоторых случаях, но только после классификации: робот не увидит директивы внутри запрещённого URL.

Нужно ли делать ЧПУ для SEO-фасетов?

Это удобно, но не является главным условием; важнее стабильность, интент и содержание.

Как понять, что crawl budget тратится на фильтры?

По серверным логам и статистике обхода: группируем запросы по параметрам и сравниваем их долю с каноническими страницами.

Практика NIC-SEO

Фильтр становится поисковой страницей только по осознанному правилу

Мы сохраняем полезные фасеты и ограничиваем техническое пространство URL, чтобы каталог рос по задачам пользователей, а не по числу комбинаций.