Один контент
Текст, структура и основная задача страницы практически совпадают.
Практическое SEO · техническая структура
Одна и та же страница может оказаться доступной по нескольким URL: с параметрами, через index.php, с разным регистром, слешем или техническим маршрутом CMS. Поисковая система видит несколько адресов с одинаковым содержимым и вынуждена выбирать, какой из них считать основным.
Основа
Дубль — это ситуация, когда одинаковое или почти одинаковое содержимое доступно по нескольким адресам. Для пользователя это может выглядеть как одна и та же страница, а для поискового робота — как несколько разных URL, которые нужно обойти и сопоставить.
Яндекс объединяет такие документы в группу дублей и выбирает один URL для показа в поиске. Предпочтительный адрес называют каноническим. Владелец сайта может помочь поисковой системе выбрать основную версию через редирект или rel="canonical", но лучше сначала понять, почему вообще появились лишние адреса.
Текст, структура и основная задача страницы практически совпадают.
Одинаковый документ открывается по двум или большему числу адресов.
Поисковая система решает, какой URL считать главным в группе.
Робот тратит время на альтернативные адреса вместо новых полезных страниц.
Яндекс о дублировании страниц отдельно отмечает, что из-за дублей нужная страница может быть исключена, а основной URL в поиске — меняться.
Важное различие
Две страницы могут упоминать одну тему и при этом быть самостоятельными документами. Например, услуга «перенос сайта» и статья «как перенести сайт на новый домен» тематически близки, но отвечают на разные задачи.
Также одинаковые Title или Description сами по себе не доказывают, что страницы дублируют друг друга. Это отдельная проблема метаданных: пользователю сложнее различать документы в выдаче, а владельцу сайта — понимать структуру. Содержимое страниц при этом может быть совершенно разным.
Шаг 1
Большинство дублей появляется не потому, что кто-то специально создаёт копии. Их генерирует CMS, веб-сервер, фильтры каталога, рекламные параметры, старые маршруты или особенности шаблона. Поэтому на аудите полезно искать не отдельный URL, а правило, которое способно породить целую группу адресов.
/catalog/, /catalog, /catalog/index.php могут отдавать одно и то же содержимое.
UTM, сортировка, фильтры, идентификаторы сессий и другие GET-параметры создают альтернативные адреса.
HTTP/HTTPS, www/без www и технические домены могут быть доступны одновременно без единого правила перенаправления.
Один товар или раздел может выводиться в нескольких ветках структуры по разным URL.
Яндекс отдельно приводит примеры дублей главной страницы через index.php, адресов с UTM-метками и разных технических вариантов URL. Примеры дублей в документации Яндекса.
Шаг 2
Адреса вида ?utm_source=..., ?sort=price, ?page=... или фильтры могут открывать тот же контент под множеством вариантов. Для аналитики параметр полезен, а для поисковой структуры он может быть лишним.
Важно различать параметры, которые действительно меняют содержимое страницы, и параметры, которые только отслеживают источник перехода или порядок вывода. Первые иногда формируют самостоятельные страницы, вторые чаще не должны становиться отдельными поисковыми документами.
| Тип параметра | Пример | Что меняется | Типичное решение |
|---|---|---|---|
| Рекламная метка | ?utm_source=ads | Содержимое не меняется | Оставить один канонический URL |
| Сортировка | ?sort=price | Меняется порядок элементов | Обычно не создавать отдельный поисковый документ |
| Фильтр | ?brand=x | Меняется набор товаров | Решать по спросу и самостоятельному интенту |
| Пагинация | ?page=2 | Меняется часть списка | Проверять архитектуру и роль страниц в обходе |
В Яндекс Вебмастере есть отдельная настройка GET-параметров; сам Яндекс отмечает, что параметры могут создавать разные URL с одинаковым содержимым. Настройка GET-параметров в Вебмастере.
Шаг 3
У каждого документа должна быть понятная основная версия. Проверяем, не доступны ли одновременно HTTP и HTTPS, www и без www, URL с разным регистром, со слешем и без, с index.php и без него. Если сервер отдаёт одинаковый документ по нескольким адресам, лучше устранить причину на уровне маршрутизации.
Для действительно альтернативных адресов одного документа постоянный редирект обычно понятнее, чем попытка поддерживать несколько равноправных версий. Если же разные URL технически необходимы, canonical помогает указать предпочтительный адрес.
Небезопасная версия должна последовательно вести на рабочий HTTPS-адрес.
Выбираем одну основную форму домена и используем её во внутренних ссылках.
/Page/ и /page/ могут обрабатываться по-разному в зависимости от сервера и CMS.
Проверяем, не открывается ли один документ через несколько служебных вариантов адреса.
Шаг 4
Начинаем с данных Яндекс Вебмастера и краулинга сайта. В разделе «Страницы в поиске» можно отфильтровать исключённые страницы со статусом «Дубль». Для конкретного URL полезно проверить, какой адрес поисковая система выбрала основным.
Краулер дополняет эту картину: он помогает сгруппировать одинаковые Title, canonical, коды ответа и повторяющийся контент по тысячам URL. Отдельно проверяем шаблоны параметров, фильтры и технические маршруты CMS.
| Источник | Что ищем | Что это даёт |
|---|---|---|
| Яндекс Вебмастер | Статусы «Дубль» и «Неканоническая» | Показывает решение поисковой системы по конкретным URL |
| Краулер | Повторяющийся контент, Title, canonical, параметры | Находит системные шаблоны дублей по всему сайту |
| Логи сервера | Частые обходы параметрических и технических URL | Показывают, на что реально тратится обход |
| Ручная проверка | Одинаковый контент по нескольким адресам | Помогает понять пользовательский смысл дубля |
«Страницы в поиске» в Яндекс Вебмастере показывает статус DUPLICATE для страниц, которые дублируют уже представленную в поиске страницу сайта.
Шаг 5
Основная версия должна быть удобной для пользователя, логичной для структуры сайта и использоваться во всех внутренних ссылках. Обычно выбираем короткий стабильный адрес без лишних параметров, технических файлов и промежуточных вариантов.
После выбора проверяем согласованность сигналов: именно этот URL должен находиться в Sitemap, использоваться в меню и контенте, указываться в canonical и быть финальной целью редиректов с альтернативных адресов.
rel="canonical" указывает на URL B, поисковой системе приходится разбираться в противоречивых сигналах.Шаг 6
Правильный способ зависит от причины. Нельзя закрыть любую проблему одной директивой. Иногда лишний URL вообще не должен существовать, иногда он нужен пользователю, но не как самостоятельная поисковая страница, а иногда это полноценный документ, который по ошибке признан дублем.
| Ситуация | Подход | Почему |
|---|---|---|
| Один документ случайно доступен по двум адресам | 301 на основную версию | Убираем альтернативный маршрут и оставляем один URL |
| Альтернативный URL технически нужен | rel="canonical" | Подсказываем предпочтительную версию без удаления второго адреса |
| Служебная страница не должна участвовать в поиске | noindex, если страница должна оставаться доступной | Запрещаем индексирование, не ломая пользовательский доступ |
| CMS генерирует тысячи бессмысленных адресов | Исправить генерацию и ссылки | Лучше убрать источник дублей, чем бесконечно маскировать последствия |
| Параметр не меняет содержание | Единый canonical и корректная работа параметров | Не создаём отдельный поисковый документ под рекламную или служебную метку |
Яндекс воспринимает rel="canonical" как рекомендацию и может выбрать другую основную страницу, если остальные сигналы противоречат указанию. Документация по canonical.
Практический пример
Типичный интернет-магазин может отдавать одну карточку товара через основной URL, адрес с UTM-меткой, технический путь категории и URL после сортировки или фильтра. Для пользователя содержимое одинаковое, а робот видит четыре адреса.
| URL | Что происходит | Решение | Итог |
|---|---|---|---|
| /catalog/product-a/ | Основная карточка | Оставляем как каноническую | Индексируемый URL |
| /catalog/product-a/?utm_source=ads | Та же карточка с рекламной меткой | Canonical на основной URL | Не создаём отдельный документ |
| /category/product-a/ | CMS создаёт второй маршрут | 301 на основной URL | Убираем альтернативный адрес |
| /catalog/product-a/?sort=price | Содержимое карточки не меняется | Не использовать как самостоятельную поисковую страницу | Сохраняем один основной документ |
Главная задача — не просто поставить canonical на все варианты, а понять, почему сайт создаёт лишние маршруты и какие из них можно устранить архитектурно.
Отдельный сценарий
После миграции часто остаются старые URL, а новая CMS создаёт собственные адреса. Если старые страницы продолжают отвечать 200 вместо редиректа, поисковая система видит одновременно старую и новую версии одного документа.
Похожая проблема возникает с тестовым доменом, временным поддоменом или копией сайта на новом сервере. Если такая версия доступна роботу и не закрыта, она может создавать дополнительные группы дублей.
Новая страница уже существует, но старая версия не перенаправлена.
Копия production доступна поисковому роботу как отдельный набор адресов.
Новая страница сама указывает предпочтительным прежний URL.
Сайт одновременно сообщает поисковику о старой и новой структуре.
Чек-лист
Вопросы
Нет. Чаще это техническая проблема структуры: поисковая система объединяет одинаковые документы и выбирает один основной URL. Но большое число лишних адресов усложняет обход и может привести к выбору не той версии страницы, которую ожидает владелец.
Нет. Robots.txt управляет обходом и не является универсальным способом выбора основной версии. Для разных ситуаций подходят редирект, canonical, noindex или исправление генерации URL.
Нет. Canonical — рекомендация поисковой системе. Если можно вообще убрать лишний маршрут или сделать постоянный редирект на единственную рабочую версию, это часто понятнее архитектурно.
Не обязательно. Заголовки могут совпасть у разных документов из-за шаблона CMS. Это отдельная проблема метаданных, которую нужно проверить, но дубль определяется прежде всего одинаковым или почти одинаковым содержимым.
Разделить фильтры на те, которые имеют самостоятельный поисковый спрос и полезную посадочную задачу, и технические комбинации без отдельной ценности. Не каждый URL фильтра должен индексироваться.
Практика NIC-SEO
Мы сначала выясняем, как CMS, сервер или структура создают альтернативные адреса, затем выбираем один основной документ и приводим к нему редиректы, canonical, Sitemap и внутренние ссылки.