Канонические URL
Именно те адреса, которые сайт считает основными.
Практическое SEO · Sitemap
Sitemap сообщает поисковой системе об актуальной структуре сайта, но не гарантирует индексирование. В карту стоит включать канонические URL, которые действительно должны участвовать в поиске, а не все адреса, которые умеет генерировать CMS.
Основа
Файл Sitemap помогает поисковому роботу узнать об адресах сайта, особенно если страниц много, часть из них находится глубоко или на некоторые URL ведёт мало внутренних ссылок.
Яндекс поддерживает XML и TXT, при этом XML — рекомендуемый формат. Наличие URL в Sitemap не гарантирует, что страница попадёт в поиск: робот всё равно оценивает доступность, каноничность, дублирование и полезность документа.
Шаг 1
В карту добавляем основную версию страниц, которые должны участвовать в поиске: главную, категории, услуги, карточки, статьи и другие самостоятельные документы.
Именно те адреса, которые сайт считает основными.
Рабочие страницы без промежуточных редиректов и ошибок.
Без noindex и других запретов, если URL предназначен для поиска.
Страница решает отдельную пользовательскую задачу и имеет место в структуре сайта.
Шаг 2
Карта не должна превращаться в выгрузку всех технических маршрутов CMS. Исключаем адреса, которые не должны участвовать в поиске или не являются основной версией документа.
| URL | Почему не нужен в Sitemap |
|---|---|
| 301/302 | Карта должна вести сразу на конечную актуальную страницу |
| 404/410 | Документ не существует |
| noindex | Сайт одновременно сообщает «индексировать» через Sitemap и «не индексировать» через директиву |
| Неканонический дубль | В Sitemap должна находиться основная версия |
| UTM и рекламные параметры | Это альтернативные адреса основного документа |
| Служебные и кабинетные страницы | Не являются поисковыми посадочными |
Шаг 3
Если в Sitemap указан URL A, а rel="canonical" у страницы ведёт на URL B, сайт сам создаёт противоречие. В карту стоит включать канонические адреса, а альтернативные параметры, дубли и технические маршруты из неё убирать.
Яндекс прямо рекомендует сначала определить канонические URL, а уже потом формировать Sitemap. Это особенно важно для каталогов, фильтров и сайтов после миграции.
Шаг 4
URL из Sitemap должны вести прямо на рабочий документ. Редиректы, 404 и 5xx внутри карты создают шум и показывают, что файл не отражает актуальную структуру.
Нормальное состояние для индексируемой страницы в карте.
Лучше заменить URL в Sitemap на конечный адрес.
Удалённые страницы нужно убрать из карты.
Сначала исправить серверную проблему, потом считать страницу актуальной.
Шаг 5
Один файл Sitemap может содержать до 50 000 URL и иметь размер до 50 МБ в несжатом виде. Если сайт больше, карту разделяют на несколько файлов и объединяют через индекс Sitemap.
Разделение можно использовать и раньше лимита: например, отдельно категории, карточки, статьи и страницы услуг. Так проще увидеть, в каком типе документов появились ошибки после deploy или импорта.
Яндекс допускает до 50 000 URL файлов Sitemap внутри одного индексного файла. Для диагностики большого проекта это удобнее, чем один огромный список.
Шаг 6
В XML можно передавать дату последнего обновления страницы через lastmod. Это полезно, когда сайт умеет корректно фиксировать реальные изменения документа.
Не стоит менять lastmod у всех страниц при каждом deploy, если содержимое фактически не изменилось. Иначе дата перестаёт быть полезным сигналом. То же относится к changefreq и priority: они не заменяют нормальную структуру сайта и не делают страницу автоматически важнее.
Шаг 7
Ссылку на файл можно указать директивой Sitemap в robots.txt или добавить в разделе «Файлы Sitemap» Яндекс Вебмастера. После обновления файла удалять и добавлять его заново не нужно — робот регулярно проверяет изменения.
Для корректной обработки сам файл должен быть доступен роботу и отвечать 200 OK. Если Sitemap закрыт в robots.txt или сервер возвращает другой HTTP-код, файл не будет обработан.
Практический пример
Допустим, CMS выгружает в карту 12 000 адресов. После проверки оказывается, что часть из них — фильтры, UTM, редиректы и удалённые карточки.
| Группа | До аудита | Решение | После |
|---|---|---|---|
| Категории | 300 URL | Оставить канонические 200 OK | 300 |
| Карточки | 8 000 URL | Убрать 404 и старые редиректы | 7 400 |
| Фильтры | 2 500 URL | Оставить только самостоятельные посадочные | 450 |
| UTM и параметры | 800 URL | Убрать неканонические варианты | 0 |
| Служебные страницы | 400 URL | Исключить из поисковой карты | 0 |
Частые ошибки
Поисковику сообщают устаревший адрес вместо конечной страницы.
Файл перестаёт отражать актуальную структуру сайта.
Один сигнал просит об индексации, другой запрещает её.
Sitemap спорит с canonical и внутренними ссылками.
Робот не сможет нормально обработать сам файл.
После удаления и переноса страниц в ней остаётся старая структура.
Чек-лист
Вопросы
Нет. Яндекс прямо указывает, что наличие URL в Sitemap не гарантирует индексирование.
Нет. Лучше указывать сразу конечный актуальный URL.
Технически файл может содержать любой URL, но это создаёт противоречивые сигналы. Для рабочей поисковой карты разумнее включать страницы, которые действительно должны индексироваться.
До 50 000 URL и до 50 МБ в несжатом виде. Для большего сайта используют несколько файлов и индекс Sitemap.
Нет. Яндекс регулярно проверяет уже добавленный файл на изменения и ошибки.
Практика NIC-SEO
Мы используем карту как контрольный список канонических индексируемых страниц: без редиректов, дублей, служебных URL и устаревших адресов.