
XML Sitemap интернет-магазина: какие страницы отдавать поисковому роботу
Sitemap — файл адресов для обхода, а не меню для покупателей. Проверьте, какие товарные и категорийные URL стоит включать и как обновлять файл при изменении каталога.
Отделите файл Sitemap от навигации каталога
Покупатель ищет товар через меню, фильтры и поиск. XML Sitemap передаёт поисковому роботу перечень адресов, которые сайт считает важными. Файл не исправляет плохую внутреннюю связность и не гарантирует, что каждая указанная страница попадёт в индекс: Яндекс и Google рассматривают его как сигнал для обхода.
Сначала выберите канонические URL категорий, подкатегорий и товаров. Если вариант товара имеет собственную полезную страницу и выбран каноническим, его можно рассмотреть отдельно. Случайные комбинации фильтров, параметры сортировки и технические страницы не должны попадать в файл автоматически. Google отдельно рекомендует связывать категории и товары обычными ссылками: робот не обязан пользоваться внутренним поиском магазина.
Сверьте файл с реальными страницами
Для каждого URL проверьте абсолютный адрес, корректный ответ сервера, доступность для робота и соответствие canonical. Не включайте удалённые товары с 404, страницы входа и закрытые от индексации разделы только ради количества строк. При изменении каталога обновляйте карту синхронно с публичными страницами.
Поле lastmod должно отражать существенное изменение конкретной страницы, а не дату каждого запуска генератора. Google отдельно предупреждает о необходимости точного значения. Если массово меняется только технический шаблон без нового содержания, решение об обновлении дат требует аккуратной проверки.
| Тип URL | Обычно в XML | Отдельная проверка |
|---|---|---|
| Категория и товар | Канонические индексируемые страницы | Открываются и доступны по внутренним ссылкам |
| Полезная страница фильтра | Только после отдельного решения об индексации | Есть самостоятельный спрос и стабильный canonical |
| Сортировка и произвольные параметры | Обычно не включать | Не размножают ли почти одинаковые URL |
| Корзина, поиск, кабинет | Не включать | Нет ли случайной публичной копии в карте |
| Снятый товар | Решать по состоянию страницы | Ответ сервера и наличие полезной замены |
Разбейте большой каталог без потерь
Для крупных магазинов делайте несколько файлов и индекс Sitemap. В документации Google установлен предел 50 тысяч URL или 50 МБ несжатого файла; при достижении лимита карту разделяют. Проверьте также требования используемых поисковых систем, а не предполагайте, что любой файл примут без ограничений.
После генерации сравните число канонических индексируемых карточек и категорий с числом URL в карте. Несовпадение может быть нормальным для архивных или закрытых страниц, но должно объясняться правилами. Проверьте, не попали ли туда адреса с временными параметрами и дубликаты вариаций.
Отправьте и наблюдайте ошибки
Укажите адрес Sitemap поисковым системам поддерживаемым способом и проверяйте отчёты об обработке. Ошибка загрузки файла, неверный формат или множество исключённых URL требуют исправления источника генерации. Не измеряйте успех только тем, что сервис принял файл.
Сверяйте найденные в карте адреса с реально индексируемыми страницами и журналом сервера. Если товар не индексируется, изучите его содержимое, canonical, доступность и внутренние ссылки. При смене URL подготовьте перенаправления отдельно: Sitemap не заменяет карту переезда.
Вопросы и ответы
Нужно ли включать все комбинации фильтров?
Нет. Включайте только выбранные канонические страницы, полезные как самостоятельные URL, после проверки дублей.
Гарантирует ли Sitemap индексацию товара?
Нет. Он помогает обнаружить адрес; решение об обходе и индексации поисковая система принимает отдельно.
.webp&w=1920&q=85)