Дубли фильтров, сортировок и пагинации в Битрикс
Практическая карта дублей каталога и выбор правильного механизма: 301, canonical, noindex, robots.txt или Clean-param.
Дубль — не просто две страницы с одинаковым Title. Для поисковой системы это несколько URL с одинаковым или очень близким основным содержимым. В Битрикс источником часто становятся параметры компонентов, умный фильтр, сортировки, пагинация и разные пути к одному элементу.
Сначала сгруппируйте причины
/catalog/и/catalog/index.php;- слеш и отсутствие слеша;
- HTTP/HTTPS и www/без www;
- один товар в нескольких разделах;
?sort=price,?show=48и параметры вида списка;- одинаковый фильтр с разным порядком свойств;
- страницы пагинации с повторяющимися метаданными;
- UTM, идентификаторы сессий и технические параметры.
Как выбрать механизм
Пагинация — не всегда дубль первой страницы
Страницы 2, 3 и далее показывают другие товары и помогают роботу находить карточки. Канонизация всей пагинации на первую страницу может скрыть часть каталога. У каждой страницы должен быть собственный URL; метаданные можно уточнить номером страницы. Если нужен отдельный «показать все», он должен действительно загружаться быстро и содержать полный набор.
Не закрывайте URL до диагностики
Если адрес закрыт в robots.txt, робот не увидит размещённый на нём noindex или canonical. Сначала определите, известен ли URL поиску, получает ли внешние или внутренние ссылки и должен ли передать сигнал основной странице. Затем выберите последовательность: исправить генератор ссылок, поставить 301 или canonical, дождаться переобхода и только после этого ограничивать обход массовых шаблонов.
Как подтвердить исправление
- сканирование не находит альтернативные версии канонических страниц;
- внутренние ссылки ведут сразу на целевой URL;
- sitemap содержит только канонические адреса;
- Вебмастер показывает ожидаемый статус исключённых URL;
- серверные логи фиксируют снижение обхода мусорных комбинаций;
- важные карточки и категории не потеряли доступность после правила.