Фасетная навигация: как фильтры создают бесконечное пространство URL
Пять фильтров по десять значений выглядят безобидно в интерфейсе. Их сочетания рождают огромное число адресов, которые crawler сначала обязан проверить.
Разделите полезные и служебные фасеты
Посадочные страницы под реальный спрос получают стабильный URL, уникальное содержимое и внутренние ссылки, а сортировки или случайные комбинации остаются вне поисковой архитектуры. Решение принимают заранее.
Ограничьте ненужный обход
Для параметров без поисковой ценности используйте устойчивые правила robots.txt либо fragments, сохраняя доступ к товарам и основной категории без фильтра. Canonical действует медленнее.
Возвращайте 404 для пустоты
Комбинация без результатов, повторенный filter или невозможная страница пагинации должны честно сообщать отсутствие результата под исходным URL, а не отправлять всех на общий каталог. Так чище.
Соберите top parameter patterns из server logs и посчитайте ответы, глубину, повторяемость контента и органический спрос. Только после этого закрывайте маски, иначе можно удалить полезные посадочные страницы.
Масштаб проблемы раскрывает статья про crawl budget. Источник: рекомендации Google.
Comments are closed.