Если в индексе начали плодиться одинаковые страницы с разными параметрами в URL, проблема обычно не в «плохом SEO», а в логике генерации ссылок. WordPress сам по себе не создаёт дубли из воздуха, но темы, плагины фильтров, поиск по сайту, сортировки, UTM-параметры и технические параметры легко размножают один и тот же контент под десятками адресов.
Типичный сценарий: в поиске видны страницы вида ?sort=price, ?filter_color=black, ?s=..., а в отчётах Search Console растёт число URL без заметной пользы. Ниже — рабочая схема, как найти источник дублей, что закрывать от индексации, а что лучше нормализовать на уровне кода.
Как понять, что дубли уже есть
Сначала не трогайте robots.txt и не ставьте массово noindex наугад. Сначала проверьте, какие именно URL реально попали в индекс и чем они отличаются от основной страницы.
Что смотреть в первую очередь
- отчёт «Страницы» в Google Search Console — ищите URL с параметрами;
- серверные логи или аналитика — какие адреса чаще всего открывают боты;
- исходный HTML — есть ли у параметризованных страниц каноникал на чистый URL;
- карта сайта — не попадают ли туда служебные варианты страниц;
- поиск по сайту и фильтры темы — не создают ли они индексируемые архивы.
Если у страницы с параметром тот же заголовок, тот же основной контент и почти тот же шаблон, это кандидат на дубль. Если параметр меняет только сортировку или вид отображения, индексировать такой URL обычно не нужно.
Какие параметры чаще всего создают мусорные URL
В реальных проектах чаще всего всплывают не экзотические случаи, а вполне обычные параметры: сортировка, пагинация, фильтры, внутренний поиск, UTM-метки, идентификаторы сессий у сторонних сервисов. Отдельная история — плагины, которые добавляют AJAX-фильтры, но при этом оставляют доступными обычные GET-URL с тем же набором условий.
| Источник | Что делает | Что обычно делать |
|---|---|---|
| Сортировка | ?orderby=price, ?sort=... | Закрыть от индексации, оставить canonical на базовую страницу |
| Фильтры | ?color=black, ?brand=... | Индексировать только если есть отдельная SEO-логика и уникальный контент |
| Поиск | ?s=... | Обычно noindex, follow или canonical на страницу поиска, если она нужна |
| UTM | ?utm_source=... | Не индексировать, не плодить отдельные версии страниц |
Диагностика: где именно ломается нормализация URL
Проблема может быть в трёх местах: шаблон темы, плагин, серверная конфигурация. Удобнее идти по цепочке от HTML к индексу.
Проверка canonical и мета-роботов
Откройте проблемный URL с параметром и посмотрите исходный код. У нормальной страницы должен быть один канонический адрес без мусорных параметров. Если canonical указывает на сам параметризованный URL, поисковик получает сигнал, что это отдельная страница.
<link rel=