Если сайт на WordPress начал плодить одинаковые страницы в индексе, проблема обычно не в «плохом SEO», а в конкретной настройке: архивы тегов, авторов, дат, пагинация, параметры в URL, версии страниц с и без слеша, служебные страницы плагинов. В результате поисковик видит несколько адресов с одним и тем же содержимым и выбирает не тот, который вы хотели бы продвигать.
Ниже — рабочий сценарий: как быстро диагностировать источник дублей, что можно закрыть от индексации, что лучше оставить, и как проверить, что правка не сломала навигацию и внутреннюю перелинковку.
Какие дубли в WordPress встречаются чаще всего
В типичном проекте повторяющиеся URL появляются не из-за одной ошибки, а из-за набора мелочей. Самые частые варианты:
- архивы
/tag/,/author/,/date/, которые дублируют смысловые страницы; - страницы пагинации, где первый лист и архив без пагинации конкурируют между собой;
- параметры в URL:
?utm_*,?replytocom=, фильтры, сортировки; - доступ к одной и той же странице по HTTP и HTTPS, с www и без www;
- дубли от плагинов: отдельные страницы поиска, ленты, вложения медиафайлов;
- версии с конечным слешем и без него, если сервер или плагин настроены неаккуратно.
Не все из этого нужно «убивать». Например, пагинация и архивы могут быть полезны для обхода сайта и внутренней структуры. Вопрос в том, что именно должно индексироваться, а что — нет.
Диагностика: где искать источник дублей
Начинать лучше не с правок, а с проверки фактической картины. Иначе легко закрыть от индексации нужные страницы и оставить открытыми проблемные.
Проверка в поисковой выдаче и в индексе
Сначала посмотрите, какие варианты URL уже попали в индекс. Для этого удобно использовать оператор site: и поиск по точным фрагментам адреса. Если в выдаче есть и /category/seo/, и /tag/seo/, и страница статьи, которая повторяет один и тот же текст, это уже сигнал.
Дальше откройте несколько проблемных URL и сравните:
<link rel=