Дубли в WordPress обычно появляются не из-за одной ошибки, а из-за набора мелочей: архивы тегов, страницы авторов, пагинация, параметры фильтров, версии с /page/2/, а иногда и дубли из-за одинаковых title и meta description. Если это не разбирать точечно, поисковик начинает индексировать лишние URL, а нужные страницы получают слабый вес.
Ниже — рабочая схема, как найти источник дублей, что закрывать через noindex, где нужен canonical, а где лучше вообще убрать генерацию лишних страниц на уровне темы или плагина.
Как понять, что у вас именно проблема дублей
Сначала не трогайте настройки вслепую. Смотрите не на абстрактный «плохой SEO», а на конкретные признаки:
- в Google Search Console растёт число страниц в индексе без роста трафика;
- одна и та же запись открывается по нескольким адресам;
- в выдаче всплывают архивы тегов, авторов и пагинация вместо основной статьи;
- в отчётах по сканированию много URL с параметрами
?replytocom=,?utm_,?sort=и похожими; - внутренние ссылки ведут на разные версии одной сущности: с
wwwи без, сhttpиhttps, со слешем и без.
Что проверить в первую очередь
Откройте несколько типовых URL и сравните исходный код страницы. Вам нужны три вещи: canonical, robots meta и реальный адрес в адресной строке. Если canonical указывает на другую страницу, это не всегда ошибка — но он должен быть осознанным.
<link rel=