Как закрыть дубли страниц от пагинации в WordPress через robots, noindex и canonical

Пагинация архивов в WordPress часто создает не одну, а сразу несколько проблем: в индекс попадают страницы /page/2/, /page/3/ и дальше, дублируются заголовки и описания, а в отчетах Search Console появляются URL, которые не несут самостоятельной ценности. При этом простое закрытие всего архива от индексации обычно хуже, чем сама проблема: вы теряете нормальную навигацию и можете обрезать полезный трафик.

Ниже — рабочий сценарий для тех случаев, когда нужно оставить пагинацию для пользователей, но убрать ее как источник дублей для поисковых систем. Разберем, что именно проверять, какие есть варианты и как не сломать каноникализацию.

Когда пагинация становится проблемой

Сама по себе пагинация не ошибка. Проблема начинается, когда:

  • страницы архива с /page/2/, /page/3/ и т.д. индексируются вместо основной;
  • title и meta description у всех страниц одинаковые или почти одинаковые;
  • в sitemap попадают URL пагинации, хотя они не должны там быть;
  • канонический URL указывает на саму страницу пагинации, а не на первую страницу архива;
  • внутренние ссылки ведут на старые страницы архива, и поисковик тратит краулинговый бюджет на мусор.

Чаще всего это видно в двух местах: в отчете по индексированию и в исходном коде страницы. Если на второй и последующих страницах архива нет уникального контента, а только следующий набор записей, то индексация таких URL редко дает пользу.

Диагностика: что проверить до правок

Сначала убедитесь, что проблема действительно в пагинации, а не в другом дублировании. Для этого откройте несколько URL вручную и посмотрите исходный код.

1. Проверка canonical

На странице архива и на ее пагинированных версиях должен быть осмысленный rel="canonical". Если canonical отсутствует, дублирование усиливается. Если он ведет на неправильный URL, поисковик может игнорировать вашу логику индексации.

2. Проверка robots meta

Посмотрите, не стоит ли на всех страницах index,follow по умолчанию. Для пагинации это не всегда ошибка, но если архив не должен конкурировать с основной страницей, часто нужен другой подход.

3. Проверка sitemap

Если в sitemap.xml попадают URL пагинации, это почти всегда лишнее. Поисковик получает сигнал, что эти страницы важны, хотя по факту они только дублируют структуру архива.

4. Проверка шаблона архива

Иногда дубли появляются не из-за SEO-плагина, а из-за темы: одинаковый title, одинаковый H1, отсутствие разметки для страниц пагинации, неправильная генерация canonical в кастомном шаблоне.

Что делать: рабочая схема без лишнего риска

Есть три уровня решения. Выбор зависит от того, насколько важна пагинация для поиска и как устроен сайт.

ПодходКогда использоватьМинус
Оставить как естьЕсли архивы реально дают трафик и уникальныРиск дублей и лишней индексации
noindex,follow для пагинацииЕсли страницы нужны пользователю, но не должны ранжироватьсяНужно аккуратно настроить canonical и sitemap
Закрыть пагинацию через robots.txtРедко, только если есть явный мусор и нет нужды в обходеПоисковик может не увидеть ссылки внутри

На практике чаще всего подходит второй вариант: noindex,follow для страниц пагинации, нормальный canonical и исключение таких URL из sitemap.

Вариант 1. Настроить через SEO-плагин

Если у вас уже стоит плагин для SEO, проверьте, умеет ли он отдельно управлять архивами и пагинацией. Важно не включать глобальный запрет на индексацию всего архива, если вам нужны первые страницы категорий и рубрик.

Например, в некоторых конфигурациях Clearfy Pro можно использовать его для чистки дублей и технических настроек SEO, но проверять нужно именно результат в HTML, а не только галочки в админке. После изменения настроек откройте страницу /category/news/page/2/ и посмотрите, появился ли noindex.

Если используете другой SEO-плагин, логика та же: отдельно настраиваете архивы, отдельно — пагинацию, отдельно — sitemap.

Вариант 2. Добавить код в тему или мини-плагин

Если нужна точечная логика без зависимости от интерфейса плагина, проще добавить фильтры. Ниже пример, который ставит noindex,follow для страниц пагинации архивов и категорий.

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_paged() && ( is_home() || is_archive() || is_category() || is_tag() ) ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Этот код лучше размещать не в functions.php активной темы, а в небольшом must-use плагине или отдельном плагине сайта. Так вы не потеряете настройку при смене темы.

Если нужно еще и убрать пагинацию из canonical, можно дополнить логику фильтром wpseo_canonical для Yoast SEO или аналогичным фильтром вашего SEO-плагина. Но здесь важно не сломать каноникал для обычных архивов. Универсального фильтра для всех плагинов нет, поэтому сначала смотрите, какой SEO-стек уже установлен.

Вариант 3. Исключить пагинацию из sitemap

Даже если вы оставили пагинацию доступной, не стоит добавлять ее в карту сайта. Для большинства сайтов это просто шум. В SEO-плагине проверьте, что в sitemap попадают записи, страницы, категории и другие нужные сущности, но не URL вида /page/2/.

Если sitemap генерируется вручную или через кастомный код, фильтруйте URL до вывода. Пример для простого массива ссылок:

<?php
$urls = array_filter( $urls, function( $url ) {
    return ! preg_match( '#/page/\d+/?$#', $url );
} );

Проверка результата после внедрения

После правок не ограничивайтесь просмотром страницы в браузере. Проверьте три вещи:

  1. В исходном коде пагинированной страницы есть noindex,follow или другой ожидаемый robots meta.
  2. canonical указывает на правильный URL, без лишних параметров и без случайного перехода на несуществующую страницу.
  3. URL пагинации не попал в sitemap и не генерируется как отдельная важная сущность.

Дополнительно откройте страницу через curl и посмотрите заголовки и HTML. Это полезно, если кэш или CDN подсовывает старую версию.

curl -I https://example.com/category/news/page/2/
curl -s https://example.com/category/news/page/2/ | grep -iE 'robots|canonical'

Если у вас включен серверный кэш, очистите его после правок. Иначе вы можете смотреть на старую версию страницы и думать, что настройка не сработала.

Частые ошибки и как их исправить

Ставят noindex на весь архив

Это самая грубая ошибка. В результате поисковик перестает считать полезной и первую страницу категории, хотя именно она может приносить трафик. Если проблема только в пагинации, ограничивайте правило страницами is_paged().

Закрывают пагинацию в robots.txt

Такой способ не решает вопрос с уже найденными URL и может мешать обходу внутренних ссылок. Для дублей это обычно слабее, чем noindex на самой странице.

Оставляют пагинацию в sitemap

Это создает противоречивые сигналы: в HTML страница не нужна, а в sitemap она объявлена важной. Поисковик может дольше переобходить мусорные URL.

Ломают canonical кастомной темой

В кастомных шаблонах иногда вручную выводят canonical без учета пагинации. В итоге все страницы архива канонизируются на первую, но при этом в шаблоне остаются ссылки на вторую и третью страницы. Проверяйте итоговый HTML, а не только PHP-логику.

Не учитывают фильтры плагина кэширования

Если кэширует HTML, изменения в SEO-логике могут не примениться сразу. После правок нужно сбросить кэш страницы, объектный кэш и, если есть, CDN.

Чек-лист перед публикацией

  • Проверен HTML первой и второй страницы архива.
  • Пагинация не попадает в sitemap.
  • Canonical указывает на ожидаемый URL.
  • Нет глобального noindex на весь архив без необходимости.
  • Кэш очищен после изменения шаблона или SEO-настроек.
  • В Search Console нет резкого роста мусорных URL из пагинации после переобхода.

Когда лучше не закрывать пагинацию

Если у вас большой архив с реально полезной навигацией, а страницы пагинации получают переходы из поиска или внешних ссылок, закрывать их без анализа не стоит. Иногда лучше оставить индексацию, но улучшить title, canonical и внутреннюю перелинковку. Это особенно актуально для новостных, контентных и каталоговых сайтов, где вторая и третья страницы архива не пустые, а помогают пользователю найти нужный материал.

Если же страницы пагинации не дают ценности, а только размножают один и тот же список записей, тогда noindex,follow плюс чистый sitemap — самый предсказуемый вариант. Главное — проверить результат на живом HTML, а не по одной галочке в админке.

Как закрыть от индексации старые версии страниц WordPress после смены slug
23.08.2026
Как закрыть страницы поиска WordPress от индексации без поломки внутреннего поиска
19.08.2026
Как закрыть дубли страниц от пагинации в WordPress через robots, noindex и canonical
13.08.2026
Как закрыть страницы авторов в WordPress без потери индексации полезного контента
16.08.2026