Как убрать дубли страниц пагинации из индекса WordPress

Если в индексе поисковиков начали всплывать страницы пагинации, которые не дают новой ценности, проблема обычно не в самой пагинации, а в том, как WordPress и тема формируют архивы, канонические URL и мета-robots. На небольшом сайте это может быть просто шумом. На контентном проекте — лишними дублями, размытием сигналов и лишней нагрузкой на обход.

Ниже разберём практический сценарий: как понять, что именно попало в индекс, какие варианты решения есть в WordPress и как не сломать нормальную индексацию архивов.

Когда это действительно проблема

Не каждая страница пагинации должна быть закрыта. Если у вас большой архив статей, каталог материалов или рубрики, где страницы 2, 3, 4 реально помогают добраться до старого контента, закрывать их бездумно не стоит. Но если в индекс попали десятки URL вида /category/news/page/2/, /tag/seo/page/3/ или /page/2/ с почти одинаковым содержимым и без самостоятельной ценности, это уже кандидат на чистку.

Что обычно видно в поиске

  • в выдаче появляются URL пагинации вместо первой страницы архива;
  • в Search Console растёт число обнаруженных, но не проиндексированных страниц;
  • в логах обхода заметны частые заходы на архивные страницы без перехода к полезному контенту;
  • в теме не настроены rel=canonical и мета-robots для архивов.

Диагностика: где искать причину дублей

Сначала проверьте, как WordPress отдаёт эти страницы. Откройте несколько URL пагинации и посмотрите исходный код. Вам нужно понять три вещи: есть ли canonical, не стоит ли случайно noindex на всех архивах, и совпадает ли заголовок страницы с первой страницей архива почти один в один.

Быстрая проверка в браузере и через curl

curl -I https://example.com/category/news/page/2/

В ответе обратите внимание на статус, редиректы и заголовки кеша. Затем проверьте HTML:

curl -s https://example.com/category/news/page/2/ | grep -iE 'canonical|robots|noindex'

Если canonical указывает на саму страницу пагинации, а не на первую страницу архива, это не всегда ошибка. Но если цель — убрать такие URL из индекса, одного canonical обычно недостаточно. Поисковик может всё равно держать их в обходе и иногда в индексе.

Что выбрать: плагин, код или настройка темы

Для этой задачи есть три рабочих подхода. Выбор зависит от того, насколько у вас кастомная тема и есть ли уже SEO-плагин.

ПодходКогда подходитМинусы
SEO-плагинЕсли уже используется Yoast SEO, Rank Math или аналог и нужно быстро закрыть архивыНе всегда даёт точечный контроль над пагинацией
Код в теме или мини-плагинеЕсли нужен точный контроль над archive/category/tag pageНужно следить за обновлениями темы и логикой шаблонов
Настройка шаблонаЕсли проблема в самой теме и она неправильно выводит canonical или robotsТребует правки шаблонов и тестирования на staging

Пошаговое решение через код

Если вам нужно закрыть от индексации именно страницы пагинации архивов, а не весь архив целиком, самый предсказуемый способ — добавить мета-robots noindex,follow для paged-страниц. Это не удалит URL мгновенно, но даст поисковику понятный сигнал.

Вариант для wp_head

<?php
add_action( 'wp_head', function () {
    if ( is_paged() && ( is_home() || is_archive() || is_search() ) ) {
        echo '<meta name="robots" content="noindex,follow">\n';
    }
}, 1 );

Этот вариант простой, но его лучше использовать только если вы понимаете, как тема уже выводит robots. Если SEO-плагин тоже добавляет мета-robots, можно получить конфликтующие директивы.

Более аккуратно: через фильтр SEO-плагина

Если у вас Yoast SEO, лучше работать через его фильтры. Для архивов пагинации можно менять robots на уровне плагина, а не дублировать теги в wp_head.

<?php
add_filter( 'wpseo_robots', function( $robots ) {
    if ( is_paged() && ( is_home() || is_archive() || is_search() ) ) {
        return 'noindex,follow';
    }

    return $robots;
} );

Если используется другой SEO-плагин, логика будет похожей, но фильтр уже другой. Не переносите этот код вслепую.

Если нужно убрать только конкретные архивы

Иногда закрывать все пагинированные архивы не нужно. Например, рубрики полезны, а теги — нет. Тогда логика должна быть точечной.

<?php
add_action( 'wp_head', function () {
    if ( is_paged() && is_tag() ) {
        echo '<meta name="robots" content="noindex,follow">\n';
    }
}, 1 );

Такой подход полезен, когда у вас есть чёткая политика индексации: рубрики остаются открытыми, а теги и их пагинация — нет.

Что ещё нужно проверить, кроме noindex

Если оставить только мета-robots, а canonical и внутренние ссылки не привести в порядок, поисковик может продолжать обходить лишние URL. Поэтому проверьте ещё три места.

Canonical на страницах пагинации

Для пагинированных архивов canonical обычно должен быть сам на себя или на первую страницу — в зависимости от логики темы и SEO-плагина. Главное, чтобы не было хаоса: одна страница не должна одновременно объявляться дублем другой и при этом иметь собственный индексируемый заголовок.

Внутренние ссылки

Если в сайдбаре, хлебных крошках или блоках «похожие записи» постоянно появляются ссылки на страницы 2, 3, 4 архивов, вы сами подталкиваете поисковик к их обходу. Для большинства сайтов достаточно ссылаться на первую страницу архива.

Карта сайта

Пагинация архивов обычно не должна попадать в sitemap. Если она туда попала из-за темы или кастомного генератора, это отдельная ошибка. Проверьте, что в sitemap есть только канонические URL полезных страниц.

Проверка результата после внедрения

После правки не ждите мгновенного исчезновения URL из индекса. Сначала убедитесь, что технически всё отрабатывает правильно.

  • откройте несколько URL пагинации и проверьте наличие noindex,follow;
  • посмотрите исходный код на предмет второго, конфликтующего meta robots;
  • проверьте canonical на страницах архива;
  • в Search Console отправьте URL на повторную проверку;
  • сравните, не исчезли ли из индекса полезные страницы первого уровня архива.

Если у вас есть доступ к логам сервера, полезно посмотреть, как часто поисковый бот продолжает ходить на пагинацию после изменений. Это покажет, работает ли сигнал, а не только тег в HTML.

Частые ошибки и как их исправить

Закрыли весь архив вместо пагинации

Ошибка типичная: добавили noindex на is_archive() без условий. В результате из индекса выпали и полезные страницы рубрик. Исправление простое: ограничьте правило только страницами is_paged() или только нужными типами архивов.

Дублируются мета-теги robots

Если SEO-плагин уже выводит robots, а вы добавили ещё один через wp_head, поисковик увидит конфликт. Оставьте один источник правды: либо плагин, либо код.

Canonical указывает не туда

Иногда тема настраивает canonical через шаблон архива, а SEO-плагин — через свой фильтр. В итоге на странице два canonical или один из них ведёт на неправильный URL. Это нужно чинить в одном месте, а не маскировать noindex.

Ожидали мгновенного удаления из индекса

noindex — это сигнал, а не кнопка удаления. Страница может ещё какое-то время оставаться в отчётах, пока поисковик не переобойдёт её. Если URL уже не нужен совсем, можно дополнительно отдать 404 или 410, но только если это действительно удалённая страница, а не архив.

Практические советы по безопасности и производительности

Если правите тему, не вносите изменения прямо в родительский шаблон. Для точечных SEO-правок безопаснее мини-плагин или дочерняя тема. Так вы не потеряете изменения после обновления.

Ещё один момент: не добавляйте тяжёлые проверки в wp_head на каждом запросе. Для условий вроде is_paged() и is_archive() это не проблема, но не стоит строить там сложные запросы к базе или внешним сервисам.

Если у вас уже стоит набор SEO- и технических оптимизаций, например Clearfy Pro, часть задач по чистке дублей и управлению мета-тегами можно закрыть через интерфейс, а не кодом. Но даже в этом случае полезно понимать, какой именно шаблон или фильтр меняет итоговый HTML.

Мини-чек-лист перед выкладкой на прод

  • проверили, какие именно URL пагинации нужно закрыть;
  • убедились, что полезные архивы не пострадали;
  • оставили один источник meta robots;
  • проверили canonical на первой и последующих страницах;
  • смотрели исходный код, а не только настройки в админке;
  • после релиза отправили проблемные URL на переобход.

Если задача стоит не только в закрытии дублей, но и в общей чистке технического мусора, имеет смысл сначала привести в порядок архивы, а уже потом трогать sitemap, каноникал и внутреннюю перелинковку. Тогда поисковику проще понять, какие URL у вас основные, а какие — служебные.

Добавь в закладки и поделись с друзьями:

⭐⭐⭐⭐⭐
Как отправлять изменения в IndexNow при использовании WP REST API в WordPress
11.04.2026
Автоматическое отправление URL при изменении атрибутов товаров WooCommerce
20.06.2026
IndexNow и канонические URL в WordPress: решение проблем с дублированием
18.12.2025
Оптимизация отправки URL при массовом обновлении остатков товаров WooCommerce
26.07.2026
Оптимизация файла robots.txt для IndexNow и WordPress: практические советы и примеры
21.11.2025
×
Прокачай свой WordPress!

Скидка -20% на премиум темы и плагины

Воспользоваться сейчас ⋙