Если в индексе поисковиков начали всплывать страницы пагинации, которые не дают новой ценности, проблема обычно не в самой пагинации, а в том, как WordPress и тема формируют архивы, канонические URL и мета-robots. На небольшом сайте это может быть просто шумом. На контентном проекте — лишними дублями, размытием сигналов и лишней нагрузкой на обход.
Ниже разберём практический сценарий: как понять, что именно попало в индекс, какие варианты решения есть в WordPress и как не сломать нормальную индексацию архивов.
Когда это действительно проблема
Не каждая страница пагинации должна быть закрыта. Если у вас большой архив статей, каталог материалов или рубрики, где страницы 2, 3, 4 реально помогают добраться до старого контента, закрывать их бездумно не стоит. Но если в индекс попали десятки URL вида /category/news/page/2/, /tag/seo/page/3/ или /page/2/ с почти одинаковым содержимым и без самостоятельной ценности, это уже кандидат на чистку.
Что обычно видно в поиске
- в выдаче появляются URL пагинации вместо первой страницы архива;
- в Search Console растёт число обнаруженных, но не проиндексированных страниц;
- в логах обхода заметны частые заходы на архивные страницы без перехода к полезному контенту;
- в теме не настроены
rel=canonicalи мета-robots для архивов.
Диагностика: где искать причину дублей
Сначала проверьте, как WordPress отдаёт эти страницы. Откройте несколько URL пагинации и посмотрите исходный код. Вам нужно понять три вещи: есть ли canonical, не стоит ли случайно noindex на всех архивах, и совпадает ли заголовок страницы с первой страницей архива почти один в один.
Быстрая проверка в браузере и через curl
curl -I https://example.com/category/news/page/2/В ответе обратите внимание на статус, редиректы и заголовки кеша. Затем проверьте HTML:
curl -s https://example.com/category/news/page/2/ | grep -iE 'canonical|robots|noindex'Если canonical указывает на саму страницу пагинации, а не на первую страницу архива, это не всегда ошибка. Но если цель — убрать такие URL из индекса, одного canonical обычно недостаточно. Поисковик может всё равно держать их в обходе и иногда в индексе.
Что выбрать: плагин, код или настройка темы
Для этой задачи есть три рабочих подхода. Выбор зависит от того, насколько у вас кастомная тема и есть ли уже SEO-плагин.
| Подход | Когда подходит | Минусы |
|---|---|---|
| SEO-плагин | Если уже используется Yoast SEO, Rank Math или аналог и нужно быстро закрыть архивы | Не всегда даёт точечный контроль над пагинацией |
| Код в теме или мини-плагине | Если нужен точный контроль над archive/category/tag page | Нужно следить за обновлениями темы и логикой шаблонов |
| Настройка шаблона | Если проблема в самой теме и она неправильно выводит canonical или robots | Требует правки шаблонов и тестирования на staging |
Пошаговое решение через код
Если вам нужно закрыть от индексации именно страницы пагинации архивов, а не весь архив целиком, самый предсказуемый способ — добавить мета-robots noindex,follow для paged-страниц. Это не удалит URL мгновенно, но даст поисковику понятный сигнал.
Вариант для wp_head
<?php
add_action( 'wp_head', function () {
if ( is_paged() && ( is_home() || is_archive() || is_search() ) ) {
echo '<meta name="robots" content="noindex,follow">\n';
}
}, 1 );Этот вариант простой, но его лучше использовать только если вы понимаете, как тема уже выводит robots. Если SEO-плагин тоже добавляет мета-robots, можно получить конфликтующие директивы.
Более аккуратно: через фильтр SEO-плагина
Если у вас Yoast SEO, лучше работать через его фильтры. Для архивов пагинации можно менять robots на уровне плагина, а не дублировать теги в wp_head.
<?php
add_filter( 'wpseo_robots', function( $robots ) {
if ( is_paged() && ( is_home() || is_archive() || is_search() ) ) {
return 'noindex,follow';
}
return $robots;
} );Если используется другой SEO-плагин, логика будет похожей, но фильтр уже другой. Не переносите этот код вслепую.
Если нужно убрать только конкретные архивы
Иногда закрывать все пагинированные архивы не нужно. Например, рубрики полезны, а теги — нет. Тогда логика должна быть точечной.
<?php
add_action( 'wp_head', function () {
if ( is_paged() && is_tag() ) {
echo '<meta name="robots" content="noindex,follow">\n';
}
}, 1 );Такой подход полезен, когда у вас есть чёткая политика индексации: рубрики остаются открытыми, а теги и их пагинация — нет.
Что ещё нужно проверить, кроме noindex
Если оставить только мета-robots, а canonical и внутренние ссылки не привести в порядок, поисковик может продолжать обходить лишние URL. Поэтому проверьте ещё три места.
Canonical на страницах пагинации
Для пагинированных архивов canonical обычно должен быть сам на себя или на первую страницу — в зависимости от логики темы и SEO-плагина. Главное, чтобы не было хаоса: одна страница не должна одновременно объявляться дублем другой и при этом иметь собственный индексируемый заголовок.
Внутренние ссылки
Если в сайдбаре, хлебных крошках или блоках «похожие записи» постоянно появляются ссылки на страницы 2, 3, 4 архивов, вы сами подталкиваете поисковик к их обходу. Для большинства сайтов достаточно ссылаться на первую страницу архива.
Карта сайта
Пагинация архивов обычно не должна попадать в sitemap. Если она туда попала из-за темы или кастомного генератора, это отдельная ошибка. Проверьте, что в sitemap есть только канонические URL полезных страниц.
Проверка результата после внедрения
После правки не ждите мгновенного исчезновения URL из индекса. Сначала убедитесь, что технически всё отрабатывает правильно.
- откройте несколько URL пагинации и проверьте наличие
noindex,follow; - посмотрите исходный код на предмет второго, конфликтующего meta robots;
- проверьте canonical на страницах архива;
- в Search Console отправьте URL на повторную проверку;
- сравните, не исчезли ли из индекса полезные страницы первого уровня архива.
Если у вас есть доступ к логам сервера, полезно посмотреть, как часто поисковый бот продолжает ходить на пагинацию после изменений. Это покажет, работает ли сигнал, а не только тег в HTML.
Частые ошибки и как их исправить
Закрыли весь архив вместо пагинации
Ошибка типичная: добавили noindex на is_archive() без условий. В результате из индекса выпали и полезные страницы рубрик. Исправление простое: ограничьте правило только страницами is_paged() или только нужными типами архивов.
Дублируются мета-теги robots
Если SEO-плагин уже выводит robots, а вы добавили ещё один через wp_head, поисковик увидит конфликт. Оставьте один источник правды: либо плагин, либо код.
Canonical указывает не туда
Иногда тема настраивает canonical через шаблон архива, а SEO-плагин — через свой фильтр. В итоге на странице два canonical или один из них ведёт на неправильный URL. Это нужно чинить в одном месте, а не маскировать noindex.
Ожидали мгновенного удаления из индекса
noindex — это сигнал, а не кнопка удаления. Страница может ещё какое-то время оставаться в отчётах, пока поисковик не переобойдёт её. Если URL уже не нужен совсем, можно дополнительно отдать 404 или 410, но только если это действительно удалённая страница, а не архив.
Практические советы по безопасности и производительности
Если правите тему, не вносите изменения прямо в родительский шаблон. Для точечных SEO-правок безопаснее мини-плагин или дочерняя тема. Так вы не потеряете изменения после обновления.
Ещё один момент: не добавляйте тяжёлые проверки в wp_head на каждом запросе. Для условий вроде is_paged() и is_archive() это не проблема, но не стоит строить там сложные запросы к базе или внешним сервисам.
Если у вас уже стоит набор SEO- и технических оптимизаций, например Clearfy Pro, часть задач по чистке дублей и управлению мета-тегами можно закрыть через интерфейс, а не кодом. Но даже в этом случае полезно понимать, какой именно шаблон или фильтр меняет итоговый HTML.
Мини-чек-лист перед выкладкой на прод
- проверили, какие именно URL пагинации нужно закрыть;
- убедились, что полезные архивы не пострадали;
- оставили один источник meta robots;
- проверили canonical на первой и последующих страницах;
- смотрели исходный код, а не только настройки в админке;
- после релиза отправили проблемные URL на переобход.
Если задача стоит не только в закрытии дублей, но и в общей чистке технического мусора, имеет смысл сначала привести в порядок архивы, а уже потом трогать sitemap, каноникал и внутреннюю перелинковку. Тогда поисковику проще понять, какие URL у вас основные, а какие — служебные.