Пагинация архивов — типичный источник лишних URL в WordPress. Страницы вида /page/2/, /page/3/ и дальше часто попадают в индекс, хотя сами по себе не несут самостоятельной ценности. Проблема не в том, что пагинация существует, а в том, что поисковик тратит обход на второстепенные страницы и иногда показывает их вместо более полезных URL из архива.
Ниже — рабочий сценарий: как закрыть пагинацию архивов от индексации, не ломая переходы между страницами и не создавая конфликтов с каноникалами, robots.txt и SEO-плагинами.
Когда это действительно нужно
Не стоит закрывать пагинацию «на всякий случай». В некоторых проектах страницы архива 2, 3, 4 помогают поисковику добраться до старых записей. Но если архивы у вас состоят из коротких анонсов, а основная задача — держать в индексе только первую страницу архива, тогда запрет индексации пагинации оправдан.
Чаще всего это нужно, когда:
- в индексе много URL вида
/category/news/page/5/и похожих; - в Search Console растёт число «Просканировано, но не проиндексировано» для архивов;
- страницы пагинации конкурируют с первой страницей архива по одному и тому же запросу;
- на сайте есть фильтрация, сортировка или архивы таксономий, которые создают много слабых страниц.
Диагностика: что именно попало в индекс
Сначала проверьте, действительно ли проблема в пагинации, а не в дублирующих архивах или параметрах URL. Откройте в поиске запросы вроде site:example.com/page/ или посмотрите отчёт по страницам в Google Search Console. Если в выдаче и отчётах есть именно пагинированные архивы, можно переходить к решению.
Полезно проверить три вещи:
- Есть ли на страницах пагинации мета-тег
robotsсnoindex. - Не ставит ли SEO-плагин на эти страницы каноникал на саму страницу пагинации.
- Не закрыты ли они случайно в
robots.txt, если вам всё ещё нужен обход ссылок внутри архива.
Если вы используете кэш-плагин или серверный кэш, после правок обязательно очистите кэш страниц и CDN, иначе вы будете смотреть на старую версию HTML.
Какой способ выбрать: плагин, код или серверные правила
Для WordPress есть три реалистичных подхода. Самый безопасный для редакции — через SEO-плагин. Самый точный — через код, если нужен контроль только над архивами. Серверные правила здесь обычно не лучший вариант: они могут скрыть URL от обхода, но не решают задачу аккуратно для поисковиков.
| Подход | Плюсы | Минусы | Когда брать |
|---|---|---|---|
| SEO-плагин | Быстро, без кода | Меньше точности, зависит от настроек | Если нужен простой и предсказуемый вариант |
| Код в теме или mu-plugin | Точный контроль | Нужно тестировать после обновлений | Если надо закрыть только конкретные архивы |
| robots.txt | Легко добавить | Не гарантирует noindex, может мешать обходу | Только как дополнительная мера, не как основное решение |
Пошаговое решение через код
Если вам нужно закрыть от индексации именно пагинацию архивов, а не все архивные страницы целиком, можно добавить условие в wp_head. Это не идеальный универсальный рецепт, но для большинства проектов он работает предсказуемо.
<?php
add_action( 'wp_head', function () {
if ( is_paged() && ( is_home() || is_archive() || is_search() ) ) {
echo '<meta name="robots" content="noindex,follow" />' . "\n";
}
}, 1 );Что делает этот код:
is_paged()проверяет, что это не первая страница;is_home(),is_archive()иis_search()ограничивают правило архивами и поиском;noindex,followговорит поисковику не индексировать страницу, но не обрывать переходы по ссылкам.
Код лучше размещать в дочерней теме или в небольшом mu-plugin, если вы не хотите потерять правку после обновления темы.
Если у вас уже стоит SEO-плагин
Если используется Yoast SEO, Rank Math или аналог, сначала проверьте их настройки архивов. Во многих случаях плагин уже умеет ставить noindex на архивы или отдельные типы страниц. Тогда не нужно дублировать логику кодом: два разных источника мета-тегов часто дают конфликт.
Практика простая: либо вы настраиваете это в плагине, либо в коде. Смешивать оба подхода стоит только если вы точно понимаете, какой тег в итоге попадает в HTML.
Если нужно закрыть только категории, а не все архивы
Иногда проблема касается только категорий с глубокой пагинацией, а теги или авторские архивы должны оставаться открытыми. Тогда условие лучше сузить:
<?php
add_action( 'wp_head', function () {
if ( is_paged() && is_category() ) {
echo '<meta name="robots" content="noindex,follow" />' . "\n";
}
}, 1 );Такой вариант полезен, если категории у вас — основной навигационный слой, а теги используются как вспомогательные. Но если на сайте есть важные теги с трафиком, не закрывайте их автоматически без анализа.
Проверка результата после внедрения
После правки откройте несколько URL вручную:
- первую страницу архива, например
/category/news/; - вторую страницу архива, например
/category/news/page/2/; - несколько других архивов, если правило должно работать не везде.
В исходном коде страницы пагинации должен появиться тег:
<meta name="robots" content="noindex,follow" />Дальше проверьте:
- в Search Console через проверку URL, видит ли Google новый HTML;
- не остался ли старый кэш на сервере или в CDN;
- не переопределяет ли SEO-плагин ваш мета-тег;
- не закрыт ли архив случайно в
robots.txt.
Если страница всё ещё индексируется, это не всегда означает ошибку. Поисковику нужно время, чтобы переобойти URL и учесть новый сигнал.
Частые ошибки и как их исправить
Ставят noindex только в robots.txt
Это распространённая ошибка. robots.txt не гарантирует удаление URL из индекса и не заменяет мета-тег noindex. Для пагинации нужен именно HTML-сигнал на странице.
Закрывают первую страницу архива вместе с пагинацией
Если условие написано слишком широко, можно случайно закрыть и первую страницу архива. Проверяйте, что в коде есть is_paged(). Без неё вы запретите индексацию всего архива, а не только страниц 2+.
Дублируют настройку в плагине и в теме
Когда один плагин ставит index,follow, а тема — noindex,follow, итог зависит от порядка вывода в head. Это трудно отлаживать. Оставьте один источник правды.
Не очищают кэш
Если у вас включён page cache, объектный кэш или CDN, старый HTML может висеть неделями. После изменений очистите все уровни кэширования и проверьте страницу в режиме инкогнито.
Что ещё стоит проверить для SEO и производительности
Если вы уже чистите архивы, имеет смысл посмотреть на соседние источники мусорных URL: внутренний поиск, служебные страницы, параметры сортировки, страницы вложений. Часто именно они создают лишнюю нагрузку на обход и раздувают индекс.
- Оставляйте пагинацию доступной для пользователей, но не обязательно для индекса.
- Не закрывайте важные страницы через
noindexбез анализа трафика. - Следите, чтобы каноникал на страницах пагинации не указывал на первую страницу, если это ломает навигационную логику в вашем SEO-плагине.
- После изменений проверьте логи обхода или отчёты Search Console, если они доступны.
Если вам нужен более широкий набор инструментов для чистки дублей и служебных страниц, можно посмотреть в сторону Clearfy Pro: у него есть настройки для отключения лишних элементов WordPress и управления техническими сигналами. Но даже с плагином всё равно нужно проверять итоговый HTML, а не полагаться на галочки в админке.
Главный критерий успеха здесь простой: в индекс не должны попадать слабые страницы пагинации, а первая страница архива и переходы по сайту должны работать как раньше. Если это так, решение внедрено правильно.