Страницы пагинации вроде /page/2/, /page/3/ и дальше часто попадают в индекс не потому, что сайт «сломался», а потому что WordPress и тема отдают их как обычные HTML-страницы. Для поисковика это отдельные URL с контентом, и если на сайте много архивов, категорий или блога с длинными списками, индекс быстро забивается дублями и слабыми страницами.
Проблема обычно проявляется так: в отчёте по индексированию видны страницы пагинации, в поиске находятся архивы с номером страницы, а в логике сайта они не несут самостоятельной ценности. Ниже — рабочая схема, как понять источник, выбрать способ закрытия и проверить результат.
Когда пагинация действительно мешает индексации
Не каждая страница /page/N/ должна быть закрыта. Если это крупный каталог, новостной архив или раздел с большим количеством материалов, поисковик может использовать пагинацию для обхода глубины сайта. Но если у вас:
- много категорий с 2–5 записями и десятками страниц архива;
- в поиске всплывают страницы
/page/2/без полезного трафика; - в индексе есть архивы, которые дублируют основную страницу раздела;
- сайт получает предупреждения о «страницах с альтернативным каноническим URL» или о слабых дублях;
тогда имеет смысл ограничить индексацию пагинации. Но делать это нужно аккуратно: не ломая навигацию, не убирая ссылки из HTML и не закрывая от обхода сами страницы, если они нужны для перехода робота по разделу.
Диагностика: откуда именно берутся страницы пагинации
Сначала проверьте, как WordPress и тема формируют архивы. Важно понять, это обычная пагинация записей, пагинация категорий или пагинация в кастомном архиве.
Что смотреть в первую очередь
- отчёт Google Search Console по страницам, попавшим в индекс;
- результат поиска по сайту через
site:example.ru/page/2; - исходный HTML страницы архива: есть ли
rel="next",rel="prev", canonical и meta robots; - настройки SEO-плагина, если он уже управляет метатегами;
- шаблон темы: не выводит ли он отдельный canonical для пагинации.
Если canonical указывает на саму страницу пагинации, а не на первую страницу архива, поисковик получает сигнал, что это самостоятельный URL. Это не всегда ошибка, но для большинства контентных сайтов это лишнее.
Пошаговое решение: закрыть пагинацию от индексации через код
Самый предсказуемый вариант — добавить noindex,follow только для страниц пагинации архивов. Так поисковик не будет держать их в индексе, но сможет проходить по ссылкам дальше.
Ниже пример для functions.php дочерней темы или для небольшого must-use плагина:
<?php
add_filter( 'wp_robots', function( $robots ) {
if ( is_paged() && ( is_home() || is_archive() || is_search() ) ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Что делает этот код:
is_paged()ловит страницы с номером пагинации;is_home(),is_archive()иis_search()ограничивают правило только нужными типами страниц;wp_robots— штатный фильтр WordPress для meta robots.
Если у вас SEO-плагин уже управляет robots meta, проверьте, не конфликтует ли он с этим фильтром. Иногда достаточно настроить сам плагин, а код не нужен.
Если нужен более точный контроль по типам архивов
Иногда закрывать нужно только пагинацию рубрик, а архивы записей оставить открытыми. Тогда условие можно сузить:
<?php
add_filter( 'wp_robots', function( $robots ) {
if ( is_paged() && is_category() ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Это полезно, если рубрики у вас служебные или слишком мелкие, а блоговые архивы вы хотите оставить для обхода.
Альтернативы: плагин, canonical или код
Если не хочется править тему, можно использовать SEO-плагин или отдельный инструмент для технической чистки. Но важно понимать компромиссы.
| Способ | Что делает | Плюсы | Минусы |
|---|---|---|---|
Код через wp_robots | Добавляет noindex,follow на нужные архивы | Точно, без лишней логики, не зависит от интерфейса плагина | Нужно аккуратно внедрять и тестировать |
| SEO-плагин | Даёт настройки для архивов и robots meta | Удобно для редактора и администратора | Не всегда есть тонкая настройка именно для пагинации |
| Canonical на первую страницу | Склеивает сигналы с первой страницей архива | Иногда достаточно для снижения дублей | Не всегда убирает URL из индекса, если страница уже известна поисковику |
Если на сайте уже используется Clearfy Pro, проверьте его настройки для meta robots и архивов: в некоторых проектах этого достаточно, чтобы не писать отдельный код. Но если нужна точечная логика по типам архивов, код обычно надёжнее. Подробности по плагину можно посмотреть здесь: Clearfy Pro.
Что проверить после внедрения
После изменения не ограничивайтесь просмотром исходника одной страницы. Нужно убедиться, что сигнал дошёл до поисковика и не сломал навигацию.
- Откройте
/page/2/в браузере и проверьте HTML-код: должен появитьсяnoindex. - Убедитесь, что ссылки на следующую и предыдущую страницы остались в разметке.
- Проверьте canonical: он должен вести на ту логику, которую вы выбрали для архива, а не на случайный URL.
- В Search Console отправьте страницу на повторную проверку, если она уже была в индексе.
- Через несколько дней проверьте, уменьшилось ли число проиндексированных URL с
/page/.
Для быстрой локальной проверки можно использовать curl:
curl -I https://example.ru/category/news/page/2/В ответе ищите заголовки, которые формирует сервер и плагины. Но помните: meta robots в HTML этим способом не увидеть, поэтому лучше дополнительно посмотреть исходник страницы.
Частые ошибки и как их исправить
Закрыли пагинацию через robots.txt
Это частая ошибка. Запрет в robots.txt не убирает URL из индекса, если поисковик уже знает о нём. Кроме того, вы можете лишить робота доступа к HTML, где как раз и находится canonical или meta robots. Для пагинации обычно нужен noindex, а не блокировка обхода.
Поставили noindex на все архивы подряд
Так можно случайно закрыть полезные страницы категорий, тегов или страницы блога. Сначала определите, какие архивы реально нужны в индексе, а какие только создают шум. Если сомневаетесь, начните с самых слабых разделов и проверьте статистику.
Сломали пагинацию в теме
Иногда разработчики убирают ссылки на следующие страницы вместе с закрытием индексации. Это ошибка: поисковый робот должен иметь возможность пройти по архиву, даже если сам URL не должен ранжироваться. noindex,follow решает именно эту задачу.
Конфликт с SEO-плагином
Если плагин уже добавляет свои robots meta, ваш фильтр может не сработать так, как ожидается. В этом случае оставьте один источник правды: либо настройка в плагине, либо код. Два механизма одновременно часто дают непредсказуемый результат.
Практические советы по безопасности и производительности
Техническая правка для robots meta сама по себе безопасна, но внедрять её лучше через дочернюю тему или mu-plugin, а не в основной шаблон. Тогда обновление темы не перетрёт изменения.
- не редактируйте файлы темы напрямую, если сайт уже в эксплуатации;
- проверяйте изменения на staging-копии, особенно если архивы генерируются кастомным шаблоном;
- не ставьте несколько SEO-плагинов одновременно — они часто конфликтуют в meta robots и canonical;
- если архивы тяжёлые, отдельно проверьте кэширование страниц пагинации: закрытие от индексации не отменяет нагрузку на сервер.
Если на сайте много служебных архивов, имеет смысл сначала навести порядок в технической базе: убрать лишние дубли, проверить canonical, настроить robots meta и только потом трогать пагинацию. В таких задачах полезно смотреть не на отдельный URL, а на весь шаблон архива целиком.
Когда нужно не только закрыть пагинацию, но и привести в порядок другие технические сигналы сайта, удобнее делать это централизованно. Для этого часто используют инструменты вроде Clearfy Pro, если в проекте уже есть задача на SEO-чистку и управление дублями: https://wpshop.ru/plugins/clearfy.