Как найти и убрать дубли страниц в WordPress без потери SEO

Дубли в WordPress обычно появляются не из-за одной ошибки, а из-за набора мелочей: одинаковый контент доступен по разным URL, архивы индексируются вместе с основными страницами, а служебные версии сайта случайно попадают в поиск. В результате поисковик тратит краулинговый бюджет не туда, а в индексе остаются страницы, которые вы не планировали продвигать.

Ниже разберём не абстрактную «борьбу с дублями», а конкретный сценарий: как найти источник дублей, что закрывать, что оставлять, и как проверить, что после правок сайт не потерял нужные страницы.

Как понять, что дубли уже есть

Проблема редко видна глазами на сайте. Чаще сигнал приходит из Search Console, логов или аналитики: одна и та же страница получает разные URL, а в выдаче появляются не те версии, которые вы считали основными.

Типичные признаки

  • в индексе есть страницы с параметрами ?replytocom=, ?amp, ?utm_... или сортировкой;
  • один и тот же материал доступен по /post/, /post, с www и без www, по http и https;
  • архивы тегов, авторов, дат и страниц пагинации индексируются вместе с основными материалами;
  • в поиске видны страницы вложений изображений вместо самих записей;
  • в Search Console растёт число «Дубликат, Google выбрал другой канонический URL».

Что проверить в первую очередь

  1. Откройте несколько проблемных URL в браузере и сравните конечный адрес после редиректов.
  2. Посмотрите исходный код страницы и найдите тег rel="canonical".
  3. Проверьте, не открываются ли служебные архивы без ограничений на индексацию.
  4. Сравните заголовки ответа сервера для основной и дубль-версии.

Какие дубли в WordPress встречаются чаще всего

Перед исправлением важно не смешивать разные типы дублей. Для каждого нужен свой способ решения: где-то достаточно canonical, где-то нужен редирект, а где-то — запрет на индексацию или отключение самого источника дублей.

Источник дубляЧто делатьКогда редирект не нужен
Параметры URLОставить одну каноническую версию, остальные закрытьЕсли параметр не меняет контент
Архивы тегов/авторов/датЗакрыть от индексации или ограничитьЕсли архив реально нужен для поиска
Страницы вложенийРедирект на родительскую запись или отключить индексированиеЕсли вложения используются как отдельные страницы осознанно
Пагинация и сортировкаПроверить canonical и robotsЕсли это служебная навигация без SEO-ценности

Пошаговое решение: от диагностики к исправлению

Шаг 1. Найдите источник дубля

Начните с URL, которые уже попали в индекс или вызывают подозрение. Если у вас есть доступ к консоли поиска, откройте отчёт по индексированию и выгрузите примеры страниц с дублирующимися URL. Если нет — используйте поиск по сайту и ручную проверку.

Для быстрой проверки канонического адреса можно использовать curl:

curl -I https://example.com/sample-page/

Смотрите на статус ответа, редиректы и заголовок Link, если он отдаётся сервером. Для HTML-версии полезно проверить сам canonical:

curl -s https://example.com/sample-page/ | grep -i canonical

Шаг 2. Приведите сайт к одной основной версии

У WordPress должна быть одна базовая схема URL: HTTPS, один вариант домена, единый формат слэша на конце, если он используется. Это не косметика, а фундамент, без которого дубли будут появляться снова.

Проверьте настройки в Настройки → Общие: адрес WordPress и адрес сайта должны совпадать с фактической основной версией. Если сайт работает за прокси или CDN, убедитесь, что редиректы не зацикливаются.

Шаг 3. Закройте служебные архивы от индексации

Если архивы тегов, авторов или дат не несут самостоятельной ценности, их лучше не продвигать как отдельные посадочные страницы. Самый безопасный вариант — оставить их для навигации, но убрать из индексации.

Если вы используете SEO-плагин, настройка обычно делается в интерфейсе. Если нужен код, можно добавить noindex для архивов авторов и дат через фильтр wp_robots:

add_filter( 'wp_robots', function( $robots ) {
    if ( is_author() || is_date() ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Это не удаляет страницы, а лишь подсказывает поисковику не включать их в индекс. Для архивов тегов решение зависит от структуры сайта: если теги работают как полноценные тематические страницы, закрывать их без анализа не стоит.

Шаг 4. Уберите страницы вложений

Страницы медиафайлов — частый источник мусора в индексе. Если у изображения нет смысла жить отдельной страницей, безопаснее редиректить attachment URL на родительскую запись или сам файл.

Рабочий вариант — редирект на пост, к которому прикреплено вложение:

add_action( 'template_redirect', function() {
    if ( is_attachment() ) {
        $parent = wp_get_post_parent_id( get_queried_object_id() );

        if ( $parent ) {
            wp_safe_redirect( get_permalink( $parent ), 301 );
            exit;
        }
    }
} );

Если родителя нет, можно редиректить на сам файл или на главную, но это уже зависит от структуры медиатеки и того, как у вас используются вложения.

Шаг 5. Проверьте canonical на шаблонах и плагинах

Иногда дубли создаёт не WordPress, а тема или плагин: один и тот же контент выводится в нескольких шаблонах, а canonical указывает не туда. После правок откройте исходный код страницы и убедитесь, что canonical ведёт на единственный основной URL.

Если canonical отсутствует или дублируется, сначала ищите конфликт в теме и SEO-плагине. Два разных генератора canonical на одной странице — частая причина странного поведения в индексе.

Как проверить, что решение сработало

Проверка нужна не только в браузере. Важно убедиться, что поисковик видит именно ту версию, которую вы считаете основной.

  • основной URL отдаёт 200 OK;
  • дубль-версии отдают 301 на канонический адрес или закрыты от индексации;
  • в исходном коде есть один canonical, и он совпадает с основной страницей;
  • в Search Console после переобхода уменьшается число дублей и «альтернативных канонических URL»;
  • страницы вложений и служебные архивы больше не появляются в поиске как отдельные результаты.

Для быстрой технической проверки удобно сравнить заголовки ответа:

curl -I https://example.com/page/
curl -I https://example.com/page

Если одна версия редиректит, а другая открывается напрямую, это нормально только в том случае, если редирект ведёт на единственный правильный URL. Если обе версии отдают 200, дубль остаётся.

Частые ошибки и как их исправить

Закрыли от индексации всё подряд

Иногда после борьбы с дублями в noindex уезжают и полезные страницы. Это случается, когда правило написано слишком широко: например, закрыты все архивы, хотя часть из них нужна для трафика. Исправление простое: пересмотрите логику по типам страниц, а не по одному шаблону.

Поставили редирект вместо canonical без необходимости

Редирект полезен, когда есть явная дубль-версия одного и того же адреса. Но если речь о фильтрах, параметрах или служебных страницах, иногда достаточно canonical и noindex. Лишние редиректы усложняют обход сайта и могут ломать аналитику.

Canonical указывает на несуществующий URL

Это встречается после миграций, смены структуры ссылок или ручных правок шаблона. Поисковик видит сигнал, но не может использовать его нормально. Проверьте, что canonical ведёт на реально открывающуюся страницу с кодом 200.

Дубли создаёт кэш или CDN

Если у вас есть кэш-плагин или CDN, убедитесь, что они не отдают старые версии canonical и robots. После правок очистите кэш сайта, серверный кэш и кэш CDN, иначе вы будете проверять уже неактуальную версию страницы.

Что делать, если дубли появляются снова

Если проблема возвращается, значит источник не устранён, а только замаскирован. Обычно это одна из трёх причин: тема генерирует лишние шаблоны, плагин создаёт дополнительные URL, или редакторы публикуют материалы с одинаковой структурой без правил.

Для профилактики полезно держать под контролем:

  • архивы таксономий и авторов;
  • страницы вложений;
  • параметры сортировки и фильтрации;
  • дубли главной страницы на http/https и www/без www;
  • служебные страницы, которые не должны индексироваться.

Если на сайте много технического мусора, иногда проще сначала привести в порядок SEO-слой и дубли через один инструмент, чем вручную править десятки шаблонов. В таких сценариях уместно посмотреть в сторону Clearfy Pro: он помогает закрывать лишние архивы, чистить служебные элементы и убирать часть типовых дублей без переписывания темы. Но даже с плагином базовую логику URL и canonical всё равно нужно проверить вручную.

Главный критерий простой: у каждой страницы должен быть один понятный адрес, одна основная версия и один сценарий индексации. Всё остальное — либо редирект, либо закрытие от поиска, либо удаление источника дубля.

WooCommerce: как автоматически удалять товары по дате и статусу
19.09.2026
Как удалить все плагины WordPress одним кликом
01.10.2026
Как автоматически удалять старый контент в WordPress по установленным правилам
02.10.2026
Как использовать WPReset для быстрого восстановления базы данных WordPress
11.09.2026
Как использовать REST API WordPress для автоматизации и расширения функционала
11.09.2026