WP-1

Как закрыть строчные дубли архивов и страниц пагинации в WordPress

Если в Search Console всплывают похожие URL с одинаковым контентом, проблема часто не в «плохом SEO», а в типовой структуре WordPress: архивы рубрик, теги, авторы, страницы пагинации и сортировки могут отдавать почти одинаковые блоки. Для поисковика это не всегда критично, но для сайта с большим количеством материалов такие дубли быстро размывают сигналы и усложняют обход.

Ниже — рабочая схема: как найти источник дублей, что закрывать через noindex, что лучше отдавать через canonical, а что вообще убирать на уровне шаблона или плагина. Без «магии» и без ломания нормальной индексации.

Что именно считать дублем в WordPress

Не каждый похожий URL нужно резать. Для начала важно разделить три сценария:

  • Почти одинаковые архивы — например, страницы рубрик и тегов с теми же карточками записей.
  • Пагинация — /page/2/, /page/3/ и дальше, где контент меняется частично.
  • Служебные варианты — страницы с параметрами сортировки, поиска, фильтрации, UTM и внутренними параметрами темы или плагина.

Если у вас уже настроен canonical и базовый robots.txt, это не означает, что проблема закрыта. Canonical помогает подсказать основной URL, но не всегда убирает мусор из обхода. А robots.txt не решает вопрос дублирующего контента, если URL уже известен поисковику.

Диагностика: где искать проблему

Начните не с правок, а с проверки факта. Иначе легко закрыть то, что должно индексироваться, и оставить открытым то, что мешает.

Проверьте Search Console и серверные логи

В Search Console смотрите:

  • страницы с одинаковым title и description;
  • URL с параметрами;
  • страницы пагинации, которые попадают в индекс без необходимости;
  • дубли по типам архивов: рубрики, теги, авторы, даты.

Если есть доступ к логам, полезно посмотреть, как часто бот ходит в архивы и параметры. Это помогает понять, что реально тратит crawl budget.

Проверьте шаблоны темы

Частая причина дублей — тема выводит одинаковые блоки на разных типах архивов, а заголовки и мета-теги отличаются слабо. В таком случае поисковик видит несколько страниц с почти одинаковой структурой и не понимает, какая из них основная.

Отдельно проверьте:

  • страницы тегов, если они дублируют рубрики;
  • архивы автора, если на сайте один автор или почти один и тот же контент;
  • архивы по датам, если они не несут самостоятельной ценности;
  • страницы поиска внутри сайта.

Что закрывать через noindex, а что — через canonical

Здесь часто путают инструменты. Если коротко: canonical — это подсказка о предпочтительном URL, noindex — запрет на индексацию конкретной страницы. Для дублей архивов обычно удобнее комбинировать подходы.

СценарийЛучший вариантКомментарий
Пагинация архивовcanonical на саму страницу пагинацииНе склеивайте все страницы в первую, если на 2-й и дальше есть уникальные записи
Теги-дубли рубрикnoindex, followЕсли теговые страницы не дают ценности, их лучше не индексировать
Архивы автора на сайте с одним авторомnoindex, followИначе это почти всегда дубли
Служебные параметрыcanonical на чистый URL или исключение из индексацииЗависит от того, нужен ли параметр пользователю

Пошаговое решение: закрываем лишние архивы без поломки сайта

Шаг 1. Уберите из индекса архивы, которые не нужны пользователю

Если у вас нет смысла индексировать теги, архивы автора или даты, их можно закрыть через SEO-плагин или кодом. Важно не просто спрятать ссылки, а именно управлять мета-роботами.

Пример для темы или мини-плагина: добавим noindex, follow для архивов автора и дат, а также для страниц поиска.

<?php
add_filter('wp_robots', function (array $robots) {
    if (is_author() || is_date() || is_search()) {
        $robots['noindex'] = true;
        $robots['follow'] = true;
    }

    return $robots;
});

Этот вариант работает с современным API WordPress для robots meta. Он не трогает рубрики и записи, а значит, риск случайно закрыть нужные страницы ниже.

Шаг 2. Настройте canonical для архивов и пагинации

Если у вас кастомные архивы или тема генерирует странные URL, canonical лучше задавать явно. Для обычной пагинации WordPress часто делает это сам, но после правок темы или SEO-плагина стоит проверить итоговый HTML.

Проверка в шаблоне:

<?php if (is_archive() || is_home()) : ?>
    <link rel="canonical" href="<?php echo esc_url( get_pagenum_link( max( 1, get_query_var('paged') ) ) ); ?>" />
<?php endif; ?>

Этот фрагмент не универсален для всех тем, но показывает принцип: canonical должен указывать на текущую логическую страницу, а не всегда на первую страницу архива.

Шаг 3. Уберите мусорные параметры из генерации ссылок

Если тема или плагин добавляют параметры сортировки, фильтрации или трекинга во внутренние ссылки, поисковик может начать обходить десятки почти одинаковых URL. Для таких случаев лучше не плодить ссылки в шаблоне, чем потом лечить последствия.

Например, если в навигации или виджете формируется URL с параметрами, их нужно очищать перед выводом:

<?php
$url = add_query_arg(
    array(
        'sort' => 'popular',
        'utm_source' => false,
        'utm_medium' => false,
    ),
    home_url('/blog/')
);

echo esc_url( remove_query_arg( array('utm_source', 'utm_medium'), $url ) );

Для внутренних ссылок UTM-параметры вообще не нужны. Если они уже попали в шаблон, лучше убрать их на уровне генерации, а не надеяться на canonical.

Если нужен плагин: когда это быстрее и безопаснее

Если вы не хотите править код темы, удобнее использовать SEO-плагин с управлением мета-роботами и canonical. Для типовой чистки дублей часто хватает одного инструмента, если он не конфликтует с темой и не дублирует настройки.

Из практики важнее не название плагина, а наличие трех вещей: управление noindex для архивов, корректный canonical и возможность отключить лишние типы архивов. Если нужен более широкий набор функций по чистке сайта и SEO-настройкам, можно посмотреть Clearfy Pro: https://wpshop.ru/plugins/clearfy.

Как проверить, что решение сработало

После правок не ограничивайтесь визуальной проверкой. Нужны три уровня контроля:

  1. HTML страницы — проверьте, что на нужных архивных страницах появился noindex или корректный canonical.
  2. Search Console — отправьте на переобход несколько изменённых URL и посмотрите, как они попадают в отчет по индексированию.
  3. Сканирование сайта — прогоните сайт краулером и сравните количество дублей title, description и canonical-цепочек до и после.

Минимальный ручной чек:

  • откройте архив рубрики и тегов;
  • посмотрите исходный код страницы;
  • убедитесь, что canonical ведет на нужный URL;
  • проверьте, что закрытые архивы не отдают индексируемый статус;
  • пройдитесь по пагинации и убедитесь, что страницы 2, 3 и дальше не ломают навигацию.

Частые ошибки и как их исправить

Ошибка 1. Закрыли все архивы, включая полезные

Иногда под нож попадают рубрики, которые реально приводят трафик и помогают поиску структуры сайта. Исправление простое: оставьте индексируемыми только те архивы, где есть уникальный смысл, а не «все подряд».

Ошибка 2. Canonical указывает на первую страницу, хотя контент разный

Так делать опасно для пагинации. Если на второй странице архива есть уникальные записи, canonical на первую страницу может ухудшить обработку этих URL. Для пагинации лучше сохранять самоссылающийся canonical.

Ошибка 3. robots.txt используют вместо noindex

Если URL уже в индексе, запрет в robots.txt не удалит его мгновенно. Более того, поисковик может сохранить адрес без контента. Для дублей это обычно не то, что нужно.

Ошибка 4. Параметры удаляют только в sitemap

Если мусорные URL продолжают появляться во внутренних ссылках, sitemap ничего не решит. Нужно чистить генерацию ссылок в теме, виджетах и фильтрах.

Практические советы по безопасности и производительности

Любые правки в functions.php лучше сначала делать в дочерней теме или мини-плагине. Так вы не потеряете изменения после обновления темы. Перед внедрением проверьте:

  • есть ли резервная копия файлов и базы;
  • не конфликтует ли SEO-плагин с вашим кодом;
  • не дублируются ли canonical-теги из темы и плагина;
  • не закрыты ли случайно важные страницы, которые должны ранжироваться.

Если сайт большой, после чистки дублей полезно проверить нагрузку на обход: меньше мусорных URL — меньше лишних запросов к серверу. Это не мгновенное ускорение фронтенда, но для индексации и стабильности обхода эффект обычно заметен.

Если вам нужно не только закрыть дубли, но и системно почистить технический мусор, удобнее делать это в связке: SEO-настройки, отключение лишних архивов, контроль canonical и проверка шаблонов. Именно такой порядок дает предсказуемый результат, а не набор разрозненных правок.

×

AI-плагин

WPGPT
Сам создает статьи для вашего сайта WordPress

SEO и мета-теги

Парсинг конкурентов

Изображения

Комментарии

Подробнее