Как найти и удалить дубли страниц в WordPress из-за пагинации, архивов и тегов

Дубли в WordPress чаще всего появляются не из-за «плохого контента», а из-за штатной генерации URL: архивы рубрик, теги, страницы пагинации, авторские архивы, вложения медиа. Если это не контролировать, поисковик начинает индексировать несколько адресов с почти одинаковым содержимым, а в отчётах появляются лишние страницы, которые не дают трафик и размывают релевантность.

Ниже — рабочий сценарий: как сначала найти источник дублей, затем выбрать способ исправления и проверить, что лишние URL действительно перестали мешать индексации.

Как понять, что проблема именно в дублях архивов и пагинации

Обычно симптом не один. Сайт может выглядеть нормально для посетителя, но в Search Console или в логах видно, что поисковик ходит по страницам, которые вам не нужны.

  • в индексе есть /page/2/, /page/3/ и похожие URL без заметного поискового спроса;
  • теги и рубрики открываются как отдельные страницы, но содержат один и тот же набор записей;
  • страницы вложений изображений индексируются вместо самих записей;
  • в выдаче всплывают архивы автора на сайте, где автор один;
  • в отчётах по сканированию много URL с одинаковыми title и description.

Что проверить в первую очередь

Начните не с правки кода, а с диагностики. Это экономит время: иногда достаточно закрыть от индексации один тип архивов, а иногда нужно ещё убрать внутренние ссылки на лишние страницы.

  1. Откройте несколько архивов рубрик и тегов вручную.
  2. Проверьте, отличаются ли они по смыслу или это почти одинаковые списки записей.
  3. Посмотрите HTML-код страниц пагинации: есть ли там уникальный контент или только список постов.
  4. Проверьте, не создаёт ли тема отдельные страницы для вложений медиа.
  5. Сравните канонические URL в исходнике страницы и фактический адрес.

Если у вас установлен SEO-плагин, посмотрите, не конфликтуют ли его настройки с тем, что уже делает тема. Частая ситуация: тема генерирует архивы, а плагин пытается закрыть их от индексации, но внутренние ссылки продолжают вести на эти URL.

Какие дубли WordPress создаёт чаще всего

Удобнее разделить проблему на типы. Тогда проще выбрать решение: где-то нужен noindex, где-то редирект, а где-то достаточно убрать сам источник ссылок.

Источник дубляЧто обычно происходитЧто делать
Архивы теговПочти повторяют рубрики или другие тегиЗакрыть от индексации или удалить неиспользуемые теги
Пагинация архивовСтраницы /page/2/, /page/3/ повторяют список записейОставить для обхода, но не продвигать как отдельные посадочные
Архивы автораНа сайте один автор, контент дублируетсяОтключить архив автора или закрыть от индексации
Вложения медиаИндексируются пустые страницы вложенийРедиректить вложения на файл или на родительскую запись
Страницы поиска и фильтровСоздают бесконечные комбинации URLЗакрыть от индексации и ограничить внутреннюю перелинковку

Пошаговое решение: как убрать дубли без поломки сайта

Шаг 1. Закройте от индексации ненужные архивы

Если архивы тегов, авторов или страниц поиска не несут самостоятельной ценности, их лучше не пускать в индекс. Это не значит, что их надо удалять физически. Для поисковика достаточно убрать их из индексации и не усиливать внутренними ссылками.

Если вы работаете через код темы или мини-плагин, можно добавить базовые мета-robots правила для отдельных типов архивов:

<?php
add_action('wp_head', function () {
    if (is_tag() || is_author() || is_search()) {
        echo '<meta name="robots" content="noindex,follow" />' . "\n";
    }
});

Такой вариант допустим, но на практике лучше использовать SEO-плагин, если он уже управляет robots meta. Иначе можно получить конфликт: один код выводит noindex, другой — каноникал или другие директивы.

Шаг 2. Уберите страницы вложений с бесполезным контентом

Страницы вложений часто индексируются автоматически, хотя на них почти нет полезного текста. Для большинства сайтов это лишний слой URL. Безопаснее всего перенаправлять вложение на родительскую запись, если она есть, либо на сам файл изображения.

<?php
add_action('template_redirect', function () {
    if (!is_attachment()) {
        return;
    }

    global $post;

    if ($post && $post->post_parent) {
        wp_redirect(get_permalink($post->post_parent), 301);
        exit;
    }

    $file = wp_get_attachment_url(get_the_ID());
    if ($file) {
        wp_redirect($file, 301);
        exit;
    }
});

Этот код не трогает сами файлы и не ломает загрузку изображений. Он только убирает из индекса отдельную страницу вложения, если она не нужна.

Шаг 3. Проверьте канонические URL для пагинации

Пагинация сама по себе не ошибка. Проблема начинается, когда страницы /page/2/ и дальше получают каноникал на первую страницу или, наоборот, дублируют друг друга без логики. Для архивов это особенно заметно на больших сайтах.

Если вы используете SEO-плагин, убедитесь, что он не ставит один и тот же canonical на все страницы архива. Для страниц пагинации canonical должен указывать на текущую страницу, а не на первую, иначе поисковик может игнорировать часть списка.

Если нужно проверить вручную, откройте исходный код страницы и найдите строку с rel="canonical". На /page/2/ должен быть canonical именно на /page/2/, а не на базовый архив.

Шаг 4. Удалите лишние теги и пустые архивы

Если на сайте накопились десятки тегов с одной записью или вообще без записей, они почти всегда создают шум. Здесь лучше не маскировать проблему настройкой noindex, а почистить саму структуру.

  • удалите теги без записей;
  • объедините дублирующие теги в один;
  • проверьте, не созданы ли одинаковые рубрики и теги под разные задачи;
  • уберите автоматическое проставление тегов, если редакция не следит за ними.

Если нужно массово проверить пустые термины, можно использовать WP-CLI или SQL, но только после бэкапа. Для обычной редакционной работы чаще достаточно пройтись по списку таксономий в админке и удалить мусор вручную.

Когда лучше использовать плагин, а когда код

Если задача типовая, плагин быстрее и безопаснее. Если у вас нестандартная тема или нужно точечно управлять отдельными архивами, код даёт больше контроля. Ниже — практическое сравнение.

ПодходПлюсыМинусы
SEO-плагинБыстро, меньше риска сломать шаблонНе всегда удобно для точечных правил
Код в теме/плагинеТочный контроль над архивами и редиректамиНужно тестировать после обновлений
Комбинированный вариантМожно закрыть индексацию плагином, а редиректы сделать кодомВажно не задублировать правила

Если нужен более широкий набор технической чистки сайта — от дублей до лишних архивов и мусорных мета-данных — в таких задачах обычно помогает связка с инструментами вроде Clearfy Pro, но только если вы понимаете, какие именно опции включаете и зачем.

Как проверить, что решение сработало

После правок не полагайтесь на ощущение «вроде стало лучше». Нужна проверка по нескольким точкам.

  1. Откройте проблемные URL в браузере и убедитесь, что они отдают ожидаемый статус: 200, 301 или 404.
  2. Проверьте исходный код: есть ли noindex там, где он нужен.
  3. Посмотрите canonical на страницах пагинации и архивов.
  4. Запустите повторное сканирование в Search Console или другом краулере.
  5. Сравните список URL до и после: лишние страницы должны перестать появляться в отчётах как важные.

Если вы настроили редирект для вложений, проверьте не только главную картинку, но и несколько файлов с разной структурой URL. Иногда проблема всплывает только на старых медиа, загруженных до смены темы.

Частые ошибки и как их исправить

Закрыли от индексации всё подряд

Иногда в попытке убрать дубли отключают и полезные архивы. В результате поисковик теряет нормальную структуру сайта, а трафик по рубрикам проседает. Исправление простое: оставляйте в индексе только те архивы, которые реально могут ранжироваться как посадочные.

Поставили редирект на все архивы

Редирект с пагинации на первую страницу выглядит логично, но для больших архивов это плохая идея. Поисковик должен видеть последовательность страниц, если они нужны для обхода контента. Редиректить стоит вложения и явно мусорные URL, а не всю пагинацию подряд.

Не проверили конфликт с темой

Некоторые темы уже выводят canonical, meta robots и хлебные крошки. Если поверх этого добавить свой код без проверки, можно получить дублирующиеся теги в <head> или неожиданные редиректы. После любых изменений смотрите исходник страницы и тестируйте несколько типов URL.

Удалили теги, но оставили внутренние ссылки

Если тег удалён, а ссылки на него остались в меню, блоках или старых статьях, пользователь и бот будут попадать на 404. Перед удалением проверьте, где этот URL используется. Если удаление массовое, лучше сначала заменить ссылки, а потом чистить термины.

Практические советы по безопасности и производительности

Любая чистка URL затрагивает SEO и кэш. Поэтому сначала делайте резервную копию, потом вносите изменения, и только после этого очищайте кэш страниц, CDN и объектный кэш, если он есть.

  • не меняйте правила индексации на живом сайте без проверки на staging;
  • после редиректов очистите кэш, иначе старые URL могут ещё какое-то время отдавать прежний ответ;
  • не удаляйте архивы физически, если на них есть внешние ссылки — лучше оставить 301;
  • проверяйте, не генерирует ли плагин фильтрации бесконечные параметры в URL;
  • если сайт большой, сканируйте его частями, чтобы не упереться в лимиты краулера.

Если вам нужно не только убрать дубли, но и системно почистить сайт от лишних архивов, мета-данных и технического мусора, удобнее делать это как отдельную задачу, а не «по ходу» правок контента. Тогда проще отследить, что именно изменилось и почему.

Запрет доступа к административной панели WordPress по IP: как ограничить доступ безопасно
21.11.2025
Диагностика и решение проблем с неработающим AJAX в WooCommerce
07.08.2026
Автоматическое отключение неиспользуемых плагинов WordPress
20.01.2026
Диагностика и решение проблем с неработающим AJAX в WooCommerce
03.08.2026
Как найти и удалить дубли страниц в WordPress из-за пагинации, архивов и тегов
23.08.2026