wordpressa.ru wordpress wordpressa.ru

Как закрыть дубли страниц, тегов и архивов в WordPress без поломки индексации

Если сайт на WordPress начал плодить одинаковые страницы, чаще всего проблема не в «плохом SEO», а в структуре самого движка: архивы рубрик, тегов, авторов, дат, пагинация, страницы вложений и служебные URL могут индексироваться параллельно с основными материалами. В результате поисковик видит несколько версий одного и того же контента и сам выбирает, что считать каноническим. Это почти всегда хуже, чем явное управление индексированием.

Ниже — рабочая схема, как диагностировать дубли, что закрывать от индексации, а что оставить, и как проверить, что изменения действительно сработали.

Какие дубли в WordPress встречаются чаще всего

На практике чаще всего мешают не «дубли страниц» в узком смысле, а набор похожих URL, которые ведут к одному и тому же или почти одинаковому контенту. Для WordPress это типично:

  • архивы тегов, если тегов много и они дублируют рубрики;
  • архивы авторов на сайтах с одним автором;
  • архивы по датам, если они не несут отдельной ценности;
  • страницы вложений медиафайлов;
  • пагинация архивов, если она индексируется без необходимости;
  • страницы поиска по сайту;
  • служебные страницы вроде /feed/, /trackback/, /comment-page-1/ — в зависимости от настроек и темы.

Важно не пытаться закрыть всё подряд. Если у архива есть самостоятельная ценность для пользователя и он реально нужен в поиске, его можно оставить. Например, хорошо проработанные рубрики с уникальными описаниями и подборками материалов иногда полезнее, чем очередной noindex «на всякий случай».

Диагностика: где именно появляются дубли

Сначала нужно понять, что именно индексируется и что уже создало шум. Самый быстрый способ — посмотреть отчёт по страницам в Google Search Console и сопоставить его с реальной структурой сайта. Ищите:

  • URL с одинаковыми заголовками и сниппетами;
  • страницы с низкой ценностью и большим числом в индексе;
  • архивы, которые получают показы, но не дают кликов;
  • страницы вложений, если они открываются как отдельные URL.

Дополнительно проверьте сайт вручную через поиск по оператору site:example.ru и сравните типы URL. Если в выдаче всплывают теги, авторы и дата-архивы без явной пользы, это уже сигнал к настройке.

Что смотреть в исходном коде

Откройте несколько проблемных страниц и проверьте:

  • есть ли <meta name="robots" content="noindex,follow">;
  • есть ли корректный rel="canonical";
  • не дублируется ли canonical на всех страницах архива одной и той же ссылкой;
  • не закрыт ли важный контент случайно через noindex.

Если canonical отсутствует или указывает не туда, поисковик может выбрать не ту версию страницы. Если на странице стоит noindex, но она всё равно активно участвует во внутренней перелинковке, это не ошибка, но нужно понимать последствия: страница может передавать меньше пользы в поиске, чем ожидалось.

Пошаговое решение: что закрывать, а что оставить

Универсального набора нет, но для большинства контентных сайтов рабочая логика такая: закрываем от индексации всё, что не несёт самостоятельной поисковой ценности, и оставляем только те архивы, которые помогают навигации и имеют уникальный смысл.

1. Закройте страницы вложений

Если медиафайл открывается как отдельная страница вложения, а не как файл, это почти всегда лишний URL. В WordPress можно настроить редирект вложений на сам файл или на родительскую запись. Если используете SEO-плагин, проверьте, есть ли у него опция для attachment pages.

Если нужен кодовый вариант, можно перенаправлять attachment-страницы в functions.php темы или в мини-плагине:

add_action('template_redirect', function () {
    if (is_attachment()) {
        $parent = wp_get_post_parent_id(get_the_ID());

        if ($parent) {
            wp_redirect(get_permalink($parent), 301);
            exit;
        }

        $file = wp_get_attachment_url(get_the_ID());
        if ($file) {
            wp_redirect($file, 301);
            exit;
        }
    }
});

Этот вариант не идеален для всех проектов, но он понятен и предсказуем. Если у вас уже есть SEO-плагин с такой функцией, лучше использовать его настройку, а не дублировать логику кодом.

2. Закройте теги, если они дублируют рубрики

Теги полезны только тогда, когда они помогают собрать отдельную смысловую подборку. Если на сайте теги используются как мусорные метки, которые повторяют рубрики, их лучше закрыть от индексации. В Yoast SEO, Rank Math и похожих плагинах это обычно делается на уровне архивов таксономий.

Если нужен точечный код без плагина, можно добавить noindex для архивов тегов:

add_filter('wp_robots', function ($robots) {
    if (is_tag()) {
        $robots['noindex'] = true;
        $robots['follow'] = true;
    }

    return $robots;
});

Это не отключает переходы по ссылкам на странице, но говорит поисковику не индексировать сам архив. Для большинства сайтов это безопаснее, чем пытаться удалять теги вручную и ломать структуру контента.

3. Оцените архивы авторов и дат

Если на сайте один автор, архив автора почти всегда дублирует ленту публикаций. В таком случае его обычно закрывают. Если авторов несколько и у каждого есть отдельная ценность, архивы можно оставить, но желательно добавить уникальные описания и не делать их пустыми.

Дата-архивы чаще всего нужны только для навигации по старым материалам. Если они не используются аудиторией и не дают трафик, их тоже можно закрыть. Но если у вас новостной проект или архив по датам — часть пользовательского сценария, закрывать его без анализа не стоит.

4. Разберитесь с пагинацией архивов

Пагинация сама по себе не проблема. Проблема возникает, когда страницы /page/2/, /page/3/ и дальше индексируются как самостоятельные посадочные без смысла. Обычно их не закрывают полностью, если они нужны для обхода сайта, но могут ограничивать индексацию в зависимости от стратегии проекта.

Здесь важно не путать noindex и canonical. Если поставить canonical со всех страниц пагинации на первую страницу, можно сломать обход старых материалов. Для архивов лучше действовать аккуратно и проверять результат в Search Console.

Сравнение подходов: плагин, код или ручная настройка

ПодходКогда подходитПлюсыМинусы
SEO-плагинНужно быстро закрыть архивы и не трогать кодУдобно, меньше риска сломать шаблонНе всегда хватает гибкости для точечных правил
Код в мини-плагинеНужна точная логика для конкретного сайтаКонтроль над условиями, легко версионироватьНужно тестировать после обновлений темы
Ручная правка robots.txtНужно ограничить обход отдельных путейПросто и быстроНе заменяет noindex, не решает дубли полностью

Если задача только в том, чтобы убрать мусорные архивы из индекса, чаще всего достаточно SEO-плагина. Если нужно поведение по условиям — например, закрывать теги только в определённой категории или для части сайта — лучше делать это кодом.

Как проверить, что решение сработало

После изменений не ограничивайтесь визуальной проверкой. Нужны минимум три проверки:

  1. Откройте проблемный URL и посмотрите исходный код: должен появиться noindex или корректный canonical, если вы это настраивали.
  2. Проверьте HTTP-ответ и редиректы для страниц вложений и служебных URL.
  3. В Google Search Console отправьте страницу на повторную проверку или используйте проверку URL, если она доступна для конкретного адреса.

Если закрывали архивы тегов, поищите в индексе несколько URL этого типа через site: и сравните динамику через несколько недель. Быстрой магии здесь нет: поисковику нужно время, чтобы переоценить страницы.

Что считать нормальным результатом

  • страницы, которые вы закрыли, перестают получать новые показы;
  • в индексе уменьшается число служебных URL;
  • основные статьи не теряют доступность для обхода;
  • canonical и robots не конфликтуют между собой.

Частые ошибки и как их исправить

Ошибка 1: закрыли всё через robots.txt. Это не убирает URL из индекса, если на них уже есть внешние или внутренние ссылки. Для удаления из индекса нужен noindex или корректный редирект.

Ошибка 2: поставили canonical на главную страницу для всех архивов. Так делать опасно: поисковик может проигнорировать сигнал или начать путаться в релевантности. Canonical должен указывать на близкую по смыслу каноническую версию, а не на случайную главную.

Ошибка 3: закрыли теги, но оставили их в активной перелинковке без смысла. Это не критично, но создает шум. Если тег не нужен, лучше убрать его из шаблонов или ограничить вывод.

Ошибка 4: забыли про страницы вложений. Они часто появляются автоматически и незаметно, особенно на сайтах с большим количеством изображений.

Ошибка 5: перепутали noindex и nofollow. Для архивов обычно нужен noindex,follow, а не noindex,nofollow. Иначе можно искусственно ухудшить обход внутренних ссылок.

Практические советы по безопасности и производительности

Если вы решаете проблему кодом, не вносите правки прямо в functions.php активной темы без резервной копии. Лучше использовать мини-плагин или mu-plugin, чтобы логика не исчезла после смены темы.

Перед изменениями:

  • сделайте бэкап базы и файлов;
  • проверьте, не завязан ли шаблон на архивы, которые вы собираетесь закрыть;
  • посмотрите, нет ли у закрываемых страниц входящего трафика из поиска или внешних ссылок;
  • не закрывайте всё подряд только потому, что «так чище».

Если нужно быстро навести порядок в дублях, служебных страницах и лишних архивных URL, можно использовать инструменты вроде Clearfy Pro как часть общей настройки сайта, но даже в этом случае важно сначала понять, какие именно типы страниц вы отключаете, а не включать все опции разом: https://wpshop.ru/plugins/clearfy?utm_source=wordpressa.ru&utm_medium=article&utm_campaign=zakryt-dubli-stranits-tagov-i-arhivov-v-robots-i-noindex

Главный критерий здесь простой: после правок сайт должен стать понятнее для поисковика, а не просто «меньше страниц в индексе». Если закрытые URL действительно были мусорными, вы это увидите по структуре индекса и по тому, как Search Console перестанет показывать лишние типы страниц.

×
Прокачай свой сайт WordPress!

WordPress

-20% на премиум темы и плагины

Создай сайт своей мечты ⋙