wordpressa.ru wordpress wordpressa.ru

Как закрыть от индексации страницы тегов, архивов и пагинации в WordPress без поломки SEO

На небольших и средних WordPress-сайтах проблема обычно не в нехватке контента, а в его расползании по служебным страницам: теги, архивы по датам, авторы, страницы пагинации, пустые таксономии. В индексе они создают дубли, размывают релевантность и мешают поисковику быстрее добираться до полезных материалов.

Задача здесь не в том, чтобы «всё запретить», а в том, чтобы оставить в индексе только те страницы, которые реально несут ценность. Для части архивов достаточно noindex,follow, для части — убрать саму генерацию, а для части — просто не выводить ссылки в интерфейсе.

Как понять, что проблема именно в дублях архивов

Сначала стоит проверить не абстрактную «индексацию», а конкретные симптомы. Если в поиске всплывают страницы вида /tag/..., /author/..., /2024/... или /page/2/, а сами эти страницы не дают самостоятельной ценности, это уже повод для настройки.

Что смотреть в первую очередь

  • отчёт по страницам в Google Search Console: есть ли в индексе архивы и пагинация;
  • поисковый оператор site:example.com tag или site:example.com /page/;
  • наличие одинаковых заголовков и описаний у архивов;
  • пустые или почти пустые теги в админке WordPress;
  • дублирующиеся сниппеты у страниц категорий и тегов.

Если архивы уже получают трафик и у них есть смысл как посадочные страницы, закрывать их целиком не нужно. Но если это технические страницы без уникального контента, их лучше убрать из индекса или хотя бы не давать им конкурировать с основными материалами.

Какие страницы обычно стоит закрывать, а какие нет

У WordPress нет универсального ответа для всех сайтов. Решение зависит от структуры контента. Ниже — практическая таблица, от которой удобно отталкиваться.

Тип страницыЧто делатьКомментарий
Теги без уникальной ценностиnoindex,follow или удаление из шаблонаЧасто это главный источник дублей
Архивы по датамОбычно закрыть от индексацииПолезны редко, особенно на контентных сайтах
Архивы авторовОставить только если есть редакция и уникальные биографииИначе это дубли списков записей
Пагинация архивовЧаще не индексировать, но ссылки оставитьВажно не ломать обход роботом
Пустые таксономииНе индексировать и не выводитьИначе создают мусорные URL

Пошаговое решение через SEO-плагин

Если на сайте уже стоит SEO-плагин, проще всего начать с него. В большинстве случаев этого достаточно, и не нужно лезть в код темы. Важно только не смешивать разные способы управления мета-тегами: если плагин уже ставит noindex, не дублируйте это вручную в шаблоне.

Что настроить в интерфейсе

  1. Откройте настройки индексации архивов в SEO-плагине.
  2. Для тегов и архивов по датам включите noindex.
  3. Для архивов авторов решите отдельно: если на сайте один автор, чаще всего их тоже закрывают.
  4. Проверьте, что follow не отключён без необходимости: поисковику всё ещё полезно проходить по ссылкам внутри сайта.
  5. После изменений обновите sitemap, если плагин включает архивы туда автоматически.

Если вы используете Clearfy Pro, в нём есть отдельные настройки для удаления дублей и чистки сайта. Это не магия, а просто удобный способ централизованно отключить лишние архивы и элементы, которые плодят технический шум. Подход уместен, когда нужно быстро привести в порядок типовой сайт без кастомной разработки: Clearfy Pro.

Когда лучше сделать это кодом

Код нужен, если:

  • SEO-плагин не даёт нужной гранулярности;
  • нужно закрыть только часть таксономий;
  • важно не зависеть от интерфейса плагина;
  • на проекте есть собственная тема или mu-plugin, где удобно держать технические правила.

Ниже пример, который добавляет noindex,follow для архивов тегов, дат и авторов, а также для страниц пагинации архивов. Это рабочая база, которую можно адаптировать под конкретный сайт.

<?php
add_action('wp_head', function () {
    if (is_tag() || is_date() || is_author() || is_paged()) {
        echo '<meta name="robots" content="noindex,follow" />' . "\n";
    }
}, 1);

Этот вариант простой, но у него есть ограничение: он влияет только на вывод в <head>. Если SEO-плагин уже печатает свой robots meta, может получиться конфликт. Тогда лучше использовать фильтры самого плагина или убрать дублирующий код.

Более аккуратный вариант для тем и mu-plugin

Если нужен контроль без прямой печати в шаблоне, можно использовать фильтр wp_robots. Он есть в современных версиях WordPress и позволяет добавлять директивы без ручной вставки HTML.

<?php
add_filter('wp_robots', function (array $robots) {
    if (is_tag() || is_date() || is_author() || is_paged()) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
});

Такой способ лучше, потому что он не дублирует разметку и обычно корректнее уживается с ядром и плагинами. Но перед внедрением всё равно проверьте, не переопределяет ли robots meta ваш SEO-плагин.

Как не сломать sitemap и внутренние ссылки

Распространённая ошибка — закрыть архивы от индексации и одновременно убрать их из навигации, sitemap и хлебных крошек. В итоге поисковик теряет часть структуры сайта, а пользователь — удобные точки входа.

Правильная логика такая: страницы могут быть закрыты от индексации, но ссылки на них внутри сайта иногда всё равно нужны. Например, теги могут быть полезны как навигационный слой, даже если сами страницы тегов не должны ранжироваться.

  • Не удаляйте ссылки на архивы только потому, что они закрыты от индексации.
  • Не добавляйте закрытые архивы в XML sitemap.
  • Проверьте, что пагинация не ведёт на 404.
  • Если архив пустой, лучше не выводить его в меню и блоки тегов.

Проверка результата после внедрения

После настройки не ограничивайтесь визуальной проверкой страницы в браузере. Нужно убедиться, что поисковик видит именно то, что вы задумали.

Что проверить вручную

  1. Откройте страницу архива и посмотрите исходный код: есть ли <meta name="robots" content="noindex,follow" /> или эквивалент через wp_robots.
  2. Проверьте, не осталось ли второго robots meta от плагина.
  3. Откройте несколько страниц пагинации: они должны отдавать 200, а не 404, если вы не удаляли их специально.
  4. Посмотрите sitemap: закрытые архивы не должны туда попадать.
  5. В Search Console отправьте на переобход важные страницы, если меняли логику массово.

Если используете командную строку, удобно быстро проверить заголовки и код ответа через curl:

curl -I https://example.com/tag/wordpress/
curl -s https://example.com/tag/wordpress/ | grep -i robots

Для страниц пагинации полезно отдельно проверить, что они не закрыты случайно по шаблону и не отдают ошибку из-за неверной настройки плагина или темы.

Частые ошибки и как их исправить

Закрыли архивы в robots.txt вместо meta robots

Это частая путаница. Disallow в robots.txt не равно noindex. Если страница уже известна поисковику, она может остаться в индексе без описания. Для удаления из индекса нужен именно noindex или корректная обработка через SEO-плагин.

Поставили noindex на всё подряд

Иногда в коде или настройках случайно закрывают и полезные категории, и записи, и страницы пагинации. После этого сайт теряет видимость. Исправление простое: проверьте условия, где применяется правило, и ограничьте его только архивами, которые действительно не нужны в поиске.

Сломали canonical

Если на архиве стоит noindex, но canonical указывает на саму же страницу с параметрами или на нерелевантный URL, поисковик может путаться. Canonical должен быть логичным и стабильным. Для пагинации не стоит бездумно ставить canonical на первую страницу, если это не соответствует вашей SEO-логике и шаблону сайта.

Оставили пустые теги и мусорные таксономии

Если в админке десятки пустых тегов, закрытие от индексации не решает проблему полностью. Такие сущности лучше почистить: удалить пустые термины, убрать автогенерацию тегов из редакторского процесса и проверить, не создаёт ли их плагин импорта.

Практические советы по безопасности и производительности

Любые изменения в SEO-логике лучше вносить не в живую тему, а в дочернюю тему или mu-plugin. Так вы не потеряете правки после обновления. Перед массовым изменением архивов сделайте резервную копию базы и файлов.

Если сайт большой, не пытайтесь править всё вручную на уровне шаблонов. Сначала определите, какие типы архивов реально индексируются и какие из них приносят пользу. Это экономит время и снижает риск случайно закрыть важные посадочные страницы.

  • вносите код через отдельный mu-plugin или дочернюю тему;
  • не смешивайте несколько SEO-плагинов с одинаковой функцией;
  • после изменений очистите кеш страницы и кеш объекта, если он есть;
  • проверьте мобильную и десктопную версии шаблонов архивов;
  • сверьте индексацию через Search Console через несколько дней, а не сразу.

Если на сайте много технических дублей, иногда проще сначала провести общую чистку SEO-настроек и архивов, а уже потом точечно дорабатывать шаблоны. В таких задачах полезны инструменты уровня Clearfy Pro, потому что они закрывают типовые проблемы без переписывания темы с нуля: https://wpshop.ru/plugins/clearfy.

Главный критерий успеха здесь простой: в индексе остаются только те архивы, которые реально помогают пользователю и поисковику, а служебные страницы перестают конкурировать с основным контентом. Если после внедрения вы видите меньше мусорных URL в отчётах и при этом не потеряли переходы на важные разделы, настройка сделана правильно.

×

AI-плагин

WPGPT
Сам создает статьи для вашего сайта WordPress

SEO и мета-теги

Парсинг конкурентов

Изображения

Комментарии

Подробнее