Как запретить индексацию тегов в WordPress без потери трафика

Теги в WordPress часто превращаются в источник дублей: одна и та же подборка записей доступна через архив категории, архив тега, автора и пагинацию. Если теговые страницы не дают поисковый трафик и не несут самостоятельной ценности, их обычно закрывают от индексации. Но делать это нужно аккуратно: просто поставить noindex недостаточно, если архивы продолжают плодить внутренние ссылки и мусор в карте сайта.

Ниже — рабочий сценарий: как понять, что именно мешает, чем закрывать теги, как не сломать SEO и как проверить результат после изменений.

Когда теги действительно стоит закрывать

Не все архивы тегов одинаково бесполезны. Если тег используется как полноценная навигационная страница, на ней есть уникальный текст, она получает переходы из поиска и помогает пользователю — закрывать её не нужно. Если же тегов много, они дублируют категории или создаются автоматически без контроля, индексировать их обычно нет смысла.

Типичные признаки проблемных тегов

  • на сайте десятки или сотни тегов, а в поиске ранжируются только категории;
  • один и тот же пост размечен 5–10 тегами без реальной семантики;
  • архивы тегов пустые или почти пустые;
  • в индексе есть страницы тегов с одинаковыми title и description;
  • поисковик тратит краулинговый бюджет на мусорные архивы вместо важных страниц.

Диагностика: что именно сейчас индексируется

Перед правками проверьте, как WordPress отдаёт архивы тегов и попадают ли они в sitemap. Это можно сделать без специальных сервисов.

Что смотреть вручную

  • откройте несколько URL вида /tag/slug/ и проверьте исходный код страницы;
  • посмотрите, есть ли в <head> мета-тег robots с noindex;
  • проверьте, не включены ли теги в XML-карту сайта;
  • сравните title у разных тегов — если они шаблонные, это плохой сигнал;
  • в Search Console откройте отчёт по страницам и найдите архивы тегов в индексе.

Если у вас установлен SEO-плагин, часть настроек может уже быть доступна в интерфейсе. Но важно понимать, что именно он делает: только ставит noindex, убирает архив из sitemap или ещё и меняет каноникал.

Какой способ выбрать: плагин, код или комбинация

Для большинства сайтов достаточно настроить архивы тегов в SEO-плагине. Код нужен, если вы хотите точечно закрыть только часть тегов, например пустые или служебные. Комбинированный вариант полезен, когда нужно и закрыть индексацию, и убрать теги из карты сайта.

ПодходЧто делаетПлюсыМинусы
SEO-плагинnoindex, иногда исключение из sitemapбыстро, без кодане всегда гибко
Код в теме/плагинеточечное управление мета-robots и sitemapконтроль над логикойнужно тестировать после обновлений
Комбинациязакрытие + чистка sitemapлучше для крупных сайтовчуть сложнее сопровождение

Пошаговое решение через код

Если нужен надёжный и проверяемый вариант без зависимости от интерфейса плагина, можно добавить noindex для архивов тегов через фильтр wp_robots. Этот способ работает в современных версиях WordPress и не требует правки шаблонов.

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_tag() ) {
        $robots['noindex'] = true;
        $robots['nofollow'] = false;
    }

    return $robots;
} );

Этот код добавляет noindex только на страницах тегов. Ссылки на странице при этом остаются доступными для обхода, что обычно безопаснее, чем массовый nofollow.

Если нужно закрыть только пустые теги

Иногда полезные теги есть, а пустые или почти пустые — нет. Тогда лучше закрывать только архивы без контента. Для этого можно проверить количество записей у текущего термина.

<?php
add_filter( 'wp_robots', function( array $robots ) {
    if ( is_tag() ) {
        $term = get_queried_object();

        if ( $term instanceof WP_Term && (int) $term->count < 2 ) {
            $robots['noindex'] = true;
        }
    }

    return $robots;
} );

Порог < 2 здесь условный. На практике его стоит подбирать под структуру сайта: иногда закрывают только пустые теги, иногда — всё, что не даёт трафика и не имеет описания.

Как убрать теги из XML sitemap

Если вы используете wp-sitemap.xml, архивы тегов могут попадать туда автоматически. Для исключения таксономии можно отключить её показ в sitemap через фильтр wp_sitemaps_taxonomies.

<?php
add_filter( 'wp_sitemaps_taxonomies', function( $taxonomies ) {
    if ( isset( $taxonomies['post_tag'] ) ) {
        unset( $taxonomies['post_tag'] );
    }

    return $taxonomies;
} );

Если у вас sitemap генерирует SEO-плагин, этот фильтр может не сработать. Тогда настройку нужно искать уже в самом плагине.

Пошаговое решение через SEO-плагин

Если вы не хотите писать код, откройте настройки архивов таксономий в вашем SEO-плагине и выставьте для тегов noindex. Обычно там же можно отключить вывод в sitemap. Это удобнее для редакторов, но важно не забыть проверить итоговый HTML.

  • найдите раздел с таксономиями или архивами;
  • для тегов включите noindex;
  • если есть опция, исключите теги из XML sitemap;
  • сохраните настройки и очистите кэш;
  • проверьте исходный код страницы тега.

Если на сайте уже используется Clearfy Pro, подобные задачи по SEO и чистке дублей часто решаются через его настройки. Но принцип тот же: сначала понять, что именно меняется, потом проверить результат в HTML и sitemap.

Проверка результата после внедрения

После правок не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковик видит именно то, что вы хотели.

Чек-лист проверки

  • откройте страницу тега и проверьте наличие <meta name="robots" content="noindex"> или эквивалентной директивы;
  • проверьте, что тег исчез из sitemap;
  • посмотрите, не остался ли у страницы самоссылочный canonical на индексируемую версию;
  • убедитесь, что важные категории и записи не получили случайный noindex;
  • в Search Console запросите повторную проверку нужных URL;
  • через несколько дней проверьте статус страниц в отчёте об индексировании.

Если у вас есть доступ к серверным логам, полезно посмотреть, как бот ходит по архивам тегов после изменений. Это помогает понять, не остались ли старые ссылки в меню, хлебных крошках или блоках похожих материалов.

Частые ошибки и как их исправить

Закрыли теги, но оставили их в sitemap

Это частая несостыковка. Поисковик видит URL в карте сайта, заходит на него, а там noindex. В результате страница может ещё долго висеть в отчётах как обнаруженная, но не проиндексированная. Решение — убрать таксономию из sitemap и дождаться переобхода.

Поставили nofollow вместо noindex

nofollow не решает проблему дублей. Он только ограничивает переход по ссылкам, а сам архив может остаться в индексе. Для тегов обычно нужен именно noindex, а не жёсткая блокировка ссылок.

Скрыли архивы в robots.txt

Это плохой путь, если цель — убрать страницу из индекса. Если бот не может зайти на URL, он не увидит директиву noindex на самой странице. В итоге старые URL могут дольше оставаться в поиске. Для удаления из индекса сначала нужен доступ к странице, а уже потом — при необходимости — дополнительные ограничения.

Закрыли полезные теги вместе с мусорными

Если у вас есть теги, которые реально собирают трафик, не закрывайте их автоматически. Сначала посмотрите статистику по входам и запросам. Иногда лучше оставить 5–10 сильных тегов открытыми, а остальные закрыть.

Практические советы по безопасности и производительности

Когда вы правите SEO-логику через код, не вносите изменения прямо в файл темы, если он активно обновляется. Лучше использовать дочернюю тему или небольшой mu-plugin. Так вы не потеряете правки после обновления.

Если сайт большой, не делайте массовые изменения без предварительного бэкапа базы и файлов. Особенно если одновременно меняете sitemap, robots и шаблоны архивов. Сначала тест на staging, потом выкладка на прод.

  • храните SEO-правки отдельно от визуальной темы;
  • после изменений очищайте серверный и браузерный кэш;
  • не закрывайте в индекс всё подряд — сначала проверьте трафик и роль страницы;
  • не смешивайте логику noindex и блокировку в robots.txt без необходимости;
  • держите под рукой список URL, которые должны остаться открытыми.

Если вам нужно не только закрыть теги, но и убрать другие дубли, полезно смотреть на проблему шире: архивы, пагинацию, служебные страницы и шаблоны таксономий. Именно там обычно и теряется чистота индекса.

⭐⭐⭐⭐⭐