Если на сайте уже есть дубли из архивов рубрик, меток или кастомных таксономий, простое удаление ссылок из меню проблему не решает. Поисковик продолжает видеть сами архивные страницы, а иногда и их пагинацию. На практике задача обычно сводится к одному из двух сценариев: либо архивы нужны пользователям, но не должны попадать в индекс, либо часть таксономий вообще не должна существовать как отдельные посадочные страницы.
Ниже — рабочая схема, которая помогает закрыть taxonomy-архивы от индексации, не ломая навигацию, фильтры и внутреннюю перелинковку.
Когда архив taxonomy действительно стоит закрывать
Не все архивы нужно прятать. Если таксономия собирает осмысленные страницы с уникальным контентом и трафиком, закрывать её от индексации — плохая идея. Но если архивы создаются автоматически и повторяют контент записей, они часто только размывают качество индекса.
Типичные случаи
- метки дублируют рубрики и не дают отдельной ценности;
- кастомная таксономия используется только для внутренней фильтрации;
- архивы пустые или содержат 1–2 записи без текста;
- страницы таксономий создаются массово и плодят тонкие дубли;
- пагинация архивов индексируется отдельно и создаёт лишние URL.
Диагностика: что именно индексируется сейчас
Перед правками нужно понять, где проблема: в самих архивных страницах, в пагинации или в XML-карте сайта. Бывает, что архив закрыт через noindex, но остаётся в sitemap, и поисковик всё равно продолжает его обходить.
Проверка в браузере и через поиск
- откройте архив taxonomy и посмотрите исходный код на наличие
<meta name="robots"; - проверьте HTTP-заголовки, если SEO-плагин отдаёт
X-Robots-Tag; - выполните поиск по сайту в Google с оператором
site:example.com category/или по конкретному URL; - посмотрите, есть ли архив в XML sitemap;
- проверьте, не ведут ли внутренние ссылки на десятки пустых архивов.
Если архив уже в индексе, а вы просто поставите noindex, удаление может занять время. Это нормально. Важно не усугубить ситуацию новыми дублями и не сломать каноникал.
Пошаговое решение: закрываем taxonomy-архивы корректно
Есть три рабочих подхода: через SEO-плагин, через код в теме или через комбинацию обоих вариантов. Для большинства сайтов удобнее закрывать архивы на уровне SEO-плагина, а код использовать только для точечных исключений.
Вариант 1. Через SEO-плагин
Если у вас уже стоит плагин для SEO, проверьте настройки таксономий. В большинстве случаев можно отдельно задать индексируемость для рубрик, меток и пользовательских таксономий. Это самый безопасный путь, потому что плагин обычно сам проставляет noindex, корректный canonical и не ломает шаблон архива.
Что важно проверить после включения:
- архив отдаёт
noindex, follow, а не просто скрыт из меню; - URL убран из XML sitemap, если он больше не должен индексироваться;
- страница остаётся доступной для пользователей, если она нужна как фильтр;
- нет конфликтов с кэшем и CDN, которые могут отдавать старые мета-теги.
Вариант 2. Через код для конкретной таксономии
Если нужен точечный контроль, можно добавить фильтр в functions.php дочерней темы или в собственный мини-плагин. Ниже пример для WordPress SEO-плагина, который поддерживает фильтр robots для архивов. Смысл в том, чтобы закрывать только нужную таксономию, а не все архивы подряд.
add_filter( 'wpseo_robots', function( $robots ) {
if ( is_tax( 'product_brand' ) ) {
return 'noindex,follow';
}
return $robots;
} );Этот пример уместен, если вы точно знаете, что таксономия product_brand не должна индексироваться. Для других SEO-плагинов фильтры будут другими, поэтому не стоит копировать код вслепую. Логика одна: определить нужный архив и вернуть нужную директиву.
Вариант 3. Закрыть архив и убрать его из sitemap
Если архив не нужен ни поисковику, ни пользователю как отдельная страница, одного noindex мало. Нужно ещё исключить его из карты сайта. Иначе робот будет регулярно возвращаться к URL, тратить краулинговый бюджет и держать страницу в обходе дольше, чем нужно.
Для кастомной таксономии это обычно делается в настройках SEO-плагина или через регистрацию таксономии с параметром public и show_in_rest, но менять эти флаги стоит только если вы понимаете последствия для админки и редактора.
Сравнение подходов
| Подход | Когда подходит | Плюсы | Минусы |
|---|---|---|---|
| Настройки SEO-плагина | Нужно закрыть рубрики, метки, часть таксономий | Быстро, безопасно, обычно без кода | Зависит от конкретного плагина и его интерфейса |
| Фильтр в коде | Нужна точечная логика для одной таксономии | Гибко, можно контролировать отдельно | Нужно аккуратно тестировать после обновлений |
| Удаление архивов из шаблона/регистрации | Архив не должен существовать как страница | Убирает сам источник дубля | Может сломать фильтрацию, хлебные крошки и ссылки |
Проверка результата после внедрения
После правок не ограничивайтесь просмотром страницы в браузере. Нужно проверить, что поисковик видит именно то, что вы задумали.
Чек-лист проверки
- в исходном коде архивной страницы есть
noindexили соответствующийX-Robots-Tag; - страница не попадает в XML sitemap;
- canonical указывает на сам архив, если он остаётся доступным, или на более релевантную страницу, если архив заменён;
- пагинация архивов не создаёт отдельные индексируемые дубли;
- внутренние ссылки на архивы не ведут на 404;
- в Search Console нет резкого роста ошибок сканирования после изменений.
Если используете кэш-плагин или серверный кэш, очистите его после настройки. Иначе можно увидеть старую версию страницы и сделать ложный вывод, что правило не сработало.
Частые ошибки и как их исправить
Поставили noindex, но оставили архив в sitemap
Это частая причина, почему URL не исчезает из обхода. Решение простое: уберите архив из карты сайта на уровне SEO-плагина или генератора sitemap. Если таксономия создаётся кодом, проверьте, не добавляется ли она в sitemap автоматически.
Закрыли архив, но сломали фильтрацию
Иногда разработчики отключают сам архив или меняют параметры таксономии, а потом перестают работать фильтры в каталоге, хлебные крошки или блоки похожих материалов. Если архив нужен как интерфейс, не удаляйте его целиком — ограничьтесь noindex и исключением из sitemap.
Сделали noindex для всех taxonomy-архивов
Это слишком грубо. На многих сайтах рубрики — важные посадочные страницы, а метки — лишние. Закрывать всё подряд нельзя без анализа структуры. Сначала определите, какие таксономии реально дают трафик и полезны пользователю.
Не учли пагинацию
Если закрыт только первый URL архива, а страницы /page/2/, /page/3/ остаются открытыми, дубли никуда не исчезают. Проверьте, как SEO-плагин обрабатывает пагинацию, и убедитесь, что правила применяются ко всей цепочке.
Практические советы по безопасности и производительности
Любые изменения в SEO-логике лучше вносить через дочернюю тему или отдельный мини-плагин, а не в родительскую тему. Тогда обновление шаблона не сотрёт ваши правки. Если правка касается только robots-логики, не трогайте шаблоны архивов без необходимости.
Для крупных сайтов полезно:
- не генерировать лишние архивы на уровне регистрации таксономий;
- не плодить метки без редакционного контроля;
- проверять, не создаёт ли плагин фильтрации отдельные индексируемые URL;
- следить за тем, чтобы кэш не отдавал старые meta robots после изменения настроек;
- не закрывать важные рубрики, если они уже собрали внешние ссылки и трафик.
Если вам нужно быстро почистить сайт от дублей и лишних архивов, удобно сначала собрать список проблемных сущностей, а потом уже править правила индексации. В таких задачах часто помогает связка настроек SEO и ручной проверки шаблонов. Например, у Clearfy Pro есть инструменты для удаления дублей и технической чистки сайта: https://wpshop.ru/plugins/clearfy?utm_source=wpmy.ru&utm_medium=article&utm_campaign=kak-zakryt-arkhivy-taxonomy-wordpress-ot-indeksacii-bez-polomki-filtratsii.
Как понять, что решение сработало
Итоговая проверка должна быть не визуальной, а технической. Откройте несколько архивов, включая пагинацию, и убедитесь, что:
- страница доступна пользователю, если это нужно;
- поисковый робот получает нужную директиву;
- URL исключён из sitemap;
- внутренние ссылки не ведут на пустые или бесполезные архивы;
- в Search Console нет новых массовых проблем с покрытием.
Если после изменений архив всё ещё индексируется, проверьте два места: кэш и sitemap. В большинстве реальных случаев проблема сидит именно там, а не в самом noindex.
// Пример точечного исключения taxonomy-архива из robots-логики
add_filter( 'wpseo_robots', function( $robots ) {
if ( is_tax( 'news_topic' ) || is_tax( 'event_topic' ) ) {
return 'noindex,follow';
}
return $robots;
} );Если нужна не только индексация, но и общая чистка технических дублей, лучше сначала собрать список всех архивов, таксономий и служебных URL, а уже потом принимать решение по каждому типу отдельно. Это дешевле, чем потом разбирать последствия массового noindex на живом сайте.