Как удалить дубли архивов и тег-страниц в WordPress без потери нужной индексации

На небольшом сайте дубли архивов часто незаметны, но на живом проекте они быстро размывают структуру индексации: одна и та же запись доступна через категорию, тег, автора, дату и пагинацию. Поисковик видит несколько страниц с очень похожим набором материалов, а вы потом ловите странные каноникалы, просевшие клики и мусор в отчётах по индексированию.

Ниже разберём не абстрактную «SEO-оптимизацию», а конкретную задачу: как оставить полезные архивы, а лишние дубли закрыть, склеить или убрать из выдачи без поломки темы и без лишних плагинов.

Когда проблема уже есть: как понять, что WordPress плодит дубли

Сначала стоит не править код, а проверить симптомы. Обычно дубли архивов проявляются так:

  • в поиске индексируются страницы тегов, которые отличаются только названием;
  • страницы категорий и тегов показывают одинаковый набор записей;
  • в индексе есть пагинация архивов, хотя на ней нет уникальной ценности;
  • в Search Console появляются страницы с низкой ценностью или «Просканировано, но не проиндексировано»;
  • в выдаче всплывают служебные URL, которые вы не планировали продвигать.

Проверка простая: откройте несколько архивов и сравните их HTML-заголовок, description, список записей и канонический URL. Если у двух страниц совпадает почти всё, это кандидат на удаление из индекса или на объединение.

Что именно считать дублем, а что нет

Не все архивы нужно вырезать. Категория может быть полезной посадочной страницей, а тег — нет. Авторский архив иногда нужен в медиа-проекте, но на корпоративном блоге он обычно только дублирует ленту записей. Пагинация почти всегда техническая, и её ценность для поиска надо оценивать отдельно.

Тип страницыОставлять в индексеКомментарий
КатегорииЧасто даЕсли есть уникальный текст, нормальная структура и спрос
ТегиЧаще нетОсобенно если теги создаются без контроля и дублируют категории
Авторские архивыПо ситуацииПолезны для редакционных сайтов, бесполезны для корпоративных
Пагинация архивовОбычно нетЭто технические страницы, а не самостоятельные посадочные

Пошаговое решение: что убрать, что склеить, что оставить

Рабочая схема состоит из трёх шагов: определить приоритетные архивы, закрыть мусорные, а для нужных — добавить уникальность и корректные мета-данные.

1. Оставьте только те архивы, которые реально нужны

Если тегами никто не пользуется как навигацией, их проще отключить от индексации и не тратить время на их поддержку. Если авторский архив не несёт пользы, его тоже можно убрать из поисковой выдачи, но оставить для внутренней навигации.

Для этого удобно использовать фильтры WordPress и не трогать шаблоны руками в каждом файле темы. Ниже пример, который закрывает от индексации теги и авторские архивы, а также ставит noindex,follow для страниц пагинации архивов.

<?php
add_filter('wp_robots', function ($robots) {
    if (is_tag() || is_author()) {
        $robots['noindex'] = true;
        $robots['follow']   = true;
    }

    if (is_paged() && (is_category() || is_tag() || is_author() || is_archive())) {
        $robots['noindex'] = true;
        $robots['follow']   = true;
    }

    return $robots;
});

Этот вариант не ломает доступность страниц для пользователей и не запрещает обход ссылок. Он только подсказывает поисковику, что индексировать такие URL не нужно.

2. Уберите дублирующие архивы из меню и внутренних ссылок

Если теговые страницы не нужны, мало закрыть их от индексации. Их ещё надо перестать активно раздавать по сайту. Проверьте меню, блоки «популярные теги», облака тегов и автоматические списки в сайдбаре. Часто именно они создают лишний вес для бесполезных архивов.

Если архивы выводятся через тему, лучше убрать их из шаблона, чем маскировать SEO-метками. Так вы уменьшите число обходов и снизите шум в структуре сайта.

3. Добавьте уникальность тем архивам, которые оставляете

Категория, которую вы хотите продвигать, должна отличаться от обычной ленты. Для неё нужен нормальный title, description и, желательно, короткий текст перед списком записей. Без этого категория часто выглядит как ещё одна копия главной страницы блога.

Если в теме используется стандартный вывод архивов, можно добавить описание категории прямо в шаблон category.php или в общий archive.php:

<?php if (have_posts()) : ?>
    <header class="archive-header">
        <h1 class="archive-title"><?php single_cat_title(); ?></h1>
        <?php if (category_description()) : ?>
            <div class="archive-description"><?php echo wp_kses_post(category_description()); ?></div>
        <?php endif; ?>
    </header>

    <?php while (have_posts()) : the_post(); ?>
        <!-- вывод записи -->
    <?php endwhile; ?>
<?php endif; ?>

Если описание категории пустое, не пытайтесь автоматически генерировать длинный текст ради SEO. Лучше оставить страницу короткой, чем размножать шаблонные абзацы.

Как убрать дубли на уровне шаблонов и мета-данных

Иногда проблема не в самих архивах, а в том, как тема их размечает. Одинаковые title, одинаковые description и отсутствующий canonical создают поисковику лишнюю работу.

Проверьте canonical и заголовки

В WordPress canonical обычно выводится ядром и SEO-плагинами, но тема может мешать, если в ней есть собственные мета-блоки. Откройте исходный код страницы архива и убедитесь, что canonical указывает на саму страницу, а не на главную или на похожий архив.

Если нужно явно задать canonical для архивов, можно использовать фильтр wp_get_canonical_url только там, где это действительно оправдано. Но чаще достаточно не вмешиваться в стандартный механизм и убрать дублирующие мета-теги из темы.

Сравнение подходов

ПодходКогда подходитМинус
Плагин для SEOЕсли нужно быстро закрыть архивы и настроить мета-данные без кодаЛишняя зависимость и риск конфликтов с темой
Код в теме или дочерней темеЕсли нужен точечный контроль над архивамиНужно аккуратно тестировать после обновлений
Оставить как естьЕсли архивов мало и они реально полезныДубли могут накопиться позже

Если у вас уже стоит плагин для технической чистки сайта, например Clearfy Pro, часть задач по архивам можно закрыть через интерфейс. Но если нужен точный контроль над конкретными типами архивов, код всё равно надёжнее: вы видите, что именно меняется, и не зависите от скрытых настроек.

Проверка результата после внедрения

После правок не ограничивайтесь визуальной проверкой. Нужно убедиться, что поисковик получает именно те сигналы, которые вы задумали.

  • Откройте страницу архива и проверьте meta robots в исходном коде.
  • Убедитесь, что canonical указывает на текущий URL.
  • Проверьте, что закрытые архивы всё ещё доступны пользователю, но не выглядят как приоритетные посадочные.
  • Пройдитесь по нескольким страницам пагинации и посмотрите, не остались ли они индексируемыми.
  • В Search Console отправьте на переобход несколько изменённых URL и сравните статус через несколько дней.

Для быстрой локальной проверки удобно использовать браузерный просмотр исходника или команду curl:

curl -I https://example.com/tag/sample/
curl -s https://example.com/tag/sample/ | grep -iE 'robots|canonical'

Если вы видите noindex,follow на закрытых архивах и корректный canonical на оставленных страницах, базовая настройка сделана правильно.

Частые ошибки и как их исправить

Закрыли от индексации всё подряд

Самая частая ошибка — поставить noindex на все архивы, а потом обнаружить, что полезные категории тоже выпали из поиска. Исправление простое: разделите архивы по типам. Категории оставляйте только там, где они реально несут смысл, а теги и служебные архивы закрывайте точечно.

Удалили архив из шаблона, но оставили ссылки на него

Если страница больше не нужна, уберите не только её вывод, но и все внутренние ссылки на неё. Иначе вы получите битую навигацию или бесполезные переходы. Проверьте меню, хлебные крошки, блоки похожих материалов и сайдбар.

Поменяли robots, но не проверили sitemap

Если архивы остаются в XML-карте сайта, поисковик всё равно будет их регулярно обходить. После изменений проверьте, что ненужные архивы не попадают в sitemap, особенно если он генерируется SEO-плагином или кастомным кодом.

Сделали одинаковые title для категорий и тегов

Когда title у категории и тега совпадает почти полностью, поисковик получает ещё один сигнал о дубле. Лучше использовать разные шаблоны заголовков или вообще убрать теговые архивы из индекса.

Практические советы по безопасности и производительности

Техническая чистка архивов не должна превращаться в хаотичное редактирование ядра темы. Работайте через дочернюю тему или небольшой mu-plugin, если правка должна жить независимо от обновлений.

  • не правьте оригинальные файлы темы на боевом сайте;
  • перед изменениями сделайте резервную копию базы и файлов;
  • проверяйте изменения на staging-версии, если сайт уже в индексе;
  • не добавляйте тяжёлые условия в каждый запрос без необходимости;
  • если архивов много, следите, чтобы тема не делала лишние запросы к базе на каждой странице.

Если задача выходит за рамки ручной настройки и нужно быстро почистить дубли, мета-данные и служебные архивы, можно использовать инструменты уровня Clearfy Pro: https://wpshop.ru/plugins/clearfy. Но даже в этом случае полезно понимать, какие именно архивы вы закрываете и почему.

Главный критерий успеха здесь не «стало меньше страниц», а то, что в индексе остаются только те архивы, которые помогают пользователю и не дублируют другие разделы сайта.

Отладка проблем с кэшированием в темах WordPress: практическое руководство
29.04.2026
Как добавить поддержку отзывов в тему WordPress с использованием Schema.org
25.05.2026
WooCommerce: как добавить поддержку вариативных товаров в тему WordPress
09.07.2026
WooCommerce: как добавить поддержку оценок и отзывов в тему WordPress
26.07.2026
Как создать тему WordPress с поддержкой отзывчивого дизайна
16.03.2026