Если в индексе появляются одинаковые или почти одинаковые страницы, поисковик начинает тратить обход на лишние URL, а не на важные материалы. В WordPress это обычно не одна причина, а набор типичных источников: архивы, пагинация, параметры в адресе, страницы с www и без www, http и https, а иногда и дубли, созданные темой или плагином.
Ниже разберём, как быстро понять, откуда берутся дубли, какие из них действительно вредят SEO, а какие можно оставить, и как убрать проблему без риска сломать сайт.
Сначала определите, что именно считается дублем
Не каждая похожая страница — проблема. Для поисковика дубль возникает, когда на сайте есть несколько URL с одинаковым или почти одинаковым содержимым, а канонический вариант не задан или задан неправильно. На практике это выглядит так:
- одна и та же статья открывается по нескольким адресам;
- категория, тег и архив автора показывают почти одинаковый набор записей;
- страница доступна с параметрами в URL, например для сортировки или фильтра;
- один и тот же контент доступен по разным протоколам, поддоменам или со слешем и без него;
- плагин или тема выводят отдельные служебные страницы с тем же текстом, что и основной материал.
Если дубль отличается только частью шаблона, но основной текст тот же, для SEO это всё равно лишний URL. Если же страницы похожи, но решают разные задачи, например карточка товара и страница категории, удалять ничего не нужно — лучше настроить канонизацию и индексацию.
Где искать источники дублей в WordPress
Начинать удобнее не с удаления, а с поиска причины. В WordPress дубли чаще всего появляются в нескольких местах.
Архивы таксономий и авторов
Категории, теги, архивы по дате и автору часто повторяют друг друга по смыслу. На небольшом блоге это особенно заметно: одна запись может быть доступна и в категории, и в теге, и в архиве автора. Сам по себе такой архив не ошибка, но если он почти пустой или полностью дублирует другие страницы, его лучше закрыть от индексации или привести к одному каноническому варианту.
Пагинация и страницы со списками
Страницы вида /page/2/, /page/3/ не являются дублями первой страницы в строгом смысле, но иногда поисковик воспринимает их как слишком похожие. Проблема чаще возникает, если на страницах списка меняется только несколько карточек, а заголовок и описание остаются одинаковыми. В этом случае важно проверить, не дублируются ли title и meta description, а также корректно ли работает пагинация.
Параметры в URL
Сортировка, фильтры, UTM-метки, служебные параметры — частый источник мусорных адресов. Для интернет-магазинов и каталогов это особенно заметно: одна и та же категория может открываться с десятками вариантов URL. Если такие страницы не нужны в поиске, их нужно либо закрывать, либо указывать каноническую ссылку на основную версию.
Разные версии одного сайта
Проверьте, не доступны ли страницы одновременно по нескольким вариантам домена и протокола: http и https, www и без www. Если редиректы не настроены, поисковик может увидеть несколько копий одного и того же сайта.
Дубли, созданные темой или плагином
Некоторые темы и плагины создают отдельные шаблоны для страниц, записей, товаров, авторов, поиска и архивов. Иногда они выводят одинаковый контент в разных местах или добавляют служебные страницы, которые не нужны в индексе. Здесь важно смотреть не название плагина, а конкретный URL и его содержимое.
Как быстро проверить, есть ли дубли
Для первичной проверки не нужен сложный аудит. Достаточно пройтись по нескольким источникам.
- Откройте сайт в поиске по оператору
site:вашдомен.ruи посмотрите, какие URL попали в индекс. - Сравните заголовки и сниппеты у похожих страниц: если они одинаковые, это уже повод проверить канонические адреса.
- Откройте подозрительный URL и посмотрите исходный код страницы. В нём должен быть тег
link rel="canonical"с основным адресом. - Проверьте, не открывается ли та же страница по альтернативным адресам: со слешем и без него, с
wwwи без, поhttpиhttps. - Если используете Google Search Console или Яндекс Вебмастер, посмотрите отчёты по страницам, исключённым из индекса, и по дублирующимся URL.
Если у вас сайт на большом количестве страниц, удобнее сначала собрать список подозрительных адресов из аналитики, логов сервера или отчётов поисковых систем, а уже потом проверять каждый URL вручную.
Что делать с дублями: безопасный порядок действий
Удалять всё подряд не нужно. Правильный порядок обычно такой: сначала выбрать основной URL, затем настроить редирект или canonical, и только после этого убирать лишние версии из индекса.
1. Оставьте один основной адрес
Для каждой важной страницы должен быть один предпочтительный URL. Именно на него должен вести внутренний перелинковочный вес, именно его нужно указывать в sitemap, и именно он должен открываться без лишних вариантов.
Если у вас уже есть несколько версий одной страницы, выберите ту, которая должна ранжироваться, и зафиксируйте её как основную.
2. Настройте редирект там, где дубль не нужен пользователю
Если страница полностью дублирует другую и не имеет самостоятельной ценности, лучше сделать 301-редирект на основную версию. Это подходит для:
- дубликатов с www и без www;
- http-версии, если сайт уже работает на https;
- страниц со старым адресом после смены структуры;
- случайно созданных копий одной и той же страницы.
Редирект безопаснее, чем просто удаление: пользователь и поисковик сразу попадают на нужный URL. Но перед массовыми изменениями обязательно сделайте резервную копию и проверьте, что редиректы не создают цепочки и циклы.
3. Используйте canonical для похожих, но не идентичных страниц
Если страницы похожи, но полностью удалять их нельзя, задайте каноническую ссылку на основную версию. Это полезно для:
- страниц с параметрами сортировки и фильтрации;
- пагинированных списков, если они не должны конкурировать с первой страницей;
- версий одного материала с техническими параметрами в URL;
- страниц, где контент частично повторяется по шаблону.
В WordPress canonical обычно добавляют SEO-плагины или сама тема. Если canonical отсутствует или указывает не туда, поисковик может выбрать не ту страницу для индекса.
4. Закройте от индексации служебные страницы
Поиску не нужны страницы поиска по сайту, внутренние фильтры, результаты сортировки, технические архивы без ценности и пустые теги. Их можно закрыть от индексации через настройки SEO-плагина или мета-тег noindex, если это поддерживает ваш стек.
Но не путайте noindex и удаление. Если страница нужна пользователю, но не должна ранжироваться, её обычно не удаляют, а исключают из индекса и оставляют доступной для навигации.
Как удалить дубли в WordPress на практике
Способ зависит от того, откуда именно появился дубль.
Если дубль создался из-за неправильных адресов сайта
Проверьте настройки Настройки → Общие: адрес WordPress и адрес сайта должны быть одинаково заданы в нужной версии, обычно с https и без лишних вариантов. После этого настройте постоянный редирект на один вариант домена на уровне сервера или хостинга.
Если вы не уверены в настройках сервера, лучше не править правила вручную без резервной копии: ошибка в редиректе может сделать сайт недоступным.
Если дубли идут из архивов и таксономий
Для блога или корпоративного сайта часто достаточно оставить в индексе только категории, а теги, архивы автора и даты закрыть или ограничить. Для статейника решение зависит от структуры: если теги реально помогают навигации и дают уникальные подборки, их можно оставить. Если это просто копии списка записей, пользы от индексации мало.
Для интернет-магазина обычно отдельно проверяют категории, фильтры и страницы сортировки. Категории часто нужны в индексе, а фильтры и сортировки — нет.
Если дубли создают параметры URL
Здесь важно не только закрыть лишние версии, но и не сломать аналитику и фильтрацию. Если параметр нужен только для отображения, а не для отдельной страницы, настройте canonical на основную версию. Если параметр создаёт полноценную страницу с уникальной ценностью, её можно оставить в индексе, но тогда у неё должен быть свой уникальный контент.
Если проблема в теме или плагине
Проверьте, не выводит ли плагин отдельные архивы, страницы автора, вложения медиафайлов или служебные шаблоны. Иногда дубли появляются после установки SEO-плагина, конструктора страниц или плагина фильтров. В таком случае решение обычно не в удалении контента, а в настройке шаблонов индексации.
Если у вас уже стоит комплексный SEO-плагин, имеет смысл проверить, умеет ли он закрывать архивы, задавать canonical и управлять мета-тегами без правки кода. Например, Clearfy Pro от WPShop закрывает часть типичных SEO-задач по чистке сайта и удалению дублей: https://wpshop.ru/plugins/clearfy. Но даже с таким инструментом сначала нужно понять источник дубля, а уже потом включать нужную настройку.
Как проверить, что проблема решена
После изменений не ограничивайтесь визуальной проверкой страницы. Нужны три вещи:
- основной URL открывается без редирект-цепочек и отдаёт код ответа 200;
- лишние версии ведут на основной адрес через 301 или закрыты от индексации;
- в исходном коде основной страницы указан правильный canonical.
Через несколько дней или недель, в зависимости от частоты обхода сайта, проверьте отчёты поисковых систем. Если дубли были техническими, они постепенно уйдут из индекса или будут заменены на канонический URL. Если проблема остаётся, значит, где-то ещё остался доступный альтернативный адрес.
Что чаще всего ломают при удалении дублей
Самая частая ошибка — удалять страницу, не настроив редирект. Вторая — закрывать от индексации всё подряд, включая нужные категории и страницы товаров. Третья — ставить canonical на нерелевантный URL, например на главную вместо основной версии материала.
Ещё одна типичная ситуация — когда в sitemap остаются старые адреса, а на сайте уже работают новые. Тогда поисковик продолжает обходить мусорные URL. После чистки проверьте карту сайта и внутренние ссылки: они тоже должны вести только на основные страницы.
Если коротко, рабочая схема такая: найти источник дубля, выбрать основной URL, настроить редирект или canonical, закрыть ненужные служебные страницы и проверить результат в поисковых инструментах. Для WordPress этого обычно достаточно, чтобы убрать технические дубли без потери полезных страниц и без лишнего риска для сайта.