wpshab.ru wordpress wpshab.ru

Как найти и удалить дубли архивов и страниц в WordPress без потери SEO

Дубли в WordPress обычно появляются не из-за одной ошибки, а из-за набора мелких настроек: открытые архивы тегов, страницы автора, вложения, пагинация, служебные URL плагинов и одинаковые заголовки у таксономий. В итоге поисковик видит несколько адресов с почти одинаковым содержимым и сам выбирает, что оставить в индексе. Это часто заканчивается просадкой релевантности, размытием ссылочного веса и мусором в отчётах по покрытию.

Ниже разберём не абстрактную «чистку сайта», а конкретный сценарий: как найти дубли, понять, что именно индексируется, и убрать лишнее без риска сломать нужные страницы.

Какие дубли WordPress встречаются чаще всего

Если смотреть на проблему с точки зрения технической SEO-диагностики, чаще всего повторяются такие типы URL:

  • архивы тегов, рубрик и авторов с одинаковыми или почти одинаковыми заголовками;
  • страницы вложений, которые дублируют медиафайл или запись-источник;
  • пагинация архивов, где первая страница конкурирует с канонической;
  • страницы поиска и служебные URL, которые не должны попадать в индекс;
  • дубли из-за параметров в URL, например сортировки или фильтрации, если они есть в теме или плагинах.

Отдельная проблема — когда контент на архиве и на странице записи совпадает почти полностью. Например, у рубрики короткое описание, а в списке постов выводится тот же текст, что и в карточках. Для поисковика это уже не «разные страницы», а несколько слабых вариантов одной сущности.

Диагностика: как понять, что именно дублируется

Начинать лучше не с удаления, а с проверки индексации. Иначе легко закрыть от поисковика полезный архив или, наоборот, оставить в индексе технический мусор.

Что проверить в первую очередь

  • отчёт «Страницы» в Google Search Console: там обычно видно, какие URL попали в индекс и почему;
  • поиск по сайту через site:example.com с разными типами URL;
  • наличие одинаковых <title> и meta description у архивов;
  • канонические URL в исходном коде;
  • ответ сервера для служебных страниц: 200, 301, 404 или 410.

Если у вас есть доступ к консоли, полезно быстро посмотреть, какие архивы реально отдаются поисковику. Например, так можно проверить заголовки ответа:

curl -I https://example.com/tag/wordpress/

Или посмотреть, не отдаёт ли страница каноникал на саму себя или на другой адрес:

curl -s https://example.com/tag/wordpress/ | grep -i canonical

Если каноникал отсутствует, а архив доступен по нескольким адресам, это уже повод разбираться с настройками темы, SEO-плагина или правилами редиректов.

Как убрать дубли: рабочая схема

Здесь есть три нормальных подхода: закрыть от индексации, поставить канонический адрес или удалить страницу совсем. Выбор зависит от того, нужна ли эта страница пользователю и есть ли у неё самостоятельная ценность.

ПодходКогда использоватьКомпромисс
noindexдля архивов, которые нужны на сайте, но не должны ранжироватьсястраница остаётся доступной, но не участвует в поиске
canonicalдля дублей с параметрами, пагинации и альтернативных URLнужно аккуратно выбрать основную версию
301/410если страница больше не нужнанужно проверить внутренние ссылки и внешние входящие URL

1. Уберите лишние архивы в SEO-плагине

Если у вас есть SEO-плагин, сначала проверьте настройки архивов авторов, тегов и дат. Для небольшого сайта архивы тегов часто полезны, а архивы авторов и дат — нет. Но это не универсальное правило: если у вас редакционный проект с несколькими авторами, архив автора может быть нормальной посадочной страницей.

Если нужно отключить архивы программно, не делайте это через правку ядра. Лучше использовать фильтры темы или мини-плагин. Например, для отключения архивов автора в теме можно добавить такой код:

<?php
add_action('template_redirect', function () {
    if (is_author()) {
        wp_safe_redirect(home_url('/'), 301);
        exit;
    }
});

Это грубый вариант, но он рабочий. Если архив автора уже в индексе и не нужен, редирект на главную лучше, чем оставлять страницу с 200 и пустым содержанием. Только не применяйте такой редирект, если архивы авторов у вас реально используются для навигации.

2. Закройте вложения и технические страницы

Страницы вложений часто создают мусорный индекс. Если медиафайл открывается как отдельная страница без полезного контента, обычно его лучше перенаправить на родительскую запись или сам файл.

Для вложений можно использовать такой шаблонный редирект:

<?php
add_action('template_redirect', function () {
    if (is_attachment()) {
        $parent = wp_get_post_parent_id(get_queried_object_id());

        if ($parent) {
            wp_safe_redirect(get_permalink($parent), 301);
            exit;
        }

        wp_safe_redirect(home_url('/'), 301);
        exit;
    }
});

Это лучше, чем оставлять пустую attachment page. Но если у вас медиа-страницы специально оптимизированы под поиск, такой редирект делать не стоит.

3. Приведите каноникал и заголовки к одной логике

Если дубли возникают из-за параметров URL или пагинации, важно не просто закрыть страницу, а показать поисковику основную версию. Обычно это делает SEO-плагин, но его настройки стоит проверить вручную. На страницах с пагинацией каноникал должен вести на саму страницу пагинации, а не на первую страницу архива, если это не ломает логику сайта.

Если вы пишете свою логику в теме, не пытайтесь руками собирать каноникал для всех случаев. Лучше ограничиться точечными правками там, где проблема уже подтверждена.

Пошаговая схема очистки дублей

  1. Соберите список URL из Search Console и краулера.
  2. Разделите их на полезные и технические.
  3. Для полезных страниц оставьте индексирование, но исправьте заголовки и описания.
  4. Для технических архивов поставьте noindex или редирект.
  5. Для полностью лишних страниц используйте 301 на релевантный адрес или 410, если контент удалён окончательно.
  6. Проверьте внутренние ссылки, чтобы они вели только на канонические URL.

Как проверить, что решение сработало

После внедрения не ограничивайтесь визуальной проверкой в браузере. Нужны технические признаки, которые можно быстро проверить:

  • страница с дублем отдаёт 301 или 410, если вы её удаляли;
  • в исходном коде остался только один канонический URL;
  • в Search Console уменьшается число страниц со статусом «Просканировано — сейчас не проиндексировано» и похожих технических дублей;
  • поиск site: перестаёт показывать лишние варианты адресов;
  • внутренние ссылки больше не ведут на старые URL.

Для быстрой проверки редиректа можно использовать:

curl -I https://example.com/old-url/

А если нужно убедиться, что страница не индексируется, проверьте HTML на наличие noindex и правильного canonical:

curl -s https://example.com/page/ | grep -Ei 'robots|canonical'

Частые ошибки и как их исправить

Закрыли не тот архив

Самая частая ошибка — отключить архивы тегов или авторов, которые реально дают трафик. Перед изменением посмотрите, есть ли у страницы входящие переходы и показы в Search Console. Если архив работает как посадочная страница, его лучше не удалять, а доработать.

Сделали 301 на главную для всего подряд

Редирект на главную кажется простым решением, но для SEO это часто плохой вариант. Если у удалённой страницы есть близкая замена, перенаправляйте именно на неё. На главную можно отправлять только то, что не имеет релевантного аналога.

Оставили внутренние ссылки на старые URL

Даже после редиректа старые ссылки продолжают создавать лишнюю нагрузку и цепочки переходов. После чистки обязательно пройдитесь по меню, блокам, виджетам и контенту старых записей.

Поставили noindex, но не убрали дубли из sitemap

Если URL остаётся в карте сайта, поисковик всё равно будет его регулярно обходить. Для технических страниц лучше не только закрыть индексацию, но и исключить их из sitemap на уровне SEO-плагина или генератора карты сайта.

Практические советы по безопасности и производительности

Любая массовая чистка URL должна идти через резервную копию и staging-копию сайта. Это не формальность: один неверный редирект может зациклить переходы, а одна ошибка в условии template_redirect — сломать вход в админку или API.

Если вы вносите правки кодом, держите их в мини-плагине или в отдельном файле подключаемого функционала, а не в functions.php активной темы. Так проще откатить изменения и не потерять их при обновлении темы.

Для сайтов, где много дублей из-за архивов и служебных страниц, полезно дополнительно проверить настройки чистки в Clearfy Pro: он помогает убрать часть технического мусора и упростить SEO-настройки без ручного редактирования шаблонов. Но даже с плагином всё равно нужно проверять итоговые URL вручную, потому что автоматическая настройка не знает вашу структуру контента.

Если задача сводится к точечной очистке, не пытайтесь «лечить» всё сразу. Сначала уберите самые вредные дубли: пустые архивы, вложения, технические страницы поиска и старые URL с параметрами. Потом уже смотрите на менее критичные случаи, где нужен canonical или доработка шаблона.

×

AI-плагин

WPGPT
Сам создает статьи для вашего сайта WordPress

SEO и мета-теги

Парсинг конкурентов

Изображения

Комментарии

Подробнее