wpcache.ru wordpress WPCache.ru

Как убрать дубли страниц пагинации из индексации в WordPress

Если в Search Console всплывают URL вида /page/2/, /page/3/ и похожие архивные страницы, это не всегда проблема сама по себе. Проблема начинается тогда, когда такие страницы начинают конкурировать с основными разделами, плодят мусор в индексе или тянут на себя краулинговый бюджет. На WordPress это особенно заметно на блогах, новостных сайтах и каталогах с большим количеством записей.

Ниже разберём, как понять, действительно ли пагинация мешает, какие варианты закрытия дубликатов работают в WordPress, и как проверить, что после правки сайт не потерял нужные страницы из поиска.

Когда пагинация становится проблемой

Не каждая страница пагинации должна быть закрыта от индексации. Если у вас большой архив и страницы /page/2/, /page/3/ содержат уникальные записи, поисковик может использовать их как часть обхода сайта. Но есть типовые сценарии, где пагинация начинает вредить:

  • в индексе появляются десятки или сотни архивных URL, которые не дают трафика;
  • в выдаче ранжируются не статьи, а страницы разделов с обрывочным набором материалов;
  • на сайте есть фильтры, сортировки или параметры, которые создают похожие архивы;
  • в шаблоне архивов дублируются title, description и H1 на всех страницах пагинации;
  • поисковик тратит время на обход страниц, которые не несут самостоятельной ценности.

Что проверить в первую очередь

До любых правок откройте Search Console и посмотрите, какие именно URL попали в индекс. Если это только /page/2/ и дальше, а основные разделы индексируются нормально, решение может быть точечным. Если же в индексе есть ещё и параметры сортировки, поиск по сайту, теги и архивы автора, закрывать нужно не только пагинацию.

Полезно также проверить исходный код страниц пагинации. Часто проблема не в индексации как таковой, а в том, что шаблон выводит одинаковые мета-теги на всех страницах архива.

Диагностика: что именно создаёт дубли

На WordPress дубли пагинации обычно возникают по одной из трёх причин: шаблон архива не различает страницы, SEO-плагин не настроен на архивы, либо в теме есть собственная логика, которая ломает canonical и robots meta.

Проверьте такие точки:

  • <title> на страницах архива с пагинацией;
  • meta name="robots";
  • rel="canonical";
  • наличие ссылок на пагинированные страницы в sitemap;
  • не создаёт ли плагин фильтрации отдельные URL с тем же контентом.

Если у вас установлен SEO-плагин, сначала смотрите его настройки. В ряде случаев достаточно изменить шаблон индексации архивов или отключить вывод архивов в sitemap, а код вообще не понадобится. Но если тема или плагин ведут себя нестабильно, лучше зафиксировать правила на уровне кода.

Пошаговое решение: закрываем только лишнее

Самый безопасный подход — не ставить глобальный noindex на все архивы подряд, а закрыть только пагинированные страницы, если они не нужны в поиске. Для этого можно использовать фильтр wp_robots, который есть в ядре WordPress.

Вариант через код в functions.php или мини-плагин

Добавьте код в дочернюю тему или в собственный плагин. Он ставит noindex,follow только на страницы пагинации архивов, кроме главной страницы архива.

add_filter( 'wp_robots', function( array $robots ) {
    if ( is_paged() && ( is_archive() || is_search() || is_home() ) ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Что делает этот код: поисковик не индексирует вторую и последующие страницы архивов, но может переходить по ссылкам дальше. Это важно, если на страницах пагинации лежат ссылки на записи, которые вы не хотите отрезать от обхода.

Если нужно закрыть только архивы записей, а главную блога оставить открытой, сузьте условие:

add_filter( 'wp_robots', function( array $robots ) {
    if ( is_paged() && is_home() ) {
        $robots['noindex'] = true;
        $robots['follow']  = true;
    }

    return $robots;
} );

Если нужен canonical на первую страницу

В некоторых проектах полезно дополнительно проверить canonical. На пагинированных страницах он должен указывать на саму страницу, а не всегда на первую. Иначе поисковик может считать вторую страницу копией первой и игнорировать её содержимое некорректно. Это особенно критично для больших архивов и разделов с уникальными анонсами.

Если SEO-плагин уже выводит корректный canonical, не дублируйте его кодом. Двойной canonical — частая ошибка, из-за которой поисковик получает противоречивые сигналы.

Сравнение подходов: плагин, код, настройка темы

ПодходКогда подходитПлюсыМинусы
Настройка SEO-плагинаЕсли дубли создаёт стандартный архив WordPressБыстро, без правки кодаНе всегда решает проблемы темы и кастомных архивов
Код через wp_robotsЕсли нужен точечный контрольПрозрачно, предсказуемо, не зависит от интерфейса плагинаНужно аккуратно тестировать на staging
Правка шаблона темыЕсли проблема в title, canonical или разметкеМожно исправить источник дублированияРиск сломать шаблон при обновлении темы

Проверка результата после внедрения

После правки не ограничивайтесь визуальной проверкой в браузере. Нужно убедиться, что поисковик видит именно те сигналы, которые вы планировали.

  • Откройте страницу пагинации и проверьте исходный код.
  • Убедитесь, что есть meta name="robots" content="noindex,follow" или эквивалентный набор директив.
  • Проверьте canonical: он должен быть логичным для конкретной страницы.
  • Посмотрите, не исчезли ли из индекса страницы, которые должны оставаться открытыми.
  • В Search Console отправьте страницу на повторную проверку, если она уже была проиндексирована.

Для быстрой проверки можно использовать curl и посмотреть HTML без браузерных расширений:

curl -I https://example.com/category/news/page/2/
curl -s https://example.com/category/news/page/2/ | grep -iE 'robots|canonical|title'

Если у вас есть доступ к логам сервера, полезно посмотреть, как часто поисковые боты ходят на пагинированные URL после изменений. Резкое падение обхода не всегда плохо, но если вместе с ним пропали переходы к новым материалам, значит, вы закрыли слишком много.

Частые ошибки и как их исправить

Ставят noindex на весь архив целиком

Это самая грубая ошибка. В результате из поиска исчезают не только страницы пагинации, но и основная страница раздела, которая может приносить трафик. Исправление простое: ограничьте условие через is_paged().

Дублируют robots meta из плагина и темы

Если SEO-плагин уже выводит robots meta, а тема добавляет свой тег, поисковик получает конфликтующие инструкции. Оставьте один источник правды. Обычно это SEO-плагин или ядро через wp_robots.

Закрывают пагинацию, но оставляют мусорные параметры

Иногда проблема не в /page/2/, а в URL с параметрами сортировки, поиска или фильтров. В таком случае закрытие пагинации не даст эффекта. Нужно отдельно разбирать параметры, которые генерируют дубли.

Меняют canonical на первую страницу без проверки

Такой приём иногда советуют в старых статьях, но он не универсален. Если страница пагинации содержит уникальный набор записей, canonical на первую страницу может ухудшить понимание структуры сайта. Лучше сначала проверить, как ведёт себя текущий шаблон и что рекомендует ваш SEO-плагин.

Практические советы по безопасности и производительности

Любые правки в SEO и шаблонах лучше вносить не на боевом сайте, а на staging-копии. Это особенно важно, если вы меняете код в functions.php: одна лишняя запятая может положить сайт, а откат в продакшене займёт лишнее время.

Если на сайте много архивов, подумайте о снижении количества бесполезных страниц в принципе:

  • уменьшите число записей на страницу, если архивы слишком тяжёлые;
  • уберите из индекса теги и таксономии без реальной ценности;
  • проверьте, не генерирует ли тема лишние архивы автора или дат;
  • очистите sitemap от URL, которые не должны индексироваться.

Если нужен более системный аудит дублей, технических архивов и мусорных URL, удобно использовать инструменты вроде Clearfy Pro: он помогает навести порядок в SEO-настройках и убрать часть типовых дублей без ручной сборки всего набора правил. Но даже с плагином логику индексации лучше понимать руками, иначе легко закрыть лишнее.

В итоге рабочая схема обычно выглядит так: сначала находите источник дублей, затем закрываете только пагинированные архивы, после этого проверяете robots, canonical и индексацию в Search Console. Если всё сделано аккуратно, поисковик перестаёт тратить ресурсы на мусорные URL, а основные страницы разделов остаются доступны и понятны.

×

Увеличьте продажи!

Скидка на
My Popup!

-15%
плагин для WordPress

Успей купить ⋙