Пагинация в WordPress часто создаёт не одну проблему, а сразу три: поисковик индексирует лишние URL, в отчётах появляются дубли заголовков и описаний, а краулинговый бюджет уходит на страницы, которые не несут самостоятельной ценности. Типичный пример — архив категории с адресами /category/news/page/2/, /page/3/ и так далее. Сами по себе такие страницы не ошибка, но если их не контролировать, они начинают мешать нормальной индексации сайта.
Ниже разберём, что именно закрывать, когда использовать noindex, а когда достаточно каноникал, и как проверить, что после правок сайт не потерял важные страницы из поиска.
Когда пагинация становится проблемой
Не всякая пагинация требует вмешательства. Если у вас большой каталог материалов, и каждая страница архива реально помогает пользователю добраться до старых записей, поисковик может индексировать такие страницы без вреда. Проблема начинается в трёх сценариях:
- на страницах пагинации почти одинаковые title и description;
- в индексе оказываются страницы, которые не должны конкурировать с основной страницей архива;
- в Search Console растёт число URL с параметрами и дублей, а полезные страницы проседают по обходу.
Что обычно видно в диагностике
Перед правками откройте отчёты индексации и посмотрите, какие URL поисковик считает дубликатами. В WordPress это часто не только /page/2/, но и страницы тегов, авторов, дат, а также архивы с фильтрами от темы или плагина. Если на сайте включены SEO-плагины, проверьте, не создают ли они отдельные мета-теги для каждой страницы пагинации без логики.
Полезно вручную проверить несколько URL:
- основной архив категории;
- вторую и третью страницы пагинации;
- страницу с пустой или почти пустой выдачей;
- страницы архивов, которые не должны индексироваться вообще.
Что закрывать, а что оставлять в индексе
Самая частая ошибка — закрывать всё подряд. Это кажется безопасным, но на практике ломает поиск по сайту: поисковик перестаёт понимать структуру архива, а важные материалы хуже находят путь к индексации. Логика должна быть такой:
| Тип страницы | Решение | Комментарий |
|---|---|---|
| Основная страница категории | Оставить в индексе | Это точка входа в раздел |
Страницы /page/2/ и дальше |
Чаще всего noindex,follow |
Если они не несут самостоятельной ценности |
| Архивы автора, даты, меток | По ситуации | Если они пустые или дублируют рубрики, лучше ограничить |
| Служебные страницы | Закрыть от индексации | Поиску они не нужны |
Если сайт небольшой, а архивы почти не используются как посадочные страницы, можно жёстче ограничить индексацию пагинации. Если же это новостной или контентный проект с длинными архивами, лучше не рубить всё на уровне robots.txt, а управлять мета-тегами и каноникалами.
Пошаговое решение: как убрать дубли от пагинации
Ниже рабочая схема, которая подходит для большинства тем и не требует переписывать шаблоны с нуля.
Шаг 1. Проверьте, не закрыта ли пагинация в robots.txt
Если в robots.txt уже есть жёсткий запрет на обход страниц пагинации, сначала оцените последствия. Полное закрытие через Disallow не всегда полезно: поисковик может не увидеть связь между страницами архива и не дойти до старых материалов. Для большинства сайтов безопаснее управлять индексацией через noindex, а не через запрет обхода.
Шаг 2. Добавьте noindex,follow для страниц пагинации
Если используете SEO-плагин, проверьте его настройки для архивов. Если нужен кодовый вариант, можно добавить мета-тег в functions.php дочерней темы или в собственный мини-плагин.
add_action('wp_head', function () {
if (is_paged() && (is_category() || is_tag() || is_author() || is_archive())) {
echo '<meta name="robots" content="noindex,follow" />' . PHP_EOL;
}
});
Этот вариант простой, но его стоит использовать только если вы понимаете, какие архивы попадают под условие. Для некоторых сайтов лучше исключить, например, авторские архивы, но оставить категории.
Шаг 3. Настройте canonical на основную страницу архива
Если тема или SEO-плагин не формируют корректный canonical, поисковик может считать страницы пагинации самостоятельными дублями. Для архивов canonical обычно должен указывать на саму страницу пагинации, а не на первую страницу раздела. Но если задача именно убрать дубли и не индексировать вторые страницы, важно не ломать логику пагинации на уровне шаблона.
Проверяйте, что canonical не подменяется вручную на главную категорию для всех страниц архива. Такая схема иногда приводит к тому, что поисковик игнорирует вторые страницы полностью и хуже обходит старые записи.
Шаг 4. Уберите лишние архивы, если они не нужны
Если на сайте нет смысла держать архивы по датам или авторам, их лучше отключить или закрыть от индексации точечно. Это снижает количество дублей и упрощает структуру сайта. Важно не путать отключение архива и удаление контента: записи остаются доступными, просто поисковик не тратит ресурсы на бесполезные страницы-обёртки.
Пример точечной настройки через фильтр WordPress
Если нужен более управляемый вариант, можно использовать фильтр wp_robots. Он есть в современных версиях WordPress и позволяет добавить директивы аккуратнее, чем через прямой вывод в wp_head.
add_filter('wp_robots', function (array $robots) {
if (is_paged() && (is_category() || is_tag() || is_author() || is_archive())) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
});
Плюс такого подхода в том, что он не конфликтует с другими компонентами, которые тоже работают с robots-мета. Но если у вас уже стоит SEO-плагин, сначала проверьте, не перетирает ли он эти директивы своими настройками.
Как проверить, что решение сработало
После внедрения не ограничивайтесь просмотром исходника одной страницы. Проверка должна быть по нескольким уровням:
- откройте несколько URL пагинации и убедитесь, что в
<head>есть нужный robots-мета; - проверьте canonical на страницах архива;
- посмотрите, не закрыли ли вы случайно основную страницу категории;
- в Search Console отправьте на переобход несколько проблемных URL;
- через несколько дней сравните отчёт по индексированию и количество дублей.
Если используете командную строку, можно быстро проверить заголовки и HTML через curl:
curl -s https://example.com/category/news/page/2/ | grep -iE 'robots|canonical'
Для более надёжной проверки откройте страницу в браузере и посмотрите исходный код, а не только визуальный рендер. Иногда тема или плагин добавляют мета-теги динамически, и это видно только в HTML ответа.
Частые ошибки и как их исправить
Закрыли пагинацию через robots.txt
Это частая попытка «быстро убрать дубли». Проблема в том, что запрет на обход не равен запрету на индексацию. Поисковик может продолжать учитывать URL, если увидит их из внутренних ссылок или внешних упоминаний. Для большинства случаев лучше использовать noindex.
Поставили noindex на все архивы без разбора
После такой настройки иногда исчезают из поиска полезные категории, которые реально приводят трафик. Исправление простое: разделите архивы по типам и оставьте в индексе те, что работают как посадочные страницы.
Сломали canonical на страницах пагинации
Если canonical указывает на первую страницу для всех страниц архива, поисковик может игнорировать вторые и третьи страницы даже там, где это нежелательно. Проверьте шаблон темы и настройки SEO-плагина: canonical должен соответствовать логике конкретного URL.
Не учли дубли от тегов и авторов
Иногда проблема не в пагинации как таковой, а в том, что у сайта слишком много архивов с одинаковой структурой. Тогда закрытие только /page/2/ не даст эффекта. Нужно смотреть на всю систему архивов целиком.
Что делать, если нужен быстрый способ без кода
Если вы не хотите править тему, используйте SEO-плагин, который умеет управлять индексированием архивов и мета-тегами. Это удобнее для редакторов и безопаснее для сайтов, где шаблон часто обновляется. Но даже в этом случае не отключайте проверку вручную: плагин может работать не так, как ожидается после обновления темы или смены структуры URL.
Если на сайте уже есть плагин для технической чистки и SEO-настроек, например Clearfy Pro, проверьте, не дублирует ли он настройки другого SEO-решения. Два инструмента, которые одновременно управляют robots-мета и canonical, часто создают конфликт.
Практические советы по безопасности и производительности
Любая правка, связанная с индексацией, должна идти через резервную копию и staging-окружение. Это особенно важно, если вы меняете код в functions.php: одна синтаксическая ошибка может положить сайт целиком. Для производительности полезно ещё и сократить количество архивов, которые генерируются без необходимости — это уменьшает нагрузку на обход и упрощает внутреннюю перелинковку.
- делайте изменения сначала на копии сайта;
- не смешивайте правки robots и редиректы без понимания последствий;
- проверяйте, не создаёт ли тема дополнительные архивы автоматически;
- после обновления темы повторно смотрите исходный код страниц архива.
Если нужно не только убрать дубли, но и почистить лишние технические хвосты сайта, удобнее держать это в одном регламенте: архивы, мета-теги, дубли, служебные страницы и карта сайта должны проверяться вместе, а не по отдельности.
Короткий чек-лист перед публикацией правок
- Проверены URL основной категории и нескольких страниц пагинации.
- На нужных страницах стоит
noindex,follow, а не жёсткий запрет обхода. - Canonical не ломает логику архива.
- Не закрыты полезные разделы сайта.
- Изменения протестированы на staging или хотя бы на резервной копии.
- После внедрения запланирована повторная проверка в Search Console.
Если после правок дубли не исчезают, обычно проблема не в одной директиве, а в связке: тема генерирует лишние архивы, SEO-плагин добавляет свои правила, а карта сайта продолжает отдавать URL, которые вы хотели скрыть. В таких случаях лучше идти от диагностики к точечной настройке, а не пытаться закрыть всё одной строкой.