Если в индексе уже есть страницы 2, 3, 4 и дальше, а сами они не дают пользователю ничего нового, кроме продолжения списка записей, это обычно не проблема сайта, а вопрос настройки индексации. В WordPress пагинация сама по себе нормальна: она нужна для навигации по архивам, категориям, тегам и блогу. Проблема начинается тогда, когда поисковик тратит обход на однотипные страницы, а в выдаче показываются слабые или бесполезные URL.
Задача здесь не в том, чтобы «запретить всю пагинацию», а в том, чтобы оставить полезные разделы и убрать из индекса те страницы, которые не несут самостоятельной ценности. Для этого сначала нужно понять, какие типы пагинированных страниц у вас есть, а потом выбрать для них разное поведение.
Какие страницы пагинации обычно создают дубли
В WordPress пагинация появляется не только в блоге. Она может быть у:
- главной страницы записей;
- архивов категорий и тегов;
- архивов автора и даты;
- страниц с результатами поиска;
- кастомных архивов записей, если тема или плагин их выводит.
Поисковики чаще всего считают проблемными именно страницы вида /page/2/, /page/3/ и дальше, если на них повторяется тот же набор блоков, что и на первой странице архива, а уникального контента почти нет. При этом первая страница раздела обычно полезна: она служит входной точкой в тему и собирает основной трафик.
Важно различать два сценария. Первый — пагинация внутри ценного раздела, где каждая страница помогает добраться до старых материалов, но сама по себе не нужна в поиске. Второй — раздел, где каждая страница содержит отдельную ценность или формирует самостоятельный список, и тогда закрывать всё подряд уже нельзя.
Что стоит оставить, а что ограничить
Практическое правило простое: в индексе должны оставаться страницы, которые помогают пользователю и могут ранжироваться как самостоятельные точки входа. Остальные пагинированные URL лучше не продвигать в поиск.
| Тип страницы | Обычно оставляют в индексе | Обычно ограничивают |
|---|---|---|
| Первая страница категории или блога | Да | Нет |
| Страница 2+ обычного архива записей | Редко | Чаще да |
| Архив с сильной навигационной ценностью и уникальными блоками | Иногда | Зависит от контента |
| Поиск по сайту | Обычно нет | Да |
| Тонкие теги без наполнения | Нет | Да |
Если на второй и последующих страницах нет уникального текста, фильтров, полезных подборок или заметной самостоятельной ценности, индексировать их обычно не нужно. Но если это, например, крупный каталог материалов с сильной внутренней перелинковкой и отдельной пользовательской задачей, решение может быть другим.
Как убрать дубли без потери нужных разделов
Для WordPress есть несколько рабочих подходов. Выбор зависит от того, что именно вы хотите получить: полностью исключить страницы из индекса, оставить их доступными для обхода, но не показывать в поиске, или просто сократить количество слабых архивов.
1. Закрыть от индексации только пагинированные страницы, а не весь архив
Это самый частый вариант для блогов и новостных сайтов. Смысл в том, чтобы первая страница раздела оставалась открытой, а страницы 2, 3 и дальше не попадали в индекс. Так вы сохраняете навигацию для пользователей и убираете однотипные URL из поиска.
На практике это обычно делают через SEO-плагин, который умеет задавать мета-теги robots для архивов и пагинации. Если у вас есть возможность настроить правила для конкретных типов архивов, не закрывайте всё подряд: категории могут быть полезны, а вот страницы поиска и некоторые теги — нет.
2. Сократить количество архивов, которые вообще создают дубли
Часто проблема не в самой пагинации, а в том, что WordPress генерирует слишком много слабых архивов: теги без записей, архивы автора на одностраничных сайтах, даты, которые не нужны посетителю. Если убрать лишние архивы, вы уменьшите число дублей еще до настройки индексации.
Здесь важно не ломать структуру сайта. Например, если у вас несколько авторов и страницы авторов реально помогают ориентироваться в контенте, закрывать их только ради «чистоты» не стоит. Но если автор один и архив ничего не добавляет, его можно ограничить.
3. Настроить канонический адрес, если страницы похожи, но нужны для навигации
Иногда страницы пагинации нельзя просто закрыть, потому что они нужны для обхода и переходов, но при этом не должны конкурировать с основной страницей раздела. В таких случаях используют canonical на основную страницу архива. Это не универсальное лекарство, но в ряде конфигураций помогает подсказать поисковику, какой URL считать главным.
Однако canonical не заменяет здравый смысл. Если страница 2 содержит совершенно иной список материалов и реально может быть полезна как отдельная точка входа, насильно указывать canonical на первую страницу не всегда правильно. Для обычных архивов это допустимо, для сложных каталогов — уже спорно.
Что делать в WordPress на практике
Если вы работаете с обычным сайтом на WordPress без кастомной логики, самый безопасный путь такой:
- Определите, какие архивы действительно нужны пользователю.
- Оставьте в индексе только те разделы, которые могут приносить трафик или помогают навигации.
- Страницы пагинации внутри этих архивов ограничьте для поисковиков, если они не несут самостоятельной ценности.
- Проверьте, не закрыли ли вы случайно полезные разделы целиком.
Если вы используете SEO-плагин, ищите настройки для архивов, мета robots и индексации таксономий. Важно не путать отключение индексации с удалением страницы. Пользователь должен по-прежнему переходить по пагинации, а поисковик — не обязан хранить в индексе каждую техническую страницу списка.
Если у вас сайт на базе плагинов каталога, фильтров или темы с бесконечной подгрузкой, проверьте, не создаются ли отдельные URL для параметров сортировки, фильтрации и пагинации одновременно. Именно там чаще всего появляются лишние дубли, которые потом сложно разгребать.
Как проверить, что вы не переборщили
После настройки не ограничивайтесь визуальной проверкой на сайте. Нужно убедиться, что поисковик видит именно то, что вы задумали.
- Откройте несколько пагинированных URL вручную и проверьте, что они доступны пользователю.
- Посмотрите исходный код страницы и убедитесь, что на нужных URL стоит правильный meta robots.
- Проверьте canonical: он должен вести туда, куда вы действительно хотите направлять сигналы.
- В Google Search Console посмотрите, какие страницы попадают в индекс и не остались ли там нежелательные архивы.
Если после изменений из индекса пропали полезные категории или страницы разделов, значит правило было слишком широким. Обычно это происходит, когда закрывают не только /page/2/ и дальше, но и саму первую страницу архива, либо одновременно отключают индексирование всей таксономии.
Когда пагинацию лучше не трогать
Есть случаи, когда массово закрывать пагинацию не стоит. Например, если у вас большой тематический архив, где пользователи реально листают страницы, а поисковик получает из них дополнительные сигналы о структуре сайта. Или если страница 2 содержит заметно отличающийся набор материалов и может быть полезна как продолжение темы.
Также не стоит закрывать пагинацию только потому, что она есть. Сама по себе страница /page/2/ не вредна. Вред появляется тогда, когда она начинает конкурировать с более полезными URL, раздувает индекс и не приносит самостоятельной ценности. Если этого нет, лучше ничего не ломать.
Хороший ориентир такой: оставляйте в поиске то, что может быть входной точкой в контент, и ограничивайте то, что существует только для перехода к следующей порции записей. Для WordPress это обычно означает сохранение первой страницы раздела и отключение лишних страниц пагинации, а не полную зачистку всех архивов подряд.
Если вам нужно быстро навести порядок в дублях, можно использовать SEO-плагин с управлением архивами и мета-тегами. В линейке WPShop для этой задачи подходит Clearfy Pro: он помогает убирать лишние дубли и упрощает настройку технических страниц сайта. Подробности есть на странице продукта: Clearfy Pro.