Дубли страниц пагинации в WordPress обычно появляются не из-за одной ошибки, а из-за набора мелких настроек: архивы категорий, теги, авторы, поиск по сайту, сортировки, параметры в URL. В итоге поисковик видит несколько почти одинаковых страниц и тратит обход на мусорные варианты. На небольшом сайте это часто незаметно, а на контентном проекте быстро превращается в проблему с индексацией и каннибализацией.
Ниже разберём, как понять, что у вас именно дубли пагинации, какие варианты исправления подходят в разных сценариях и как проверить, что после правок сайт не потерял важные страницы из индекса.
Когда пагинация становится проблемой
Сама по себе пагинация не вредна. Проблема начинается, когда WordPress генерирует несколько адресов с одинаковым или почти одинаковым содержимым:
/category/news/page/2/и/category/news/page/2/?amp;/tag/seo/page/3/и варианты с UTM-параметрами;- страницы архивов, которые дублируются через сортировку, фильтры или поиск;
- страницы пагинации, где canonical указывает не туда или вообще отсутствует;
- архивы, которые закрыты от индексации, но продолжают активно обходиться ботом.
Если на сайте есть много архивов и внутренней перелинковки, поисковик может индексировать не те URL, а в отчётах появятся страницы с низкой ценностью. Это особенно заметно, когда в Search Console растёт число страниц с параметрами, а в выдаче всплывают нецелевые адреса.
Диагностика: как понять, что проблема именно в дублях пагинации
Сначала не трогайте настройки. Посмотрите, что реально отдаёт сайт.
Проверка исходного кода
Откройте несколько страниц архива, включая вторую и третью страницу пагинации, и проверьте:
- есть ли в
<head>тегrel="canonical"; - не указывает ли canonical на первую страницу архива, если это не ваш осознанный выбор;
- нет ли случайного
noindexна страницах, которые должны индексироваться; - не добавляются ли лишние параметры в URL через тему или плагин.
Пример того, что стоит увидеть на странице пагинации:
<link rel="canonical" href="https://example.com/category/news/page/2/" />Если canonical ведёт на первую страницу архива, это не всегда ошибка. Для некоторых сайтов так и задумано. Но если в выдаче должны участвовать именно страницы пагинации, такой canonical мешает их индексации.
Проверка через Search Console
Откройте отчёт по страницам и посмотрите, какие URL попадают в индекс. Типичные признаки проблемы:
- много адресов с
/page/2/,/page/3/и параметрами; - страницы с пометкой «Просканирована, но не проиндексирована»;
- дубли с альтернативными URL, где различается только параметр;
- в отчёте по каноническим страницам Google выбирает не тот URL, который вы ожидали.
Что проверить в WordPress
Посмотрите, какие плагины влияют на SEO и URL-структуру. Часто дубли создают не сами архивы, а:
- плагины фильтрации и сортировки;
- SEO-плагины с нестандартной обработкой canonical;
- кеширующие плагины, которые не учитывают параметры URL;
- тема, которая выводит пагинацию с неправильными ссылками.
Какой подход выбрать: noindex, canonical или чистка параметров
Универсального решения нет. Сначала определите, что именно вы хотите сделать с пагинацией: оставить в индексе, скрыть от индексации или убрать дубли только для технических URL.
| Подход | Когда подходит | Минус |
|---|---|---|
| Canonical на основную страницу | Если пагинация не должна ранжироваться отдельно | Не убирает обход, только подсказывает поисковику предпочтительный URL |
noindex,follow | Если страницы пагинации не нужны в поиске, но ссылки на них должны работать | Нужно аккуратно проверить, чтобы не закрыть важные архивы |
| Удаление параметров и дублей на уровне темы/плагина | Если дубли создают фильтры, сортировки, UTM и технические параметры | Требует тестирования, можно сломать аналитику или навигацию |
На практике чаще всего комбинируют canonical и чистку параметров. Если же проблема в том, что поисковик индексирует второстепенные страницы архивов, добавляют noindex только там, где это действительно нужно.
Пошаговое решение через код
Если у вас нет SEO-плагина, который уже управляет canonical и robots, можно задать поведение точечно. Делать это лучше в дочерней теме или через небольшой mu-plugin, а не в functions.php активной темы, если тема часто обновляется.
1. Оставить canonical для страниц пагинации
WordPress сам выводит canonical в большинстве случаев, но если тема или плагин его ломают, можно проверить фильтр. Ниже пример, который не меняет canonical для архивов пагинации, а лишь даёт WordPress сформировать его корректно:
<?php
add_filter( 'get_canonical_url', function( $canonical, $post ) {
if ( is_paged() ) {
return $canonical;
}
return $canonical;
}, 10, 2 );Этот пример не делает магии, но полезен как точка контроля: если у вас в проекте есть кастомный код, который перезаписывает canonical, его можно отследить и убрать конфликтующий фильтр.
2. Закрыть от индексации технические страницы архивов
Если задача — убрать из индекса второстепенные страницы пагинации, можно добавить noindex,follow для архивов, которые не должны ранжироваться отдельно. Делать это стоит аккуратно и только после проверки структуры сайта.
<?php
add_filter( 'wp_robots', function( array $robots ) {
if ( is_paged() && ( is_category() || is_tag() || is_author() || is_date() ) ) {
$robots['noindex'] = true;
$robots['follow'] = true;
}
return $robots;
} );Такой вариант подходит, если вы хотите сохранить обход ссылок, но не видеть эти URL в поиске. Не применяйте его ко всем страницам подряд: на некоторых сайтах страницы пагинации категорий дают трафик и их лучше оставить индексируемыми.
3. Убрать лишние параметры из URL
Если дубли создают параметры вроде ?utm_source=, ?sort= или технические хвосты, сначала проверьте, можно ли решить это на уровне плагина или сервера. Если нет, не переписывайте URL агрессивно без понимания последствий. Для WordPress безопаснее ограничиться нормализацией в местах генерации ссылок, а не глобальным редиректом всего подряд.
Например, если тема выводит ссылки на архивы с параметрами, исправьте генератор ссылок, а не ловите их редиректом на лету. Это уменьшит нагрузку и не сломает аналитику.
Если используете SEO-плагин
В большинстве проектов удобнее управлять дублями через SEO-плагин, а не кодом. Но важно понимать, что плагин не отменяет проверку результата. Он просто даёт более предсказуемый способ задать canonical, robots и поведение архивов.
Если вам нужен инструмент для чистки дублей, технических страниц и лишних элементов в WordPress, посмотрите Clearfy Pro. Его имеет смысл рассматривать именно как набор точечных настроек, а не как замену нормальной SEO-логике сайта.
Проверка результата после внедрения
После правок не ограничивайтесь открытием пары страниц в браузере. Проверка должна быть технической.
- Откройте страницу архива и страницу пагинации, проверьте
canonicalиrobotsв исходнике. - Проверьте, что URL с параметрами не создают отдельные индексируемые страницы.
- В Search Console отправьте на переобход несколько проблемных URL и посмотрите, как меняется статус.
- Убедитесь, что внутренние ссылки на пагинацию продолжают работать и не ведут на 404.
- Проверьте серверные логи или отчёты краулера, если нужно понять, уменьшился ли обход мусорных URL.
Быстрая ручная проверка через curl тоже полезна. Например, можно посмотреть заголовки и убедиться, что редиректов нет:
curl -I https://example.com/category/news/page/2/Если вы меняли robots-мета, проверьте HTML-источник страницы, а не только визуальный вывод в браузере. Некоторые темы и плагины подменяют мета-теги после загрузки, и это легко пропустить.
Частые ошибки и как их исправить
Закрыли от индексации всё подряд
Самая частая ошибка — поставить noindex на все архивы и потом удивляться падению внутренней перелинковки. Если страницы пагинации участвуют в навигации и приводят на важные материалы, не закрывайте их без анализа.
Canonical указывает на неправильную страницу
Иногда SEO-плагин или тема ставят canonical на первую страницу архива, хотя вы хотите индексировать конкретную пагинацию. В этом случае проверьте настройки плагина и кастомные фильтры в теме. Часто проблема не в WordPress, а в одном лишнем фильтре, добавленном разработчиком год назад.
Редиректите параметры и ломаете аналитику
Если вы жёстко редиректите все URL с параметрами на чистый адрес, можно потерять полезные данные из кампаний и сломать фильтры. Лучше сначала убрать генерацию лишних параметров, а не лечить их редиректом на уровне всего сайта.
Путаете дубли пагинации с тонким контентом
Страница /page/2/ не всегда дубль в строгом смысле. Иногда это полноценная часть архива, и поисковик должен её видеть. Если на странице есть уникальные ссылки на новые записи и она логично продолжает раздел, не закрывайте её автоматически.
Практические советы по безопасности и производительности
Любые правки, связанные с canonical, robots и редиректами, лучше вносить после бэкапа и на staging-копии. Ошибка в условии is_paged() может случайно закрыть от индексации весь архив или, наоборот, открыть мусорные URL.
Если на сайте много архивов, подумайте о снижении количества генерируемых дублей ещё на этапе шаблона:
- не выводите лишние параметры в ссылках;
- не создавайте отдельные архивы под технические таксономии без нужды;
- проверьте, не дублируются ли хлебные крошки и пагинация в теме;
- уберите из индекса страницы поиска по сайту, если они создают шум;
- следите, чтобы кеш не отдавал один и тот же HTML для разных параметров URL.
Если нужно не только убрать дубли, но и почистить сайт от лишних технических страниц, дублей архивов и конфликтов SEO-настроек, удобнее делать это централизованно, а не набором разрозненных правок. Но даже в этом случае сначала проверьте, как именно у вас устроены архивы и какие URL реально участвуют в индексации.