Как удалить дубли страниц пагинации в WordPress и настроить canonical

Если в индексе появляются страницы вида /page/2/, /page/3/ и дальше, это не всегда ошибка. Для WordPress пагинация — нормальная часть архива, рубрик, тегов и главной страницы блога. Проблема начинается тогда, когда поисковик видит такие страницы как дубли, а на сайте при этом неправильно настроены canonical, мета robots или сама тема выводит пагинацию так, что индексация становится лишней.

Короткий ответ такой: чаще всего не нужно «жёстко удалять» пагинацию из индекса. Для архивов, где контент реально разбит на несколько страниц, обычно достаточно корректного canonical и нормальной внутренней перелинковки. Дополнительные ограничения через robots.txt или noindex нужны только в отдельных сценариях — например, если это технические страницы, пустые архивы или пагинация создаётся там, где она не несёт пользы.

Когда пагинация в WordPress — это не дубль, а нормальная страница

Страницы пагинации не являются дублями автоматически. Если на первой странице архива показаны первые записи, а на второй — следующий набор записей, это разные URL с разным содержимым. Поисковик может их индексировать, и это нормально.

Проблемы обычно возникают в трёх случаях:

  • canonical на всех страницах пагинации указывает на первую страницу архива;
  • тема или плагин закрывает пагинацию от индексации без понимания структуры сайта;
  • на страницах пагинации почти нет уникального контента, а сами архивы не нужны в поиске.

Если у вас обычный блог, каталог статей или рубрика с большим количеством материалов, страницы пагинации часто полезны сами по себе. Они помогают поисковику добраться до более глубоких записей и не ломают структуру сайта.

Что должно быть с canonical на страницах /page/2/ и дальше

Для пагинированных архивов canonical должен указывать на саму страницу, а не на первую страницу серии. Иначе поисковик получает сигнал, что /page/2/ — это копия / или первой страницы архива, хотя содержимое там другое.

На практике это означает:

  • на /category/news/ canonical ведёт на /category/news/;
  • на /category/news/page/2/ canonical ведёт на /category/news/page/2/;
  • на /page/3/ главной страницы блога canonical ведёт на /page/3/, если это именно отдельная страница пагинации, а не ошибка шаблона.

Такой подход соответствует логике WordPress и большинства SEO-плагинов: каждая страница списка имеет свой адрес, а не притворяется первой.

Как проверить canonical без догадок

Откройте страницу пагинации в браузере и посмотрите исходный код или используйте инструменты разработчика. В HTML должен быть один понятный тег <link rel="canonical" ...> с адресом текущей страницы.

Если у вас установлен SEO-плагин, проверьте, не переписывает ли он canonical вручную. Частая ошибка — когда тема и плагин одновременно пытаются управлять canonical, а в итоге в коде появляется неверный адрес или дублирующийся тег.

Когда canonical достаточно, а когда нужны дополнительные меры

Если цель — убрать именно проблему дублей, сначала смотрите на canonical. Во многих случаях этого достаточно, потому что поисковик понимает: страницы пагинации связаны между собой, но каждая имеет собственный адрес и назначение.

Дополнительные меры нужны не всегда. Ниже — практичное разделение по сценариям.

СценарийЧто делатьКомментарий
Обычные архивы записей, рубрики, тегиОставить индексируемую пагинацию и проверить canonicalЭто нормальная структура сайта
Технические или пустые архивыОграничить индексацию через noindex или убрать сам архивЕсли страница не несёт пользы, лучше не тянуть её в индекс
Пагинация создаёт мусорные URL из-за темыИсправить шаблон темы или настройки плагинаСначала устранить причину, а не маскировать её robots.txt
Нужно скрыть URL от обхода роботомИспользовать robots.txt с осторожностьюЭто не заменяет canonical и не удаляет уже проиндексированные страницы

Важно понимать: robots.txt не удаляет страницы из индекса сам по себе. Он только ограничивает обход. Если URL уже известен поисковику, запрет в robots.txt может даже помешать ему увидеть canonical или мета robots на странице. Поэтому использовать robots.txt для пагинации стоит только тогда, когда вы точно понимаете последствия.

Как убрать пагинацию из индекса, если она вам действительно не нужна

Иногда страницы /page/2/ и дальше не должны индексироваться вообще. Такое бывает у служебных архивов, страниц поиска по сайту, некоторых фильтров или нестандартных шаблонов, где пагинация не даёт ценности.

В этом случае лучше не полагаться только на robots.txt. Надёжнее сделать так, чтобы страница отдавалась с мета-тегом noindex,follow. Тогда поисковик не будет добавлять её в индекс, но сможет переходить по ссылкам дальше.

Если вы используете SEO-плагин, проверьте настройки архивов, рубрик, тегов и служебных страниц. Многие плагины позволяют отдельно закрывать от индексации:

  • страницы поиска;
  • авторские архивы;
  • даты;
  • пустые таксономии;
  • отдельные типы архивов.

Для обычной пагинации записей это решение применяют осторожно. Если вы закроете от индексации всю пагинацию блога, поисковику станет сложнее добираться до старых материалов, особенно на сайте с большим архивом.

Что делать, если canonical в теме настроен неправильно

На практике источник проблемы часто не в WordPress, а в теме. Некоторые шаблоны выводят canonical вручную или вмешиваются в SEO-логику плагина. Если canonical на страницах пагинации указывает на первую страницу, поисковик начинает считать остальные страницы дублями.

Проверяйте такие моменты:

  • не выводит ли тема собственный тег canonical в <head>;
  • нет ли одновременно SEO-плагина и ручной логики в шаблоне;
  • не ломается ли пагинация на главной странице, в рубриках и архивах;
  • не подменяется ли текущий URL на канонический адрес первой страницы.

Если проблема в теме, правильнее исправить шаблон, чем пытаться лечить симптомы через robots.txt. Иначе вы получите ситуацию, когда URL скрыт от обхода, но техническая ошибка остаётся.

Минимальная проверка в коде темы

Откройте файл header.php или шаблон, который формирует <head>, и проверьте, не вставлен ли там вручную canonical. Если вы используете SEO-плагин, обычно ручной тег нужно убрать, чтобы не было конфликта.

Если правите тему, делайте это в дочерней теме или через отдельный плагин для кастомизации. Так обновление не затрёт изменения.

Когда robots.txt уместен, а когда он только мешает

robots.txt полезен, если нужно ограничить обход заведомо бесполезных URL, но он не решает задачу удаления дублей как таковую. Для пагинации это особенно важно: если страница уже в индексе, запрет на обход не гарантирует её исчезновение.

Использовать robots.txt имеет смысл, когда вы хотите:

  • снизить нагрузку от обхода большого количества технических URL;
  • закрыть служебные разделы, которые не должны сканироваться;
  • убрать из обхода параметры, создающие бесконечные комбинации адресов.

Не стоит закрывать в robots.txt нормальные архивные страницы только потому, что они выглядят как /page/2/. Для WordPress это штатный механизм навигации, а не мусорный URL.

Если всё же решите править robots.txt, сначала сделайте резервную копию текущего файла. Ошибка в нём может случайно закрыть важные разделы сайта от обхода.

Практический порядок действий

Если нужно быстро привести пагинацию в порядок, идите по такой последовательности:

  1. Проверьте, действительно ли страницы /page/2/ и дальше нужны сайту.
  2. Посмотрите canonical на нескольких страницах пагинации и убедитесь, что он указывает на саму страницу.
  3. Уберите ручной canonical из темы, если он конфликтует с SEO-плагином.
  4. Проверьте настройки SEO-плагина для архивов, рубрик, тегов и служебных страниц.
  5. Только если страница не нужна в поиске, добавляйте noindex или ограничивайте обход через robots.txt.

После изменений откройте исходный код страницы и убедитесь, что canonical стал корректным. Затем проверьте URL в Google Search Console: если страница уже была в индексе, её удаление или переоценка может занять время. Это нормально, мгновенного эффекта тут не бывает.

Если у вас на сайте много архивов и дублей, часть задачи можно закрыть настройками SEO-плагина. В экосистеме WordPress для этого часто используют Clearfy Pro, если нужен именно набор инструментов для чистки дублей и управления SEO-логикой без ручного правления шаблонов. Но даже в этом случае сначала проверьте, как тема выводит canonical, иначе плагин не спасёт от конфликта в коде.

Главная мысль простая: страницы пагинации в WordPress не нужно автоматически прятать от индекса. Сначала убедитесь, что canonical указывает на правильный URL, затем решайте, нужны ли дополнительные ограничения. В большинстве случаев этого достаточно, чтобы убрать путаницу с дублями и не навредить индексации полезных архивов.

Добавь в закладки и поделись с друзьями:

⭐⭐⭐⭐⭐
Как изменить URL входа в админку WordPress без плагинов
24.09.2026
Как отключить XML-RPC и pingback в WordPress без лишних поломок
30.08.2026
Как отключить архивы авторов в WordPress через код и robots.txt без лишних дублей
19.09.2026
Как динамически изменить автозаголовки записей в WordPress
15.09.2026
WooCommerce: как правильно изменить URL товара без создания 301 редиректа
25.09.2026
×

Увеличьте продажи!

Скидка на
My Popup!

-15%
плагин для WordPress

Успей купить ⋙