Пагинация, реплитоком и фиды — три источника дублей, о которых молчат в курсах по WordPress

Анатолий Кузнецов
Анатолий Кузнецов
SEO-оптимизатор с 20-летним стажем. Автор блога hozyindachi.ru о продвижении и доработке сайтов.

В мае ко мне пришёл владелец блога о загородном строительстве. Ситуация классическая до зевоты: 340 статей, все написаны руками эксперта, ни одного заимствованного абзаца, ссылки покупались аккуратно. И при этом в Яндекс.Вебмастере — 11 400 страниц в разделе «Исключённые» против 290 в поиске. Клиент был уверен, что попал под фильтр.

Фильтра не было. Была пагинация комментариев, replytocom и фиды. Три штуки, которые за полтора года наплодили одиннадцать тысяч мусорных URL и приучили робота Яндекса, что на этом сайте копать особо нечего.

Самое обидное в этой истории — человек прошёл два платных курса по WordPress. В обоих подробно рассказывали про title, про alt у картинок, про плагины кэширования. Про то, что движок из коробки умножает каждую вашу страницу на три-четыре технических клона, — ни слова. Не потому что авторы курсов злодеи. Просто это скучно, это не даёт красивого скриншота «+300% трафика», и это не продаётся.

За 20 лет практики я вывел простое правило: если сайт на WordPress старше года и трафик не растёт при нормальном контенте — первым делом иду смотреть не тексты и не ссылки, а количество исключённых страниц. В 6 случаях из 10 разгадка там.
Содержание статьи

Пагинация, реплитоком и фиды — три источника дублей, о которых молчат в курсах по WordPress

Почему дубли — это не «просто мусор», а прямая потеря денег

Начну с механики, потому что без неё дальше читать бессмысленно. Многие воспринимают дубли как что-то из разряда «некрасиво, но не критично». Это заблуждение обходится дорого, и вот почему.

У робота есть краулинговый бюджет — конечное число обращений к вашему сайту за единицу времени. Он не бесконечный и не одинаковый для всех: молодому сайту с низким авторитетом Яндекс выделяет крохи. И если робот из тысячи заходов восемьсот тратит на URL вида ?replytocom=4821, то на вашу новую статью, ради которой вы потратили выходные, у него остаётся двести. А потом ещё сто. А потом он просто заходит реже.

Второй удар — размывание релевантности. Когда у одной статьи существует четыре адреса, поисковик должен выбрать, какой из них показывать. Он выберет. Но не факт, что тот, который вы продвигаете. Я регулярно вижу картину, когда в выдаче болтается /page/2/ вместо основной страницы категории.

Третий, самый недооценённый — статус «Малоценная или маловостребованная страница». Яндекс присваивает его массово, и когда доля таких страниц по сайту переваливает за критическую отметку, алгоритм начинает делать вывод не о конкретных URL, а о сайте целиком. Это не фильтр в классическом смысле, это хуже: тихая понижающая переоценка качества всего домена. Кстати, про то, что иногда лучший способ поднять сайт — удалить половину страниц, я писал отдельно, и там ровно эта логика.

Источник первый: пагинация. Та самая, которую вы считаете безобидной

Пагинация — это разбиение списка на страницы. В WordPress она вылезает минимум в четырёх местах, и большинство владельцев сайтов знает только про одно.

Четыре лица пагинации в WordPress

  • Пагинация архивов и категорий/category/remont/page/2/. Та самая, которую все видят.
  • Пагинация главной страницы/page/2/, /page/3/. Если у вас на главной лента постов — она есть.
  • Пагинация внутри статьи — тег <!--nextpage-->. Даёт URL /moya-statya/2/. Многие вставляют его ради «глубины просмотра», не понимая последствий.
  • Пагинация комментариев/moya-statya/comment-page-2/. Вот это главный убийца. Включается галочкой «Разбивать комментарии верхнего уровня на страницы» и по умолчанию во многих сборках она включена.

Почему comment-page страшнее остальных. Возьмите статью с 90 комментариями при настройке «по 20 на страницу». Получаете пять URL. На каждом — полный текст статьи целиком, потому что шаблон WordPress выводит контент поста на всех страницах комментариев. Меняется только подвал с комментариями. Для робота это пять почти идентичных документов. Умножьте на количество обсуждаемых статей.

Главная ошибка: rel=canonical на первую страницу

Здесь я обязан вступить в спор с большинством русскоязычных мануалов. Гуляет совет: «поставьте на всех страницах пагинации canonical на первую страницу списка». Это вредный совет, и вот почему.

Canonical — указание на дубликат. Страница /category/remont/page/5/ не является дубликатом /category/remont/: на ней другие товары, другие анонсы, другие ссылки. Склеивая их каноникалом, вы говорите роботу: «содержимое пятой страницы — это то же самое, что на первой». Робот верит. И перестаёт переходить по ссылкам с пятой страницы. Товары и статьи, которые доступны только оттуда, выпадают из индекса.

Я наблюдал это в интернет-магазине запчастей: 4 200 карточек, из них в индексе 900. Причина — каноникал пагинации на первую страницу плюс глубокая вложенность. Убрали каноникал, сделали self-canonical на каждой странице пагинации — за два месяца в индекс вошло 3 100 карточек. Про то, как одна лишняя буква в canonical выкидывает страницу из выдачи, у меня есть подробный разбор с кодом — рекомендую, если вы вообще трогаете этот тег руками.

Что делать с пагинацией: рабочая схема

Тип пагинации Что делать Почему так
Категории, архивы, каталог Self-canonical + уникальный title (добавить «— страница N») + description либо убрать, либо уникализировать Страницы разные, они нужны роботу как транзитные узлы к карточкам
Главная страница /page/N/ Self-canonical, но убрать SEO-текст главной со второй страницы и далее SEO-текст, продублированный на 20 страницах, — самый быстрый способ обнулить его вес
Комментарии comment-page-N Отключить разбивку в настройках. Если отключить нельзя — canonical на основную статью Здесь дубликат настоящий: текст статьи повторяется полностью
Разбивка статьи nextpage Не использовать вообще Дробит вес одного материала между URL, при этом ни один не полон

Отдельно про title пагинации. WordPress по умолчанию отдаёт на всех страницах категории идентичный title. Это триггер для «Дубли страниц: страницы с одинаковыми title и description» в Вебмастере. Лечится одной вставкой в functions.php дочерней темы либо настройками нормального SEO-плагина. И да, про то, что один H1 открывает дорогу в топ, а четыре её закрывают, — на страницах пагинации это тоже актуально, многие темы дублируют H1 на каждой.

Источник второй: replytocom. Легенда, которая до сих пор жива

Вот здесь начинается самое интересное, потому что в интернете гуляет утверждение: «replytocom давно неактуален, в новых версиях WordPress этого нет». Открываю свежую установку последней версии, включаю древовидные комментарии, смотрю исходный код. Ссылка на месте:

<a rel="nofollow" href="https://site.ru/statya/?replytocom=157#respond">Ответить</a>

Никуда она не делась. Просто механика вреда изменилась, и вот об этом реально не рассказывают нигде.

Как это работает и почему nofollow вас не спасает

Каждая кнопка «Ответить» под каждым комментарием генерирует уникальный URL с параметром ?replytocom=ID. По этому адресу открывается — внимание — полная копия статьи с раскрытой формой ответа. Сто комментариев под статьёй = сто уникальных URL, на каждом полный дубль текста.

«Но там же rel=nofollow, робот не пойдёт», — говорят мне на каждой второй консультации. Разберём по пунктам, почему это не работает:

  • nofollow — это не запрет индексации. Это рекомендация не передавать вес. Атрибут никогда не был директивой «не заходи сюда». Google официально перевёл nofollow в статус подсказки ещё в 2019-м, Яндекс трактует его по-своему, но точно не как запрет обхода.
  • Робот узнаёт URL не только с вашей страницы. Метрика, счётчики, браузер Яндекса, чужие сайты, случайно скопированная кем-то ссылка из адресной строки. Ссылка попадает в очередь обхода в обход вашего nofollow.
  • Один раз проиндексированный URL живёт годами. Даже если вы уберёте параметр сегодня, страницы будут висеть в исключённых ещё долго, и робот будет их периодически перепроверять, сжигая бюджет.

Мой случай с кулинарным блогом: 34 000 дублей на 210 рецептов

Осенью разбирал проект — блог рецептов, живое сообщество, под некоторыми рецептами по 200-400 комментариев с ветками ответов. Всего 210 опубликованных рецептов. В Вебмастере — 34 700 исключённых страниц.

Считаем: 210 рецептов × в среднем 165 комментариев = ~34 650 replytocom-URL. Совпадение до сотни. Живой трафик — 1 800 в сутки, при том что материал был сильнее конкурентов из топа. Просто робот физически не успевал доходить до новых рецептов: он месяцами ходил по кругу вокруг форм ответа.

Убрали параметр. Через 11 недель — 4 100 в сутки, без единой новой ссылки и без единой новой статьи. Аналогичных результатов на чистой технике у меня в портфолио набралось достаточно, чтобы перестать удивляться.

Три способа убить replytocom — от худшего к лучшему

Способ 1, плохой: Disallow в robots.txt.

Disallow: /*?replytocom=

Почему плохой: запрет в robots.txt закрывает обход, но уже проиндексированные страницы будут висеть. Хуже — робот, не имея права зайти, не увидит там ваш canonical или noindex и не сможет корректно склеить. Получается замкнутый круг. Как временная затычка — сойдёт, как решение — нет.

Способ 2, приемлемый: убрать вывод ссылки из шаблона. Плагин или хук, который вырезает ?replytocom из HTML. Форма ответа при этом работает на JavaScript. Решает проблему для новых страниц, но не разбирается со старыми.

Способ 3, правильный: 301-редирект. Отдаём с любого URL с параметром replytocom постоянный редирект на чистый адрес статьи. Робот приходит, получает 301, склеивает, выбрасывает мусор из индекса и больше не возвращается. Дополнительно — вырезаем генерацию ссылки в шаблоне, чтобы новых не появлялось. Двойная защита: старое схлопывается, новое не рождается.

Именно этот вариант я ставлю на всех проектах, где веду доработку сайта перед стартом продвижения. Занимает полчаса, эффект держится годами.

Источник третий: фиды. Самый незаметный из троицы

Про фиды не говорят вообще нигде, потому что «RSS же умер». RSS как канал потребления контента — возможно. Как генератор URL в вашем WordPress — жив и здоров.

Сколько фидов на самом деле у вашего сайта

Откройте свой сайт и проверьте эти адреса. Скорее всего, откроются все:

  • /feed/ — главный фид
  • /comments/feed/ — фид всех комментариев сайта
  • /lyubaya-statya/feed/фид комментариев к каждой отдельной статье
  • /category/lyubaya/feed/ — фид каждой категории
  • /tag/lyuboy/feed/ — фид каждой метки
  • /author/admin/feed/ — фид каждого автора
  • /feed/rdf/, /feed/rss/, /feed/atom/ — альтернативные форматы того же самого

Третий пункт — вот он, тихий убийца. У каждой статьи есть собственный фид. 300 статей = 300 фидов. Плюс 300 фидов по формату atom. Плюс категории, плюс метки. Легко набегает под тысячу URL, о существовании которых вы не подозреваете.

Почему фид — это дубль, если он в XML

Возражение, которое я слышу: «это же XML, поисковик понимает, что это не страница». Понимает. Но:

  • Если в настройках чтения стоит «Полный текст» — фид отдаёт полные тексты статей. Робот получает ваш контент по второму адресу.
  • Фиды попадают в обход и жрут краулинговый бюджет так же, как обычные страницы. Роботу всё равно, что качать.
  • Фиды — это готовый инструмент для парсеров. Ваш контент утаскивают автоматом, публикуют раньше, чем Яндекс успел проиндексировать оригинал, и оригиналом становится не ваш сайт. Я разбирал такие ситуации, и доказать первичность постфактум — та ещё история.
  • В Вебмастере фиды регулярно оседают в «Малоценных», добавляя процент к общему проценту мусора по домену.

Что с ними делать

Решение зависит от того, нужен ли вам RSS вообще. Честный ответ для 90% коммерческих сайтов и блогов: не нужен.

Сценарий Действие
RSS не используется совсем Отключить все фиды через хуки и поставить 301 с /feed/ на главную, с /statya/feed/ — на статью
Фид нужен для Дзена / агрегатора Оставить только основной /feed/, остальные (комментарии, метки, авторы, форматы) — отключить
Фид нужен, но контент воруют Настройки → Чтение → «Краткий текст» вместо полного. В фид уходит анонс, а не вся статья
Фиды комментариев Отключать всегда, без исключений. Пользы ноль, URL сотни

Как найти все три источника на своём сайте за 20 минут

Теория без диагностики бесполезна. Вот порядок действий, который я прохожу на каждом аудите.

Шаг 1. Яндекс.Вебмастер

Индексирование → Страницы в поиске → вкладка «Исключённые». Смотрим соотношение: если исключённых в 5+ раз больше, чем в поиске, — диагноз почти поставлен. Выгружаем архив, открываем в Excel, фильтруем по вхождениям: replytocom, comment-page, /feed, /page/. Получаем точные цифры по каждому из трёх источников.

Шаг 2. Операторы поиска

Вбиваем в Яндекс: site:vashsite.ru replytocom, затем site:vashsite.ru feed, затем site:vashsite.ru comment-page. Если что-то находится в основной выдаче — ситуация запущенная, там уже не профилактика нужна, а хирургия.

Шаг 3. Краулер

Прогоняем сайт любым десктопным пауком с включённым обходом внешних параметров. Смотрим отчёт по дубликатам title и по каноническим адресам. Здесь обычно всплывает четвёртый, неучтённый источник — у каждого сайта свой сюрприз: то UTM-метки индексируются, то фильтры каталога, то версия для печати.

Шаг 4. Проверка после исправлений

Через две недели после внедрения смотрим динамику исключённых. Она должна пойти вниз — не резко, процесс небыстрый, реальное схлопывание занимает от 6 недель до 4 месяцев в зависимости от размера сайта и частоты обхода. Параллельно следим, чтобы количество страниц в поиске не падало: если упало — где-то перестарались с запретами.

Важный момент: не ждите роста трафика на следующей неделе. Здесь работает та же логика, что и в годовом плане SEO по месяцам — техническая база даёт отложенный, но накопительный эффект. И не ориентируйтесь на ИКС: индекс качества вам ничего не гарантирует, я об этом писал отдельно.

Чего делать точно не надо

Список ошибок, которые я вижу после «самолечения по статьям из интернета»:

  • Закрывать всё подряд в robots.txt. Особенно шедеврально выглядит Disallow: /*?* на сайте с фильтрами каталога. Одной строкой выносится половина посадочных.
  • Ставить noindex на пагинацию категорий. Робот перестаёт видеть карточки, доступные только с глубоких страниц. Особенно больно, если страницы и так лежат на пятом уровне вложенности.
  • Ставить два SEO-плагина одновременно. Каждый выводит свой canonical и свой robots meta. Иногда противоречащие друг другу. Робот выбирает случайно.
  • Удалять дубли через «Удалить URL» в Вебмастере пачками. Это лечение симптома. Через месяц движок сгенерирует их заново.
  • Трогать всё сразу без бэкапа и без замера базовой линии. Потом невозможно понять, что помогло, а что сломало.

Короткий чек-лист для WordPress-сайта

  • Настройки → Обсуждение → снять «Разбивать комментарии верхнего уровня на страницы».
  • 301-редирект со всех URL с ?replytocom= на чистый адрес статьи + вырезать генерацию ссылки в шаблоне.
  • Отключить фиды комментариев, меток, авторов и альтернативные форматы. Основной /feed/ — по необходимости.
  • Настройки → Чтение → «Краткий текст» в фиде, если фид всё-таки нужен.
  • Self-canonical на страницах пагинации, уникальный title с номером страницы.
  • SEO-текст и H1 — только на первой странице списка.
  • Не использовать <!--nextpage--> внутри статей.
  • Проверить, что вложения (attachment pages) отдают 404 или редирект, — это, к слову, четвёртый источник, но о нём отдельно.
  • Через 2 недели — контрольный замер в Вебмастере.

Почему в 2026 году это стало важнее, чем было

Раньше цена дублей измерялась только краулинговым бюджетом. Сейчас добавилось новое измерение, и вот его не понимают почти нигде.

Ответы нейросетей и AI-выдача строятся на выборке источников. Модель выбирает документ, которому доверяет: цельный, авторитетный, с однозначным адресом. Когда одна ваша статья существует в четырёх версиях, каждая с обрезанным весом и размытыми сигналами, вероятность попасть в такую выборку падает. Это уже не про позиции в десятке — это про то, будете ли вы вообще существовать для человека, который задаёт вопрос нейросети вместо поисковой строки. Я разбирал механику в материале про оптимизацию под AI-поиск — там нюансы, которых пока нет ни в одном учебнике.

Проще говоря: раньше дубли стоили вам части трафика. Теперь они стоят вам присутствия в новом канале целиком. И пока конкуренты вылизывают тексты, выигрывает тот, у кого чистая техника. Если хотите глубже разобраться в теме самостоятельно — у меня в разделе Техническое SEO собраны разборы по каждому пункту, а в разделе GEO-продвижение — всё про работу с ИИ-выдачей.

Если трафика мало, а причину найти не получается

Честно скажу: чек-лист выше закрывает процентов семьдесят типовых случаев. Оставшиеся тридцать — это когда дубли переплетены с кривой структурой, старыми редиректами, наследием прошлого подрядчика и парой плагинов, которые конфликтуют между собой. Разбирать это по статьям из интернета можно месяцами и в итоге сломать то, что работало.

Меня зовут Анатолий Кузнецов, я занимаюсь поисковым продвижением с 2005 года. За это время вывел в топ Яндекса более 300 сайтов и не получил ни одного фильтра — работаю только белыми методами по рекомендациям поисковых систем. Беру один проект на нишу, чтобы не конкурировать сам с собой.

Что предлагаю конкретно.

  • Бесплатный аудит сайта — покажу, сколько у вас реально дублей, откуда они лезут и какой объём трафика вы из-за них недополучаете. Без воды и общих фраз, результат за 24 часа.
  • Глубокий SEO-аудит — 120+ параметров с приоритизированным планом исправлений, который можно отдать любому разработчику.
  • SEO-продвижение под ключ — от чистки технической базы до топ-3 по коммерческим запросам. Работаете напрямую со мной, без менеджеров-прокладок, отчёты каждую неделю.
  • GEO-продвижение — вывод вашего бренда в ответы нейросетей и AI-поиска. Пока конкуренты про это не думают, места в выборке ещё свободны. Через год они будут стоить в разы дороже.

Средний рост заявок у моих клиентов — в 3–4 раза за первые полгода. Не потому что я знаю секретную кнопку, а потому что начинаю с фундамента: убираю то, что мешает роботу видеть ваш сайт таким, какой он есть. Посмотрите кейсы с цифрами и графиками — там всё честно, включая сроки.

Начните с бесплатной диагностики: проверить сайт за 30 секунд. Или напишите напрямую — форма обратной связи, отвечаю лично.

Дубли не убивают сайт мгновенно. Они просто делают так, что вся ваша работа над контентом даёт вполовину меньше отдачи, чем должна. Год за годом. И самое дорогое здесь — не потерянный трафик, а потерянное время: конкурент, который вычистил технику два года назад, сейчас уже недосягаем.

Увеличьте позиции и продажи вашего сайта

Профессиональное SEO-продвижение с гарантией результата. Выберите подходящую услугу:

Анатолий Кузнецов — SEO-оптимизатор

Остались вопросы по продвижению?

Меня зовут Анатолий Кузнецов, я SEO-оптимизатор с 20-летним стажем. Разберу ваш сайт, отвечу на вопросы и подскажу, что улучшить для роста позиций в Яндексе и Google.

Связаться со мной →

Оставьте комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

 Нажимая «оставить комментарий» вы принимаетеправила конфиденциальности 

Прокрутить вверх