Дубли страниц и каннибализация запросов: как сайт конкурирует сам с собой

Дубли страниц и каннибализация запросов: как найти и исправить
Технические дубли плодят копии одной страницы по разным адресам, а каннибализация сталкивает две разные страницы на одном запросе. Разбираем, как отличить одно от другого, найти оба случая в отчётах и чем лечить каждый.

Сайт может конкурировать сам с собой двумя способами. Технические дубли плодят копии одной страницы по разным адресам, а каннибализация заставляет две разные страницы бороться за один запрос. Симптом у обеих проблем один: позиции скачут, а в топ не выходит ни одна страница. Разбираем, как отличить одно от другого, как найти оба случая в своих отчётах и чем лечить.

Две разные проблемы, которые путают

Технический дубль — это одна и та же страница, доступная по нескольким адресам. С параметрами и без, со слешем и без слеша, в http и в https, в мобильной версии и в основной.

Каннибализация — это две разные страницы с разным текстом, которые отвечают на один и тот же запрос. Обе написаны осмысленно, просто кто-то не свёл их в плане.

Лечатся они по-разному, поэтому сначала стоит понять, с чем имеете дело.

ПризнакТехнический дубльКаннибализация
Что дублируетсяАдрес при том же содержанииТема при разном содержании
Как замечаютВ отчётах индексацииПо скачкам позиций в выдаче
Типичная причинаНастройки движка, фильтры, параметрыОтсутствие плана и учёта запросов
Чем лечитсяCanonical, редирект, настройка движкаОбъединение страниц или разведение по запросам
Сколько занимаетРазово, силами разработчикаПравка контента и перелинковки

Начнём с технических, они встречаются чаще и чинятся быстрее.

Откуда берутся технические дубли

  • Параметры в адресах. Метки рекламных кампаний, сортировки, фильтры каталога.
  • Пагинация, когда вторая и третья страницы списка повторяют текст первой.
  • Один товар в нескольких категориях, если адрес включает путь категории.
  • Страницы вложений в WordPress, когда каждая картинка получает свою страницу.
  • Версии с www и без, со слешем на конце и без него, http рядом с https.
  • Черновые копии страниц, забытые после переделки сайта.

Все эти случаи решает указание основной версии страницы. Google описывает способы в руководстве по объединению дублирующихся адресов: атрибут canonical, редиректы, карта сайта и согласованные внутренние ссылки. Атрибут при этом подсказка, а не команда, и поисковик может выбрать другую версию, если остальные сигналы ей противоречат.

Разница между техническим дублем и каннибализацией запросов
Симптом один, а лечение совершенно разное

Как найти дубли за полчаса

  1. Откройте отчёт об индексации в Search Console и Вебмастере, раздел с исключёнными страницами. Там прямо перечислены адреса, признанные копиями.
  2. Поищите в поиске несколько характерных предложений со своей страницы в кавычках и посмотрите, сколько своих же адресов найдётся.
  3. Прогоните сайт любым краулером и отсортируйте страницы по совпадению заголовков и описаний. Одинаковые title у разных адресов почти всегда означают дубли.
  4. Проверьте, что во внутренних ссылках вы всегда ссылаетесь на один и тот же вариант адреса.

Четвёртый пункт пропускают чаще всего, а он бесплатный и снимает половину разночтений.

Каннибализация: как её увидеть

Здесь отчёты тоже дают ответ, только смотреть нужно на связку запроса и страницы.

Выгрузите из Search Console запросы вместе со страницами за три месяца и найдите запросы, по которым показывались два и более ваших адреса. Если по одному запросу сайт показывает то одну страницу, то другую, и обе стоят ниже десятой позиции, это она.

Второй признак виден по истории. Позиция по запросу скачет диапазонами, а не двигается плавно, и в моменты скачков меняется адрес, который показывается в выдаче.

Третий способ грубый, но быстрый. Поиск по сайту с нужным запросом показывает, сколько ваших страниц вообще претендуют на эту тему.

Три способа вылечить каннибализацию запросов
Выбор зависит от того, насколько страницы разные по сути

Чем лечить каннибализацию

Вариантов три, и выбор зависит от того, насколько страницы разные по сути.

  1. Объединить. Если страницы отвечают на один вопрос, лучшие части собираются в одну, а со второй ставится постоянный редирект. Так накопленные ссылки и сигналы не теряются.
  2. Развести по интентам. Если одна страница про «как сделать», а вторая про «заказать», их разделяют явно: правят заголовки, первые абзацы и внутренние ссылки, чтобы каждая отвечала на свой тип запроса. Как это определяется, разобрано в статье о типах поисковых запросов.
  3. Назначить главную. Если обе страницы нужны, выбирают ту, что должна ранжироваться, и ведут на неё внутренние ссылки с нужным анкором, а со второй убирают лишние вхождения запроса.

Есть и случай, когда вмешиваться не нужно. Если по запросу стабильно показывается одна и та же страница и она в топе, наличие второй страницы с похожими словами проблемой не является.

Почему слишком много ключей на странице вредит

Каннибализация бывает и внутри одной страницы, когда её пытаются оптимизировать сразу под несколько близких запросов.

Показательная история из англоязычной практики. Страница держала первое место по одному запросу и восьмое по похожему. Её дооптимизировали под второй, какое-то время она ранжировалась по обоим, а после обновления алгоритма поиск решил, что за этими запросами стоят разные намерения. Позиции по второму запросу пропали, по первому страница опустилась, и всё вернулось только после того, как упоминания второго запроса убрали.

Отсюда правило. Одна страница отвечает на одну задачу. Близкие по словам, но разные по смыслу запросы разводятся по разным страницам заранее, а не после падения.

Сколько ждать после правок

Изменения не срабатывают в день публикации, и это нормально.

Поисковику нужно переобойти обе страницы, увидеть редирект или новый canonical и пересчитать, какая версия теперь основная. На небольшом сайте это занимает от нескольких дней до пары недель, на крупном дольше, потому что до редко посещаемых страниц робот доходит реже. Ускорить процесс помогает отправка адресов на переобход и внутренние ссылки на страницу, которая должна остаться главной.

Проверять результат стоит по двум признакам. В отчёте об индексации меняется статус второй страницы, а в связке запроса и страницы по нужному запросу начинает стабильно показываться один адрес.

Если через месяц ничего не изменилось, чаще всего дело в противоречивых сигналах. Canonical указывает на одну страницу, внутренние ссылки ведут на другую, а карта сайта содержит обе.

Как не создавать проблему заново

  • В контент-плане у каждой статьи записан свой главный запрос, и он не повторяется.
  • Перед новой статьёй проверяется, нет ли на сайте страницы, которая уже отвечает на этот запрос.
  • Фильтры и сортировки в каталоге закрыты от индексации или снабжены canonical.
  • Внутренние ссылки ведут на один канонический вариант адреса.
  • После переделки сайта старые адреса получают редиректы, а не остаются копиями.

С чего начать

Откройте отчёт об индексации и посмотрите раздел исключённых страниц. Обычно уже там видно, сколько адресов поиск считает копиями и какую версию он выбрал основной. Затем выгрузите связки запросов и страниц и найдите запросы с двумя адресами. Эти два действия занимают час и показывают обе проблемы сразу.

Как встроить проверку на пересечения в работу над контентом, чтобы не разгребать потом, описано в руководстве по контенту для сайта.

Поиск дублей и разметку страниц по запросам мы делаем в рамках SEO-аудита, а переработку пересекающихся статей — в рамках контент-маркетинга.

Частые вопросы о дублях и каннибализации
Чем дубли отличаются от каннибализации?
Как быстро найти дубли на сайте?
Атрибут canonical гарантирует выбор нужной страницы?
Как понять, что страницы каннибализируют запрос?
Всегда ли нужно объединять такие страницы?
Через сколько будет виден результат правок?

SEO-специалист с 2012 года, руководитель веб-студии SEO Академия. До SEO — 11 лет в банковской сфере, экономист по образованию (БГЭУ). Создатель блога SEOJedi и курса «SEO для чайников», более 50 проектов продвижения.

SEO Академия