Статті ·
Канібалізація сторінок: як знайти без Search Console
Коли дві сторінки конкурують за один запит, Google обирає сам — і не завжди ту, яку треба вам. Як знайти такі пари, маючи лише sitemap, і що з ними робити.
Канібалізація — це коли дві або більше сторінок сайту закривають один і той самий запит. Google має обрати одну, і робить це самостійно. Проблема не в тому, що він обирає, а в тому, що обирає не завжди ту: у видачу може потрапити стара стаття замість сторінки послуги, або картка товару замість категорії.
Як це виглядає на практиці
- стаття в блозі «Як обрати газонокосарку» і категорія «Газонокосарки» — обидві про вибір газонокосарки;
- дві посадкові під один регіон, зроблені в різний час різними людьми;
- сторінка послуги й кейс про цю саму послугу з майже однаковим текстом;
- категорія і її ж версія з фільтром, яку забули закрити від індексації.
Симптом, який видно без інструментів: позиція по запиту стрибає, і в різні дні у видачі показуються різні URL вашого ж сайту.
Чому це шкодить
- Сигнали діляться. Зовнішні посилання, поведінкові фактори й вік розподіляються між двома сторінками замість того, щоб працювати на одну.
- Google витрачає бюджет. Він змушений сканувати обидві й вирішувати щоразу заново.
- Ви втрачаєте контроль. У видачу потрапляє сторінка з гіршою конверсією, і ви про це не знаєте, доки не подивитесь звіт по запитах.
Чому не всі можуть перевірити через Search Console
Класичний спосіб — вивантажити звіт «Ефективність» і подивитись, чи один запит приводить на різні URL. Він добрий, але має два обмеження.
По-перше, потрібен підтверджений доступ до Search Console, а на аудиті чужого сайту його часто немає — і поки клієнт дасть доступ, минає тиждень. По-друге, сторонні сервіси, що читають GSC за вас, вимагають sensitive scopes і верифікації застосунку в Google, яка триває тижнями.
Спосіб, для якого достатньо sitemap
Канібалізація майже завжди має лексичний слід: дві сторінки під один інтент написані схожими словами. Тому її видно, навіть не знаючи запитів.
Алгоритм простий:
- беремо URL із sitemap;
- завантажуємо сторінки й витягуємо title, H1, опис і початок тексту;
- рахуємо попарну схожість;
- показуємо пари, де схожість вища за поріг.
Три типи конфлікту
Дублі контенту
Схожість вища за 92%. Це фактично одна сторінка за двома адресами. Лишіть одну, з другої поставте 301.
Однаковий тайтл
Заголовки майже збігаються, тексти різні. Найчастіше — дві посадкові, зроблені в різний час. Перепишіть під різні запити або об’єднайте.
Однаковий інтент
Тексти різні, але відповідають на те саме питання. Тут рішення змістове: або об’єднати в одну сильну сторінку, або чітко розвести — одна відповідає «як обрати», друга «купити».
Що робити з парою
- Об’єднати — найкращий варіант, коли обидві слабкі. Одна сильна сторінка виграє в двох посередніх.
- Canonical — коли обидві потрібні людям, але в пошуку має бути одна.
- 301 — коли друга взагалі не потрібна.
- Переписати — коли сторінки мають різну аудиторію, просто написані однаково.
Чого не варто робити — ставити noindex на одну зі сторінок «про всяк випадок». Ви втрачаєте її сигнали й нічого не передаєте другій.
Перевірити свій сайт
Детектор канібалізації приймає адресу сайту або sitemap.xml і повертає пари з оцінкою схожості й типом конфлікту. Доступу до Search Console не потрібно.
Поріг схожості можна змінити. За замовчуванням 80% — на цьому рівні майже не буває хибних спрацювань; якщо хочете подивитись ширше, знизьте до 70.