Дубльований контент і канонічні теги: як вони впливають на індексацію
Чому майже ідентичні сторінки конкурують одна з одною за індексацію і як канонічний тег повідомляє пошуковим системам, яку версію справді слід індексувати та ранжувати.
Дубльований контент рідко буває повним копіюванням
Більшість дубльованого контенту — не дві ідентичні статті, а та сама сторінка, доступна через кілька URL-адрес: з www і без, зі скісною рискою в кінці й без, через http і https, з доданими параметрами відстеження чи сортування, або версія для друку за окремою URL-адресою. Для сканера кожна з них — окрема URL-адреса, що виявляється відображає той самий контент.
Чому це шкодить індексації, а не лише ранжуванню
Поширене припущення — що дубльований контент просто розділяє сигнали ранжування між версіями. На практиці пошукові системи часто йдуть на крок далі й просто обирають одну версію для індексації, значною мірою ігноруючи решту — і цей вибір не гарантовано збігається з версією, яку ви насправді хотіли. Це одна з поширеніших, менш очевидних причин того, що сторінка застрягає в статусі «Скановано, наразі не проіндексовано»: її сканували, розпізнали як еквівалентну іншій URL-адресі й просто відкинули на користь тієї.
Що насправді робить канонічний тег
Тег <link rel="canonical" href="..."> повідомляє сканеру: кілька URL-адрес можуть вести сюди, але саме ця конкретна — версія, яку слід індексувати й зараховувати. Кожна доступна для індексації сторінка має мати канонічний тег — включно з таким, що посилається сама на себе, — щоб ніколи не виникало неоднозначності щодо того, яку URL-адресу власний контент сторінки вважає авторитетною.
Це підказка, а не директива
Пошукові системи сприймають канонічні теги як сильний сигнал, а не абсолютне правило — подібно до sitemap. Якщо інші сильні сигнали суперечать (наприклад, більшість зовнішніх зворотних посилань вказують на неканонічну версію), пошукова система може обрати для індексації іншу URL-адресу, ніж ту, що ви вказали. Канонічні теги працюють найкраще, коли вони узгоджені з усіма іншими сигналами на сторінці: внутрішні посилання, запис у sitemap і перенаправлення мають вказувати на ту саму URL-адресу.
Поширені помилки канонізації
- Вказування канонічного тегу на URL-адресу, що кудись перенаправляє, — сканеру доводиться проходити весь ланцюжок, що додає тертя сигналу, який мав би усувати неоднозначність.
- Вказування канонічного тегу на сторінку, яка сама має тег noindex, — суперечлива пара сигналів, що може залишити обидві версії непроіндексованими.
- Неузгоджені канонічні теги в серії сторінок з пагінацією (кожна сторінка вказує назад на сторінку 1), коли кожна сторінка насправді має унікальний, вартий індексації контент, який варто зберегти окремо.
- Помилка загальносайтового шаблону, що канонізує кожну сторінку на головну, — рідкісна, але катастрофічна, і варта вибіркової перевірки після будь-якої зміни шаблонів.
Виправлення на майбутнє
Оберіть одну канонічну форму для вашого домену (з www чи без, зі скісною рискою в кінці чи без) і перенаправляйте кожен інший варіант на неї на рівні сервера — канонічний тег є вторинним сигналом, а не заміною того, щоб взагалі не віддавати дубльовані URL-адреси зі статусом 200. Коли це узгоджено, переконайтеся, що ваш sitemap завжди містить лише канонічну версію кожної сторінки — включення неканонічної URL-адреси надсилає сигнал, що прямо суперечить власному канонічному тегу сторінки.
Хочете, щоб наступна сторінка знайшлася швидше, ніж завдяки самому лише органічному скануванню?
IndexLaunch надсилає кожну URL-адресу, яку ви подаєте, безпосередньо до Bing, Yandex, Seznam і Naver через IndexNow одразу після того, як ви додаєте її в чергу.
Переглянути тарифи