Шаблон канонічних тегів і дубльованого контенту
Практичний шаблон, який допоможе знайти дубльований і майже дубльований контент і правильно налаштувати канонікалізацію на всьому сайті.
Дубльований контент рідко призводить до санкцій, але він марно витрачає бюджет сканування й розпорошує сигнали ранжування між конкурентними URL. Цей шаблон допоможе виявити дублікати, обрати правильний спосіб консолідації та коректно впровадити rel=canonical. Пам'ятайте, що канонічний тег — це підказка, а не директива, тож обраний URL має бути очевидно бажаною та індексованою версією.
6 готових варіантів
Пошук дубльованого та майже дубльованого контенту
Проведіть аудит сайту, щоб знайти точні та майже дубльовані сторінки, перш ніж вирішувати, як їх об'єднати.
Пошук дубльованого та майже дубльованого контенту
Перш ніж щось канонікалізувати, складіть інвентар того, що насправді дублюється. Почніть із повного сканування й згрупуйте URL зі схожими або однаковими заголовками, meta-описами, H1 і основним текстом.
Перевірте ці поширені джерела дублювання:
- Варіанти протоколу та хоста: http проти https, www проти без-www, різниця в кінцевому слеші
- Параметри: сортування, фільтри, ідентифікатори сесій і теги відстеження, як-от [Приклад параметра]
- Версії для друку/AMP/мобільні версії тієї самої статті
- Сторінки з великою кількістю шаблонного тексту: тонкі сторінки категорій чи тегів, що сильно перетинаються
- Проскануйте сайт і експортуйте URL, заголовок, H1 і хеш контенту.
- Відсортуйте за хешем контенту, щоб виявити точні дублікати.
- Вибірково перевірте майже дублікати, порівнюючи кількість слів і спільні фрази.
- Підтвердьте в [URL Search Console], яку версію Google наразі індексує.
Задокументуйте кожен кластер дублікатів і оберіть один бажаний URL на кластер. Цей бажаний URL стане вашою канонічною ціллю в наступних варіантах.
Самопосилальні канонічні теги
Налаштуйте поведінку канонікалізації за замовчуванням так, щоб кожна індексована сторінка вказувала сама на себе.
Самопосилальні канонічні теги
Кожна індексована сторінка має оголошувати канонічний тег, що вказує на її власний чистий, бажаний URL. Таке самопосилання є значенням за замовчуванням і не дає Google гадати, коли з'являються незначні варіації URL через посилання, параметри чи спільні платформи.
Правила впровадження:
- Розміщуйте тег у [Секція Head], а не в тілі сторінки.
- Використовуйте абсолютний URL із правильним протоколом і хостом, наприклад [Бажаний URL].
- Канонічний URL має повертати статус 200 і бути індексованою версією без перенаправлень.
- Зберігайте один канонічний тег на сторінку; кілька суперечливих тегів ігноруються.
- Один раз визначте бажаний хост і протокол і застосуйте їх на всьому сайті.
- Виводьте власний чистий URL сторінки як канонічний, прибираючи параметри відстеження.
- Перевіряйте відрендерений HTML, а не лише шаблон, оскільки JavaScript може змінювати теги.
Оскільки rel=canonical — це підказка, підсильте її послідовними внутрішніми посиланнями, чистою XML-картою сайту та 301-редиректами для застарілих URL, щоб усі сигнали вказували на ту саму бажану версію.
URL з параметрами та фасетною навігацією
Контролюйте дублювання від параметрів сортування, фільтрів, сесій і відстеження на сторінках лістингу та електронної комерції.
URL з параметрами та фасетною навігацією
Фасетна навігація й параметри URL можуть генерувати тисячі майже ідентичних сторінок, що виснажують бюджет сканування. Вирішіть, які комбінації параметрів заслуговують на індексацію, а які мають консолідуватися до чистого базового URL.
Поширені типи параметрів і поводження з ними:
- Порядок сортування (напр. [Параметр сортування]): переупорядковує ті самі елементи, тож вказуйте канонічний тег на несортований базовий URL.
- Ідентифікатори сесій і відстеження: ніколи не змінюють контент, тож вказуйте канонічний тег на чистий URL.
- Фільтри, що створюють унікальний, цінний асортимент: можуть заслуговувати на власний самопосилальний канонічний тег і індексацію.
- Пагінація: кожна сторінка має посилатися сама на себе, а не на сторінку 1.
- Перелічіть кожен параметр, який видає ваш сайт, і позначте, чи змінює він контент.
- Для параметрів, що не змінюють контент, вказуйте канонічний тег варіанта на чистий базовий URL.
- Зберігайте канонічні URL абсолютними, зі статусом 200 і доступними для сканування, не заблокованими в robots.txt.
- Уникайте поєднання канонічного тега з noindex на тому самому URL.
Там, де фільтри не додають пошукової цінності, розгляньте noindex для користувачів плюс контроль внутрішніх посилань замість покладання лише на канонічний тег, адже канонікалізація — це лише підказка.
Крос-доменні канонічні теги та синдикований контент
Консолідуйте сигнали, коли той самий контент з'являється на кількох доменах або републікується партнерами.
Крос-доменні канонічні теги та синдикований контент
Коли ви синдикуєте статті або републікуєте контент на партнерських доменах, крос-доменний канонічний тег просить Google зарахувати першоджерело. Сторінка, що републікує, встановлює канонічний тег, який вказує на ваш оригінальний URL.
Як це налаштувати:
- Синдикована копія додає канонічний тег на оригінал, наприклад [Оригінальний URL].
- Канонічний тег має бути абсолютним URL на домені-джерелі, що повертає 200.
- Обидві версії можуть залишатися доступними для читачів; канонічний тег консолідує сигнали ранжування.
- Попросіть партнерів впровадити його; ви не можете встановлювати канонічні теги на доменах, які не контролюєте.
- Переконайтеся, що оригінал опубліковано й індексовано, перш ніж синдикувати.
- Надайте партнерам точний абсолютний канонічний URL для вбудовування.
- Перевірте, що тег присутній у відрендереному HTML партнера.
Крос-доменні канонічні теги все одно залишаються підказкою. Якщо консолідація критична, доповніть її чітким графіком «спершу публікуємо ми», внутрішніми посиланнями та, де партнери згодні, noindex на синдикованій копії.
Канонічний тег проти noindex проти 301
Оберіть правильний метод консолідації для кожного сценарію дублювання.
Канонічний тег проти noindex проти 301
Ці три інструменти вирішують різні задачі, і плутанина між ними призводить до втрати сигналів або деіндексації сторінок. Зіставте метод із метою, перш ніж впроваджувати.
- 301-редирект: використовуйте, коли URL має назавжди зникнути, а його сигнали мають консолідуватися до іншого URL. Найкраще для вилучених, переміщених або об'єднаних сторінок.
- rel=canonical: використовуйте, коли обидва URL мають залишатися доступними для користувачів, але є справжніми дублікатами, і ви хочете консолідувати індексацію в один. Це підказка, тож тримайте обидві версії узгодженими.
- noindex: використовуйте, коли сторінка має залишатися доступною для користувачів, але поза індексом, як-от тонкі сторінки фільтрів чи результати внутрішнього пошуку.
- Запитайте: чи має URL і далі існувати? Якщо ні — використовуйте 301.
- Якщо так і він дублює іншу сторінку — використовуйте канонічний тег.
- Якщо так, але він просто не має ранжуватися — використовуйте noindex.
Не поєднуйте канонічний тег і noindex на тому самому URL; сигнали суперечать один одному, і Google може проігнорувати обидва. Оберіть один метод на URL і застосуйте його чітко.
Перевірка канонічних тегів і типові помилки
Перевірте своє впровадження канонічних тегів і виявіть помилки, що непомітно ламають консолідацію.
Перевірка канонічних тегів і типові помилки
Канонічний тег дає збій непомітно, тож цілеспрямована перевірка є критично важливою. Проскануйте свої живі, відрендерені сторінки й переконайтеся, що кожен канонічний тег веде до чистої, індексованої цілі.
Перевірте ці типові помилки:
- Канонічний тег на перенаправлений, заблокований або 404 URL замість сторінки зі статусом 200
- Відносні URL або URL з неправильним протоколом, коли канонічний тег має бути абсолютним
- Пагіновані сторінки, канонікалізовані на сторінку 1 замість самопосилання
- Канонічний тег плюс noindex на тому самому URL, що суперечать один одному
- Кілька канонічних тегів або впроваджені через JavaScript, що не збігаються з вихідним HTML
- Проскануйте й експортуйте кожен URL з його оголошеним канонічним тегом.
- Переконайтеся, що кожна ціль повертає 200 і не заблокована в robots.txt.
- Порівняйте свій оголошений канонічний тег із канонічним тегом, обраним Google, у [URL Search Console].
Там, де Google обирає інший канонічний тег, ніж ви оголосили, сприймайте це як сигнал, що внутрішні посилання, карти сайту чи схожість контенту суперечать вашому вибору, а потім узгодьте ці сигнали.
Як використовувати цей шаблон
- Проскануйте весь сайт і експортуйте кожен URL з його заголовком, H1, хешем контенту та поточним канонічним тегом.
- Згрупуйте точні та майже дубльовані сторінки в кластери, потім оберіть один бажаний, індексований URL на кластер.
- Визначте свій єдиний бажаний протокол і хост (https та www чи без-www) і застосовуйте їх послідовно всюди.
- Додайте самопосилальний канонічний тег на кожну індексовану сторінку, використовуючи абсолютний URL, що повертає статус 200.
- Зіставте кожен параметр (сортування, фільтр, сесія, відстеження) і вкажіть канонічний тег варіантів без зміни контенту на їхній чистий базовий URL.
- Для кожного дубліката оберіть правильний інструмент: 301 для вилучення URL, канонічний тег для консолідації живих дублікатів, noindex для тримання сторінки поза індексом.
- Встановіть крос-доменні канонічні теги на синдикованих копіях, що вказують на ваш оригінальний абсолютний URL-джерело.
- Перевірте в Search Console, який канонічний тег насправді обрав Google, потім узгодьте внутрішні посилання та карти сайту зі своїм вибором.
Поради
- Сприймайте rel=canonical як підказку, а не директиву; підсильте її послідовними внутрішніми посиланнями, картами сайту та 301-редиректами, щоб усі сигнали узгоджувалися.
- Ніколи не вказуйте канонічний тег на перенаправлений, заблокований або 404 URL і ніколи не поєднуйте канонічний тег із noindex на тій самій сторінці.
- Не канонікалізуйте пагіновані сторінки на сторінку 1; нехай кожна сторінка в серії посилається на власний канонічний тег.
- Завжди перевіряйте канонічні теги у відрендереному HTML, оскільки JavaScript або плагіни платформи можуть впроваджувати чи перевизначати тег.
Поширені запитання
Чи призводить дубльований контент до санкцій Google?
Майже в усіх випадках — ні. Дубльований контент зазвичай не є санкцією; натомість він марно витрачає бюджет сканування й розпорошує сигнали ранжування між конкурентними URL. Канонікалізація консолідує ці сигнали на вашій бажаній версії. Санкції зазвичай застосовуються лише до навмисно оманливого або масово скопійованого контенту.
Чи є rel=canonical директивою, якої Google має дотримуватися?
Ні. Канонічний тег — це підказка, а не директива. Google враховує його поряд з іншими сигналами, як-от внутрішні посилання, редиректи, карти сайту та схожість контенту, і може обрати інший канонічний тег. Зробіть свій бажаний URL очевидним, тримаючи всі ці сигнали узгодженими.
Чи повинна кожна сторінка мати канонічний тег?
Так, за замовчуванням кожна індексована сторінка має посилатися на власний канонічний тег, використовуючи абсолютний URL, що повертає статус 200. Самопосилальні канонічні теги усувають неоднозначність, коли з'являються варіації URL за параметром, протоколом чи хостом через посилання або платформи.
Коли слід використовувати 301-редирект замість канонічного тега?
Використовуйте 301, коли URL має назавжди зникнути, а його сигнали мають консолідуватися до іншого URL, як-от переміщені чи об'єднані сторінки. Використовуйте канонічний тег, коли обидва URL мають залишатися доступними для користувачів, але є справжніми дублікатами, які ви хочете індексувати як один.
Чи можна розмістити канонічний тег і тег noindex на одній сторінці?
Ні. Поєднання канонічного тега й noindex на тому самому URL надсилає суперечливі сигнали, і Google може проігнорувати обидва. Оберіть один метод на URL: канонічний тег для консолідації живого дубліката або noindex, щоб залишити сторінку доступною для користувачів, але поза індексом.
Чи мають пагіновані сторінки вказувати канонічний тег на сторінку 1?
Ні. Друга й наступні сторінки не є дублікатами першої, тож кожен пагінований URL має посилатися на власний канонічний тег. Канонікалізація всієї серії на сторінку 1 може приховати глибший контент від індексації й втратити посилання, наявні лише на пізніших сторінках.