Ми перевірили 21 живу карту сайту на відповідність протоколу, і найгірші порушники продають SEO-софт.
Чистими повернулися лише 8. Ahrefs не віддає lastmod узагалі, і Semrush теж не віддає.
Карта сайту, це єдиний файл на вашому сайті, який ніхто не перечитує. Ви згенерували його один раз, він вічно валідний як XML, і жоден інструмент не скаже вам, що він тихо перестав бути корисним.
Тож 6 вересня 2026 року ми перезавантажили 21 таку карту і прочитали, що в них насправді всередині. Ось 7 уроків, і кожен із них стосується і вашого файлу.
Вважайте свою карту зламаною, доки не подивитесь
Ми запитали 21 карту сайту, відповіли 19. Etsy віддав 404 за адресою, яку сам оголошує у своєму robots.txt, а GitHub відмовив нам напряму.
Ваш власний файл може робити те саме просто зараз, і ніщо вам про це не скаже.
Із тих 19 у 8 не було геть нічого поганого: Booking.com, Canva, eBay, Figma, Investopedia, Moz, Vercel і наша.
Решта 11 несуть щось, що ігнорується, виходить за дозволені межі або просто відсутнє. І жодне з цього не є синтаксичною помилкою.
Кожен із цих файлів, це валідний XML, який пройшов би валідатор без жодного слова докору. Саме тому проблеми й живуть, і саме тому ваша теж дожила донині.
Тож вважайте свій файл зламаним, доки не відкриєте і не прочитаєте його самі. Ніщо у вашому стеку не скаже вам інакше.
Збірка його генерує, валідатор пропускає, а трекер позицій про нього ніколи не згадує. Якщо не подивитесь ви, не подивиться ніхто.
Приберіть поля, яких ніхто не читає
Найчастіша знахідка і найбезглуздіша.
<changefreq> і <priority>, це дорадчі поля у специфікації sitemaps.org, а в документації Google прямо сказано, що він ігнорує обидва. 5 із 19 досі шлють changefreq, а 4 досі шлють priority.
Cloudflare шле 896 кожного. Shopify шле 557 кожного. The Guardian шле 424 значення changefreq. Zapier шле 36 кожного. HubSpot шле рівно 1 кожного, і це чомусь найдивніший результат усього огляду.
Файл Cloudflare несе 1800 елементів, яких не читає жоден великий пошуковик. Вони не коштують нічого, крім байтів.
Річ не в байтах. Річ у тому, що файл згенерував кілька років тому інструмент із такими налаштуваннями за замовчуванням, і відтоді його ніхто не відкривав. У вашого генератора теж були свої налаштування за замовчуванням, і ви їх, найпевніше, теж не обирали.
Дайте кожному URL справжній lastmod
Поле, яке таки читають, найчастіше відсутнє.
<lastmod> каже пошуковому роботу, які з ваших сторінок змінилися, щоб він витрачав свій бюджет саме на них. У 6 із 19 його немає зовсім: Ahrefs, Semrush, Stripe, Notion, Healthline і Zapier.
Без нього нічого не ламається. Робот просто не отримує сигналу про те, що нового, і покладається на власний здогад, а на великому сайті це означає, що ваші оновлені сторінки стоять у черзі за тисячами незмінених.
Погляньте на склад цього списку: платіжний API, новинний видавець, платформа автоматизації і 2 SEO-вендори. Розмір і зрілість тут не передбачають нічого.
Якщо хочете побачити, що оголошує ваш власний файл, перш ніж його лагодити, XML Sitemap Generator пройде індекси і покаже, що саме отримує пошуковий робот.
Це безкоштовно. Проблема з картою сайту проявляється як сторінки, що тихо випадають з індексу, тож тримайте поруч історію позицій: і Semrush, і SE Ranking її ведуть, і падіння видно там за тижні до того, як його хтось помітить.
Не довіряйте пораді, якої сам порадник не дотримується
Із 3 найбільших SEO-компаній чисту карту сайту має 1.
Moz чистий. Ahrefs не віддає lastmod. Semrush не віддає lastmod і має 7 URL, які вказують на інший хост, ніж той, що віддає саму карту: такі записи пошуковий робот має повне право ігнорувати, бо карта сайту може говорити лише за адреси того хоста, на якому вона лежить.
Ми включили в це порівняння й себе, тож: індекс unmiss.com має 7 записів і чистий. Це маленький файл, і хвалитися тут особливо нічим.
Суттєве інше: хтось його перевірив. У цьому вся різниця між двома половинами цієї таблиці.
Опинитися у верхній половині ви можете вже сьогодні по обіді. Ніщо з цього переліку не потребує ні проєкту, ні бюджету, ні підрядника. Потрібно, щоб хтось відкрив файл.
11 із 19 перевірених нами карт сайту порушують правила, зокрема кілька від компаній, які продають SEO. Ці файли ніхто не перечитує. Ми перечитуємо, разом з усім іншим, у що ніхто не заглядав від самого запуску.
- Повний технічний аудит, який читає людина
- Розробники, які лагодять знайдене аудитом
- SEO і GEO, коли база вже чиста
- Перша консультація безкоштовна
Відкрийте файл, не вірте статусу
Найдивніший результат. wikihow.com/sitemap_index.xml віддає 200, валідний XML, правильний кореневий елемент, і 0 URL.
Порожній індекс карти сайту неможливо відрізнити від здорового в жодній автоматичній перевірці, яка зупиняється на питанні "чи розпарсилося". Він віддає 200. Він валідний. Усередині нічого.
wikiHow, це сайт із сотнями тисяч статей, який ранжується чудово, тож бізнесу це їм не коштує. Зате це гарна ілюстрація того, що карта сайту може бути цілком відсутньою за дією і цілком присутньою на вигляд, і ніхто про це не дізнається, доки не порахує записи.
Тож порахуйте свої. Це один рядок у терміналі, і він відділяє "у нас є карта сайту" від "у нашій карті сайту є наші сторінки".
На статус-мітингу ці два речення звучать однаково. На більшості сайтів правдиве лише одне з них, і ви не знатимете, яке саме, доки не подивитесь.
Обмежте карту її власною текою
Протокол обмежує карту сайту адресами на рівні її власного шляху або нижче. Карта за адресою /sitemaps/news.xml може перелічувати /sitemaps/… і нічого вище.
Новинна карта сайту The Guardian перелічує 424 URL поза власною текою: звичайні адреси статей у корені сайту, подані з файлу, який не має над ними жодних повноважень.
На практиці Google ставиться до цього поблажливо, якщо карту оголошено в robots.txt, а в Guardian вона оголошена. Але це така річ, що працює, доки якийсь робот не вирішить застосувати правило, а користі від невідповідності специфікації немає жодної.
Тож покладіть карту сайту в корінь або підніміть її так, щоб вона покривала все, що перелічує. Це коштує вам одного редиректу і прибирає цілий клас тихих збоїв.
Перевіряйте її після кожного деплою
Інструкція, і причина, чому цей огляд узагалі існує.
Усе описане вище невидиме для того, хто цим володіє. Немає ні помилки, ні падіння позицій, яке можна було б сюди прив'язати, ні сповіщення. Файл був правильним, коли його згенерували, а потім поплив.
Тож вбудуйте це в деплой. Заберіть карту сайту, порахуйте записи, звірте, що кількість саме така, як ви очікуєте, і перевірте, що потрібні вам поля на місці. Ми тепер робимо це у власній збірці: у ранішій версії цієї статті довелося написати, що ми цього не робимо і що наш власний файл провалює перевірку, яку ми проганяли на чужих.
А тоді подивіться, що робить із вашим файлом пошуковий робот. Наш Website Audit позначає адреси з карти сайту, які несуть тег noindex, а це найдорожчий варіант цієї проблеми: просити проіндексувати і тим самим подихом відмовляти. У Canva такий випадок живий просто зараз.
Кожен файл у цьому огляді, це валідний XML. Проблеми в тому, що файл каже, а не в тому, чи він парситься, і саме тому 11 із 19 роками були неправильними, а ніхто цього не помічав.
- Проходить ваш індекс карти сайту і рахує, що отримує пошуковий робот
- Працює в парі з перевіркою аудиту на noindex у карті сайту
- Безкоштовно, без реєстрації і без картки
Чого ми не змогли поміряти
А ось те, чого цей аудит не показує. Кілька інструментів, названих на цьому сайті, наші партнери: якщо ви купуєте за цими посиланнями, ми отримуємо комісію, а ви не платите ані цента більше.
Ми не міряли жодного впливу на позиції. Ніщо тут не пов'язує відсутній lastmod із позицією, частотою сканування чи візитом. Це знахідки про відповідність протоколу: файл не каже того, що за протоколом мав би казати, а відповідність, це не те саме, що наслідок.
Те, що Google ігнорує changefreq і priority, це офіційна опублікована позиція самого Google, а не наш тест. Ми порахували поля, але не можемо спостерігати, що з ними робить той чи інший робот.
Ми перевіряли лише верхньорівневу карту сайту або індекс, а не кожен дочірній файл. Чистий індекс може вести на зламаний дочірній файл, а 8 із наших 19, це індекси, тож "чисто" тут означає, що чиста точка входу. Сам лише індекс Booking.com розгортається в сотні тисяч файлів, яких ми для цього огляду не обходили.
2 карти сайту прочитати не вдалося взагалі. Etsy віддав 404 за адресою, яку оголошує його власний robots.txt, і це вже сама по собі знахідка, яку ми не копали далі.
GitHub віддав нашому user agent 406, і це радше блокування нас, ніж вада в їхньому файлі.
Вибірка, це 21 сайт, який ми обрали самі, а не випадкова вибірка, і вона зміщена в бік компаній, яких SEO-аудиторія впізнає. Метод лежить у scripts/survey-sitemaps.mjs у нашому репозиторії, а сирий вивід у evidence/surveys/.
Часті запитання
Скільки карт сайту мали проблеми?
11 із 19, які ми змогли прочитати, заміряно 6 вересня 2026 року. Чистими виявилися 8: Booking.com, Canva, eBay, Figma, Investopedia, Moz, Vercel і seotools.pro. Кожен файл в огляді, це валідний XML: проблеми в тому, що вони оголошують, а не в тому, чи вони парсяться.
Чи використовує Google changefreq і priority?
Ні. У документації Google прямо сказано, що він ігнорує обидва. 5 із 19 карт сайту досі шлють changefreq, а 4 досі шлють priority: Cloudflare віддає 896 кожного, Shopify 557 кожного, а HubSpot рівно 1 кожного.
Чи важить lastmod?
Це поле, яке пошуковий робот таки читає, і воно каже йому, які сторінки змінилися, щоб він дав їм пріоритет. У 6 із 19 його немає зовсім: Ahrefs, Semrush, Stripe, Notion, Healthline і Zapier. Впливу його відсутності на позиції ми не міряли.
Чи може карта сайту перелічувати адреси з іншої теки?
Протокол обмежує карту сайту адресами на рівні її власного шляху або нижче. Новинна карта The Guardian перелічує 424 URL вище своєї теки, а карта Semrush, 7 адрес узагалі на іншому хості. На практиці Google поблажливий, коли файл оголошено в robots.txt, але користі від невідповідності специфікації немає.
Чи може карта сайту бути порожньою і при цьому виглядати нормально?
Так, і одна в цьому огляді саме така. Індекс карти сайту wikihow.com віддає 200, парситься як валідний XML, має правильний кореневий елемент і містить 0 URL. Будь-яка автоматична перевірка, що зупиняється на питанні "чи розпарсилося", його пропускає.
Які обмеження на розмір карти сайту?
50 тис. URL і 50 МБ без стиснення на файл. Жоден із верхньорівневих файлів цього огляду і близько не підійшов, хоча товарні карти сайту IKEA, поміряні окремо, сягають 47,6 МБ кожна через блоки hreflang усередині.
Чи чисті карти сайту в самих SEO-вендорів?
В одного з трьох найбільших, так. Moz чистий, Ahrefs не віддає lastmod, Semrush не віддає lastmod і має ще 7 URL на іншому хості. Наша чиста і має 7 записів, і це радше маленький файл, ніж досягнення: різниця в тому, що її перевіряють.
Як перевірити власну карту сайту?
Заберіть її, порахуйте записи <loc> і звірте, що кількість саме така, як ви очікуєте, а тоді перевірте, що lastmod присутній і що кожна адреса лежить на власному хості та шляху цієї карти. Вбудуйте це у свій деплой, бо більше ніщо не скаже вам, коли вона попливе.
Одна цифра, яку варто запам'ятати
0.
Саме стільки адрес лежить в індексі карти сайту wikiHow, на сайті із сотнями тисяч статей, і саме стільки автоматичних перевірок їм про це скажуть, бо файл віддає 200 і парситься бездоганно.
Такий вигляд має тут кожна знахідка. Ніщо в цьому огляді не зламане так, щоб про це хоч щось повідомило. 1800 ігнорованих полів Cloudflare, відсутній lastmod в Ahrefs, адреси Guardian поза дозволеною зоною, записи Semrush на чужому хості: усе це валідний XML, усе тихе, усе багаторічне.
Карта сайту, це останній файл, який хтось відкриває, і перший, який перестає бути правдою. Наша була неправильною, доки ми не написали для неї перевірку, а на ту перевірку пішло півдня.
Ідіть і порахуйте записи у своїй. Якщо цифра вас здивує, це і є знахідка.
Заміряно 6 вересня 2026 року. Ми забрали 21 верхньорівневу карту сайту, знаходячи адресу в robots.txt там, де сайт не використовує звичний шлях, і перевірили кількість записів, наявність і формат lastmod, використання changefreq і priority, межі хоста і шляху, а також протокольні ліміти в 50 тис. URL і 50 МБ. Відповіли 19. Метод лежить у scripts/survey-sitemaps.mjs у нашому репозиторії, а сирі результати в evidence/surveys/, тож кожну цифру тут можна перерахувати самостійно.