Blog von UNmiss

Wir haben 21 Sitemaps geprüft. Nur 8 waren sauber.

Wir haben 21 Sitemaps großer Websites gegen das Protokoll geprüft. Zehn listen URLs außerhalb ihres eigenen Ordners, und acht tragen Felder, die Google ignoriert. Unsere war eine davon.

Ihre Sitemap ist die eine Datei auf Ihrer Website, die niemand je wieder liest.

Jemand hat sie vor Jahren eingerichtet, wahrscheinlich ein Plugin, und seitdem sagt sie Suchmaschinen still und leise, was sie crawlen sollen. Sie funktioniert, also öffnet sie niemand.

Wir haben 21 davon geöffnet — von IKEA, Booking.com, Stripe, Shopify, Zillow, Goodreads, wikiHow und einem Dutzend anderer — und jede einzelne gegen das Sitemap-Protokoll selbst geprüft.

Acht waren sauber. Dreizehn waren es nicht.

Eine der dreizehn war unsere.

Die Ergebnisse auf einen Blick

8 von 21
Sitemaps ganz ohne Probleme
8
enthalten Felder, die Google vollständig ignoriert
10
listen URLs außerhalb ihres eigenen Ordners
Die Kurzfassung

Zwei Probleme erklären fast alles, was wir gefunden haben, und beide sind von außen unsichtbar: Felder, die nichts bewirken, und URLs, die die Datei technisch nicht abdecken darf.

Keines davon wird Ihre Website lahmlegen. Beide sind zehn Minuten wert.

Was wir geprüft haben, und wie

Wir nahmen die robots.txt jeder Website, folgten der ersten Sitemap, die sie deklarierte, öffneten eine echte URL-Datei dahinter und stellten drei Fragen.

Liegt jede URL im eigenen Ordner der Sitemap? Das Protokoll sagt, dass eine Sitemap ihren eigenen Pfad und alles darunter abdeckt. Eine Datei unter /sitemaps/, die Seiten unter /products/ listet, liegt außerhalb davon.

Enthält sie priority oder changefreq? Beide sind gültiges XML, und beide werden von Google ignoriert. Sie sind Überbleibsel aus dem Jahr 2005.

Enthält sie ein lesbares lastmod? Dieses Feld nutzt Google, wenn Google Ihnen vertraut.

Dann ließen wir mehrere derselben Dateien durch unseren eigenen XML Sitemap Generator laufen, der genau diese Prüfungen ausführt, um sicherzugehen, dass unsere Lesart und das Tool übereinstimmten. Das taten sie.

Nur 8 von 21 waren sauber

Die sauberen acht: Omni Calculator, Healthline, Coursera, Vercel, Netlify, MongoDB, Semrush und Similarweb.

Die anderen dreizehn: wikiHow, Calculator.net, NerdWallet, Goodreads, GeeksforGeeks, Zillow, Booking.com, IKEA, Stripe, Shopify, HubSpot, Atlassian — und UNmiss.

In dieser Aufteilung steckt ein Muster, und es ist dasselbe, das wir fanden, als wir prüften, wer eine llms.txt veröffentlicht: Die Entwicklertool-Unternehmen sind ordentlich, und die großen Verbraucher-Websites auf älteren Content-Systemen sind es nicht.

Die Felder, die nichts bewirken

Acht der 21 Sitemaps enthalten <priority>. Acht enthalten <changefreq>.

Beide Tags waren Teil der ursprünglichen Sitemap-Spezifikation von 2005. Die Idee war, dass Sie Suchmaschinen mitteilen, welche Ihrer Seiten am wichtigsten sind und wie oft sie sich ändern, und dass das Crawling entsprechend geplant würde.

Das überstand den Kontakt mit der Realität nicht, weil jede Website sagte, jede Seite habe Priorität 1.0 und ändere sich täglich. Google ignoriert beide Felder vollständig. Sie sind weiterhin gültiges XML. Sie tun einfach nichts.

Auf einer kleinen Website ist das harmloser Ballast. Auf einer großen ist es das nicht. IKEAs Produkt-Sitemap kommt auf 47,6 MB gegenüber einem harten Protokolllimit von 50 MB — und jeder Eintrag darin gibt Bytes für zwei Felder aus, die niemand liest.

URLs außerhalb ihres eigenen Ordners

Zehn der 21 listen URLs, die außerhalb des eigenen Verzeichnisses der Sitemap liegen. Das ist der interessantere Fehler, weil fast niemand weiß, dass diese Regel existiert.

Eine Sitemap soll nur ihren eigenen Pfad und alles darunter abdecken. Legen Sie die Datei unter example.com/sitemaps/products.xml ab, und technisch deckt sie /sitemaps/ und darunter ab — nicht /products/ und nicht Ihre Startseite.

In der Praxis ist Google nachsichtig, besonders wenn Sie die Sitemap direkt in der Search Console einreichen. Aber „wird meist verziehen“ ist eine schlechtere Position als „korrekt“, und die Lösung ist die einfachste im SEO: Verschieben Sie die Datei in das Stammverzeichnis Ihrer Domain. Eine Sitemap unter example.com/sitemap.xml deckt immer alles ab, ohne Ausnahmen, an die man sich erinnern muss.

Wir sind durch unsere eigene Prüfung gefallen

Jetzt der unangenehme Teil, und der Grund, weshalb wir sicher sind, dass der Rest fair ist.

Wir ließen unmiss.com durch unseren eigenen XML Sitemap Generator laufen. Er meldete 370 URLs, 399,5 KB, HTTP 200, mit einem lesbaren lastmod bei jedem Eintrag — und markierte dann dies:

Unser eigenes Tool, auf unserer eigenen Sitemap

370 Einträge enthalten priority oder changefreq.

„Google ignoriert beide Felder vollständig. Sie sind gültig, sie tun nur einfach nichts für Sie.“

Jede einzelne URL. Sie können es in der Rohdatei sehen, wo auf jeden Eintrag ein Datum, das Wort weekly und die Zahl 0.7 folgen:

Das rohe XML der englischen Sitemap von unmiss.com, in einem Browser gezeigt, wobei auf jede URL ein Datum, das Wort weekly und die Zahl 0.7 folgen, wiederholt über die gesamte Datei hinweg.
Worauf zu achten ist: das wiederholte „weekly 0.7“ nach jeder Adresse. Das sind 370 Kopien von zwei Feldern, die Google nie lesen wird.

Niemand hat das bewusst gewählt. Es kam vor Jahren aus einer Voreinstellung und überlebte, weil niemand die Datei wieder öffnete — was genau der Punkt dieses Artikels ist.

Kopieren Sie das an einem Nachmittag

Vier Schritte. Das Ganze dauert weniger lang, als darüber zu lesen.

1. Öffnen Sie Ihre eigene Sitemap. Hängen Sie /sitemap.xml an Ihre Domain an, oder finden Sie die Adresse in Ihrer robots.txt. Die meisten Menschen haben nie hineingeschaut.

2. Durchsuchen Sie sie nach priority und changefreq. Wenn sie vorhanden sind, entfernen Sie sie. Es gibt keinen Nachteil und kein Risiko; sie haben nichts bewirkt.

3. Prüfen Sie, wo die Datei liegt. Wenn sie in einem Unterordner liegt, während Ihre Seiten woanders sind, verschieben Sie sie in das Stammverzeichnis. Dieser eine Schritt erledigt eine ganze Problemkategorie.

4. Stellen Sie sicher, dass lastmod ehrlich ist. Das ist das eine Feld, das noch zählt, und es zählt nur, wenn es stimmt. Eine Datei, die behauptet, alles habe sich heute geändert, bringt Suchmaschinen bei, das Feld zu ignorieren.

Was wir nicht messen konnten

21 Sitemaps sind eine Stichprobe. Wir wählten erkennbare Namen aus Publishing, Handel, Software und Entwicklertools, und wir lasen die erste Sitemap, die jede Website deklarierte. Eine andere Stichprobe würde andere Prozentsätze ergeben.

Eine Datei pro Website. Mehrere dieser Unternehmen veröffentlichen Tausende von Sitemap-Dateien. Wir bewerteten von jedem eine echte URL-Datei, unter der Annahme, dass sie vom selben System erzeugt werden — was wahrscheinlich, aber nicht verifiziert ist.

Pfadabdeckung ist eine Regel, die Google üblicherweise verzeiht. Wir berichten darüber, weil sie in der Spezifikation steht und weil unser Tool sie markiert, nicht weil wir zeigen können, dass sie irgendjemanden Traffic kostet. Das können wir nicht.

Wir können nicht sehen, was irgendeine Suchmaschine mit diesen Dateien macht. Alles hier ist das, was die Websites veröffentlichen, nicht das, was gecrawlt oder indexiert wird.

Kostenlos, kein Konto
Lesen Sie Ihre eigene Sitemap zurück

Fügen Sie die Adresse einer Sitemap ein, die Sie bereits veröffentlichen, und unser XML Sitemap Generator prüft sie gegen das Protokoll, ohne eine einzige URL darin zu besuchen. Es ist dieselbe Prüfung, die das Problem in unserer eigenen Datei fand, und in zehn der einundzwanzig oben.

  • Markiert URLs außerhalb des eigenen Pfads der Sitemap
  • Weist auf priority und changefreq hin, die Google ignoriert
  • Gibt Ihnen eine bereinigte Kopie zurück, die Sie heute veröffentlichen können
Sitemap kostenlos prüfen

Häufig gestellte Fragen

Welche Sitemaps habt ihr geprüft, und was waren die Ergebnisse?

21 lesbare Sitemaps am 23. August 2026. Sauber: Omni Calculator, Healthline, Coursera, Vercel, Netlify, MongoDB, Semrush, Similarweb. Mit mindestens einem Problem: wikiHow, Calculator.net, NerdWallet, Goodreads, GeeksforGeeks, Zillow, Booking.com, IKEA, Stripe, Shopify, HubSpot, Atlassian und UNmiss. Zehn listeten URLs außerhalb des eigenen Ordners der Sitemap, acht enthielten priority und acht enthielten changefreq.

Bewirken priority oder changefreq überhaupt irgendetwas?

Nicht für Google, das beide Felder vollständig ignoriert und das klar gesagt hat. Andere Crawler können sie lesen, aber keine große Suchmaschine verpflichtet sich, nach einem der beiden zu handeln. Sie sind gültiges XML, das nichts bewirkt, und sie zu entfernen birgt kein Risiko.

Warum ist es wichtig, wo die Sitemap-Datei liegt?

Weil das Protokoll sagt, dass eine Sitemap nur ihren eigenen Pfad und alles darunter abdeckt. Eine Datei unter /sitemaps/products.xml deckt technisch /products/ nicht ab. Google ist im Allgemeinen nachsichtig, besonders bei Sitemaps, die in der Search Console eingereicht wurden, aber das Problem verschwindet vollständig, wenn Sie die Datei in das Stammverzeichnis der Domain legen.

Ist eine Sitemap mit diesen Problemen kaputt?

Nein, und wir würden dieses Wort nicht verwenden. Keine der dreizehn Websites hier hat eine Sitemap, die nicht funktioniert. Sie enthalten Felder, die Platz verschwenden, und in zehn Fällen eine Pfadanordnung, die die Spezifikation nicht strikt erlaubt. Das sind Ordnungsprobleme, keine Ausfälle — und genau deshalb überleben sie jahrelang.

Ihr habt ein Problem in eurer eigenen Sitemap gefunden. Welches?

Alle 370 URLs in der englischen Sitemap von unmiss.com enthalten priority und changefreq. Unser eigener XML Sitemap Generator markierte es, als wir ihn auf uns selbst richteten. Es kam vor Jahren aus einer Voreinstellung, niemand öffnete die Datei wieder, und es ist genau das Fehlermuster, um das es in diesem Artikel geht.

Was ist mit lastmod?

Dieses Feld ist weiterhin wichtig. Google nutzt lastmod, wenn es dem Wert vertraut, und Vertrauen entsteht durch Genauigkeit. Jede Sitemap in unserer Stichprobe enthielt es bei praktisch jedem Eintrag, was gut ist — sofern die Daten echt sind. Eine Datei, die behauptet, jede Seite habe sich heute geändert, lehrt Suchmaschinen, das Feld zu missachten.

Wie groß darf eine Sitemap sein?

50.000 URLs oder 50 MB unkomprimiert, je nachdem, was zuerst erreicht wird; danach teilen Sie sie in mehrere Dateien hinter einem Sitemap-Index auf. Diese Grenze ist der Grund, warum verschwendete Felder in großem Maßstab wichtig sind: IKEAs Produkt-Sitemap liegt bereits bei 47,6 MB, also bei 95 % des Limits, während sie Bytes für zwei Felder ausgibt, die niemand liest.

Kann ich diese Prüfung selbst durchführen?

Ja, in beide Richtungen. Von Hand: Öffnen Sie Ihre robots.txt, folgen Sie der Sitemap und durchsuchen Sie die Datei nach priority und changefreq. Oder fügen Sie die Adresse in unseren XML Sitemap Generator ein, der dieselben Prüfungen ausführt und eine korrigierte Kopie zurückgibt.

Reparieren Sie die Datei, die niemand wieder liest

Der größte Teil dieser Reihe handelt von Unternehmen, die etwas Bemerkenswertes gebaut haben. RTINGS misst, was niemand misst, wikiHow zeichnet für jeden Schritt ein Bild, Goodreads fand sechzehn Substantive, wo alle anderen eines fanden.

Dieser hier handelt vom Gegenteil: von dem Ding, das jede Website hat und das fast niemand zweimal angesehen hat.

Dreizehn von einundzwanzig großen, gut ausgestatteten Unternehmen veröffentlichen eine Sitemap, in der etwas falsch ist. Nicht, weil es schwer ist, sondern weil es unsichtbar ist. Die Datei funktioniert, also öffnet sie niemand, also leben die Voreinstellungen von 2005 für immer weiter.

Wir waren eines der dreizehn, und wir fanden es nur heraus, indem wir unser eigenes Tool auf uns selbst richteten.

Also öffnen Sie Ihre Sitemap. Es dauert eine Minute, und die Wahrscheinlichkeit ist hoch, dass Sie sie seit dem Tag ihrer Erstellung nicht mehr gelesen haben.

Geprüft am 23. August 2026. Methode: Die robots.txt jeder Website abrufen, der ersten deklarierten Sitemap folgen, eine echte URL-Datei dahinter öffnen und Pfadabdeckung, priority, changefreq und lastmod testen. Die Ergebnisse wurden mit unserem eigenen XML Sitemap Generator gegengeprüft, der dieselben Prüfungen ausführt, und beide stimmten überein.

Eine Datei pro Website ist eine Stichprobe, kein Audit jeder Sitemap, die diese Unternehmen veröffentlichen. Pfadabdeckung ist eine Spezifikationsregel, die Suchmaschinen häufig verzeihen, und es wird nicht behauptet, dass eines dieser Probleme irgendjemanden Traffic gekostet hat.

Blog