Eine XML-Sitemap, die umgeleitete URLs, Seiten im Noindex oder kanonische Adressen zu anderen Ressourcen auflistet, sendet widersprüchliche Signale an Suchmaschinen. Dies beobachten wir regelmäßig nach einem Redesign: Die Datei ist technisch gültig, verweist jedoch auf Seiten, die Google nicht crawlen sollte. Die Optimierung der Struktur einer Website mit einer effektiven Sitemap beginnt mit dieser Bereinigung, nicht mit der automatischen Erstellung der Datei.
XML-Sitemap nach einem Redesign: die zu korrigierenden widersprüchlichen Signale
Bei der Migration einer Website oder der Neustrukturierung des Baumdiagramms regeneriert das CMS oft die Sitemap, ohne den tatsächlichen Status der URLs zu überprüfen. Man hat eine Datei, die alte, auf 301 umgeleitete Adressen, Seiten, die seit dem Redesign im Noindex sind, und manchmal URLs enthält, die einen 404- oder 410-Fehler zurückgeben.
Das konkrete Problem: Google erhält eine Liste von URLs, die als gültig präsentiert werden, und stellt dann fest, dass sie es nicht sind. Das Crawl-Budget wird verschwendet, und die Indizierung neuer Seiten verzögert sich.
Die Überprüfung nach dem Redesign sollte einer einfachen Logik folgen. Man extrahiert alle URLs aus der Sitemap, lässt sie durch einen Crawler (Screaming Frog, Sitebulb oder ein Äquivalent) laufen und vergleicht drei Spalten: HTTP-Code, Indexierungsanweisung, deklarierte kanonische URL.
Jede URL, die nicht einen 200 zurückgibt, die ein Noindex trägt oder deren kanonisches Tag auf etwas anderes verweist, muss aus der Datei entfernt werden. Man kann beobachten, wie die Website yvazur.ch ihre eigene Sitemap strukturiert, um einen sauberen Ansatz für diese Sortierung zu veranschaulichen.

Lastmod-Tag in der Sitemap: Wann es besser ist, es zu entfernen als es zu behalten
Das lastmod-Tag ist das wichtigste verwertbare Signal für Google in einer XML-Sitemap. Aber dieser Nutzen beruht auf einer strengen Bedingung: Das Datum muss einer tatsächlichen und signifikanten Änderung des Inhalts, der strukturierten Daten oder der internen Links der Seite entsprechen.
In der Praxis aktualisieren viele CMS dieses Datum bei jedem Deployment, selbst wenn sich auf der Seite nichts geändert hat. Eine einfache Änderung des Fußzeilentextes, eine Aktualisierung des Copyright-Jahres, ein Cache-Rebuild – und alle Daten werden auf das aktuelle Datum gesetzt.
Der praktische Reflex, der die Falle vermeidet
Wenn Ihr CMS kein zuverlässiges Datum liefern kann, das mit einer echten Inhaltsänderung verbunden ist, ist es besser, das lastmod-Tag vollständig zu entfernen, als es mit irreführenden Werten zu belassen. Google ignoriert schließlich inkonsistente Daten, und in diesem Fall trägt ihre Anwesenheit nur zur Verwirrung bei.
Im Gegensatz dazu beschleunigt auf einer redaktionellen Website, auf der jeder Artikel tatsächlich aktualisiert wird (Hinzufügen von Absätzen, Aktualisierung von Daten), ein zuverlässiges lastmod die Berücksichtigung der Änderungen. Es ist ein konkreter Hebel für Seiten, die regelmäßig aktualisiert werden.
Priority- und Changefreq-Tags: Was die XML-Sitemap nicht mehr tut
Es gibt immer noch Sitemaps, die mit Priority- und Changefreq-Tags überladen sind, manchmal sorgfältig konfiguriert. Google ignoriert diese beiden Elemente. Ihre Anwesenheit bringt keinen Vorteil für die Suchmaschinenoptimierung.
Statt Zeit damit zu verschwenden, Prioritäten zu kalibrieren, die niemand liest, ist es besser, die Anstrengungen auf die Konsistenz zwischen vier Elementen zu konzentrieren:
- Die im Sitemap enthaltene URL muss die im Quellcode der Seite deklarierte kanonische Version sein
- Diese gleiche URL muss zugänglich sein (Code 200), ohne Zwischenumleitungen
- Das interne Linking der Website muss auf diese URL verweisen, nicht auf eine Variante mit oder ohne abschließendem Slash, mit oder ohne www
- Die Seite darf keine Noindex-Anweisung tragen, wenn sie in der Sitemap aufgeführt ist
Eine konsistente Sitemap mit dem internen Linking und den kanonischen Tags trägt mehr zur Indizierung bei als jede Priority-Einstellung.
Sitemap und verwaiste Seiten: Ein oft vernachlässigter Anwendungsfall
Die Sitemap ersetzt nicht das interne Linking, spielt jedoch eine spezifische Rolle für Seiten, die von den restlichen Teilen der Website keinen Link erhalten. Wir sprechen von verwaisten Seiten: Sie existieren, sind indizierbar, aber es gibt keinen Navigationspfad, um darauf zuzugreifen.
Dieser Fall tritt häufig auf E-Commerce-Websites auf (Produktseiten, die aus dem Katalog entfernt, aber weiterhin online sind), Blogs mit tiefen Archiven oder Websites, die mehrere aufeinanderfolgende Redesigns ohne Link-Audit durchlaufen haben.
Wie man verwaiste Seiten in der Sitemap behandelt
Die erste Frage ist, ob diese Seiten indiziert werden sollten. Wenn ja, zwei parallele Maßnahmen:
- Sie in die XML-Sitemap aufnehmen, damit die Suchmaschinen sie entdecken
- Mindestens einen relevanten internen Link zu jeder von einer thematisch nahen Seite erstellen
- Überprüfen, dass das kanonische Tag jeder verwaisten Seite korrekt auf sich selbst verweist
Wenn diese Seiten keinen Wert mehr haben (veralteter Inhalt, verschwundenes Produkt), ist es besser, sie aus der Sitemap zu entfernen und sie ordentlich mit einem Noindex oder einer 410-Umleitung zu deindexieren.

Einreichung der XML-Sitemap: robots.txt und Search Console
Eine saubere Sitemap zu generieren reicht nicht aus, wenn die Suchmaschinen nicht wissen, wo sie sie finden können. Zwei Einreichungskanäle funktionieren parallel.
Der erste ist die Datei robots.txt. Dort fügt man eine Zeile Sitemap: gefolgt von der absoluten URL der Datei hinzu. Diese Erklärung wird von allen kompatiblen Suchmaschinen gelesen, nicht nur von Google. Es ist der passive Kanal, der nach der Einrichtung ohne manuelles Eingreifen funktioniert.
Der zweite ist die Google Search Console (und ihr Pendant Bing Webmaster Tools). Die Einreichung über diese Tools ermöglicht es, den Indexierungsstatus der aufgeführten URLs zu verfolgen, Crawling-Fehler zu erkennen und zu überprüfen, ob die Datei korrekt gelesen wird. Die Rückmeldungen variieren hinsichtlich der Häufigkeit des erneuten Crawlens der Sitemap nach der Einreichung, aber die anfängliche Berücksichtigung ist in der Regel schnell.
Der Punkt, den man nicht vernachlässigen sollte: Wenn Ihre Website die Volumenobergrenze einer einzelnen Sitemap-Datei überschreitet, bleibt eine Sitemap-Indexdatei, die mehrere segmentierte Dateien (nach Kategorie, nach Inhaltstyp) zusammenfasst, die technische Standardlösung. Jede Kinddatei folgt denselben Sauberkeitsregeln wie die Hauptdatei.
Eine gut strukturierte Sitemap verbessert nicht direkt das Ranking einer Seite. Ihre Rolle besteht darin, sicherzustellen, dass die Suchmaschinen die richtigen URLs finden, crawlen und verstehen. Der Gewinn zeigt sich in der Indexierungsrate und der Geschwindigkeit, mit der Änderungen berücksichtigt werden, zwei Metriken, die die Search Console konkret verfolgen kann.



