XML-Sitemap-Checker
Eine Sitemap ist die XML-Datei, die Suchmaschinen mitteilt, welche Seiten es auf Ihrer Website gibt und welche davon durchsucht werden sollen. Dieses Werkzeug findet Ihre Sitemap für Sie, prüft zuerst die Angabe in der robots.txt und weicht sonst auf die Konvention /sitemap.xml aus, folgt etwaigen Sitemap-Indexdateien und prüft den Inhalt sowohl gegen das Sitemap-Protokoll als auch gegen die SEO-Praxis. Es sieht nicht nur darauf, ob das XML gültig ist, sondern ob die aufgeführten Adressen überhaupt dort stehen sollten.
Gültiges XML genügt nicht
Die meisten Sitemap-Prüfer verlangen, dass Sie Ihre Datei einfügen, und sagen Ihnen dann, ob das XML formal gültig ist. In der Praxis sind die meisten Probleme jedoch nicht formaler Art: Eine in der Sitemap aufgeführte URL kann von der robots.txt gesperrt sein, auf eine andere Domain zeigen, wegen http:// in eine Weiterleitung fallen oder Dutzende Male wiederholt werden. Nichts davon macht das XML ungültig; alles davon verbrennt Crawl-Budget und sendet der Suchmaschine widersprüchliche Signale. Dieses Werkzeug prüft beide Ebenen gemeinsam.
Protokollgrenzen: 50.000 URLs und 50 MB
Das Sitemap-Protokoll erlaubt einer einzelnen Datei höchstens 50.000 URLs und höchstens 50 MB unkomprimiert. Werden diese Grenzen überschritten, wird die Datei womöglich nur teilweise verarbeitet oder ganz übergangen. Für größere Websites ist die richtige Struktur, die URLs auf mehrere Sitemap-Dateien zu verteilen und diese in einem Sitemap-Index aufzuführen. Für die Indexdatei gelten dieselben Grenzen, sie kann also höchstens 50.000 untergeordnete Sitemaps aufführen.
Wenn Sitemap und robots.txt einander widersprechen
Das ist der häufigste und verwirrendste Fehler: Eine URL steht in der Sitemap, während die robots.txt das Crawlen verbietet. Die Suchmaschine erhält zwei entgegengesetzte Anweisungen zugleich, \"durchsuche diese Seite\" und \"sieh dir diese Seite nicht an\". Google meldet das in der Search Console als Warnung, und die URL wird meist gar nicht indexiert; wird sie es doch, lässt sich ihr Inhalt nicht lesen, sodass sie ohne Titel in den Ergebnissen erscheinen kann. Richtig ist, die URL aus der Sitemap zu nehmen oder die Regel in der robots.txt zu korrigieren; beides stehen zu lassen verschmutzt nur Ihre Signale.
Was in eine Sitemap gehört und was nicht
Eine Sitemap sollte ausschließlich kanonische, indexierbare Adressen enthalten. Weitergeleitete URLs, Seiten der Blätterung, noindex-Seiten, Kopien mit Parametern und Adressen, die auf eine andere Seite kanonisieren, gehören nicht hinein. Sie aufzuführen zwingt die Suchmaschine, Adressen zu verarbeiten, die keinen Wert bringen, was auf großen Websites unmittelbar Crawl-Budget kostet. Die Regel ist einfach: Jede Adresse in Ihrer Sitemap sollte die endgültige Adresse sein, die in den Suchergebnissen erscheinen soll.
lastmod: falsch verwendet schlechter als gar nicht verwendet
Das Feld lastmod gibt an, wann sich eine Seite zuletzt bedeutsam geändert hat, und verbessert richtig verwendet die Priorisierung beim erneuten Crawlen. Der Wert muss im W3C-Datetime-Format stehen: 2026-07-25 oder mit Zeitzone 2026-07-25T14:30:00+03:00. Zwei Fehler kommen häufig vor. Der erste ist ein ungültiges Format, dann wird der Wert stillschweigend übergangen. Der zweite ist, jede Nacht das lastmod jeder Seite zu aktualisieren, obwohl sich nichts geändert hat; das zerstört die Glaubwürdigkeit des Feldes, und mit der Zeit beachtet die Suchmaschine Ihr lastmod überhaupt nicht mehr. Wenn Sie den richtigen Wert nicht erzeugen können, lassen Sie das Feld besser weg.
Die Sitemap in der robots.txt angeben
Der beständigste Weg, Ihre Sitemap bekannt zu machen, ist eine Zeile in der robots.txt: Sitemap: https://example.com/sitemap.xml. Jede Suchmaschine liest diese Zeile, und sie erspart Ihnen, die Sitemap gesondert in der Search Console einzureichen. Die Konvention /sitemap.xml funktioniert meist, doch wenn Ihre Sitemap unter einer anderen Adresse liegt oder Sie mehrere haben, ist die Angabe unverzichtbar.

Ihre Fragen
Häufig gestellte Fragen
Wird meine Website ohne Sitemap nicht indexiert?
Doch. Eine Sitemap ist keine Pflicht, sondern eine Hilfe, die das Auffinden beschleunigt. Suchmaschinen finden Seiten auch, indem sie internen und externen Verweisen folgen. Der eigentliche Nutzen einer Sitemap zeigt sich bei Websites mit schwacher interner Verlinkung, bei frisch veröffentlichten Seiten oder bei sehr vielen Seiten.
Wie viele URLs darf eine Sitemap enthalten?
Höchstens 50.000 URLs je Datei und höchstens 50 MB unkomprimiert. Für alles darüber müssen Sie mehrere Sitemap-Dateien anlegen und sie in einem Sitemap-Index aufführen.
Was passiert mit einer URL, die in der Sitemap steht, aber von der robots.txt gesperrt ist?
Die Suchmaschine erhält zwei widersprüchliche Anweisungen: Die Sitemap nennt die Seite, die robots.txt verbietet das Crawlen. Die Seite kann nicht durchsucht werden; meist wird sie nicht indexiert, und wird sie es doch, lässt sich ihr Inhalt nicht lesen, sodass sie ohne Titel oder Beschreibung in den Ergebnissen erscheinen kann. Die Search Console meldet das als Warnung.
Sollte ich lastmod täglich aktualisieren?
Nein. lastmod sollte nur dann aktualisiert werden, wenn sich die Seite wirklich bedeutsam ändert. Es massenhaft zu aktualisieren, während der Inhalt gleich bleibt, zerstört die Glaubwürdigkeit des Feldes, und mit der Zeit übergeht die Suchmaschine den Wert. Wenn Sie den richtigen Wert nicht erzeugen können, lassen Sie das Feld besser weg.
Prüft dieses Werkzeug, ob die URLs in meiner Sitemap wirklich funktionieren?
Diese Prüfung betrachtet die Sitemap selbst und die strukturelle sowie richtlinienbezogene Eignung der aufgeführten Adressen: Sperren durch die robots.txt, fremde Domains, Abweichungen zwischen http und https, doppelte Adressen und ungültige Datumsangaben. Sie ruft nicht jede URL einzeln ab, um Statuscodes zu messen, was bei Sitemaps mit Tausenden Adressen sehr aufwendig wäre. Um jede Adresse Ihrer Website samt Statuscode zu prüfen, verwenden Sie unser Werkzeug Deep Crawl.
Was ist ein Sitemap-Index, und wann brauche ich einen?
Ein Sitemap-Index ist eine übergeordnete Datei, die mehrere Sitemap-Dateien aufführt. Er ist für Websites erforderlich, die die Grenze von 50.000 URLs überschreiten, und die Aufteilung nach Inhaltsart (Beiträge, Produkte, Kategorien) erleichtert zudem Verwaltung und Fehlersuche. Dieses Werkzeug erkennt Indexdateien und folgt den darunterliegenden Sitemaps.