Wenn eine Website mehr als zwanzig Seiten hat, kann es manchmal eine Herausforderung sein, eine bestimmte Information zu finden. Die Sitemap-Seite, egal ob im HTML- oder XML-Format, bietet eine umfassende Übersicht der verfügbaren URLs. Ihre Nützlichkeit zu messen, setzt voraus, dass man unterscheidet, was sie den Besuchern und was sie den Indexierungsrobotern bietet, und dann überprüft, ob die angekündigten Vorteile auch tatsächlich umgesetzt werden.
HTML-Sitemap und XML-Sitemap: Was jedes Format tatsächlich abdeckt
Die beiden Formate teilen sich einen Namen, aber ihre Empfänger und Funktionen unterscheiden sich. Die Vergleichung ihrer Merkmale ermöglicht es, zu entscheiden, welches Format prioritär konsultiert oder implementiert werden sollte.
| Kriterium | HTML-Sitemap | XML-Sitemap |
|---|---|---|
| Hauptempfänger | Menschlicher Besucher | Suchmaschinen-Roboter (Googlebot, Bingbot) |
| Format | Klassische Webseite mit klickbaren Links | Strukturierte XML-Datei (Tags <url>, <lastmod>) |
| Gewöhnlicher Zugang | Link im Footer oder Menü | Im robots.txt-Dokument deklariert oder über die Search Console eingereicht |
| Nutzer-Navigation | Ja, direkte Navigation durch Klicks | Nein, ohne spezielles Tool unlesbar |
| Direkter SEO-Einfluss | Indirekt (interne Verlinkung, Zugänglichkeit) | Direkt (beschleunigt das Crawlen und die Indizierung) |
| Barrierefreiheit (WCAG 2.4.5) | Als gültiges Mittel anerkannt, um mehrere Navigationswege anzubieten | Nicht betroffen |
Die XML-Sitemap bleibt die technische Datei, die Google konsultiert, um neue URLs zu entdecken oder Aktualisierungsdaten zu überprüfen. Im Gegensatz dazu richtet sich die HTML-Sitemap an Besucher, die einen Überblick über die Website suchen, ohne das Hauptmenü zu nutzen.
Um ein konkretes Beispiel für eine HTML-Sitemap zu sehen, können Sie die Sitemap-Seite von Samh Web besuchen, die ihre Inhalte in einer lesbaren Baumstruktur auflistet.
Zugänglichkeit und Navigation: Die HTML-Sitemap als gesetzliche Anforderung

Der Aspekt der Zugänglichkeit ist derjenige, den die meisten Artikel über Sitemaps ignorieren, obwohl er die gesetzliche Konformität einer Website in Europa bestimmt.
Das Kriterium WCAG 2.4.5, mit dem Titel “Multiple Ways”, verlangt, dass eine Website mehr als einen Weg zur Auffindung einer Seite anbietet. Eine Suchleiste, ein Inhaltsverzeichnis, eine Sitemap: Jeder dieser Mechanismen zählt. Die HTML-Sitemap wird von den WCAG-Richtlinien ausdrücklich als eines dieser gültigen Mittel anerkannt.
Diese Anforderung ist nicht theoretisch. Das European Accessibility Act verpflichtet Websites, mindestens das Niveau AA der WCAG 2.2 einzuhalten. Eine gut strukturierte HTML-Sitemap, mit Links, die unter hierarchischen Überschriften gruppiert sind, und einem klar benannten <nav>-Tag oder Abschnitt, erfüllt diese Verpflichtung.
Was sich für Tastaturbenutzer und Screenreader ändert
Ein mehrstufiges Dropdown-Menü kann für einen Benutzer, der mit der Tastatur navigiert, zu einer Falle werden. Jedes Untermenü erfordert zusätzliche Tastenkombinationen. Die HTML-Sitemap ermöglicht es, diese komplexen Menüs zu umgehen, indem sie eine flache Liste von Links anbietet.
Screenreader nutzen Landmarks und die Navigation nach Überschriften, um sich zurechtzufinden. Eine korrekt markierte Sitemap-Seite wird zu einem schnellen Einstiegspunkt für jeden Abschnitt der Website, ohne von der Struktur des Hauptmenüs abhängig zu sein.
- Eine in
<nav>markierte HTML-Sitemap erscheint als Landmarke, die von Hilfstechnologien identifiziert werden kann - Die hierarchischen Überschriften (H2, H3) ermöglichen es Screenreadern, direkt zu einer Inhaltskategorie zu springen
- Die Liste der gruppierten Links reduziert die Anzahl der erforderlichen Tastaturinteraktionen, um eine tiefere Seite zu erreichen
Die Abdeckung einer Website mithilfe der XML-Sitemap diagnostizieren
Die Konsultation der XML-Sitemap einer Website (häufig unter der Adresse /sitemap.xml zugänglich) dient nicht nur den Robotern. Für einen Webmaster oder SEO-Experten fungiert diese Datei als Inventar.
Den Vergleich der Anzahl der URLs in der XML-Sitemap mit der Anzahl der in Google indizierten Seiten zeigt signifikante Abweichungen. Wenn die Sitemap mehrere Hundert Seiten angibt und Google nur einen Bruchteil davon behält, liegt das Problem entweder in der Qualität des Inhalts oder in widersprüchlichen Crawlanweisungen (noindex-Tag, Blockierung in der robots.txt-Datei).
Waisenkinderseiten und veraltete Inhalte erkennen
Eine Seite, die in der XML-Sitemap fehlt, hat geringere Chancen, von Suchmaschinen entdeckt zu werden, insbesondere wenn kein interner Link auf sie verweist. Dies sind die Waisenkinderseiten. Das Durchsehen der Sitemap ermöglicht es, sicherzustellen, dass keine strategische URL übersehen wurde.
Im Gegensatz dazu sendet eine Sitemap, die URLs mit 404-Fehlern oder Weiterleitungen auflistet, ein negatives Signal an die Roboter. Die regelmäßige Bereinigung der XML-Sitemap von toten URLs verbessert die Crawling-Effizienz.

- Überprüfen, dass jede URL der Sitemap einen HTTP-Statuscode 200 zurückgibt
- Sicherstellen, dass die strategischen Seiten (Produktseiten, Hauptartikel, Dienstleistungsseiten) tatsächlich in der Datei enthalten sind
- Die
<lastmod>-Tag überprüfen, um Inhalte zu identifizieren, die lange nicht aktualisiert wurden
Sitemap und Crawl-Budget: Ein unterschätzter Hebel für umfangreiche Websites
Auf einer kleinen Website mit etwa zehn Seiten hat die XML-Sitemap nur eine marginale Rolle. Google durchsucht den gesamten Inhalt über interne Links. Die Situation ändert sich radikal für Websites mit mehreren Tausend Seiten.
Suchmaschinen weisen jedem Domain ein begrenztes Crawl-Budget zu. Die XML-Sitemap lenkt dieses Budget auf die priorisierten Seiten, indem sie sie explizit auflistet. Ohne diese Datei kann der Roboter seine Ressourcen darauf verwenden, Seiten mit geringem Wert (Filterseiten, Seiten mit doppelter Pagination) zu durchsuchen, was zulasten strategischer Inhalte geht.
Das <priority>-Tag der XML-Sitemap ermöglicht es, eine Hierarchie zwischen den URLs anzuzeigen, auch wenn Google klargestellt hat, dass es dieser nicht systematisch folgt. Das <lastmod>-Tag hingegen löst ein schnelleres Crawlen aus, wenn es ein tatsächliches Änderungsdatum widerspiegelt.
Eine Website, die ihre XML-Sitemap bei jeder Veröffentlichung aktualisiert und veraltete URLs entfernt, gibt den Robotern eine zuverlässige Karte. Eine aktuelle Sitemap reduziert den Crawling-Abfall auf Seiten, die für die Suchmaschinenoptimierung keinen Wert haben.
Die Sitemap-Seite, ob HTML oder XML, erfüllt somit zwei unterschiedliche, aber komplementäre Funktionen. Das HTML-Format erfüllt ein Bedürfnis nach menschlicher Navigation und messbaren Zugänglichkeitsanforderungen, während das XML-Format die technische Beziehung zwischen einer Website und ihren Suchmaschinen strukturiert. Die Konsultation beider bietet eine umfassende Sicht auf die Abdeckung und die tatsächliche Architektur einer Domain.



