XML-Sitemap Best Practices für schnellere, saubere Indexierung
Was hinein gehört, was nicht, Größenlimits und die Sitemap-Fehler, die still und leise Crawl-Budget verschwenden.
Eine Sitemap ist ein Hinweis, keine Garantie
Suchmaschinen behandeln eine Sitemap als starkes Discovery-Signal, nicht als Befehl. Sie erzwingt keine Indexierung minderwertiger Seiten — sie beseitigt jeden Zweifel darüber, welche URLs Sie als kanonisch und crawlwürdig betrachten, was auf großen oder neueren Websites am meisten zählt.
Was hinein gehört
- Nur kanonische URLs — die exakte Version, die indexiert werden soll.
- Nur URLs, die einen 200-Status zurückgeben und tatsächlich indexierbar sind (kein
noindex-Tag, nicht durch robots.txt blockiert). - Ein korrektes
lastmod-Datum — aktualisieren Sie es nur, wenn sich der Seiteninhalt inhaltlich ändert, nicht bei jedem Deploy.
Was nicht hinein gehört
- Seiten mit einem
noindex-Tag — eine solche in eine Sitemap aufzunehmen sendet ein widersprüchliches Signal. - Weiterleitende oder 404-URLs — diese werden als Sitemap-Fehler gemeldet, statt der Discovery zu helfen.
- Doppelte oder parametrisierte Varianten derselben Seite (Sortierreihenfolgen, Session-IDs, Tracking-Parameter) — listen Sie nur die eine kanonische Version.
- Dünne, automatisch generierte Seiten mit wenig einzigartigem Inhalt — sie sind eine häufige Ursache für „Gecrawlt – zurzeit nicht indexiert“, und Hunderte davon aufzunehmen verwässert das Sitemap-Signal für die Seiten, die wirklich zählen.
Größenlimits
Eine einzelne Sitemap-Datei ist auf 50.000 URLs und 50 MB unkomprimiert begrenzt. Größere Websites benötigen eine Sitemap-Indexdatei — eine Datei, die mehrere untergeordnete Sitemaps auflistet — statt einer einzigen riesigen Datei. Die meisten Frameworks (auch das dieser Website) generieren dies automatisch, aber es lohnt sich, das zu prüfen, wenn Sie eine von Hand erstellen.
Einreichen und pflegen
Reichen Sie sie einmal sowohl bei Google Search Console als auch bei Bing Webmaster Tools ein und fügen Sie in Ihrer robots.txt eine Sitemap:-Zeile hinzu, die darauf verweist — so kann jeder Crawler, der Ihre Website unabhängig findet, ohne vorherige Einreichung, sie ebenfalls entdecken. Danach sollte sich die Sitemap automatisch regenerieren, wenn sich Inhalte ändern; eine von Hand gepflegte Sitemap veraltet fast immer.
Häufige Fehler, die still und leise Crawl-Budget verschwenden
- Sie einmal beim Launch zu generieren und nie zu aktualisieren, wenn Seiten hinzukommen oder entfernt werden.
- Bei jedem Build den
lastmod-Wert jeder URL auf das aktuelle Datum zu setzen — das trainiert Crawler darauf, dem Feld nicht mehr als echtes Änderungssignal zu vertrauen. - Nach einer größeren URL-Umstrukturierung (z. B. einer Domain-Migration oder Permalink-Änderung) das erneute Einreichen zu vergessen — Google wird es irgendwann von selbst bemerken, aber ein erneutes Einreichen beschleunigt den Übergang.
Soll Ihre nächste Seite schneller gefunden werden als durch organisches Crawling allein?
IndexLaunch leitet jede eingereichte URL in dem Moment, in dem Sie sie einreihen, direkt über IndexNow an Bing, Yandex, Seznam und Naver weiter.
Preise ansehen