Lektion 08 · Crawling & Indexierung

XML-Sitemap

Eine Sitemap listet die URLs, die Google kennen soll. Sie ersetzt keine gute interne Verlinkung, hilft aber, neue und geänderte Seiten schneller zu finden – besonders bei großen oder neuen Websites.

Live auf dieser Seite

Das ist die echte Sitemap dieser Website. Sie enthält nur indexierbare Seiten – die Fehlerseite mit noindex fehlt bewusst:

<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
  <url><loc>https://www.suchmaschinen-video.de/</loc><lastmod>2026-10-03</lastmod></url>
  …
</urlset>

Taste G: Der Röntgenblick zeigt die sitemap.xml, jeder <url>-Eintrag leuchtet auf, die Prüfung zählt die URLs.

So geht's richtig

  • Nur kanonische, indexierbare URLs mit Status 200 aufnehmen – keine Weiterleitungen, keine 404, kein noindex.
  • <lastmod> nur angeben, wenn sich der Inhalt wirklich geändert hat. Google nutzt den Wert, wenn er verlässlich ist.
  • Pro Datei höchstens 50.000 URLs bzw. 50 MB (unkomprimiert), sonst mehrere Sitemaps plus Sitemap-Index.
  • Sitemap in der Google Search Console einreichen und in der robots.txt verlinken.

Typische Fehler

  • Weitergeleitete, gelöschte oder auf noindex gesetzte URLs in der Sitemap.
  • lastmod, das bei jedem Abruf auf „heute“ springt – Google ignoriert den Wert dann.
  • URLs mit anderer Schreibweise als im Canonical (http statt https, mit/ohne www).

Mythos-Check

„Mit priority und changefreq steuert man, wie oft Google crawlt.“
Nein. Google ignoriert <priority> und <changefreq>.
„Was in der Sitemap steht, wird auch indexiert.“
Eine Sitemap ist ein Hinweis, keine Garantie. Ob eine Seite in den Index kommt, entscheidet Google nach Qualität und Signalen.

Quellen & Stand

Zuletzt geprüft: Oktober 2026