XML-Sitemap-Generator

Fügen Sie Ihre Adressen ein — aus der Tabelle, aus der Konsole, wie sie eben kommen — und erhalten Sie eine Datei, die Suchmaschinen annehmen. Wiederholungen und Fremdzeilen werden gemeldet, nicht stillschweigend verworfen.

Google liest lastmod und ignoriert changefreq und priority — sie bleiben für andere Crawler.

So geht es

  1. Adressliste einfügen, eine pro Zeile; relative Pfade funktionieren, wenn die Website-Adresse ausgefüllt ist.
  2. Änderungsdatum eintragen, falls vorhanden — dieses Feld liest Google.
  3. XML kopieren oder sitemap.xml herunterladen und ins Stammverzeichnis legen.
  4. Zum Prüfen einer vorhandenen Datei auf Prüfen wechseln und sie einfügen.

Gut zu wissen

Das kaufmännische Und, das die ganze Datei zerstört

Eine Adresse mit Parametern — /?a=1&b=2 — ist völlig gewöhnlich, doch in XML muss das Und-Zeichen als & maskiert werden. Andernfalls scheitert der Parser an der ersten solchen Zeile und weist die gesamte Datei zurück, nicht bloß diesen Eintrag. Dieses Werkzeug maskiert jede Adresse, die es schreibt — eine Query-Zeichenkette kostet Sie also nie die Sitemap.

Was Google tatsächlich liest

Von den vier Feldern wird nur lastmod genutzt, und auch nur, wenn es ehrlich ist: Ein Datum, das sich bei jedem Deploy ändert, bringt dem Crawler bei, es zu ignorieren. Changefreq und priority ignoriert Google seit Jahren; sie bleiben hier, weil andere Crawler und manche internen Werkzeuge sie noch lesen — eine Wirkung in der Suche sollte man von ihnen nicht erwarten.

Häufige Fragen

Wie viele Adressen passen in eine Datei?

Fünfzigtausend und höchstens fünfzig Megabyte unkomprimiert. Darüber hinaus teilt man die Liste auf mehrere Dateien auf und führt diese in einem Sitemap-Index auf. Der Prüfer warnt, wenn eine eingefügte Datei die Grenze überschreitet.

Welche Seiten gehören nicht in die Sitemap?

Alles, was Sie nicht als Suchergebnis sehen wollen: durch robots.txt oder noindex gesperrte Seiten, Duplikate mit fremdem Canonical, Weiterleitungen und Fehlerseiten. Eine Sitemap voller solcher Adressen senkt das Vertrauen in die gesamte Datei.

Wohin kommt die fertige Datei?

Ins Stammverzeichnis, neben die robots.txt, und ergänzen Sie dort die Zeile «Sitemap: https://example.com/sitemap.xml». Das Einreichen in der Search Console ist danach freiwillig, beschleunigt aber den ersten Durchlauf.

Kann ich damit meine Website crawlen?

Nein, und kein Browserwerkzeug kann das ehrlicherweise: Aus Sicherheitsgründen lässt sich eine Seite einer fremden Domain nicht aus einem Skript auslesen. Dieses Werkzeug baut die Datei aus der Liste, die Sie liefern — aus Ihrem CMS, Ihrem Build oder einem Desktop-Crawler.

Ähnliche Tools