Sitemap-Generator
Fügen Sie eine Liste von Adressen ein, und die Sitemap entsteht in Ihrem Browser. Oder lassen Sie den optionalen Crawl-Modus die Seiten einer öffentlichen Website einsammeln – dieser Teil läuft über den ToolCMB-Server, der die Website Seite für Seite liest.
- XML + Sitemap-Index
- Aus Liste: im Browser
- Crawl: über unseren Server
- ZIP- und .gz-Download
Eine Sitemap aus einer Adressliste entsteht vollständig in Ihrem Browser – es wird nichts gesendet. Nur der optionale Modus „Website crawlen“ nutzt den ToolCMB-Server: Er liest die öffentlichen Seiten der von Ihnen genannten Website nacheinander und gibt die gefundenen Links zurück. Wir speichern weder die Adressen noch das Ergebnis.
Fügen Sie eine Liste, eine Tabellenspalte oder eine vorhandene sitemap.xml ein – oder öffnen Sie eine .txt-, .csv- oder .xml-Datei. Ein Datum hinter der Adresse (durch Tab oder Komma getrennt) wird als „Zuletzt geändert“ verwendet.
Der Crawl folgt Links auf derselben Domain, beginnend bei dieser Adresse.
Teile des Pfads, durch Kommas getrennt. * steht für Beliebiges.
Crawl-Protokoll
| URL | Ergebnis |
|---|
Optionen
Google nutzt „Zuletzt geändert“, wenn die Angabe stimmt, und ignoriert Änderungshäufigkeit und Priorität. Lassen Sie beide auf „Keine“, sofern keine andere Suchmaschine oder kein anderes Tool sie braucht.
Höchstens 50.000. Längere Listen werden aufgeteilt.
Nötig für den Index, wenn die Liste aufgeteilt wird. Leer = Stammverzeichnis der Website.
Ergebnis
Laden Sie die Datei in das Stammverzeichnis Ihrer Website hoch, ergänzen Sie die Sitemap-Zeile in robots.txt und reichen Sie die Adresse in der Google Search Console und den Bing Webmaster Tools ein.
So erstellen Sie eine XML-Sitemap
Zwei Quellen, ein Ergebnis.
- 1
Liste einfügen – oder die Website crawlen
Eine Liste von Adressen, eine Tabellenspalte oder eine alte sitemap.xml wird in Ihrem Browser verarbeitet. Für „Website crawlen“ geben Sie eine Startadresse ein: Unser Server ruft dann die öffentlichen Seiten nacheinander ab und liefert die gefundenen Links zurück.
- 2
Optionen wählen
Legen Sie fest, wie „Letzte Änderung“ befüllt wird, ob Duplikate und Tracking-Parameter entfernt werden und ob Sie XML oder eine einfache Textdatei möchten.
- 3
Herunterladen und einreichen
Speichern Sie die sitemap.xml (oder ein ZIP, wenn die Liste geteilt wurde), laden Sie sie auf Ihre Website hoch, kopieren Sie die Sitemap-Zeile für die robots.txt und reichen Sie die Adresse bei den Suchmaschinen ein.
Eine gültige Sitemap – egal, wie Sie die Adressen sammeln
Folgt dem Protokoll von sitemaps.org und seinen Grenzen.
Aus einer Liste
Akzeptiert eine Adresse pro Zeile, eine Tabelle mit Datumsangaben oder eine vorhandene XML-Sitemap – eingefügt oder als .txt-, .csv- oder .xml-Datei geöffnet. Ein Datum hinter der Adresse wird zu „Letzte Änderung“.
Crawl-Modus
Folgt von Ihrer Startadresse aus den Links auf derselben Domain, bis zu 50, 100, 250 oder 500 Seiten – mit Ausschlussmustern, Stopp-Schaltfläche und einem Protokoll jeder Seite.
Nur indexierbare Seiten
Der Crawl kann die robots.txt beachten und Seiten auslassen, die mit noindex markiert sind oder deren Canonical woandershin zeigt – so listet die Sitemap, was indexiert werden soll.
Aufteilung und Index
Listen, die länger sind als Ihr Limit – höchstens 50.000 Adressen oder 50 MB pro Datei –, werden in mehrere Dateien plus einen Sitemap-Index geteilt und als ein ZIP heruntergeladen.
Lastmod, changefreq, priority
Behalten Sie vorhandene Datumsangaben, tragen Sie das heutige Datum ein, wo eines fehlt, oder setzen Sie ein Datum für alle. Änderungshäufigkeit und Priorität sind verfügbar – mit dem Hinweis, dass Google sie ignoriert.
Prüfungen
Meldet vor dem Download ungültige Zeilen, gemischte Hosts, gemischtes http und https, Adressen mit mehr als 2.048 Zeichen und Duplikate.
Ehrlich, was gesendet wird
Die Prüfung läuft auf unserem Server, weil ein Browser sie nicht durchführen darf. Gesendet wird nur die Adresse, die Sie eingeben; sie wird nicht gespeichert.
Kostenlos, ohne Anmeldung
Kein Konto, keine Limits, kein Wasserzeichen – auf Smartphone, Tablet und Computer.
Was eine XML-Sitemap ist und was hineingehört
Eine XML-Sitemap ist eine Datei, die die Adressen einer Website auflistet, die Suchmaschinen kennen sollen – jede in einem <loc>-Element, optional mit einem <lastmod>-Datum. Sie hilft Crawlern, Seiten schneller zu entdecken – besonders bei neuen Websites, großen Websites und solchen, deren Seiten intern schlecht verlinkt sind. Eine Sitemap ist ein Vorschlag, keine Garantie: Sie erzwingt keine Indexierung und verbessert das Ranking nicht von selbst. Kleine, gut verlinkte Websites werden meist auch ohne sie vollständig gecrawlt.
Das Protokoll von sitemaps.org setzt feste Grenzen: Eine Datei darf höchstens 50.000 Adressen und unkomprimiert 50 MB enthalten. Größere Websites verwenden mehrere Dateien und einen Sitemap-Index, der sie auflistet; eingereicht wird nur der Index. Adressen müssen absolut sein und zu dem Host gehören, auf dem die Sitemap liegt, und Sonderzeichen wie & müssen maskiert werden – das übernimmt der Generator für Sie. Google nutzt lastmod, wenn es sich als zuverlässig erweist, und ignoriert changefreq und priority.
Eine gute Sitemap enthält nur kanonische, indexierbare Seiten, die mit Status 200 antworten. Häufige Fehler sind Weiterleitungen, Fehlerseiten, Seiten mit noindex oder in der robots.txt gesperrte Adressen in der Liste; die Mischung von http und https oder von www und ohne www; und das heutige Datum für jede Seite bei jedem Export – so lernen Suchmaschinen, den Datumsangaben zu misstrauen. Listen Sie keine Parametervarianten derselben Seite auf. Und halten Sie die Datei aktuell: Eine Sitemap, die einmal erzeugt und nie aktualisiert wird, verliert schnell ihren Wert.
Sitemap-Elemente und ihre Verwendung
| Element | Bedeutung | Von Google genutzt |
|---|---|---|
| <code><loc></code> | Vollständige Adresse der Seite (erforderlich) | Ja |
| <code><lastmod></code> | Datum der letzten wesentlichen Änderung | Ja, wenn es durchgehend zuverlässig ist |
| <code><changefreq></code> | Wie oft sich die Seite voraussichtlich ändert | Nein |
| <code><priority></code> | Wichtigkeit von 0.0 bis 1.0 innerhalb der Website | Nein |
| <code><image:image></code> | Bilder, die zur Seite gehören | Ja, für die Bildersuche |
Tipps
- Machen Sie die Sitemap mit einer
Sitemap:-Zeile in der robots.txt bekannt – der Robots.txt-Generator schreibt sie für Sie. - Prüfen Sie gelistete Adressen stichprobenartig mit dem HTTP-Status-Checker: Jede sollte mit 200 antworten, und keine sollte weiterleiten (siehe Redirect-Checker).
- Listen Sie nur kanonische Adressen auf. Der Canonical-URL-Generator bereinigt eine ganze Liste und markiert Duplikate.
- Der Crawl liest höchstens 500 Seiten pro Durchlauf. Crawlen Sie bei einer größeren Website einzelne Bereiche getrennt, indem Sie in einem Unterordner starten, oder exportieren Sie die Adressliste aus Ihrem CMS und fügen Sie sie ein.
Häufig gestellte Fragen
Keine Antwort gefunden? Schreiben Sie uns – wir antworten schnell.
Wohin lade ich die Sitemap hoch?
In der Regel in das Hauptverzeichnis der Website, sodass sie unter https://your-domain.com/sitemap.xml erreichbar ist. Eine Sitemap darf nur Adressen aus ihrem eigenen Ordner und darunter auflisten – deshalb ist das Hauptverzeichnis der sichere Ort. Tragen Sie die Adresse anschließend in die robots.txt ein und reichen Sie sie in der Google Search Console und den Bing Webmaster Tools ein.
Wie viele URLs darf eine Sitemap enthalten?
Bis zu 50.000 Adressen und unkomprimiert 50 MB pro Datei. Darüber hinaus teilen Sie die Liste in mehrere Dateien und verweisen in einem Sitemap-Index auf sie. Dieser Generator übernimmt die Aufteilung und schreibt den Index.
Verbessert eine Sitemap mein Ranking?
Nicht direkt. Sie hilft Suchmaschinen, Ihre Seiten zu finden und erneut zu crawlen – das zählt vor allem bei neuen, großen oder schwach verlinkten Websites. Ob eine Seite indexiert wird und wie sie rankt, hängt von der Seite selbst ab.
Sollte ich priority und changefreq setzen?
Für Google macht es keinen Unterschied: Beide Werte werden ignoriert. Lassen Sie sie weg, sofern keine andere Suchmaschine und kein Tool, das Sie nutzen, sie verlangt. Ein zutreffendes lastmod-Datum ist der einzige optionale Wert, dessen Pflege sich lohnt.
Was wird an Ihren Server gesendet?
Nur die Adresse oder der Domainname, den Sie eingeben. Ein Browser darf diese Art von Anfrage nicht selbst stellen, deshalb stellt unser Server sie für Sie und liefert das Ergebnis zurück. Wir speichern weder die Adresse noch das Ergebnis, und der Inhalt der geprüften Seiten wird nie weitergegeben.
Welche Grenzen hat der Crawl-Modus?
Ein Durchlauf liest höchstens 500 Seiten einer öffentlichen Website, folgt nur Links auf derselben Domain und pausiert, wenn die Zahl der Anfragen pro Minute erreicht ist. Private und interne Netzwerkadressen werden abgelehnt. Der Crawl liest das HTML, das der Server ausliefert – Links, die erst durch JavaScript entstehen, werden daher nicht gefunden. Der Listenmodus kennt keine dieser Grenzen, abgesehen von den 50.000 Adressen pro Datei, die das Protokoll vorgibt.
Weitere kostenlose SEO- und Website-Tools
Tags und Dateien erzeugen, Statuscodes, Weiterleitungen, DNS und Zertifikate prüfen – kostenlos und ohne Konto.