Kategorie: Entwicklung

Sitemap-URL-Zähler

Eigene IdeeTool fehlt?

URLs in einem sitemap.xml-Dokument zählen und prüfen

Fügen Sie Sitemap-XML ein, entweder ein urlset oder ein sitemapindex, um die URLs, verschiedenen Hosts, http- gegenüber https-Protokolle, fehlende lastmod-Daten und doppelte URLs zu zählen. Läuft komplett im Browser.

URLs insgesamt4Verschiedene Hosts1https-URLs3http-URLs1Sonstige/ungültig0lastmod vorhanden3lastmod fehlt1Doppelte URLs1
Doppelte URLs
https://example.com/about2

Alles auf dieser Seite wird in Ihrem Browser verarbeitet. Nichts wird hochgeladen.

Wozu dieses Werkzeug dient

Eine über die Zeit gewachsene Sitemap kann still Probleme ansammeln: doppelte Einträge, eine Mischung aus http- und https-URLs oder Seiten ohne lastmod-Datum. Dieses Werkzeug liest ein eingefügtes Sitemap-Dokument, egal ob es sich um ein seitenbezogenes urlset oder ein sitemapindex mit untergeordneten Sitemaps handelt, und meldet die Gesamtzahl der URLs, wie viele verschiedene Hosts vorkommen, die Protokollverteilung, wie viele Einträge ein lastmod-Datum haben, und alle doppelten URLs.

So funktioniert es

  1. Fügen Sie das Sitemap-XML in das Eingabefeld ein.
  2. Prüfen Sie die Gesamtzahl der URLs, die Anzahl der Hosts, die Protokollverteilung und die lastmod-Abdeckung.
  3. Sehen Sie in der Liste der doppelten URLs nach jedem Eintrag, der mehr als einmal vorkommt.

Datenschutz

Dieses Werkzeug läuft vollständig in Ihrem Browser. Ihre Eingabe wird nie hochgeladen, gespeichert oder weitergegeben – beim Schließen des Tabs ist sie weg.

Häufig gestellte Fragen

Wird meine Sitemap irgendwohin hochgeladen?
Nein. Das XML wird lokal in Ihrem Browser-Tab gescannt; nichts wird an einen Server gesendet.
Funktioniert es mit einer Sitemap-Index-Datei?
Ja. Ein sitemapindex-Dokument wird automatisch erkannt, und seine untergeordneten <sitemap>-Einträge werden anstelle von Seiten-URLs gezählt, mit einem Hinweis, dass es sich um untergeordnete Sitemaps und nicht um Seiten handelt.
Wie erkennt es doppelte URLs?
Es vergleicht den exakten Text jedes <loc>-Eintrags nach dem Dekodieren von XML-Entitäten; zwei Einträge, die sich zur gleichen Zeichenfolge auflösen, gelten als Duplikate.