Alle URLs aus einer sitemap.xml extrahieren — SEO-Audit 2026
Ihre Sitemap enthält 2.000 URLs. Sie öffnen sitemap.xml in einem Texteditor, sehen eine Wand aus <loc>-Tags und scrollen los. Zwanzig Minuten später stehen Sie bei URL 143, mit müden Augen und ohne Fortschritt. So sterben SEO-Audits.
Die Wahrheit: Eine Sitemap ist bereits eine maschinenlesbare Liste aller URLs, die Sie für wichtig halten — Sie müssen sie nur aus dem XML herausziehen und in ein Format bringen, mit dem Sie tatsächlich arbeiten können. In diesem Anleitung lernen Sie drei Wege kennen, von der 60-Sekunden-Browser-Methode bis zum Schwergewichts-Crawler, plus eine kurze Checkliste, die aus einer rohen URL-Liste ein echtes Audit macht.
Warum URLs aus einer Sitemap extrahieren?
Zuerst das Warum, dann das Wie. Eine abgeflachte URL-Liste aus Ihrer Sitemap bildet die Grundlage für mehrere zentrale SEO-Aufgaben:
- Index-Audits: Vergleichen Sie die eingereichten URLs mit dem, was Suchmaschinen tatsächlich indexieren. Lücken zeigen Kanonisierungsprobleme, vergessene noindex-Tags oder Content mit geringem Wert.
- Content-Inventar: Eine vollständige Liste aller veröffentlichten Seiten ist die Grundlage für Content-Audits, Entschlackung und Themencluster.
- Migrations-Checklisten: Extrahieren Sie vor dem Relaunch die alte Sitemap, danach die neue. Die Differenz ist Ihre Weiterleitungs- und QA-Checkliste.
- Sitemap-Recherche bei Wettbewerbern: Sitemaps sind öffentlich. Die extrahierte Sitemap eines Wettbewerbers zeigt dessen komplette Seitenstruktur, Veröffentlichungstempo und Bereiche, die Sie noch nicht abdecken.
Methode 1: sitemap.xml im Browser öffnen + Extractor-Erweiterung (empfohlen)
Hier der Trick, den die meisten übersehen: Eine Sitemap ist einfach nur eine Liste von Links. Jede URL steckt in einem <loc>-Tag, und Browser rendern diese als klickbare Links auf der Seite. Das bedeutet: Jedes Tool, das Links aus Webseiten extrahiert, extrahiert auch URLs aus einer Sitemap — ganz ohne XML-Parsing.
Hier kommt VKT LinkHarvest ins Spiel. Es ist eine Chrome- und Edge-Erweiterung, die alle Links aus jeder Webseite extrahiert — einschließlich dynamisch gerenderter Seiten. Öffnen Sie Ihre Sitemap-URL, klicken Sie auf das LinkHarvest-Symbol, und alle URLs der gerenderten Seite werden erfasst — mit Filterung, Sortierung, interner/externer Klassifizierung und Vorkommenszählung.
Zwei praktische Hinweise:
- Sitemap-Indexdateien: Ist Ihre
sitemap.xmlein Index mit Verweisen auf untergeordnete Sitemaps (sitemap-posts.xml,sitemap-pages.xml...), extrahieren Sie zuerst den Index und öffnen Sie dann jede untergeordnete Sitemap nach demselben Muster. Die Vorkommenszählung von LinkHarvest hilft Ihnen zu erkennen, welche URLs Sie bereits gesammelt haben. - Exporte: Die kostenlose Variante kopiert gefilterte Links in die Zwischenablage und exportiert als TXT. LinkHarvest Premium (einmalig 9,99 $, lebenslang) ergänzt CSV-Export mit UTF-8-BOM-Kodierung — ideal zum direkten Einfügen in Excel oder Google Sheets ohne kaputte Sonderzeichen.
Methode 2: Screaming Frog / Online-Parser
Desktop-Crawler wie der Screaming Frog SEO Spider haben einen eigenen Sitemap-Modus: Sitemap-URL einfügen, „List Mode" wählen, und der Crawler ruft jede URL auf und meldet Statuscodes, Weiterleitungen und Metadaten. Online-XML-Parser funktionieren ähnlich — direkt im Browser.
Nutzen Sie diese Methode, wenn Sie vollständige Crawl-Daten brauchen — Response-Codes, Titles, Canonical-Tags — und nicht nur die URL-Liste. Der Preis sind Aufwand und Ressourcen: Desktop-Crawler wollen installiert sein, werden bei sehr großen Sitemaps langsam und speicherhungrig, und viele Online-Parser deckeln die Anzahl der kostenlos verarbeitbaren URLs. Wer einfach nur „gib mir die URL-Liste" will, fährt mit Methode 1 schneller.
Methode 3: Tabellenkalkulation + XML-Import
Excel und Google Sheets können XML direkt importieren. In Excel über Daten → Daten abrufen → Aus XML-Datei; in Google Sheets mit der Funktion =IMPORTXML() und einem XPath wie //loc, der auf die Sitemap-URL zeigt.
Für kleine, flache Sitemaps funktioniert das — aber es wird schnell spröde: IMPORTXML hat Zellen- und Längenlimits, an denen große Sitemaps scheitern; Sitemap-Indizes brauchen eine zweite Abfrage pro untergeordneter Sitemap; und XML-Namespaces sorgen gelegentlich dafür, dass der Import stumm nichts zurückgibt. Für einen Einzelfall mit 50 URLs in Ordnung; bei allem Größeren oder Verschachtelten greifen Sie zu Methode 1.
Kurze Audit-Checkliste nach der Extraktion
Sind die URLs in einer Liste, ist das Audit größtenteils Handwerk:
- Duplikate entfernen. Untergeordnete Sitemaps zusammenführen und Doppler löschen — die Vorkommenszählung von LinkHarvest zeigt jede URL einmal mit der Anzahl ihrer Auftreten.
- Statuscodes prüfen. Crawlen Sie die Liste (oder prüfen Sie stichprobenartig) auf 404er und 301/302-Ketten. URLs in der Sitemap sollten 200 zurückgeben.
- Mit Indexzahlen abgleichen. Eine
site:-Abfrage oder die Abdeckungsberichte der Search Console zeigen die Lücke. Ein großer Abstand zwischen eingereichten und indexierten URLs hat höchste Priorität. - Verwaiste Muster aufspüren. URL-Muster, die in der Sitemap auftauchen, aber nirgends auf der Seite verlinkt sind (oder umgekehrt), zeigen Lücken in Navigation und interner Verlinkung.
- Ballast markieren. Tag-Seiten, parametrisierte URLs und Staging-Subdomains gehören nicht in eine Produktiv-Sitemap. Filtern Sie in LinkHarvest per Schlüsselwort — gefunden sind sie in Sekunden.
Schritt für Schritt: Sitemap-URLs mit LinkHarvest extrahieren
- Installieren Sie VKT LinkHarvest aus dem Chrome Web Store oder den Edge-Add-ons.
- Geben Sie Ihre Sitemap-Adresse (üblicherweise
yourdomain.com/sitemap.xml) in die Adressleiste ein und öffnen Sie sie. Im Zweifel:robots.txtnach der Sitemap-Direktive durchsuchen. - Klicken Sie auf das LinkHarvest-Symbol. Es erfasst jede auf der Seite gerenderte URL samt Vorkommenszählung.
- Handelt es sich um einen Sitemap-Index, öffnen Sie jeden Link zu einer untergeordneten Sitemap, wiederholen die Extraktion und führen die Listen zusammen.
- Entfernen Sie mit dem Schlüsselwortfilter Störungen (etwa URLs mit
tagoderpageausschließen) und sortieren Sie die Ergebnisse. - Kopieren Sie die gefilterten Links in die Zwischenablage oder exportieren Sie als TXT (beides kostenlos). Für Tabellenkalkulationen schalten Sie den CSV-Export auf der Preisseite frei.
Wer noch nie einen Link-Extractor benutzt hat, findet in unserem Guide alle Links aus einer Webseite extrahieren eine ausführlichere Einführung in die Bedienung.
Methodenvergleich auf einen Blick
| Methode | Am besten für | Aufwand | Verschachtelte Sitemaps |
|---|---|---|---|
| Browser + LinkHarvest | Schnelle URL-Listen, Filterung, kostenloser Export | Einmalige Installation | ✅ Jede untergeordnete Sitemap besuchen |
| Screaming Frog / Crawler | Statuscodes, Titles, vollständige Crawl-Daten | Installation + Konfiguration | ✅ Automatisch |
| Tabellenkalkulation mit XML-Import | Kleine, einmalige, flache Sitemaps | Keiner | ⚠️ Manuell pro untergeordneter Sitemap |
Häufige Fragen
Kann ich URLs aus einer Sitemap-Indexdatei extrahieren?
Ja, aber eine Sitemap-Indexdatei enthält Links zu untergeordneten Sitemaps und keine Seiten-URLs. Extrahieren Sie zunächst die URLs aus dem Index, öffnen Sie dann jede untergeordnete Sitemap und extrahieren Sie deren URLs auf dieselbe Weise. Führen Sie alles zu einer Master-Liste zusammen. Eine Erweiterung wie VKT LinkHarvest erfasst die URLs der untergeordneten Sitemaps automatisch auf der gerenderten Indexseite.
Wie öffne ich eine sitemap.xml?
Geben Sie die Sitemap-Adresse — üblicherweise yourdomain.com/sitemap.xml — direkt in die Adressleiste Ihres Browsers ein. Moderne Browser rendern das XML als klickbare Linkliste statt als Quellcode. Lädt die Seite nicht, prüfen Sie robots.txt auf eine Sitemap:-Direktive, denn eine Sitemap kann unter jeder vom Betreiber gewählten URL liegen.
Ist LinkHarvest kostenlos?
Der Kern von VKT LinkHarvest ist kostenlos: alle Links einer Seite extrahieren, filtern und sortieren, gefilterte Links in die Zwischenablage kopieren und als TXT exportieren. Einziges Bezahlfeature ist der CSV-Export mit UTF-8-BOM-Kodierung für Tabellenkalkulationen — ein einmaliges Upgrade für 9,99 $ auf Lebenszeit, ohne Abo.
Was ist der Unterschied zwischen TXT- und CSV-Export?
Der TXT-Export erzeugt eine schlichte Liste mit einer URL pro Zeile — ideal für schnelle Vergleiche, Merge-Tools und Skripte. Der CSV-Export erzeugt eine Tabelle mit sauberen Spalten für Excel oder Google Sheets. LinkHarvest fügt zusätzlich ein UTF-8-BOM hinzu, damit Sonderzeichen in URLs korrekt angezeigt werden, statt zu kaputten Zeichen zu werden.
Wie oft sollte ich meine Sitemap-URLs extrahieren und prüfen?
Es gibt keine feste Regel, aber sinnvolle Anlässe sind nach einer Migration oder einem Relaunch, nach größeren Inhaltsänderungen und in einem regelmäßigen Turnus, etwa quartalsweise. Ziel ist es, 404-Fehler, Redirect-Ketten und URLs, die nicht in die Sitemap gehören, zu finden, bevor Suchmaschinen und Nutzer sie entdecken.
Aus der Sitemap wird in Minuten eine saubere URL-Liste: VKT LinkHarvest extrahiert jeden Link der gerenderten Seite — Filterung, Sortierung, Klassifizierung, Vorkommenszählung. Kostenloser Kern; Premium (einmalig 9,99 $, lebenslang) ergänzt den Excel-tauglichen CSV-Export. Chrome Web Store · Edge-Add-ons.
Weitere Tools finden Sie im VKT-Erweiterungskatalog oder schreiben Sie uns an [email protected].
