Sitemap-URL-extractor

Extraheer elke URL uit elke XML-sitemap: haal een live sitemap op per URL, upload een bestand of plak XML. Verwerkt sitemap-indexbestanden, markeert duplicaten, groepeert op map en exporteert naar CSV.

De Sitemap URL Extractor haalt elke URL uit een XML-sitemap, detecteert duplicaten en analyseert de mapdiepte om u te helpen het crawlbudget te optimaliseren. Vervolgens exporteert u de volledige lijst naar CSV. Het is een snelle manier om te controleren wat zoekmachines daadwerkelijk in uw sitemap zien.

Share
Categorie
SEO-hulpmiddelen
Inclusief
6-functies
Toegang
Vrij · Geen aanmelding
Privacy
Draait in uw browser
Sitemap-URL-extractor

Calibrating Sitemap Extractor......

Please wait a moment

Hoe te gebruiken

Hoe Sitemap-URL-extractor te gebruiken

  1. 01

    Geef de sitemap op

    Upload een XML-bestand of plak de onbewerkte sitemapinhoud.

  2. 02

    Pak de URL's uit

    De tool parseert elke link en geeft ze onmiddellijk weer.

  3. 03

    Beoordelingsstructuur

    Ontdek dubbele vermeldingen en controleer de paddiepte op de site.

  4. 04

    Exporteren naar CSV

    Download alle URL's voor audit- of migratiewerkzaamheden.

Gebruiksgevallen

Veelvoorkomende gebruiksscenario's

  • Een SEO controleert een sitemap op dubbele of verweesde URL’s.
  • Een ontwikkelaar exporteert alle URL's vóór een sitemigratie.
  • Een contentmanager controleert hoe diep pagina's in de structuur zijn begraven.
  • Een consultant controleert de sitemap van een klant op crawlbudget-verspilling.
Overzicht

Waarom uw sitemap controleren?

Uw sitemap is de kaart die zoekmachines volgen, dus duplicaten, dode vermeldingen of een log formaat verspillen stilletjes het crawlbudget en verwarren de indexering. Het extraheren en beoordelen van de URL's brengt problemen aan het licht die onzichtbaar zijn als de sitemap alleen maar ruwe XML is.

Paddiepte en crawlbudget

Pagina's die vele mappen diep verborgen zijn, worden minder vaak gecrawld en als minder belangrijk gezien. Door de paddiepte te analyseren, kunt u zien welke inhoud zich te ver van de startpagina bevindt, zodat u de structuur kunt afvlakken en belangrijke pagina's kunt indexeren.

Privé-parsing aan de clientzijde

De extractor parseert de sitemap in uw browser en exporteert naar CSV zonder iets te uploaden, zodat u client- of interne sitemaps kunt controleren zonder hun structuur naar een server van derden te sturen.

Functies
01
Haal een live sitemap op via URL, upload een bestand of plak XML
02
Ondersteuning voor sitemapindex: dieper ingaan op onderliggende sitemaps
03
Automatische dubbele URL-detectie
04
Mapgroepering en paddiepte-analyse voor crawlbudget
05
Direct zoeken, filteren en diepte/alfabetisch sorteren
06
Exporteer naar CSV of een gewone URL-lijst
Veelgestelde vragen

Veelgestelde vragen

Hoe extraheer ik alle URL's uit mijn XML-sitemap?+

Plak uw sitemap-URL of upload het XML-bestand. De tool parseert onmiddellijk alle URL's en toont u de volledige lijst met hun paddiepte en eventuele dubbele vermeldingen. Exporteer alles met één klik naar CSV.

Waarom moet ik mijn sitemap controleren op dubbele URL's?+

Dubbele URL's in een sitemap verspillen uw crawlbudget. Google heeft een limiet voor het aantal pagina's dat per dag wordt gecrawld. Dubbele vermeldingen duiden ook op een slechte sitestructuur en kunnen uw rankingsignalen over dezelfde inhoud verdelen.

Wat is paddiepte in een sitemap?+

Paddiepte is het aantal mapniveaus in een URL (geteld door schuine strepen achter het domein). /blog/post = diepte 2. Ondiepere URL's (diepte 1-2) krijgen over het algemeen prioriteit door zoekmachines en worden gemakkelijker gerangschikt.

Hoeveel URL's moeten er in mijn sitemap staan?+

Eén sitemapbestand kan maximaal 50.000 URL's bevatten met een maximale bestandsgrootte van 50 MB. Voor grotere sites gebruikt u een sitemapindexbestand dat naar meerdere sitemapbestanden verwijst. Neem alleen indexeerbare, canonieke URL's op.

Moet ik elke pagina in mijn sitemap opnemen?+

Nee. Neem alleen pagina's op die u door Google wilt laten indexeren: hoofdinhoudspagina's, blogposts, productpagina's, categoriepagina's. Uitsluiten: beheerderspagina's, inlogpagina's, bedankpagina's, dubbele inhoud en pagina's met noindex-tags.

Kan ik dit gebruiken om weespagina's op mijn website te vinden?+

Ja. Haal alle URL's uit uw sitemap en verwijs ze vervolgens met uw interne linkaudit. Pagina's in uw sitemap zonder interne links die ernaar verwijzen, zijn 'weespagina's'. Google ontdekt ze zelden en ze presteren vaak ondermaats. Het toevoegen van interne links naar weespagina’s is een snelle SEO-winst.

Waarom een ​​sitemap controleren op dubbele URL's?+

Dupliceert het crawlbudget en kan rangschikkingssignalen verzwakken. Door ze te vinden en te verwijderen, kunnen zoekmachines zich concentreren op uw canonieke pagina’s.

Hoeveel URL's moet een sitemap hebben?+

Eén sitemapbestand ondersteunt maximaal 50.000 URL's; verder kunt u het opsplitsen in meerdere sitemaps waarnaar wordt verwezen door een sitemapindex.