
Een sitemap is een XML-bestand dat de URL’s van een website opsomt en de crawlers van zoekmachines de lijst van te doorbladeren pagina’s doorgeeft. Voor een blog fungeert dit bestand als een gestructureerde inventaris: het geeft aan welke pagina’s bestaan, wanneer ze zijn gewijzigd en hoe ze onderling zijn georganiseerd.
De sitemap-ping werkt niet meer: wat dit betekent voor uw blog
Veel SEO-plugins voor WordPress of andere CMS’en bevatten een “ping”-functie die Google automatisch op de hoogte stelde bij elke publicatie van een nieuw artikel. Dit mechanisme was gebaseerd op een specifieke endpoint bij Google.
Deze endpoint is officieel gedeactiveerd en geeft nu fouten terug. Als uw blog nog steeds afhankelijk is van een oude of slecht onderhouden plugin die alleen Google pingt, worden uw nieuwe publicaties niet meer via dit kanaal gemeld.
De consequentie is direct: de enige betrouwbare methode om ervoor te zorgen dat Google uw sitemap in overweging neemt, blijft deze aan te geven in het robots.txt-bestand en deze in te dienen via Google Search Console. Een blog dat regelmatig publiceert zonder dit punt te hebben gecontroleerd, loopt het risico dat zijn recente artikelen buiten de index blijven, zonder duidelijke verklaring. Om de werking van dit bestand en de generatie ervan beter te begrijpen, kunt u de sitemap-pagina van Blospot bekijken die de concrete werking detailleert.
Indexatiestatus in Search Console: lees de signalen van de sitemap

Een XML-sitemap indienen in Google Search Console garandeert niet de indexatie van alle vermelde URL’s. Het specifieke rapport kent aan elke ingediende sitemap een van drie statussen toe: Succes, Heeft fouten of Kon niet ophalen.
De belangrijkste interesse van dit rapport voor een blog ligt in de vergelijking tussen de via de sitemap ontdekte URL’s en hun werkelijke status in het rapport “Pagina’s”. Een URL kan als ontdekt verschijnen, maar geblokkeerd blijven met de status “Ontdekt, momenteel niet geïndexeerd”.
Deze status geeft geen technisch probleem van de sitemap zelf aan. Het wijst op een probleem met de kwaliteit van de inhoud, cannibalisatie tussen vergelijkbare artikelen of onvoldoende interne linkstructuur. De sitemap heeft zijn rol vervuld door de pagina aan te geven, maar Google heeft besloten deze om andere redenen niet te indexeren.
Identificeer slecht gedekte blogsecties
Door het sitemap-rapport te kruisen met het pagina-rapport, kunt u zien welke categorieën of series artikelen systematisch worden genegeerd. Als een hele categorie van uw blog overwegend de status “niet geïndexeerd” vertoont, ondanks aanwezigheid in de sitemap, is het signaal duidelijk: het probleem ligt op het niveau van de inhoud of de interne architectuur, niet van het XML-bestand.
Deze kruislezen transformeert de sitemap in een diagnostisch hulpmiddel. Zonder deze zou deze wees-URL’s onzichtbaar blijven in uw dashboard.
XML-sitemap en blogstructuur: organiseren om te worden gecrawld
Een blog verzamelt pagina’s naarmate er publicaties plaatsvinden. Zonder expliciete structuur ontdekken crawlers de artikelen door interne links te volgen, pagina voor pagina. Deze route is traag en onvolledig, vooral wanneer oude artikelen niet meer zijn gelinkt vanaf de homepage of recente archieven.
De XML-sitemap omzeilt dit probleem door een uitputtende lijst te bieden. Elke URL wordt vergezeld van een <lastmod>-tag die de laatste wijziging aangeeft. Crawlers kunnen zo prioriteit geven aan recent bijgewerkte pagina’s zonder de volledige site te doorbladeren.
Sitemaps scheiden op basis van inhoudstype
Voor een aanzienlijk blog wordt een enkele sitemap die artikelen, statische pagina’s en categorieën mengt, moeilijk te exploiteren, zowel voor crawlers als voor de webmaster die probeert de indexatie-dekking te analyseren.
Het fragmenteren van de sitemap in verschillende gespecialiseerde bestanden (één voor artikelen, één voor pagina’s, één voor categorieën) en deze vervolgens te groeperen in een sitemap-index biedt verschillende concrete voordelen:
- Elk bestand blijft leesbaar en de status in Search Console is onafhankelijk van de andere te verifiëren
- Een probleem met een type inhoud (bijvoorbeeld een 404-fout op oude categorieën) heeft geen invloed op de verwerking van artikelen
- De frequentie van updates kan per bestand worden aangepast, wat beter het werkelijke publicatietempo weerspiegelt

Robots.txt en de verklaring van de sitemap: het vaak verwaarloosde configuratiepunt
Het opgeven van de locatie van de sitemap in het robots.txt-bestand is een eenvoudige maar vaak vergeten stap. De richtlijn heeft de vorm van een enkele regel:
Sitemap: https://votredomaine.com/sitemap.xml
Deze verklaring stelt alle zoekmachines (niet alleen Google) in staat om het bestand te lokaliseren zonder via Search Console te gaan. Bing, Yandex en andere crawlers lezen robots.txt als eerste.
Zonder deze regel bestaat de sitemap alleen voor de zoekmachine waaraan u deze handmatig heeft ingediend. Een blog dat zichtbaarheid buiten Google nastreeft, heeft er alle belang bij deze stap niet over te slaan.
Controleer of de sitemap toegankelijk is
Een verklaarde sitemap die een HTTP-fout (403, 404, 500) teruggeeft, is erger dan een ontbrekende sitemap: het genereert fouten in Search Console en kan de crawlfrequentie die aan uw domein is toegewezen vertragen. Voor elke indiening verdienen drie punten controle:
- De URL van de sitemap geeft correct antwoord met een HTTP-code 200
- Het bestand is in geldig XML-formaat, zonder verkeerd gecodeerde tekens
- Geen Disallow-regel in robots.txt blokkeert de toegang tot het sitemap-bestand zelf
Een correct verklaarde, toegankelijke en per inhoudstype gesegmenteerde sitemap vervangt noch een goede interne linkstructuur, noch kwaliteitsartikelen. Het maakt zichtbaar wat al bestaat op uw blog en biedt de nodige gegevens om te diagnosticeren wat zoekmachines kiezen te negeren. Het sitemap-bestand is een transparantie-instrument tussen uw blog en de indexeringsrobots, geen garantie voor ranking.