Ga naar hoofdinhoud
ÉÉN PAGINA PER WEBSITEWE BEWAREN JE INHOUD NIETUITSLUITEN KAN ALTIJD

Wij hebben je website opgehaald.

Zag je SignumResearchBot in je logboek staan? Dan waren wij dat. Hier staat wie we zijn, wat we ophalen, wat we ermee doen en hoe je ons in één regel buiten de deur zet.

Wie hier langskwam.

SignumCore meet websites en beheert advertenties voor Nederlandse ondernemers. Om te weten hoe het er voorstaat — hoeveel bedrijfswebsites hun bezoekers eigenlijk meten, hoeveel er een cookiemelding hebben, hoe toegankelijk ze zijn — halen we bedrijfswebsites op en kijken we naar de techniek eronder.

Op dit moment gaat dat onderzoek over één gemeente: Wageningen. Daar hebben we 365 bedrijfswebsites gemeten. Meer gemeenten kunnen volgen, maar we schrijven hier geen "Nederland" zolang dat niet klopt.

Dat onderzoek doen we voor onszelf. We verkopen de opgehaalde gegevens niet door en we bouwen er geen adressenbestand van dat je bij ons kunt kopen.

SignumCore is een handelsnaam van Mink Helwig (HGVC), KvK 93077149, gevestigd in Nederland. Schrijf naar info@signumcore.io; er zit een mens achter.

Waar je ons aan herkent.

Er is één naam waarmee we websites ophalen. Komt er iets langs dat zich anders noemt en zegt dat het van SignumCore is, dan zijn wij dat niet.

SignumResearchBot/1.0 (+https://signumcore.io/bot)
Het onderzoek. Komt ongevraagd langs en haalt je voorpagina op.

We hebben geen vaste server met een vast IP-adres — het onderzoek draait op een gewone Nederlandse internetverbinding, en dat adres wisselt. Blokkeren op IP raden we daarom af: je zou er anderen mee treffen die niets met ons te maken hebben. De naam hierboven is het enige waar je ons betrouwbaar aan herkent.

Twijfel je of iets echt van ons was? Stuur de regel uit je logboek naar info@signumcore.io, dan zoeken we het op.

Wat we opvragen, en wat we ervan bewaren.

We vragen één pagina op: je voorpagina. Staat daar geen adres op, dan proberen we hoogstens één contactpagina erbij — en het pad daarvan lezen we uit je eigen menu, zodat we niet hoeven te raden. Daar houdt het op. We vullen geen formulieren in, we klikken nergens op, we proberen nergens in te loggen, en we halen geen afbeeldingen of bestanden op.

Wat we van die pagina onthouden:

  • → het webadres, en of de site bereikbaar was
  • → of er meetsoftware op staat, en van welke soort (bijvoorbeeld een tagbeheerder of een bezoekersteller)
  • → of er een cookiemelding is en of er naar een privacyverklaring wordt gelinkt
  • → een paar toegankelijkheidskenmerken, zoals of de taal is ingesteld en of afbeeldingen een omschrijving hebben
  • → de postcode, plaats en het KvK-nummer, als die op de pagina staan
  • → de datum waarop we keken

Wat we niet bewaren: je teksten, je afbeeldingen, je broncode, je prijzen, je nieuwsberichten, namen van medewerkers, e-mailadressen of telefoonnummers. De opgehaalde pagina wordt gelezen en meteen weggegooid; alleen de kenmerken hierboven blijven staan. Dat is geen belofte achteraf maar hoe de opslag is gebouwd: er is geen kolom waar je pagina zelf in terecht kan komen.

Hoe vaak we langskomen.

Eén keer per onderzoeksronde. Binnen een ronde ziet jouw server ons dus één keer, en als we een contactpagina nodig hebben twee keer, met een seconde ertussen. Daarnaast vragen we je robots.txt op — dat is het verzoek dat elke nette crawler doet voordat hij iets anders ophaalt.

Over alle websites samen doen we ongeveer één verzoek per seconde. Dat is bewust traag: het scheelt jouw server niets als wij haast hebben, en het scheelt ons niets als het een dag langer duurt.

Eerlijk over de frequentie: we meten opnieuw wanneer onze meetmethode beter wordt, want oude cijfers onder een verbeterde meetlat zijn onbruikbaar. Op 30 juli 2026 gebeurde dat een paar keer op één dag, omdat we die dag drie fouten in onze meting vonden en dichtten. Dat is geen normaal tempo en niet de bedoeling, maar het is wel wat er is gebeurd — en dan hoort het hier te staan in plaats van in een ronder verhaal.

Staat in je robots.txt dat we weg moeten blijven, dan komen we niet. Ook niet voor de contactpagina. Vraag je om rust met een Crawl-delay, dan houden we die aan tot dertig seconden; vraag je om meer dan dat, dan slaan we je over in plaats van uren een plek in de rij bezet te houden.

Waarom we hier waren.

We onderzoeken hoe bedrijfswebsites in een gemeente ervoor staan op drie punten: meten ze hun bezoekers, vragen ze netjes toestemming, en zijn ze te gebruiken voor mensen die slecht zien of niet met een muis werken. Dat onderzoek gebruiken we om ons eigen werk te ijken en om erover te publiceren — altijd in aantallen over een gemeente of een branche, nooit met jouw bedrijf erbij.

De meeste kenmerken die we bewaren gaan over een website, niet over een mens. Bij een eenmanszaak kan dat anders liggen: een postcode en een KvK-nummer zijn daar wél tot een persoon te herleiden. Voor dat deel beroepen we ons op een gerechtvaardigd belang (AVG artikel 6, lid 1, onder f): onderzoek naar de staat van de bedrijfswebsites in een gemeente, met zo min mogelijk gegevens, zonder dat we jou benaderen en zonder dat je bedrijf ooit als voorbeeld wordt opgevoerd.

Vind je die afweging niet kloppen voor jouw situatie, dan hoef je dat niet te beargumenteren — je kunt bezwaar maken (AVG artikel 21) en dan halen we je eruit. Zie het blok hieronder.

Dit is geen juridisch advies; het is wat wij doen en waarop wij ons baseren.

Hoe je ons buiten de deur zet.

Er zijn twee manieren. Kies wat je het prettigst vindt; ze werken allebei even goed.

Liever zelf regelen.

Zet dit in het bestand robots.txt op je website (te vinden op jouwdomein.nl/robots.txt):

User-agent: SignumResearchBot
Disallow: /

Wil je ons alleen uit een deel weren, vervang dan / door dat pad. Wil je ons alleen wat rustiger, zet er Crawl-delay: 10 onder — dan wachten we tien seconden tussen twee verzoeken.

Liever dat wij het regelen.

Mail je webadres naar info@signumcore.io met de zin dat je eruit wilt. Je hoeft niets uit te leggen. Wij zetten je op onze eigen uitsluitlijst — dan komen we ook langs een omleiding of een tweede domein niet meer binnen. Die lijst wordt vóór elk bezoek geraadpleegd, nog vóór je robots.txt.

Wil je ook dat we verwijderen wat we al over je hebben opgeslagen? Zeg dat er in dezelfde mail bij, dan doen we dat er handmatig bij.

Wat je van ons kunt verwachten: antwoord binnen twee werkdagen, uitgevoerd binnen zeven dagen, en een bericht als het klaar is.

Ons e-mailadres loopt via ImprovMX, een doorstuurdienst buiten de EU. Wil je ons liever niets mailen, dan is de robots.txt-regel hierboven genoeg — die werkt zonder dat je ons iets hoeft te sturen.

Hoe lang we het houden.

We bewaren per website de metingen die we deden, zodat we kunnen zien of er iets verandert. Vraag je om verwijdering, dan halen we alles over jouw domein eruit — ook de oudere metingen — en krijg je daar bericht van.

De metingen staan in Nederland, op onze eigen apparatuur. Ze gaan niet naar een advertentieplatform en niet naar een dataleverancier.

Eén uitzondering, en die hoort hier te staan:we maken elke nacht een versleutelde reservekopie van onze database en zetten die op GitHub, een Amerikaanse dienst. De inhoud is versleuteld en GitHub kan er niets mee, maar het is wel een kopie buiten Nederland — dus "alles blijft hier" zou onwaar zijn. Om dezelfde reden zijn we voorzichtig met het woord "alles" bij verwijderen: uit de werkende database halen we je gegevens er volledig uit, maar oudere reservekopieën verdwijnen pas als die verlopen. We zeggen je in de bevestigingsmail precies wat er wel en niet weg is.

Wat er niet gebeurt.

We benaderen je niet omdat we je website gemeten hebben. Op het moment dat deze pagina is geschreven is dat nog nooit gebeurd — niet één keer. Als dat ooit verandert, staat het hier vóórdat het gebeurt, niet erna.

We zetten je bedrijf ook nooit als voorbeeld in een publicatie. Wat wij publiceren zijn aantallen: hoeveel van de zoveel bedrijven in een gemeente iets meten, hoeveel er een cookiemelding hebben. Wie precies wat doet blijft binnen.

// EN NU?

Vragen over dit bezoek?

Stuur de regel uit je logboek naar info@signumcore.io. Je krijgt binnen twee werkdagen antwoord van een mens — geen standaardbericht.