Terug naar alle artikelen

DSGVO Web Scraping volgens de Duitse wetgeving

Wat de Duitse privacy-, databank-, concurrentie- en toegangsregels betekenen voor verantwoord Managed Web Scraping.

DSGVO Web Scraping volgens de Duitse wetgeving

Web scraping mag ook in Duitsland ingezet worden door bedrijven om data te verzamelen. Dat betekent niet dat alles wat online staat automatisch mag worden verzameld. Het maakt juridisch veel uit of een web scraper productprijzen bijhoudt of persoonlijke LinkedIn-profielen opslaat. Ook de manier waarop de data wordt verkregen telt mee. Een openbare productpagina bezoeken is iets anders dan een login, CAPTCHA of IP-blokkade omzeilen.

Wie openbare, niet-persoonsgebonden data verzamelt en technische grenzen respecteert, kan webscraping in Duitsland verantwoord inzetten als middel om concurrenten te volgen of om meer markt inzicht te krijgen. Hiervoor is het wel nodig dat de bronnen, datavelden en verzamelmethoden vooraf duidelijk zijn en tijdens het project worden bewaakt. Ook moet er niet meer worden gescraped dan nodig is.

Openbare toegankelijkheid

Een belangrijk uitgangspunt is dat de bron openbaar moet zijn. De data moet zonder account, abonnement of technische truc kunnen worden bekeken. Ook gebruiksvoorwaarden, robots.txt-instructies en machineleesbare gebruiksvoorbehouden kunnen relevant zijn.

Een productpagina laat dat verschil goed zien. De prijs, voorraadstatus en productspecificaties zijn doorgaans zakelijke data. Op dezelfde pagina kunnen ook klantreviews staan. Bij Managed web scraping nemen we niet alles mee wat technisch beschikbaar is. Alleen de afgesproken datavelden worden verwerkt.

Is de data persoonsgebonden?

Ons datamodel is bewust gericht op zakelijke informatie:

DatatypePersoonsgebonden?Wat wij doen
ProductprijzenNeeVerzamelen wij wel
BedrijfsomschrijvingenDoorgaans nietVerzamelen wij wel
LinkedIn-profielenJaVerzamelen wij niet
E-mailadressenVaak welVerzamelen wij niet

Productprijzen, assortimenten, beschikbaarheid en technische productkenmerken zijn normaal gesproken niet aan een natuurlijke persoon gekoppeld. Deze data kan worden gebruikt voor prijsmonitoring, marktonderzoek en Business Intelligence.

LinkedIn-profielen en e-mailadressen sluiten wij uit. Een openbaar profiel blijft persoonsgebonden, ook als het zonder login zichtbaar is. Hetzelfde geldt vaak voor zakelijke e-mailadressen waarin de volledige naam van een medewerker staat.

Door zulke bronnen en datavelden vanaf het begin uit te sluiten, voorkomen we dat persoonsdata ongemerkt in een grotere dataset terechtkomt.

Een verantwoorde verzamelmethode

Een juridisch zorgvuldige aanpak moet ook technisch netjes zijn. De scraper wordt zo geconfigureerd dat alleen de data die voor het afgesproken doel nodig is wordt verzameld. De scraping wordt daarnaast ethisch ingesteld zodat de target server geen last heeft van het scrapen. In de WSA Bot manager is vastgelegd welke bronnen worden gebruikt en welke datavelden worden opgeslagen. Er wordt niet meer gescraped dan nodig is.

Managed Web Scraping als gecontroleerde geautomatiseerde dataservice

Managed Web Scraping brengt het verzamelen, controleren, monitoren, onderhouden en leveren van data samen. Onze grens is duidelijk: we verzamelen openbare product- en bedrijfsdata. Zo kunnen Duitse bedrijven webdata gebruiken voor prijsanalyses, marktmonitoring en strategische beslissingen, zonder ongemerkt een database met persoonsdata op te bouwen.

Klaar om te starten?

Welke data brengt jou verder?

Vertel ons welke inzichten je met webscraping wilt verkrijgen. Binnen één werkdag nemen we contact op om de mogelijkheden te bespreken.

Bespreek je datavraag