Arrow Left Anonimisering, pseudonimisering en overige gegevensbeschermingsmaatregelen

Wanneer zijn gegevens als anoniem te beschouwen?

Gegevens worden beschouwd als anoniem als zij niet, of met onredelijk veel moeite, te herleiden zijn naar individuen. Hoe dit te beoordelen verschilt per dataset en de context daarvan: je kunt nooit zeggen dat de ene set variabelen wel persoonsgegevens zijn, en andere variabelen niet. Het hangt er maar net vanaf wie je doelgroep is, welke variabelen je verzamelt, wanneer en waar, en welke gegevens er nog meer beschikbaar zijn in andere bronnen.  

Om te bepalen of gegevens anoniem zijn – en dus geen persoonsgegevens meer zijn – moeten de gegevens voldoen aan alle onderstaande eisen: 

  • Er zijn geen direct identificerende gegevens. 
  • Deelnemers kunnen niet worden geïsoleerd in de dataset (singling out) doordat zij uniek zijn. Dat kan bijvoorbeeld als een deelnemer een sterk afwijkende waarde heeft voor een bepaalde variabele, bijv. een heel grote lichaamslengte of een heel zeldzame medische aandoening. Een ander voorbeeld vind je hier
  • Deelnemers zijn niet herleidbaar door het combineren van verschillende gegevens binnen én buiten de dataset (record linkage, ook wel het Mozaïek-effect genoemd). Een bekend voorbeeld is een studie die liet zien dat 87% van de Amerikaanse bevolking kon worden geïdentificeerd met een combinatie van hun postcode, geslacht en geboortedatum.
  • Persoonskenmerken zijn niet af te leiden uit andere variabelen in de dataset (inference). Dit kan bijvoorbeeld gebeuren als je naar iemands medicatie vraagt, waaruit hun medische indicatie is af te leiden. 

Bij het bepalen of gegevens anoniem zijn of niet moet je rekening houden met de moeite – bijvoorbeeld de kosten, tijd en technologie - die nodig is om de gegevens te herleiden naar individuen (overweging 26 AVG). Door technologische ontwikkelingen kan het zo zijn dat gegevens die op dit moment als anoniem kunnen worden beschouwd, dit over tien jaar niet meer zijn. Een voorbeeld hiervan is “omics” data. Die werden vroeger in sommige gevallen als anoniem beschouwd, maar nu is erkend dat de hoeveelheid datapunten in dit soort data ervoor zorgt dat de data indirect naar individuen te herleiden zijn. 
 
Voor gezondheidsgegevens geldt dat deze bijna nooit als anoniem kunnen worden beschouwd. Dat komt omdat er vaak veel en/of heel unieke informatie wordt verzameld. Ook zijn er vaak kwetsbare groepen betrokken bij gezondheidsonderzoek, en is medische informatie bij meerdere instellingen bekend. Merk op dat gezondheidsgegevens zelfs onder de bijzondere persoonsgegevens vallen: extra gevoelige persoonsgegevens die extra bescherming genieten. 

Laatst bijgewerkt op 16-10-2023.

Deel deze pagina…