Een document anonimiseren lijkt eenvoudig: gevoelige informatie selecteren, er een zwarte balk overheen plaatsen en het bestand publiceren. Maar wat voor het oog verdwenen is, hoeft technisch nog niet uit een document verwijderd te zijn. Namen, adressen, BSN’s of andere vertrouwelijke gegevens kunnen daardoor soms alsnog worden achterhaald.
Hoe actueel dit risico is, blijkt uit recent onderzoek van NOS en Nieuwsuur. Zij troffen in openbare gemeentelijke documenten onder meer e-mailadressen, telefoonnummers, adressen, identiteitsbewijsnummers en BSN’s aan. Ook het NOS Journaal besteedde aandacht aan het onderwerp.
Het probleem zit niet alleen in persoonsgegevens die bij het anonimiseren over het hoofd worden gezien. Ook informatie die wél is gelakt, kan soms technisch nog aanwezig zijn. Een zwarte balk is daarom niet automatisch voldoende. Gevoelige informatie moet onomkeerbaar uit de te publiceren versie van een document worden verwijderd.
Een zwarte balk maakt informatie niet altijd onleesbaar
Wanneer een zwarte vorm of markering over tekst wordt geplaatst, kan de oorspronkelijke informatie in het document aanwezig blijven. De tekst is dan niet meer zichtbaar, maar kan in sommige gevallen nog worden geselecteerd, gekopieerd of doorzocht.
Ook gescande documenten kunnen verborgen informatie bevatten. Zo kan achter een scan een OCR-tekstlaag aanwezig zijn waarmee het document doorzoekbaar wordt gemaakt. Daarnaast kunnen privacygevoelige gegevens verborgen zijn in metadata, bijvoorbeeld in bestandsnamen, documenttitels of auteursgegevens. Wanneer deze informatie vóór publicatie niet wordt gecontroleerd en waar nodig verwijderd, kunnen persoonsgegevens alsnog onbedoeld openbaar worden gemaakt en kan er sprake zijn van een datalek.
Alleen visueel controleren of persoonsgegevens achter een zwarte balk staan, biedt daarom onvoldoende zekerheid.
Wat is onomkeerbaar anonimiseren?
Bij onomkeerbaar anonimiseren worden persoonsgegevens en andere gevoelige gegevens daadwerkelijk uit de publicatieversie van een document verwijderd. De informatie is daarna niet meer zichtbaar, selecteerbaar, kopieerbaar, doorzoekbaar of technisch uit het gepubliceerde bestand terug te halen.
Daarbij gaat het niet alleen om de zichtbare inhoud van een document. Ook onderliggende tekstlagen en andere verborgen informatie moeten worden meegenomen.
Dat is belangrijk voor overheidsorganisaties die documenten openbaar maken of verstrekken. Denk bijvoorbeeld aan Woo-verzoeken, actieve openbaarmaking, AVG-inzageverzoeken, vergunningstukken, juridische dossiers en andere documenten waarin persoonsgegevens of vertrouwelijke informatie voorkomen.
De risico’s van onjuist anonimiseren
Wanneer gevoelige informatie niet goed wordt verwijderd, kunnen persoonsgegevens onbedoeld openbaar worden. Afhankelijk van de omstandigheden kan dat een datalek opleveren.
Voor betrokken personen kunnen de gevolgen groot zijn. Zeker bij gevoelige gegevens zoals BSN’s, identiteitsbewijsnummers, handtekeningen, financiële gegevens of medische informatie. Maar ook een combinatie van bijvoorbeeld naam, adres, functie of andere gegevens kan iemand herkenbaar maken.
Voor organisaties kan een fout leiden tot herstelwerk, reputatieschade en verlies van vertrouwen. Zorgvuldig anonimiseren gaat daarom verder dan alleen voldoen aan wet- en regelgeving. Het is ook onderdeel van zorgvuldig en betrouwbaar openbaar maken.
Onomkeerbaar anonimiseren bij Woo-verzoeken
Bij de uitvoering van de Wet open overheid draait alles om een zorgvuldige balans tussen openbaarheid en het beschermen van informatie die niet openbaar mag worden.
Dat kan bij omvangrijke Woo-dossiers een flinke uitdaging zijn. Dossiers bestaan vaak uit grote aantallen e-mails, brieven, rapporten, spreadsheets en scans. Per document en soms per passage moet worden beoordeeld welke informatie openbaar kan worden gemaakt en welke informatie moet worden gelakt.
Juist bij zulke hoeveelheden documenten is een gecontroleerd en consistent anonimiseringsproces belangrijk. Niet alleen om sneller te kunnen werken, maar vooral om te voorkomen dat gevoelige informatie onbedoeld wordt gepubliceerd.
Hoe ondersteunt eData bij onomkeerbaar anonimiseren?
eData helpt organisaties om gevoelige informatie sneller te herkennen, zorgvuldig te beoordelen en vervolgens onomkeerbaar uit de publicatieversie te verwijderen.
AI ondersteunt daarbij de eerste beoordeling. De software kan persoonsgegevens en andere mogelijk vertrouwelijke informatie signaleren, zoals namen, adressen, contactgegevens, BSN’s en documentnummers. Hierdoor hoeft een medewerker niet iedere passage volledig handmatig te doorzoeken.
De uiteindelijke beoordeling blijft echter bij de gebruiker. De medewerker bepaalt welke informatie daadwerkelijk moet worden gelakt en kan voorstellen accepteren, aanpassen of afwijzen. AI ondersteunt het proces, maar neemt de inhoudelijke en juridische afweging niet over.
Na de beoordeling verwerkt eData de goedgekeurde lakkeuzes in een veilige publicatieversie. De betreffende informatie wordt niet alleen visueel afgedekt, maar onomkeerbaar verwijderd. De gelakte gegevens zijn daardoor niet meer te selecteren, kopiëren, doorzoeken of technisch uit het publicatiebestand terug te halen.
Zo combineert eData automatisering met menselijke controle en helpt het overheidsorganisaties om documenten sneller, consistenter en zorgvuldiger openbaar te maken.
Anonimiseren moet definitief zijn
Een document dat er veilig uitziet, is niet automatisch technisch veilig. Dat is misschien wel de belangrijkste les uit de recente berichtgeving. Een zwarte balk kan informatie voor het oog verbergen, terwijl de oorspronkelijke gegevens nog steeds in het bestand aanwezig zijn.
Onomkeerbaar anonimiseren voorkomt dat gevoelige informatie na publicatie alsnog kan worden teruggevonden. Zeker voor overheidsorganisaties die steeds meer documenten actief of op verzoek openbaar maken, is dat een essentieel onderdeel van een zorgvuldig openbaarmakingsproces.
Met eData Anonimiseren worden AI-ondersteuning, menselijke controle en onomkeerbare verwijdering gecombineerd in één proces.
Wil je weten hoe eData jouw organisatie kan ondersteunen bij het veilig en efficiënt anonimiseren van documenten? Vraag een vrijblijvende demo aan.
Meer weten?
Benieuwd hoe jouw organisatie actieve openbaarmaking efficiënter en beheersbaarder kan organiseren? Bekijk eData Publiceren of plan een demo.
Recente blogposts
Kennisbank:
In onze kennisbank staan meerdere gerelateerde blogs en Whitepapers. Hieronder alvast een selectie:
- Blog: Hoe verzamel je Woo-documenten sneller en completer?
- Blog: Wat betekent anonimiseren in het kader van de Woo?
- Blog: Waarom zijn koppelingen cruciaal binnen het Woo-proces?
- Blog: Waarom actieve openbaarmaking bij overheidsorganisaties vastloopt
- Whitepaper: Woo-proof anonimiseren
- Whitepaper: In 6 stappen wél voldoen aan de Woo





