Documenten anonimiseren voordat u ze in ChatGPT plakt
De veiligste manier om AI op een gevoelig bestand toe te passen, is om eerst de persoonsgegevens te verwijderen, de AI op een geanonimiseerde kopie te laten werken en de echte waarden daarna te herstellen — allemaal op uw eigen computer. Occlira doet precies dat voor documenten, spreadsheets, e-mail en audio, zodat er nooit iets privés uw machine verlaat.
Waarom onbewerkte gegevens plakken riskanter is dan het lijkt
Het voelt onschuldig — u kopieert een alinea uit een contract of een patiëntennotitie naar een chatvenster om snel een concept te krijgen. Maar die tekst gaat naar de servers van de aanbieder, en daar blijft het niet altijd bij. Een beveiligingsanalyse van Cyberhaven wees uit dat ongeveer 11% van alles wat medewerkers in ChatGPT plakken, uit vertrouwelijke bedrijfsgegevens bestaat, en het aandeel gevoelig materiaal dat naar AI-tools stroomt, neemt fors toe naarmate het gebruik toeneemt. (Bron: Cyberhaven Labs.)
Dit is niet hypothetisch. Binnen ongeveer drie weken nadat ChatGPT was toegestaan, lekten Samsung-ingenieurs bij drie afzonderlijke gelegenheden vertrouwelijk materiaal — broncode van halfgeleiders, routines voor defectdetectie en een intern vergaderverslag — dat ze inplakten om bugs op te lossen en notulen op te stellen. Het bedrijf verbood generatieve AI kort daarna op zijn apparaten. (Bron: Forbes.)
Drie misverstanden over ChatGPT en privacy
De geruststellingen waar mensen op vertrouwen, houden minder goed stand dan ze denken:
- „Ik verwijder de chat gewoon.” Verwijderen is een verzoek, geen garantie. In mei 2025 beval een Amerikaanse rechtbank OpenAI om ChatGPT-logs te bewaren — inclusief chats die gebruikers al hadden verwijderd — als bewijs in de zaak van The New York Times. Het bevel werd later beperkt, maar de les blijft overeind: zodra uw tekst op de server van iemand anders staat, bepaalt u niet langer wanneer hij verdwijnt. (Bron: OpenAI.)
- „Het is alleen voor mij, het wordt nergens voor getraind.” Bij Free-, Plus- en Pro-accounts staat modeltraining standaard aan — u moet „Improve the model for everyone” in Data Controls zelf uitzetten. En het meeste ChatGPT-gebruik op de werkvloer loopt nu juist via deze persoonlijke accounts. (Bron: OpenAI Help Center.)
- „We hebben een zakelijke overeenkomst getekend, dus we zijn gedekt.” Een enterprise-abonnement of een verwerkersovereenkomst beperkt het risico, maar de persoonsgegevens raken alsnog buiten uw controle en belanden op de infrastructuur van een derde partij — onderworpen aan diens beveiliging, diens subverwerkers en bevelen zoals hierboven. Voor iedereen die gebonden is aan een beroepsgeheim, is dat een heel ander risico dan de gegevens op uw eigen machine houden.
Elk van deze punten wijst naar dezelfde oplossing: verstuur de persoonsgegevens om te beginnen niet — en dat is precies wat de werkwijze van Occlira doet: anonimiseren → AI gebruiken → herstellen, op uw eigen machine. Lees meer in slaat ChatGPT uw gegevens op?
De veilige werkwijze: anonimiseren → AI gebruiken → herstellen
- Open uw bestand in Occlira. Sleep het document, de spreadsheet, de e-mail of de audio-opname die u naar een AI-tool wilde sturen, gewoon naar binnen. Er wordt niets geüpload — de detectie draait op uw eigen machine, dus het bestand verlaat uw computer niet eens om gescand te worden.
- Bekijk wat er verwijderd wordt. Occlira markeert elke naam, elk e-mailadres, elk telefoonnummer, elk ID, elk financieel gegeven en meer. In een snelle controlestap behoudt of verwijdert u elk item, en u kunt zelf tekst selecteren die de detector heeft gemist en die alsnog markeren. Zo houdt u precies in de hand wat er vervangen wordt.
- Anonimiseer. Echte waarden worden vervangen door consistente, neutrale plaatsaanduidingen — <PERSON_1>, <IBAN_1>, <DATE_1>. Doordat dezelfde persoon overal dezelfde tag houdt, blijft de tekst goed leesbaar. De koppeling tussen elke plaatsaanduiding en de oorspronkelijke waarde wordt lokaal opgeslagen, zodat de wijziging omkeerbaar is.
- Gebruik de AI-tool. Plak of upload de geanonimiseerde versie in ChatGPT, Claude, Gemini of Copilot en doe uw werk. Het model redeneert net zo goed over de plaatsaanduidingen als over echte namen, dus u krijgt een bruikbaar antwoord — een concept, een samenvatting, een analyse — zonder dat de persoonsgegevens ooit bij de aanbieder terechtkomen.
- Herstel de originelen. Zet de AI-uitvoer terug in Occlira en herstel de echte waarden vanuit uw lokale koppeling, zodat uw afgeronde document compleet en accuraat is. Het herstellen gebeurt volledig op uw eigen apparaat.
Wat u moet anonimiseren voordat u plakt — een korte checklist
Het doel is om alles te verwijderen wat een persoon identificeert, rechtstreeks of in combinatie. Loop deze lijst door — hij komt overeen met de categorieën die Occlira automatisch herkent (40+ typen in totaal):
- Namen van personen — cliënten, patiënten, werknemers, tegenpartijen, getuigen
- Contactgegevens — e-mailadressen, telefoonnummers, postadressen
- Overheids- en nationale ID’s — BSN, NINO, paspoort, fiscaal nummer, Codice Fiscale, DNI, INSEE
- Financiële identificatiegegevens — IBAN’s, reken- en kaartnummers, salarisbedragen
- Gezondheidsgegevens — diagnoses, medische dossiernummers, alles wat een aandoening onthult
- Datums die naar een persoon te herleiden zijn — geboortedatums, opname- of zittingsdata
- Zaak-, dossier-, factuur- en referentienummers die naar een echt dossier verwijzen
- Quasi-identificatoren — een zeldzame functietitel plus een stad, of elk detail dat op zichzelf uniek genoeg is om iemand opnieuw herkenbaar te maken
Wat Occlira verwijdert
Namen, e-mailadressen, telefoonnummers, postadressen, IBAN’s en kaartnummers, nationale ID’s (BSN, NINO, btw, paspoorten en meer), geboortedatums, IP-adressen en medische dossiernummers — in Word, PDF, Excel, e-mail en platte tekst, en daarnaast audio-opnames. De detectie draait lokaal met een AI-model, ondersteund door nauwkeurige patroonregels, en u bevestigt elk item in de controlestap, zodat er niets wordt verwijderd — of over het hoofd gezien — zonder uw toestemming.
Is anonimiseren voldoende om compliant te blijven?
Het neemt het lastigste deel van het probleem weg. Wanneer u de geanonimiseerde versie plakt, bereiken er geen identificatiegegevens de aanbieder — dus er zijn geen persoonsgegevens die een derde partij kan opslaan, waarop ze kan trainen of die ze gedwongen kan worden af te staan. Dat is het beginsel van dataminimalisatie dat toezichthouders van u verwachten voordat u een externe tool inzet. Gebruik AI zonder de AVG te overtreden gaat dieper in op de praktische aanpak.
Twee eerlijke kanttekeningen. Ten eerste is de koppeling waarmee u de originelen kunt herstellen zelf ook een persoonsgegeven — maar die blijft op uw apparaat, zodat uw verwerking minimaal blijft en onder uw eigen controle, in plaats van verspreid over de cloud van een leverancier. Ten tweede leggen EU-toezichthouders de lat hoog voordat iets echt „anoniem” mag heten: de EDPB benadrukt in Advies 28/2024 dat dit per geval moet worden beoordeeld. Identificatiegegevens verwijderen voordat u deelt, is één sterke maatregel — geen vervanging voor de volledige verplichtingen van uw organisatie.
Omkeerbaar van opzet: pseudonimisering, geen black box
Doordat Occlira een lokale koppeling bijhoudt, is de anonimisering omkeerbaar — in
AVG-termen heet dat pseudonimisering. Dat is het praktische voordeel: de plaatsaanduidingen zijn consistent
(dezelfde persoon is overal <PERSON_1>), zodat het antwoord van de AI nog steeds aansluit op uw
echte gegevens wanneer u ze herstelt. U profiteert van het werken met het echte document, zonder dat het echte
document ooit wordt prijsgegeven.
Werkt het met Claude, Gemini en Copilot?
Ja. De aanpak staat los van de gebruikte tool. Occlira maakt een geanonimiseerde kopie die u met elke AI-assistent kunt gebruiken; doordat de plaatsaanduidingen consistent zijn, krijgt u nog steeds een bruikbaar antwoord, en herstelt u de echte waarden op uw eigen machine wanneer u klaar bent.
Veelgestelde vragen
Ga ervan uit dat alles wat u in een cloud-AI-tool plakt, buiten uw controle raakt. Bij persoonlijke accounts kunnen uw chats worden gebruikt om het model te trainen, tenzij u zich afmeldt, en een Amerikaans gerechtelijk bevel uit 2025 toonde aan dat zelfs verwijderde chats bewaard kunnen blijven. De veilige werkwijze is om de persoonsgegevens eerst te verwijderen, de AI op de versie met plaatsaanduidingen te laten werken en de echte waarden achteraf op uw eigen machine te herstellen.
Nee. Modellen werken prima met consistente plaatsaanduidingen zoals <PERSON_1> of <IBAN_1> — dezelfde entiteit houdt dezelfde tag, dus de tekst blijft samenhangend. U krijgt een bruikbaar concept, een samenvatting of een analyse en herstelt daarna de echte waarden lokaal, zodat het uiteindelijke document compleet is.
Niet aan de hand van de plaatsaanduidingen alleen — een tag zoals <PERSON_1> bevat geen persoonsgegevens, en de koppeling met de echte naam verlaat uw computer nooit. Zorg er alleen voor dat u geen overduidelijk identificerende context laat staan (bijvoorbeeld een unieke combinatie van functietitel en locatie) die een lezer zonder die koppeling zou kunnen herleiden.
Bij Free-, Plus- en Pro-accounts staat modeltraining standaard aan — u moet „Improve the model for everyone” in Data Controls uitzetten om dat te stoppen. Temporary Chat en de zakelijke producten (Team, Enterprise, de API) worden niet voor training gebruikt. Maar de schoonste bescherming is om de persoonsgegevens simpelweg helemaal niet te versturen.
Niet per se. In mei 2025 beval een Amerikaanse rechtbank OpenAI om ChatGPT-logs te bewaren — inclusief chats die gebruikers hadden verwijderd — als bewijs in de zaak van The New York Times. De reikwijdte werd later beperkt, maar het is een treffende herinnering dat zodra uw tekst op de servers van een ander bedrijf staat, „verwijderen” een verzoek is en geen garantie.
Het neemt het lastigste deel van het probleem weg: als er geen namen, ID’s of andere identificatiegegevens worden verstuurd, zijn er ook geen persoonsgegevens die een derde partij kan opslaan, waarop ze kan trainen of die ze gedwongen kan worden vrij te geven — en dat is precies het beginsel van dataminimalisatie dat toezichthouders verwachten. De lokale koppeling is zelf ook een persoonsgegeven, maar die blijft op uw apparaat — dus u houdt de verwerking minimaal en onder uw eigen controle. Het is één sterke maatregel, geen vervanging voor de volledige nalevingsverplichtingen van uw organisatie.
Ja. De werkwijze staat los van de gebruikte tool: Occlira maakt een geanonimiseerd bestand dat u met elke AI-assistent kunt gebruiken; daarna herstelt u de originelen lokaal.
Hetzelfde principe geldt, en het is dan zelfs nog belangrijker: bestanden bevatten naast de zichtbare tekst ook verborgen metadata, bijgehouden wijzigingen en opmerkingen. Occlira anonimiseert het document zelf — inclusief die verborgen gegevens — zodat niet alleen het zichtbare deel schoon is, maar de hele kopie die u uploadt.
Nergens naartoe. De detectie, de anonimisering, de koppeling van plaatsaanduidingen en het herstellen draaien allemaal op uw eigen computer. Uw bestanden en de persoonsgegevens daarin komen nooit bij ons of bij een clouddienst terecht.
Houd gevoelige bestanden privé bij AI
Eén keer anonimiseren, met elke AI-tool werken, lokaal herstellen. 14 dagen gratis op Windows en macOS.
Meer: persoonsgegevens uit audio verwijderen · lokale versus cloudmatige PII-afscherming · voor advocatenkantoren · hoe uw gegevens worden behandeld