Is het veilig om ChatGPT met vertrouwelijke gegevens te gebruiken?
Niet met ruwe vertrouwelijke gegevens — maar wel als u ze eerst anonimiseert. Alles wat u plakt, wordt naar de servers van de aanbieder verzonden, daar opgeslagen en op consumentenaccounts gebruikt om het model te trainen. Deze gids zet de echte risico’s uiteen aan de hand van concrete incidenten, geeft u een snelle riskant-versus-oké-beslishulp en laat de veilige manier zien om toch hulp van AI bij gevoelige bestanden te krijgen.
Wat er gebeurt wanneer u vertrouwelijke gegevens plakt
Uw tekst wordt naar de aanbieder verzonden en op diens servers opgeslagen, en op consumentenaccounts (Free, Go, Plus, Pro) wordt hij standaard gebruikt om de modellen te trainen. (Bron: OpenAI, geraadpleegd juli 2026.) We leggen precies uit hoe bewaring, training en verwijdering werken in slaat ChatGPT uw gegevens op? — hier is de vraag eenvoudiger: gegeven dat dit zo werkt, is het veilig?
De echte risico’s, op een rij
- Onbedoelde lekken (“schaduw-AI”). Medewerkers plakken vertrouwelijk materiaal in persoonlijke accounts, buiten het zicht van de IT-afdeling.
- Blootstelling via modeltraining. Op consumentenaccounts traint uw tekst standaard het model.
- Datalekken bij de aanbieder en subverwerkers. De aanbieder — of een van diens leveranciers — kan gehackt worden.
- Vindbaarheid en bewaarplichten. Prompts kunnen op rechterlijk bevel worden bewaard en als bewijs worden overgelegd.
- Onbedoelde openbaarmaking. Een verkeerde instelling of gedeelde link kan een gesprek op het open web zetten.
Het is al gebeurd — concrete incidenten
- Samsung (2023). Binnen enkele weken nadat ChatGPT was toegestaan, plakten ingenieurs er vertrouwelijke broncode en interne vergadernotities in; Samsung verbood daarop generatieve AI op bedrijfsapparaten.
- De ChatGPT-bug van maart 2023. Een fout in de redis-py-bibliotheek liet sommige gebruikers de chattitels en eerste berichten van anderen zien, en stelde betaalgegevens bloot — naam, e-mailadres, factuuradres, vervaldatum van de kaart en de laatste vier cijfers (nooit de volledige kaart) — voor 1,2% van de ChatGPT Plus-abonnees die actief waren in een venster van ongeveer 9 uur. (Bron: OpenAI.)
- Gedeelde chats op Google (medio 2025). Een “maak deze chat vindbaar”-schakelaar zorgde ervoor dat gedeelde ChatGPT-gesprekken door zoekmachines werden geïndexeerd; OpenAI schrapte de functie binnen enkele dagen omdat die te riskant was. (Bron: TechCrunch.)
- Het datalek bij subverwerker Mixpanel (nov. 2025). Een datalek bij OpenAI’s analyseleverancier stelde de namen, e-mailadressen, geschatte locatie en organisatie-ID’s van sommige API-klanten bloot — het bewijs dat zelfs de leveranciers van een veilige aanbieder een aanvalsoppervlak vormen. (Bron: OpenAI.)
Dit is niet zeldzaam — de schaduw-AI-cijfers
Incidenteel plakken telt op tot een systemisch lek. Uit een beveiligingsanalyse van 1,6 miljoen werknemers bleek dat ongeveer 11% van wat medewerkers in ChatGPT plakken vertrouwelijk is, en dat minder dan 1% van het personeel 80% van de lekken veroorzaakt. (Bron: Cyberhaven.) Uit een rapport uit 2025 bleek dat 68% van de medewerkers gratis AI via persoonlijke accounts gebruikt, en dat 57% daarbij gevoelige gegevens invoert; (Bron: Menlo Security); uit een ander rapport bleek dat generatieve AI inmiddels het belangrijkste kanaal is voor data-exfiltratie van bedrijf naar privé. (Bron: LayerX.)
Wanneer is het riskant versus relatief oké?
| Wat u wilt invoeren | Oordeel |
|---|---|
| Namen, gegevens van cliënten of patiënten, alle persoonsgegevens | Niet rauw plakken — eerst anonimiseren |
| Bedrijfsgeheimen, broncode, onaangekondigde plannen | Niet plakken |
| Bevoorrechte of gereguleerde gegevens (juridisch, medisch, financieel) | Niet plakken — verhoogde zorgplicht |
| Informatie die al openbaar is | Meestal prima |
| Algemene vragen zonder echte gegevens erin | Prima |
| Een geanonimiseerde kopie met plaatsaanduidingen in plaats van echte waarden | Prima — dit is de veilige manier |
De rijen “eerst anonimiseren / prima” hierboven beschrijven allemaal dezelfde handeling: verwijder de identificatoren lokaal en plak daarna. Dat is precies wat Occlira doet — anonimiseren op uw eigen machine, op de kopie werken en de originelen herstellen zodra u klaar bent.
Stel uzelf drie vragen voordat u plakt:
- Zou een lek hiervan u in verlegenheid brengen of een plicht schenden (jegens een cliënt, patiënt of werkgever)?
- Zou u de taak net zo goed op een geanonimiseerde versie kunnen uitvoeren?
- Zit u op een consumentenaccount (dat standaard voor training wordt gebruikt) of op een zakelijke laag?
Maakt een zakelijke laag het veilig?
Het helpt tegen één risico: Business, Enterprise, Edu en de API worden standaard niet gebruikt voor training en gaan gepaard met een verwerkersovereenkomst — zie de volledige uitsplitsing van de lagen in slaat ChatGPT uw gegevens op? Maar de gegevens verlaten nog altijd uw apparaat en kunnen nog steeds uitlekken bij een datalek van een subverwerker, en een verwerkersovereenkomst maakt de verwerking op zichzelf nog niet rechtmatig — dat komt aan bod in AI gebruiken zonder de AVG te schenden. Een zakelijke laag verkleint het risico; het neemt het niet weg.
De veilige werkwijze
De regel is dataminimalisatie — verstuur niet wat de taak niet nodig heeft:
- Anonimiseer of verwijder de vertrouwelijke delen voordat er iets wordt verzonden.
- Laat de AI-tool op de geanonimiseerde kopie werken.
- Kies bij voorkeur een laag zonder training, en plak nooit inloggegevens of gereguleerde gegevens.
- Houd een mens in de lus en controleer de uitkomst voordat u erop vertrouwt.
Hoe Occlira het veilig maakt
Occlira is die eerste stap. Het detecteert en verwijdert persoonsgegevens uit documenten, spreadsheets, e-mail, audio en afbeeldingen op uw eigen computer — geen cloud, geen account. U anonimiseert een bestand lokaal, laat een AI-tool op de geanonimiseerde kopie werken en herstelt daarna de echte waarden op uw computer. Dat neutraliseert elk risico hierboven: er is niets gevoeligs meer om per ongeluk te plakken, om op te trainen, om te lekken bij een datalek of om te dagvaarden.
Eén eerlijke kanttekening: de anonimisering van Occlira is omkeerbaar, wat in AVG-termen pseudonimisering heet — sterke lokale minimalisatie, maar de koppeling (die op uw apparaat blijft) is nog steeds een persoonsgegeven, dus beschouw het als een beheersmaatregel en niet als een maas in de wet. De stap-voor- stapuitleg vindt u in anonimiseren vóór ChatGPT.
Veelgestelde vragen
Niet in ruwe vorm. Alles wat u plakt, wordt naar de aanbieder verzonden en daar opgeslagen, en op consumentenaccounts wordt het standaard gebruikt om het model te trainen — bovendien kan het bij een datalek uitlekken of op rechterlijk bevel bewaard blijven. Het is wél veilig als u de vertrouwelijke delen eerst anonimiseert en de AI op de versie met plaatsaanduidingen laat werken.
Ja. Een bug van maart 2023 stelde kortstondig de chattitels en betaalgegevens van sommige gebruikers bloot; in november 2025 legde een datalek bij OpenAI’s analyseleverancier Mixpanel de contactgegevens van sommige API-klanten bloot; en medio 2025 zorgde een “maak vindbaar”-schakelaar ervoor dat gedeelde chats door Google werden geïndexeerd voordat OpenAI de functie schrapte. Elk voorbeeld laat zien dat de gegevens buiten uw controle raken zodra ze zijn verzonden.
In 2023, binnen enkele weken nadat het gebruik was toegestaan, plakten ingenieurs van Samsung vertrouwelijke broncode en interne vergadernotities in ChatGPT. Samsung reageerde met een verbod op generatieve-AI-tools op bedrijfsapparaten — hét schoolvoorbeeld van “schaduw-AI”.
Normaal gesproken niet — maar het is voorgekomen. De bug van 2023 toonde de chattitels van andere gebruikers, en gedeelde links werden kortstondig door zoekmachines geïndexeerd. Vaker gebeurt het dat medewerkers die gemarkeerde inhoud beoordelen — en in rechtszaken de tegenpartij — gesprekken te zien krijgen. Ga ervan uit dat alles wat u plakt buiten uw controle raakt.
Het beperkt één risico: Business, Enterprise, Edu en de API worden standaard niet gebruikt voor training en gaan gepaard met een verwerkersovereenkomst. Maar de gegevens verlaten nog steeds uw apparaat en kunnen nog altijd uitlekken bij een datalek van een subverwerker — zoals het Mixpanel-incident liet zien. Het verkleint het risico; het neemt het niet weg.
Schaduw-AI is het gebruik van persoonlijke AI-accounts voor werk, buiten het zicht en de controle van de IT-afdeling. Het is wijdverbreid — uit rapporten blijkt dat het meeste AI-gebruik via persoonlijke accounts verloopt en dat een groot deel daarvan gevoelige gegevens bevat — en daardoor telt incidenteel plakken op tot een systemisch lek.
Persoonsgegevens van cliënten of patiënten, bedrijfsgeheimen en broncode, bevoorrecht of gereguleerd materiaal, inloggegevens, en alles waarvan blootstelling een plicht zou schenden of u in verlegenheid zou brengen. Hebt u bij zo’n document hulp van AI nodig, anonimiseer het dan eerst.
Verwijder de vertrouwelijke delen voordat er iets wordt verzonden: anonimiseer het bestand lokaal met Occlira, laat een AI-tool op de geanonimiseerde kopie werken en herstel daarna de echte waarden op uw eigen computer. Er blijft dan niets gevoeligs over om te lekken, om op te trainen of om te dagvaarden.
Gebruik AI veilig op gevoelige bestanden
Anonimiseer lokaal en gebruik daarna een willekeurige AI-tool op de kopie. 14 dagen gratis op Windows en macOS.
Meer: wat zijn persoonsgegevens? · voor advocatenkantoren · redigeren in Word, PDF & Excel · hoe uw gegevens worden verwerkt