AI en privacy
Waar staat je data als je AI gebruikt? Dataresidentie uitgelegd
Dataresidentie is het land of gebied waar je gegevens worden opgeslagen en verwerkt. Bij een AI-dienst staat je data zelden op één plek: je loopt apart na waar de invoer, de logboeken, de back-ups en de beheertoegang terechtkomen.
Dataresidentie is het land of gebied waar je gegevens fysiek worden opgeslagen en verwerkt. Bij een AI-dienst staat je data zelden op één plek: je invoer gaat naar de server die het model draait, er blijft een logboek achter, er worden back-ups gemaakt en er zijn beheerders die erbij kunnen. Wie wil weten waar zijn data staat, loopt die vier lagen apart na, want ze kunnen alle vier in een ander land liggen.
Dit is algemene uitleg en geen juridisch advies. Voor je eigen situatie hoort een jurist of privacyfunctionaris mee te kijken, zeker als je met bijzondere persoonsgegevens werkt.
Wat is het verschil tussen dataresidentie, datasoevereiniteit en toegang?
Dataresidentie gaat over de plek, datasoevereiniteit over het recht dat op die plek geldt, en toegang over wie er feitelijk bij kan. Die drie vallen niet samen, en de meeste misverstanden komen daaruit voort.
Een voorbeeld dat vaak voorkomt bij een installatiebedrijf dat een AI-dienst afneemt. De leverancier zegt: onze servers staan in Frankfurt. Dat is dataresidentie. Maar het moederbedrijf valt onder Amerikaans recht, dus er kan een bevel komen dat gegevens opvraagt die in Frankfurt staan. Dat is datasoevereiniteit. En het supportteam dat bij storingen in je omgeving kijkt, zit in India. Dat is toegang. Alle drie zijn relevant, en alleen de eerste staat meestal in de brochure.
Voor de AVG is de plek op zichzelf niet het doorslaggevende punt. Wat telt, is of persoonsgegevens beschikbaar komen voor een partij buiten de Europese Economische Ruimte. Dat kan gebeuren door opslag, maar net zo goed door iemand die op afstand meekijkt.
Welke plekken moet je nalopen bij een AI-dienst?
Er zijn vijf lagen waar je data terecht kan komen, en ze hebben elk hun eigen locatie en eigen bewaartermijn.
| Laag | Wat het is | Waar je het antwoord vindt |
|---|---|---|
| Invoer en antwoord | De mail, de pdf of de vraag die je aan het model geeft, en wat eruit komt | De regio-instelling van de dienst en de documentatie over de verwerkingslocatie |
| Logboeken | Wat er is opgevraagd, door wie en wanneer, vaak inclusief de tekst zelf | De verwerkersovereenkomst: bewaartermijn en locatie van logging |
| Modeltraining | Of je invoer wordt gebruikt om het model te verbeteren | Een uitdrukkelijke trainingsclausule, niet een instelling in een scherm |
| Back-ups | Kopieën van de gegevens, meestal op een andere plek dan het origineel | De subverwerkerslijst en de back-upafspraken |
| Beheer en support | De mensen en systemen die in je omgeving kunnen kijken | De subverwerkerslijst en het beleid voor toegang op afstand |
De laag die in de praktijk het vaakst wordt vergeten, zijn de logboeken. Een verkooporganisatie die offerteaanvragen door een AI-dienst laat samenvatten, denkt vaak dat de tekst na het antwoord verdwenen is. Bij veel diensten blijft hij een tijd staan voor misbruikcontrole, en soms langer als een medewerker van de aanbieder hem markeert voor beoordeling. Hoe lang precies, staat in de voorwaarden van die dienst. Je moet het wel weten voordat je er klantnamen en adressen in zet.
Hoe kom je erachter waar je data staat?
Je vraagt het schriftelijk op, in deze volgorde, en je bewaart de antwoorden.
- Vraag de verwerkersovereenkomst op, niet de algemene voorwaarden. Daarin hoort te staan waar wordt verwerkt en onder welke voorwaarden er buiten de Europese Economische Ruimte gegaan wordt. Waar je verder op let bij zo’n overeenkomst, staat in verwerkersovereenkomst met een AI-leverancier.
- Vraag de lijst met subverwerkers. Daar staan de hostingpartij, de modelaanbieder, de back-uppartij en soms de supportpartij op, met het land erbij. Een leverancier die deze lijst niet heeft, heeft zijn eigen keten niet in beeld.
- Vraag vanuit welke landen beheer en support werken. Dit staat zelden op papier en is bijna altijd relevant.
- Kijk wat je zelf kunt instellen. Sommige diensten laten je een verwerkingsregio kiezen. Ga na of die keuze ook geldt voor logboeken en back-ups, want dat is regelmatig niet zo.
- Leg het vast in je verwerkingsregister. Per AI-dienst: welke gegevens, welk doel, welke locatie, welke bewaartermijn, welke grondslag voor doorgifte. Dat register is het document waar een klant of een accountant naar vraagt.
Stel die vragen per e-mail en niet in een gesprek. Een antwoord dat je kunt laten zien, is meer waard dan een geruststelling die je hebt gehoord.
Mag je data buiten de Europese Economische Ruimte staan?
Dat mag, maar alleen met een geldige grondslag voor doorgifte. De AVG staat toe dat gegevens naar een land buiten de Europese Economische Ruimte gaan als de Europese Commissie voor dat land een adequaatheidsbesluit heeft genomen, of als er passende waarborgen zijn, zoals de standaardcontractbepalingen van de Commissie.
Voor de Verenigde Staten geldt het adequaatheidsbesluit over het EU-US Data Privacy Framework van 10 juli 2023. Dat besluit werkt alleen voor Amerikaanse organisaties die zich voor dat kader hebben aangemeld en op de bijbehorende lijst staan. Het is dus geen algemene vrijbrief: je gaat na of jouw specifieke aanbieder eronder valt, of dat hij met standaardcontractbepalingen werkt.
Wat dit lastig maakt voor een planning op langere termijn, is dat eerdere regelingen voor doorgifte naar de Verenigde Staten door het Hof van Justitie van de Europese Unie ongeldig zijn verklaard. Een bedrijf dat zijn hele offerte- en factuurstroom op zo’n doorgifte bouwt, bouwt op een grond die kan verschuiven. Dat hoeft geen reden te zijn om het niet te doen, maar het is wel een reden om te weten hoe je eruit zou stappen.
Wat verandert er als het AI-systeem in je eigen pand staat?
Dan is de vraag naar dataresidentie te beantwoorden met een aanwijzing: het apparaat in de meterkast of de serverruimte. Alle klantdata blijft daarop staan.
Zo werkt het bij ons. Bij de klant staat één apparaat van mini-pc-formaat op kantoor. Daarop draait in Docker een lokaal taalmodel, een documentindex in PostgreSQL, een automatiseringslaag en een webinterface voor medewerkers. De inhoudelijke verwerking gebeurt op dat apparaat. In onze verwerkersovereenkomst staat dat er geen doorgifte buiten de Europese Economische Ruimte plaatsvindt tenzij dat in het aanhangsel vermeld staat en er een geldige grondslag voor is, en dat subverwerkers bij de lokale AI-omgeving alleen betrokken zijn bij beheer, bewaking en back-up.
Twee dingen zijn daarbij het nakijken waard, ook bij ons.
Het eerste is het inkomende verkeer. Vanaf internet zijn er geen inkomende poorten naar het apparaat; het is van buitenaf onbereikbaar. Dat is de standaardinrichting, tenzij we met jou iets anders afspreken. Wel is er uitgaand verkeer: HTTPS naar Microsoft voor mail en bestanden, en onze beheerverbinding. Dat uitgaande verkeer is de plek waar je moet kijken, niet de binnenkant.
Het tweede is de aanvoer. De koppeling met Microsoft 365 is standaard strikt alleen-lezen, met de machtigingen Mail.Read en Files.Read, via een app-registratie die je zelf ziet en zelf kunt intrekken in je eigen Entra-beheer. Wil je er iets anders mee, dan spreken we dat met je af; het is de standaardinrichting en geen wet. Intrekken stopt de aanvoer direct. Dat is een concrete vorm van regie: je hebt geen supportticket nodig om de kraan dicht te draaien. Meer over de opzet staat op dataveiligheid en op private AI.
Welk bewijs kun je laten zien als een klant ernaar vraagt?
Drie documenten en één rondleiding zijn meestal genoeg voor een aanbesteding of een vraag van een accountant.
Het eerste is het aanhangsel bij de verwerkersovereenkomst waarin per opdracht staat wat de aard en het doel van de verwerking zijn, welke categorieën betrokkenen en gegevens erin zitten, waar wordt verwerkt, wie er vanuit de leverancier bij kan en hoe lang het bewaard blijft. Het tweede is de subverwerkerslijst met de landen erbij. Het derde is het jaarlijkse overzicht van getroffen maatregelen en de uitkomst van de controles, dat je bij ons jaarlijks en op verzoek krijgt.
Daar hoort eerlijkheid bij over wat dat overzicht wel en niet is. Het komt uit een eigen controle-instrument. Het is geen onafhankelijke certificering, geen keurmerk en geen penetratietest door een derde partij. TechSolv richt zich naar de uitgangspunten van ISO 27001 en is niet gecertificeerd. Wil je wel een onafhankelijke test, dan kan dat als aparte opdracht.
Loop deze week één AI-dienst na die in je bedrijf gebruikt wordt, en probeer van die dienst de vijf lagen uit de tabel in te vullen. Lukt dat niet met de documenten die je hebt, dan weet je meteen welke vraag je aan de leverancier moet stellen. Wil je zien hoe het eruitziet als de verwerking in het pand zelf gebeurt, dan kun je de demo aanvragen, waarin vijf fictieve bedrijven op één lokaal AI-systeem draaien. Wat er juridisch speelt bij publieke AI-diensten staat in mag je klantgegevens in ChatGPT zetten.
Stuur ons een bericht
Vragen over AI en je gegevens?
Vertel hoe jullie AI nu gebruiken en waar je over twijfelt. Je hoort eerlijk wat er nodig is. Je hoort binnen één werkdag van ons.
Verstuurd
Je bericht is binnen
Je hoort binnen één werkdag van ons, op de manier die je hebt aangegeven. Wil je ondertussen al iets zien, dan staat de demo voor je open.
Veelgestelde vragen




