Een cluster bewakingscamera's in verschillende kleuren naast elkaar aan een muur.
Nieuws6 juli · 12:134 min leestijd

Bits of Freedom: AIVD en MIVD trainen mogelijk eigen AI met burgerdata

Bits of Freedom leidt uit het CTIVD-rapport over bulkdata af dat de AIVD en MIVD mogelijk hun eigen AI trainen met data van burgers. De diensten bevestigen niets, maar de governance-fout eronder raakt elk bedrijf dat AI traint.

De AIVD en MIVD lijken hun eigen AI te trainen met data van burgers, stelt burgerrechtenorganisatie Bits of Freedom in een reactie op het CTIVD-rapport over de bulkdataverwerking door beide inlichtingendiensten. De diensten zelf hebben dat niet bevestigd; het is een lezing van het toezichtrapport, geen vaststaand feit.

Toch raakt die lezing een punt dat verder reikt dan Zoetermeer. Wie een AI-model traint of finetunet op eigen data, loopt tegen precies dezelfde twee vragen aan: waar komt die trainingsdata vandaan, en hoe lang mag je die houden. Bij de diensten gaat het om bulkbestanden vol persoonsgegevens, bij een bedrijf om klant-, medewerker- of leveranciersdata. In beide gevallen bepalen de herkomst en de bewaartermijn of die training onder de AVG mag, of dat je een boete en een datalek in de maak hebt.

Wat Bits of Freedom uit het rapport afleidt

Bits of Freedom reageert op Toezichtrapport nr. 84 van de CTIVD, dat de verwerking van bulkdatasets door de AIVD en MIVD onder de loep nam. Volgens de organisatie lijkt het erop dat de diensten hun eigen AI trainen met de data die ze op grote schaal verzamelen. Ze zouden daarbij zelfs gegevens kopen die uit datalekken afkomstig zijn, aldus de organisatie.

Het zwaartepunt zit in dat woord: lijken. De AIVD en MIVD bevestigen niets van dit alles. Het is een gevolgtrekking die Bits of Freedom uit de bevindingen trekt, niet iets wat de diensten zelf naar buiten brachten. Algemeen directeur Evelyn Austin verwoordt de onderliggende zorg scherp: de diensten "willen alsmaar meer macht, terwijl ze steeds weer laten zien niet om te kunnen gaan met de macht die we ze al hebben gegeven."

Wat de CTIVD wel hard vaststelt

Het onderliggende rapport is geen speculatie. De CTIVD stelt vast dat de diensten persoonsgegevens in meerdere gevallen te lang bewaarden en dat groepen medewerkers er onrechtmatig toegang toe hadden. Het gaat om bulkbestanden die soms miljoenen regels tellen, met namen, telefoonnummers, locatiegegevens, socialemedia-informatie en de inhoud van communicatie. De commissie kwam met dertien aanbevelingen.

Het hoofdkantoor van de MIVD in Den Haag, met een bewaakte toegangspoort. Bron: Paul2 / Wikimedia Commons (CC BY-SA 3.0)
Het hoofdkantoor van de MIVD in Den Haag, met een bewaakte toegangspoort. Bron: Paul2 / Wikimedia Commons (CC BY-SA 3.0)

Dat is hetzelfde dossier waarin de toezichthouder de diensten eerder deze maand dertien verbeterpunten oplegde over hun omgang met te lang bewaarde bulkdata en te ruime toegang. Nieuw is nu de AI-hoek. Als je persoonsgegevens te lang bewaart en te breed toegankelijk maakt, ligt hergebruik voor iets nieuws, zoals het trainen van een model, dichterbij dan je zou willen.

Waarom dit ook zonder geheime dienst jouw probleem is

Voor de meeste bedrijven voelt een inlichtingendienst ver weg. De governance-fout eronder niet. Het AVG-risico bij AI zit niet in het model, maar in de data die je erin stopt: de herkomst, de grondslag en de bewaartermijn. Een model dat je traint op data waarvan je de herkomst niet kunt aantonen, of die je allang had moeten wissen, is precies het scenario dat hier speelt, alleen dan op de schaal van een staat.

De praktische les is dezelfde als in het rapport zelf: dwing dataherkomst en bewaartermijnen technisch af, niet alleen op papier. Wie kan bewijzen welke dataset waarvoor in een model ging, en die na afloop ook echt opruimt, staat sterk als de toezichthouder aanklopt. Wie dat alleen in beleid heeft staan, niet.

De verschuiving zit hem hierin: dataverwerking wordt steeds vaker AI-training. Toen Meta toetsaanslagen van eigen personeel verzamelde voor AI-training en daar een datalek over moest melden, was het patroon hetzelfde: data die voor het ene doel wordt verzameld, belandt in een model. Of de AIVD en MIVD dat werkelijk doen, is niet bevestigd. Dat de vraag nu bovenaan ligt bij een toezichtrapport over dataverwerking, laat zien waar de AVG-frontlinie de komende jaren loopt: niet bij de vraag of je AI inzet, maar of je kunt aantonen waar je trainingsdata vandaan komt en wanneer die weg moet.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

AI trainen op je eigen data?

Ik help je AI end-to-end opzetten, van het in kaart brengen van je databronnen en grondslag tot een pijplijn die herkomst en bewaartermijn technisch afdwingt, self-hosted waar dat kan. Zo staat je datahuishouding op orde voordat je een model traint.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Verken verder

In dit artikel

Hoofdonderwerpen

Ook belangrijk

Kort genoemd

Concepten

AVG-conforme gebruiksregelsPrivacy en gegevensbeschermingAI-training met burgerdataToezicht op inlichtingendienstenBulkdataverwerkingAVG-compliance bij AIDataherkomst en bewaartermijnenDataverwerking versus AI-training

Gerelateerde artikelen

TikTok schikt Amerikaanse kinderprivacyzaak voor 400 miljoen dollar
Nieuws
5 min

22 aug 00:34

TikTok schikt Amerikaanse kinderprivacyzaak voor 400 miljoen dollar

TikTok en ByteDance betalen 400 miljoen dollar in de COPPA-zaak van het Amerikaanse ministerie van Justitie. De laatste 100 miljoen volgt pas als het rechterlijk gebod uit 2019 wordt ingetrokken.

AP beboet Uber met 825 miljoen euro voor automatisch blokkeren van chauffeursaccounts
Nieuws
4 minBijgewerkt om 12:23

21 aug 16:08

AP beboet Uber met 825 miljoen euro voor automatisch blokkeren van chauffeursaccounts

De Autoriteit Persoonsgegevens legt Uber 825 miljoen euro op voor het automatisch blokkeren van chauffeursaccounts. Artikel 22 van de AVG krijgt daarmee een prijskaartje, en dat raakt elke organisatie die software over mensen laat beslissen.

Elke marketingtag op je site is een verwerker die je nooit hebt aangenomen
Inzicht
7 min

15 aug 09:00

Elke marketingtag op je site is een verwerker die je nooit hebt aangenomen

Je verwerkingsregister komt uit je crediteurenadministratie, terwijl de meeste gegevensstromen op je site via tags lopen die niemand ooit heeft geteld of opgezegd. Wie de tag plaatste, is niet wie ervoor aansprakelijk is.

CDA vraagt kabinet onderzoek naar verbod op camerabrillen
Nieuws
5

7 aug 18:10

CDA vraagt kabinet onderzoek naar verbod op camerabrillen

CDA-Kamerleden vragen het kabinet onderzoek te doen naar een verbod op camerabrillen in de openbare ruimte, nadat de Autoriteit Persoonsgegevens drie meldingen kreeg over heimelijk filmen. Voor ondernemers ligt de oplossing voorlopig in het huisreglement.

Rechter blokkeert Meta-ontslagen niet in AI-discriminatiezaak
Nieuws
4 min

18 jul 10:39

Rechter blokkeert Meta-ontslagen niet in AI-discriminatiezaak

Een rechter weigert de ontslagen van 26 Meta-medewerkers te blokkeren die AI-gedreven ontslagselectie aanvechten. De ontslagen gaan 22 juli door, maar de vraag of AI onterecht selecteerde blijft open, met lessen voor werkgevers onder AVG en AI Act.

Oud-medewerkers klagen Meta aan om AI-gedreven ontslagselectie
Nieuws
4 min

14 jul 20:11

Oud-medewerkers klagen Meta aan om AI-gedreven ontslagselectie

Zesentwintig oud-medewerkers dagen Meta voor de rechter: AI-software zou werknemers met een medische aandoening onevenredig hebben getroffen bij de ontslagronde. Wat dat betekent voor elke werkgever die AI in personeelsbeslissingen inzet.