Een beveiligings- en privacydashboard op een computerscherm met de actuele status.
Nieuws4 augustus · 20:124 min leestijd

Linux Foundation legt meldregels voor incidenten met AI-agents ter consultatie

De Linux Foundation legt SAFE ter consultatie, een vrijwillige meldstandaard voor incidenten met AI-agents. Leden waarschuwen klanten binnen 72 uur en melden binnen vier werkdagen. De alliantie erachter groeide van 37 naar ruim 120 leden.

De Linux Foundation legt met SAFE een meldstandaard voor incidenten met AI-agents ter consultatie, waarin leden een incident binnen vier werkdagen vertrouwelijk melden en getroffen klanten binnen 72 uur waarschuwen.

Voor een Nederlands bedrijf dat agents laat werken in Outlook, een CRM of een betaalstraat verschuift daarmee de vraag die je aan je leverancier stelt. Nu bepaalt die zelf of en wanneer je hoort dat een agent buiten zijn hok stapte. SAFE zet er een klok op. Het voorstel staat als Request for Comments in een publieke repository waar iedereen met issues en pull requests kan reageren; een sluitingsdatum noemt de stichting niet, dus meepraten kan zolang de concepttekst in behandeling is.

Wat meldplichtig wordt

Het gaat niet om "een hack" in het algemeen, maar om een agent die grenzen overschrijdt. Meldplichtig zijn ongeautoriseerde toegang tot of verstoring van systemen van derden, het doorbreken van sandbox-, netwerk-, identiteits-, beleids- of toolgrenzen, toegang tot vertrouwelijke informatie van anderen, en doorgaan met sonderen nadat duidelijk werd dat de actie buiten scope viel. Het concept stelt daarbij dat de bedoeling niet bepaalt of iets gemeld moet worden: een vergissing te goeder trouw valt onder dezelfde regel als een aanval.

De klok in het voorstel

De voorgestelde termijnen lopen van direct tot een kwartaal:

  • Direct: de rechtstreeks getroffen organisaties waarschuwen.
  • 72 uur: klanten informeren bij geloofwaardige blootstelling.
  • 4 werkdagen: een vertrouwelijk incidentrapport indienen bij SAFE.
  • 14 dagen: een bredere klantwaarschuwing, als die nodig is.
  • 30 dagen: een voorlopig feitelijk rapport publiceren.
  • 90 dagen: de status van het herstel publiceren.
  • Wekelijks: machineleesbare updates zolang het risico openstaat.

Elk incident wordt vervolgens langs acht lagen gelegd: model, instructies, waarborgen, tools, omgeving, monitoring, menselijk handelen en toeleveringsketen. Dat is een andere manier van kijken dan de gebruikelijke vraag welk model iets fout deed. Bij een agent zit de fout vaker in de rechten die hij meekreeg dan in de gewichten.

Wie er inmiddels meedoet

De alliantie is sinds de start hard gegroeid. Nvidia telt ruim 120 aangesloten organisaties, met Amazon als recente toevoeging, naast namen als Visa, Cloudflare, Okta, Palo Alto Networks, Mistral en Perplexity. Dat is een flinke sprong ten opzichte van de 37 oprichters waarmee Nvidia de Open Secure AI Alliance eind juli startte na de inbraak bij Hugging Face. Aan de RFC zelf schreven Cisco, CrowdStrike, Hugging Face, Nvidia en Red Hat mee.

Twee namen blijven ontbreken: OpenAI en Anthropic zijn nog altijd geen lid, net als bij de oprichterslijst waarop ook Google ontbrak. Dat beperkt de reikwijdte van een meldstandaard die het meeste waard is als juist de grootste modelleveranciers meedoen. Nvidia-topman Justin Boitano zegt dat een open werkgroep naar de sporen moet kunnen kijken wanneer een agent ontsnapt, zo tekende Reuters op.

Het logo van The Linux Foundation, de organisatie die het SAFE-voorstel publiceerde. Bron: Linux Foundation / Wikimedia Commons (publiek domein)
Het logo van The Linux Foundation, de organisatie die het SAFE-voorstel publiceerde. Bron: Linux Foundation / Wikimedia Commons (publiek domein)

Naast de meldplichten die er al zijn

SAFE is een vrijwillig verbond en vervangt niets. Leren staat er los van handhaven, schrijven de opstellers, en leden houden hun wettelijke plichten richting toezichthouders. Die plichten zijn in Nederland concreet. Onder de Cyberbeveiligingswet geldt een gefaseerde meldplicht die begint met een vroegtijdige waarschuwing binnen 24 uur via het NCSC-portaal, en de AI-verordening verplicht aanbieders van hoogrisico-AI om ernstige incidenten te melden bij de markttoezichtautoriteit.

Daar zit precies het gat dat SAFE probeert te vullen. Die twee routes lopen naar de overheid en gelden voor een afgebakende groep. Een agent die bij een leverancier uit zijn sandbox breekt en langs de systemen van diens klanten gaat, valt voor veel bedrijven buiten beide. Het voorstel legt de melding daarom bij de sector zelf, met onafhankelijk beheer zodat geen enkele leverancier de bevindingen controleert. Overheden en standaardisatie-organisaties mogen meekijken als waarnemer zonder zeggenschap, en een getroffen organisatie mag feitelijke fouten corrigeren maar heeft geen vetorecht op wat er geleerd wordt.

Wat hier wordt uitonderhandeld is niet techniek maar een gewoonte: wanneer een leverancier je moet bellen als zijn agent bij jouw data kwam. Zolang dat in geen enkel contract staat, is de eerste die het weet ook de enige. Termijnen van 72 uur en vier werkdagen zijn nu nog een concept in een repository, maar zodra ze in inkoopvoorwaarden landen zijn ze de norm waaraan je je AI-leverancier gaat houden. En dat concept ligt op dit moment open voor commentaar.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Agents met een noodrem

Ik help je van meedenken en ontwerp tot realiseren en automatiseren, zodat een AI-agent bij jou vastgelegde rechten, logs en een duidelijk meldpad heeft in plaats van vrij spel. Waar het kan draai je dat self-hosted, op je eigen infrastructuur.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

OpenAI, Anthropic en Google ontbreken in Nvidia's AI-beveiligingsalliantie
Nieuws
3 min

28 jul 02:13

OpenAI, Anthropic en Google ontbreken in Nvidia's AI-beveiligingsalliantie

Nvidia's Open Secure AI Alliance telt 37 oprichters, maar OpenAI, Anthropic en Google staan er geen van drieën op. Andere AI-labs wel. Wat die afwezigheid betekent als je beveiliging op hun modellen leunt.

Nvidia start alliantie van 37 bedrijven voor open AI-beveiliging
Nieuws
4 min

27 jul 12:09

Nvidia start alliantie van 37 bedrijven voor open AI-beveiliging

Nvidia richt met 36 andere bedrijven de Open Secure AI Alliance op, die open beveiligingstools bouwt die je zelf draait. Aanleiding is de inbraak bij Hugging Face, waar gesloten AI de forensische analyse blokkeerde.

Open-weight-brief aan Washington verdubbelt naar 50 ondertekenaars
Nieuws
4 min

26 jul 16:09

Open-weight-brief aan Washington verdubbelt naar 50 ondertekenaars

De open-weight-brief aan Washington telt nu 50 ondertekenaars, dubbel zoveel als bij publicatie. Google staat er alsnog op. Alleen Anthropic, Amazon en xAI blijven weg, en dat verschuift het politieke risico voor open modellen.

Nvidia, Microsoft en Meta bepleiten open AI-modellen bij Washington
Nieuws
4 min

24 jul 18:21

Nvidia, Microsoft en Meta bepleiten open AI-modellen bij Washington

Voor het eerst zetten de grootste Amerikaanse AI-leveranciers zelf, niet alleen startups, gezamenlijk hun gewicht achter open modellen. In een brief aan Washington vragen Nvidia, Microsoft, Meta en Palantir om geen beperkingen op open-weight AI.

Franse toezichthouder: drie bedrijven beheersen 84 procent van AI-agentenmarkt
Nieuws
4 min

18 jul 14:22

Franse toezichthouder: drie bedrijven beheersen 84 procent van AI-agentenmarkt

De Franse mededingingsautoriteit becijfert dat OpenAI, Google en Anthropic samen ruim 84 procent van de wereldwijde markt voor AI-agenten beheersen. Ze waarschuwt voor lock-in en beperkte overstapbaarheid, maar deelt geen boete uit.

AI-jacht op bugs bezorgt securityteams een patchgolf: 1.500 zware CVE's in juni
Nieuws
5 min

4 jul 04:39

AI-jacht op bugs bezorgt securityteams een patchgolf: 1.500 zware CVE's in juni

Onderzoeksbureau Epoch AI telde in juni 2026 zo'n 1.500 hoog- en kritieke kwetsbaarheden van 21 grote organisaties, ruim 3,5 keer het oude maandrecord. AI vindt bugs nu op schaal, en dat verandert hoe securityteams hun patchcapaciteit moeten inrichten.