Een lege controlekamer met een bureau en twee stoelen tegenover monitoren.
Nieuws11 juli · 16:124 min leestijd

Helft bedrijven zag geteste AI-agent tóch klanten raken

De helft van de bedrijven zag het afgelopen jaar een AI-agent die alle interne tests doorstond, alsnog een storing bij klanten veroorzaken. Toch neemt de menselijke controle af terwijl de autonomie juist groeit.

De helft van de bedrijven zag het afgelopen jaar een AI-agent die alle interne tests doorstond, tóch een storing bij klanten veroorzaken. Dat blijkt uit een enquête die VentureBeat in juni hield onder 157 bedrijven met meer dan honderd medewerkers.

Het cijfer legt een gat bloot tussen hoe snel bedrijven agents zelfstandig laten handelen en hoe goed ze kunnen controleren of dat veilig is. Voor een Nederlandse organisatie die een agent klantcontact, offertes of bestellingen laat afhandelen, betekent het dat een groene testuitslag weinig garandeert: de fout komt pas boven water bij een echte klant, met echte schade. En juist die controlelaag blijft achter terwijl de autonomie toeneemt.

Test geslaagd, klant de dupe

Van de ondervraagde bedrijven bracht 50 procent minstens één keer een agent of AI-functie live die de interne evaluatie doorstond en daarna alsnog een klantgerichte storing veroorzaakte. Een op de vier maakte dat meer dan eens mee. Het gaat dus niet om een incidentele uitschieter, maar om een patroon dat de helft van de markt herkent.

Tegelijk vertrouwt maar 5 procent van de bedrijven de geautomatiseerde evaluaties waarop ze hun vrijgavebesluiten baseren volledig. De test die het groene licht geeft, wordt door de bedrijven zelf dus nauwelijks geloofd.

De rem gaat eraf terwijl het zicht slechter wordt

Toch neemt de menselijke controle niet toe, maar af. 66 procent van de bedrijven staat inmiddels toe dat een agent zonder menselijke review in productie gaat, of is van plan dat binnen twaalf maanden te doen. De autonomie groeit sneller dan de verificatielaag die de missers moet onderscheppen. Precies die kloof noemt het onderzoek de evaluatie-kloof.

Wat 157 bedrijven melden over hun AI-agents (bron: VentureBeat VB Pulse, juni 2026)

De onderzoekers wijzen naar herhaalbaarheid

De oplossing ligt volgens het rapport niet in nóg een eenmalige test, maar in herhaalbaarheid. Draai een scenario meerdere keren met wisselende context, test wat er gebeurt als een tool uitvalt, en kijk of de zakelijke uitkomst steeds dezelfde is. Maak van elke storing in productie een vaste regressietest, zodat dezelfde fout niet twee keer door de mazen glipt. Het rapport verwijst daarvoor naar het NIST-profiel voor generatieve AI als kader.

Dat sluit aan op eerder onderzoek waarin bedrijven AI-agents wel met code vertrouwen, maar niet met hun live productiesystemen: het gemiddelde vertrouwen bleef daar steken op 64 van de 100, en het laagst scoorden juist ingrepen in draaiende infrastructuur. Die grip regel je vooraf: de afspraken over mandaat, escalatie, logging en een kill-switch leg je vast voordat de agent de productie in gaat.

Waar dit heen wijst

De kern van de enquête is niet dat agents onbetrouwbaar zijn, maar dat de meetlat achterloopt op de autonomie. Zolang een geslaagde test en een tevreden klant twee verschillende dingen zijn, verschuift het echte werk van het bouwen van een agent naar het bewijzen dat hij doet wat hij belooft, elke keer opnieuw. Bedrijven die dat bewijs vooraf organiseren, kunnen autonomie stap voor stap opschalen. De rest ontdekt de grens pas op het moment dat een klant hem raakt.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Agent veilig naar productie

Ik ontwerp en bouw je AI-agents end-to-end, met de verificatielaag eromheen: herhaalbare tests, logging en een menselijke goedkeuring op alles wat een live systeem raakt. Van meedenken tot self-hosted uitrol.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Verken verder

In dit artikel

Ook belangrijk

Kort genoemd

Concepten

HerhaalbaarheidAI-agent betrouwbaarheidVeilig opschalenAI-agent storing bij klantenEvaluatie-kloofEvaluatiekloofMeetlat voor autonomie

Gerelateerde artikelen

AI-kennisbank bouwen: zonder bron-eigenaar is je kennisbank slechts een snellere gedeelde map
Gids
Uitgebreide gids17 min

13 sep 09:00

AI-kennisbank bouwen: zonder bron-eigenaar is je kennisbank slechts een snellere gedeelde map

Een AI-kennisbank zonder bron-eigenaar is slechts een snellere gedeelde map. Leer hoe je twintig echte vragen koppelt aan vrijgegeven bronnen, eigenaars, rechtenfilters, uitzonderingen en een meetbare vrijgavepoort.

Post-quantum cryptografie: waarom je nu moet beginnen, niet in 2030
Inzicht
8 min

24 jun 17:00

Post-quantum cryptografie: waarom je nu moet beginnen, niet in 2030

De quantumcomputer die RSA kraakt bestaat nog niet, en toch is de aanval al begonnen. Waarom de echte deadline niet de komst van die machine is, maar de optelsom van je bewaartermijn en je migratietijd.

G5 Labs maakt natuurlijke taal tot broncode voor bedrijfssoftware
Nieuws
4 min

15 sep 23:18

G5 Labs maakt natuurlijke taal tot broncode voor bedrijfssoftware

G5 Labs haalt 14 miljoen dollar op en brengt een platform uit dat bedrijfsregels, beleid en workflows als semantische broncode beheert. De technologie richt zich nu vooral op gereguleerde ondernemingen en legacy-modernisering.

API-uitfasering migreren: van register naar veilige vrijgave
Gids
Uitgebreide gids18 min

14 sep 17:00

API-uitfasering migreren: van register naar veilige vrijgave

Een leverancier wijzigt je API of authenticatie. Met deze methode inventariseer je de impact, test je oud en nieuw naast elkaar, laat je bewust vrijgeven en houd je een terugvalpad dat met data rekening houdt.

China wijst Amodei’s oproep voor AI-rem af
Nieuws
3 minBijgewerkt om 02:39

14 sep 14:58

China wijst Amodei’s oproep voor AI-rem af

China wijst Amodei’s oproep om frontier-AI te vertragen af en noemt confrontatie schadelijk voor AI-governance. Voor Nederlandse organisaties maakt dat modelkeuze ook een vraag over exportcontrole, chiptoegang en leveranciersrisico.

ISO 9001-afwijkingen sluiten: van oorzaak tot auditbewijs
Gids
Uitgebreide gids18 min

14 sep 09:00

ISO 9001-afwijkingen sluiten: van oorzaak tot auditbewijs

Een certificaat is geen garantie dat je kwaliteitssysteem vandaag werkt. Leer iedere ISO 9001-afwijking sluiten met eigenaar, oorzaak, corrigerende actie, effectiviteitscontrole en een dossier dat standhoudt in de volgende audit.