Een lege controlekamer met een bureau en twee stoelen tegenover monitoren.
Nieuws11 juli · 16:124 min leestijd

Helft bedrijven zag geteste AI-agent tóch klanten raken

De helft van de bedrijven zag het afgelopen jaar een AI-agent die alle interne tests doorstond, alsnog een storing bij klanten veroorzaken. Toch neemt de menselijke controle af terwijl de autonomie juist groeit.

De helft van de bedrijven zag het afgelopen jaar een AI-agent die alle interne tests doorstond, tóch een storing bij klanten veroorzaken. Dat blijkt uit een enquête die VentureBeat in juni hield onder 157 bedrijven met meer dan honderd medewerkers.

Het cijfer legt een gat bloot tussen hoe snel bedrijven agents zelfstandig laten handelen en hoe goed ze kunnen controleren of dat veilig is. Voor een Nederlandse organisatie die een agent klantcontact, offertes of bestellingen laat afhandelen, betekent het dat een groene testuitslag weinig garandeert: de fout komt pas boven water bij een echte klant, met echte schade. En juist die controlelaag blijft achter terwijl de autonomie toeneemt.

Test geslaagd, klant de dupe

Van de ondervraagde bedrijven bracht 50 procent minstens één keer een agent of AI-functie live die de interne evaluatie doorstond en daarna alsnog een klantgerichte storing veroorzaakte. Een op de vier maakte dat meer dan eens mee. Het gaat dus niet om een incidentele uitschieter, maar om een patroon dat de helft van de markt herkent.

Tegelijk vertrouwt maar 5 procent van de bedrijven de geautomatiseerde evaluaties waarop ze hun vrijgavebesluiten baseren volledig. De test die het groene licht geeft, wordt door de bedrijven zelf dus nauwelijks geloofd.

De rem gaat eraf terwijl het zicht slechter wordt

Toch neemt de menselijke controle niet toe, maar af. 66 procent van de bedrijven staat inmiddels toe dat een agent zonder menselijke review in productie gaat, of is van plan dat binnen twaalf maanden te doen. De autonomie groeit sneller dan de verificatielaag die de missers moet onderscheppen. Precies die kloof noemt het onderzoek de evaluatie-kloof.

Wat 157 bedrijven melden over hun AI-agents (bron: VentureBeat VB Pulse, juni 2026)

De onderzoekers wijzen naar herhaalbaarheid

De oplossing ligt volgens het rapport niet in nóg een eenmalige test, maar in herhaalbaarheid. Draai een scenario meerdere keren met wisselende context, test wat er gebeurt als een tool uitvalt, en kijk of de zakelijke uitkomst steeds dezelfde is. Maak van elke storing in productie een vaste regressietest, zodat dezelfde fout niet twee keer door de mazen glipt. Het rapport verwijst daarvoor naar het NIST-profiel voor generatieve AI als kader.

Dat sluit aan op eerder onderzoek waarin bedrijven AI-agents wel met code vertrouwen, maar niet met hun live productiesystemen: het gemiddelde vertrouwen bleef daar steken op 64 van de 100, en het laagst scoorden juist ingrepen in draaiende infrastructuur. Die grip regel je vooraf: de afspraken over mandaat, escalatie, logging en een kill-switch leg je vast voordat de agent de productie in gaat.

Waar dit heen wijst

De kern van de enquête is niet dat agents onbetrouwbaar zijn, maar dat de meetlat achterloopt op de autonomie. Zolang een geslaagde test en een tevreden klant twee verschillende dingen zijn, verschuift het echte werk van het bouwen van een agent naar het bewijzen dat hij doet wat hij belooft, elke keer opnieuw. Bedrijven die dat bewijs vooraf organiseren, kunnen autonomie stap voor stap opschalen. De rest ontdekt de grens pas op het moment dat een klant hem raakt.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Agent veilig naar productie

Ik ontwerp en bouw je AI-agents end-to-end, met de verificatielaag eromheen: herhaalbare tests, logging en een menselijke goedkeuring op alles wat een live systeem raakt. Van meedenken tot self-hosted uitrol.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Verken verder

In dit artikel

Ook belangrijk

Kort genoemd

Concepten

AI-agent betrouwbaarheidHerhaalbaarheidVeilig opschalenAI-agent storing bij klantenEvaluatie-kloofEvaluatiekloofMeetlat voor autonomie

Gerelateerde artikelen

Post-quantum cryptografie: waarom je nu moet beginnen, niet in 2030
Inzicht
8 min

24 jun 17:00

Post-quantum cryptografie: waarom je nu moet beginnen, niet in 2030

De quantumcomputer die RSA kraakt bestaat nog niet, en toch is de aanval al begonnen. Waarom de echte deadline niet de komst van die machine is, maar de optelsom van je bewaartermijn en je migratietijd.

Spaanse toezichthouder beboet camera's die continu geluid opnemen op de werkvloer
Nieuws
4 min

27 aug 12:23

Spaanse toezichthouder beboet camera's die continu geluid opnemen op de werkvloer

De Spaanse toezichthouder AEPD beboet een metaalbedrijf met 4.000 euro omdat beveiligingscamera's continu geluid opnamen. Niet de informatieplicht sneuvelde, maar dataminimalisatie. Dat verlegt de vraag voor Nederlandse werkgevers naar de instelling van hun camerasysteem.

Salesforce zet zijn CRM in Claude met 37 verkoopvaardigheden
Nieuws
5 min

27 aug 00:20

Salesforce zet zijn CRM in Claude met 37 verkoopvaardigheden

Salesforce en Anthropic lanceren Claudeforce, een plug-in die het CRM met 37 verkoopvaardigheden in Claude zet. Wat dat betekent voor je licenties, je klantdata en de vraag wie straks de interface bezit.

Moonshot vraagt Microsoft, Amazon en Google tot 30 procent van de Kimi K3-omzet
Nieuws
4 min

26 aug 22:35

Moonshot vraagt Microsoft, Amazon en Google tot 30 procent van de Kimi K3-omzet

Moonshot vraagt volgens Reuters tot 30 procent van de omzet die Microsoft, Amazon en Google met Kimi K3 zouden maken. De gesprekken bepalen of je het Chinese topmodel straks gewoon als clouddienst inkoopt.

Het onderpand van de AI-bouw is niet de chip, maar het contract
Signaal
7 min

26 aug 21:46

Het onderpand van de AI-bouw is niet de chip, maar het contract

Banken en verzekeraars financieren AI-rekenkracht niet meer op de chip, maar op het langlopende afnamecontract eronder. Dat verandert wat er in een inkoopgesprek over capaciteit werkelijk op tafel ligt.

Twee administraties samenvoegen na een bedrijfsovername: het draaiboek voor de eerste 30 dagen
Gids
Uitgebreide gids16 min

26 aug 17:00

Twee administraties samenvoegen na een bedrijfsovername: het draaiboek voor de eerste 30 dagen

De dag na de handtekening begint de klus die niemand plant. Dit is het draaiboek voor dertig dagen: de knip in je administratie, de inventaris op naam van de vertrekkende eigenaar, en waarom je negentig dagen naast elkaar draait.