Archestra bracht OpenAPPA uit als open, modelonafhankelijke beveiligingslaag die AI-agentacties buiten het taalmodel vóór uitvoering toetst; InfoQ schreef over de release op 3 oktober.
Voor een Nederlandse organisatie die een agent aan CRM, mail of klantgegevens koppelt, komt de controle zo vóór een wijziging of verzending te liggen. Een actie gaat alleen door wanneer de data, ontvanger en bevoegdheid binnen het ingestelde beleid passen. In een CRM-workflow kan een agent voorstellen in staging zetten en pas na menselijke vrijgave schrijven.

De regels volgen de gegevens
OpenAPPA zit tussen de agent en zijn tools. Vóór elke handeling controleert het of de gegevens naar die bestemming mogen. De configuratie houdt onder meer bij wie data mag ontvangen, hoe betrouwbaar de bron is en welke acties al zijn uitgevoerd. Een intern klantrecord beperkt de doelgroep tot intern; een niet-geverifieerde webpagina verlaagt het vertrouwen in de gegevens die daarna worden gebruikt. De volgende toolactie moet aan die grenzen voldoen voordat hij wordt uitgevoerd.
De onderliggende APPA-methode behandelt dit als informatiestroombeheer voor LLM-agents: regels over herkomst, bestemming en vertrouwen bewegen mee met data tussen tools. Bij een geblokkeerde actie kan de engine een mens om eenmalige goedkeuring vragen, gevoelige gegevens uit de uitvoer verwijderen of een onbetrouwbare lezing isoleren in een tijdelijke subagent, volgens de uitleg van de herstelroutes. Een goedkeuring geldt alleen voor die handeling; een volgende actie wordt opnieuw beoordeeld.
Nul aanvallen in de benchmark
Archestra meldt nul geslaagde aanvallen in 1.320 eigen evaluaties, met 89% taakvoltooiing. Daarvan kwamen 600 tests uit Bench-Corp en 720 uit AgentThreatBench. De suites bevatten onder meer tests op promptinjectie, het delen van gevoelige data, goedkeuringsvolgorde en het scheiden van klantgegevens. In een afzonderlijke Bench-Corp-test met GPT-5.6 Luna daalde de taakvoltooiing van 88% naar 35% zonder begeleide herstelroutes. De 0% geldt voor deze benchmarkruns, niet als productiegarantie.
OpenAPPA staat nog als preview vermeld; de integratie in het Archestra-platform is in bèta. De ontwikkeling verschuift agentbeveiliging van een belofte in de modelprompt naar afdwingbare grenzen in de toolketen.
Veelgestelde vragen
AI-agenten met duidelijke grenzen
Ik denk met je mee over rechten en datastromen, ontwerp de oplossing en realiseer de koppelingen en automatisering end-to-end. Waar dat kan, houd ik de agent op je eigen infrastructuur.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
