Laptop met een code-editor op het scherm
Nieuws4 oktober · 08:202 min leestijd

Archestra brengt OpenAPPA uit voor AI-agentbeveiliging

OpenAPPA toetst AI-agentacties buiten het taalmodel om. Archestra meldt nul geslaagde aanvallen in 1.320 eigen benchmarkevaluaties en 89% taakvoltooiing. Die cijfers beschrijven tests, niet productieprestaties.

Archestra bracht OpenAPPA uit als open, modelonafhankelijke beveiligingslaag die AI-agentacties buiten het taalmodel vóór uitvoering toetst; InfoQ schreef over de release op 3 oktober.

Voor een Nederlandse organisatie die een agent aan CRM, mail of klantgegevens koppelt, komt de controle zo vóór een wijziging of verzending te liggen. Een actie gaat alleen door wanneer de data, ontvanger en bevoegdheid binnen het ingestelde beleid passen. In een CRM-workflow kan een agent voorstellen in staging zetten en pas na menselijke vrijgave schrijven.

Archestra-interface met OpenAPPA in het zijmenu, afbeelding: Archestra
Archestra-interface met OpenAPPA in het zijmenu, afbeelding: Archestra

De regels volgen de gegevens

OpenAPPA zit tussen de agent en zijn tools. Vóór elke handeling controleert het of de gegevens naar die bestemming mogen. De configuratie houdt onder meer bij wie data mag ontvangen, hoe betrouwbaar de bron is en welke acties al zijn uitgevoerd. Een intern klantrecord beperkt de doelgroep tot intern; een niet-geverifieerde webpagina verlaagt het vertrouwen in de gegevens die daarna worden gebruikt. De volgende toolactie moet aan die grenzen voldoen voordat hij wordt uitgevoerd.

De onderliggende APPA-methode behandelt dit als informatiestroombeheer voor LLM-agents: regels over herkomst, bestemming en vertrouwen bewegen mee met data tussen tools. Bij een geblokkeerde actie kan de engine een mens om eenmalige goedkeuring vragen, gevoelige gegevens uit de uitvoer verwijderen of een onbetrouwbare lezing isoleren in een tijdelijke subagent, volgens de uitleg van de herstelroutes. Een goedkeuring geldt alleen voor die handeling; een volgende actie wordt opnieuw beoordeeld.

Nul aanvallen in de benchmark

Archestra meldt nul geslaagde aanvallen in 1.320 eigen evaluaties, met 89% taakvoltooiing. Daarvan kwamen 600 tests uit Bench-Corp en 720 uit AgentThreatBench. De suites bevatten onder meer tests op promptinjectie, het delen van gevoelige data, goedkeuringsvolgorde en het scheiden van klantgegevens. In een afzonderlijke Bench-Corp-test met GPT-5.6 Luna daalde de taakvoltooiing van 88% naar 35% zonder begeleide herstelroutes. De 0% geldt voor deze benchmarkruns, niet als productiegarantie.

OpenAPPA staat nog als preview vermeld; de integratie in het Archestra-platform is in bèta. De ontwikkeling verschuift agentbeveiliging van een belofte in de modelprompt naar afdwingbare grenzen in de toolketen.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

AI-agenten met duidelijke grenzen

Ik denk met je mee over rechten en datastromen, ontwerp de oplossing en realiseer de koppelingen en automatisering end-to-end. Waar dat kan, houd ik de agent op je eigen infrastructuur.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Verken verder

In dit artikel

Concepten

AI-agentbeveiligingPromptinjectieMenselijke vrijgaveVeiligheid van AI-agentenGegevenstoegang en -bestemmingInformatiestroombeheer

Gerelateerde artikelen

Pi 1.0 voegt MCP toe aan open AI-codeeragent
Nieuws
3 min

2 okt 10:22

Pi 1.0 voegt MCP toe aan open AI-codeeragent

Pi 1.0 brengt MCP naar een open codeeragent en verlaagt in één GPT-5.6-configuratie prompttokens van circa 5.300 naar 3.300. Pi Durable kan taken hervatten, maar blijft experimenteel.

OpenAI en Synopsys ontwikkelen AI voor chipontwerp
Nieuws
3 min

30 sep 22:36

OpenAI en Synopsys ontwikkelen AI voor chipontwerp

OpenAI en Synopsys ontwikkelen GPT-Synopsys, een model dat EDA-tools voor ontwerp, verificatie en PPA-optimalisatie moet bedienen. De samenwerking zit nog in vroege klanttrajecten, zonder algemene release of gepubliceerde prijs.

TikTok beperkt tienergebruik in Alabama na schikking
Nieuws
3 min

27 sep 00:21

TikTok beperkt tienergebruik in Alabama na schikking

Een gerechtelijk akkoord verplicht TikTok tot daglimieten, nachtelijke toegangsblokkades, ouderlijk toezicht en keuzes rond tienerfeeds in Alabama. De afspraken gelden voor het platform in die staat en krijgen uiteenlopende invoeringstermijnen.

Fujitsu maakt OpenQARP open source
Nieuws
3 min

15 sep 12:40

Fujitsu maakt OpenQARP open source

Fujitsu maakt OpenQARP open source met meer dan honderd quantumsoftwarecomponenten. De release bevat 70 bouwblokken, 20 algoritmen en een voorbeeld waarin benodigde Python-code van ongeveer 130 naar 40 regels daalt.

OpenAI koppelt ChatGPT for Healthcare aan het patiëntendossier van Epic
Nieuws
4 min

1 sep 20:33

OpenAI koppelt ChatGPT for Healthcare aan het patiëntendossier van Epic

OpenAI koppelt ChatGPT for Healthcare aan het EPD van Epic, met alleen leesrechten. Alle lanceerpartners zijn Amerikaans en over Europa zegt de aankondiging niets, maar elf Nederlandse ziekenhuizen draaien wel op Epic.

Meta mag kinderdata bewaren om zijn leeftijdsmodel te trainen
Nieuws
5 min

28 aug 00:40

Meta mag kinderdata bewaren om zijn leeftijdsmodel te trainen

De schikkingstekst laat Meta gegevens van kinderen onder de dertien bewaren om er een leeftijdsdetectiemodel mee te trainen, en de staten doen daarvoor blijvend afstand van hun COPPA-claims. Die uitweg bestaat in Europa niet.