TrueFoundry brengt TrueForge uit, een open-source agentharnas onder de MIT-licentie waarmee bedrijven de laag onder hun AI-agents zelf draaien en van model wisselen zonder de agent opnieuw te bouwen. Het bedrijf zet het neer als alternatief voor Claude Managed Agents met 50 procent lagere kosten.
Daarmee komt er een derde route bij voor wie agents inzet. Tot nu toe koos je tussen een beheerde dienst afnemen bij de modelmaker en per gebruik betalen, of zelf een agentlus bouwen en onderhouden. De harnaslaag zelf draaien op eigen infrastructuur zit daartussenin, en dat raakt meteen een punt dat voor Nederlandse organisaties zwaarder weegt dan de rekening: de beheerde variant van Anthropic is nog beta en valt buiten Zero Data Retention en HIPAA-dekking, omdat sessies, sandbox-status en gespreksgeschiedenis aan de serverkant bewaard blijven. Wie met patiënt-, klant- of personeelsdata werkt, loopt daar eerder tegenaan dan tegen het kostenplaatje.
Wat er vrijkomt
Een agentharnas is de runtimelaag rond een taalmodel: modelaanroepen, MCP-tools, skills, sandboxing, goedkeuringen, contextbeheer en sessiestatus. TrueForge ontsluit dat op drie manieren: een chat-UI, een HTTP-API met TypeScript-SDK, en een insluitbare UI-SDK. In lokale modus draait alles in één proces op SQLite via npx; voor teams staat er een gehoste modus met Postgres en Redis, uit te rollen met Docker Compose of Helm. Modelproviders, MCP-servers en de sandbox breng je zelf mee, van OpenAI en Anthropic tot elk OpenAI-compatibel eindpunt.

De licentie is de standaard MIT-tekst, die inzien, aanpassen en commercieel gebruik toestaat, zonder beperking op regio of sector. Wel is dit geen 1.0: de npm-pakketten verschenen op 13 augustus, versie 0.1.3 is van 18 augustus, en de repo waarschuwt zelf dat de lokale modus alleen voor je eigen machine bedoeld is en niet voor een gedeelde of productieomgeving.
Wat de 50 procent waard is
De kostenclaim staat in de kop van de aankondiging, maar de eigen benchmarkpagina van TrueForge geeft een preciezer beeld. Op hetzelfde model, Opus 4.8, kost een run bij Claude Managed Agents 11,80 dollar en bij TrueForge 8,60 dollar, terwijl beide gemiddeld 10,7 van de 14 taken oplossen. Dat is ongeveer 30 procent goedkoper, niet 50. De grotere besparing komt pas als je het model vervangt: met het open model GLM-5.2 zakt een run naar 3,00 dollar en gaat de score omhoog naar 11,7 van de 14, ruim 75 procent onder de beheerde dienst. De 50 procent uit de kop is dus geen enkel gemeten getal, maar een middenweg tussen twee scenario's die je zelf kiest.
Het tokenverbruik legt uit waar het verschil vandaan komt: 3,7 miljoen tokens per run tegen 10,0 miljoen bij de beheerde dienst op hetzelfde model. TrueForge plande 19 tool-aanroepen per taak, tegen 32 en 40 bij de vergeleken harnassen, en snoeit de geschiedenis in plaats van die elke beurt opnieuw mee te sturen. In een agentrun zit het geld in de lus, niet in het antwoord.
Eén nuance hoort erbij: dit is de test van de leverancier zelf. Veertien taken uit DevRev's Enterprise-Bench, drie MCP-servers in de rol van CRM, projecttracker en documentopslag, drie runs per configuratie en een blinde LLM-jury die alleen de opdracht en het antwoord ziet. De benchmarkmap staat in de repo, dus de cijfers zijn na te rekenen. Dat blijft iets anders dan een onafhankelijke meting.
Waar de afhankelijkheid heen schuift
Een open harnas verplaatst de vraag naar leveranciersafhankelijkheid, het beantwoordt hem niet. Open source op de agent-laag maakt je niet vrij van lock-in, maar verschuift die naar de koppelingen en de gebruikshistorie die je agent opbouwt: je MCP-servers, OAuth-verbindingen en het geheugen van eerdere sessies verhuizen niet mee als je van platform wisselt. De Franse mededingingsautoriteit becijferde in juli dat drie bedrijven ruim 84 procent van de markt voor AI-agenten beheersen en waarschuwde dat overstappen juist door die opgebouwde data stroef verloopt.
Zelf draaien heeft ook een eigen prijs. Postgres en Redis komen erbij, patches houd je zelf bij, en de sandbox waarin de agent code uitvoert loopt vandaag via één provider, Daytona. Dat is geen argument tegen zelf hosten, het is de rekening die naast de bespaarde dollars per run staat.
TrueForge is deze maand niet het enige harnas dat open op tafel komt: DeepSeek zette zijn eigen harnas op 13 augustus onder de MIT-licentie op GitHub, model-onafhankelijk en met een eigen basis-URL voor een bedrijfsgateway. De harnaslaag wordt in hoog tempo gemeengoed, en daarmee verschuift het onderscheid naar wat eromheen zit: welke tools je koppelt, waar de sessiedata staat, en wie er patcht als er een lek in zit. Wie nu een agentplatform kiest, kiest in de praktijk vooral dat.
Veelgestelde vragen
Agents op je eigen fundament
Of je de agentlaag nu zelf host of inkoopt, de winst zit in de koppelingen eronder en in wie het onderhoudt. Ik denk met je mee over die keuze, ontwerp de opzet en bouw en automatiseer hem end-to-end, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
