Anthropic opent dynamische workflows in bèta voor Claude Managed Agents, waarmee een hoofdagent zelf een uitvoerbaar werkplan schrijft en een meerfasige taak door andere agents laat uitvoeren.
Een Nederlands softwareteam kan daarmee grotere codebases of documentverzamelingen parallel laten onderzoeken. De operationele grens is concreter dan de kop doet vermoeden: Anthropic telt maximaal 1.000 agentstarts over een hele run en noemt 64 actieve threads tegelijk. Dat bepaalt hoeveel werk tegelijk loopt, hoeveel modelverbruik optelt en hoeveel bevindingen mensen moeten kunnen controleren.
De agent schrijft het werkplan
Een workflow is meer dan een hoofdagent die telkens beslist welke specialist aan de beurt is. De hoofdagent schrijft een uitvoerbaar plan met fasen. Het programma start agents, verzamelt hun antwoorden, geeft resultaten door en kan stappen herhalen of op basis van uitkomsten een volgende fase kiezen. De server voert het programma als achtergrondrun uit en maakt afzonderlijke sessiethreads wanneer nodig.
Bij een documentcontrole kan een eerste agent bijvoorbeeld ieder contract scannen en een tweede alle documenten nalopen, ook als de eerste geen probleem signaleerde. Dat gebeurt alleen als het werkplan die controle expliciet voorschrijft. Voor activering zijn multiagent.type op multiagent_20261001 en de Managed Agents-betaheader nodig. De agent kan zijn workflow dus zelf uitschrijven, maar de organisatie bepaalt nog steeds welke controle in dat programma terechtkomt.

De coördinatie lijkt op Claude Code Projects, maar het is een andere functie. Claude Code Projects verdeelt ontwikkeldoelen over threads met eigen branches, tests en pull requests, met gedeeld projectgeheugen. Managed Agents is de API-omgeving voor agents en workflows die op Anthropic-infrastructuur draaien. De nieuwe workflowfunctie is dus geen uitbreiding van de Projects-interface.
De 1.000 geldt over de hele run
De kop van The Decoder spreekt van 1.000 agents in parallel. De API-documentatie maakt een preciezer onderscheid: maximaal 64 agentthreads werken tegelijk; 1.000 is het totaal aan agentstarts dat een workflow gedurende haar levensduur kan doen. Volgens Anthropic is het aantal gelijktijdige threads geen vaste API-garantie. Een run duurt standaard maximaal 24 uur; per sessie zijn standaard tien runs tegelijk open.
Bij een taak die in kleine, onafhankelijke delen valt, kunnen agents parallel bestanden of documenten behandelen. Als resultaten eerst door een mens moeten worden samengevoegd voordat de rest kan beginnen, bepaalt dat menselijke werk de doorlooptijd. Mislukte agents kunnen opnieuw op een thread draaien, waardoor het totale threadgebruik boven 1.000 kan uitkomen.
De proef telt gevonden bugs
Op 9 oktober publiceerde Anthropic op het officiële Claude Developers-account een test met 70 bewust ingeplante bugs in een codebase van 116.000 regels. In drie runs vond één agent achtereenvolgens 14, 15 en 27 bugs. Volgens het officiële testbericht vond de dynamische workflow in elk van de drie runs 66 bugs. Dat is een groot verschil binnen deze proef, maar geen maat voor de totale kwaliteit van codecontrole.
De telling gaat over het vinden van ingeplante fouten. Anthropic meldt niet hoeveel foutieve meldingen er waren, hoeveel tokens of tijd beide methodes gebruikten, of de bugs correct zijn opgelost en of dezelfde fouten in iedere run terugkwamen. De vergelijking betreft één codebase en toont dus niet aan dat een workflow geld bespaart of alle relevante fouten vindt.
Kosten en review blijven meetbaar werk
Anthropic waarschuwt dat workflows veel tokens kunnen verbruiken en adviseert met een afgebakende taak te beginnen. Een eerdere uitleg van Anthropic noemt voor vergelijkbaar werk typisch drie tot tien keer zoveel tokens voor multi-agentsystemen als voor één agent. Dat is algemene guidance, geen rekening van deze bugtest.
Managed Agents rekent modeltokens af tegen de modelprijs en voegt daar 8 dollarcent per draaiend sessie-uur aan toe. Die sessieprijs telt overlappende agents niet elk als een apart uur; tokengebruik telt wel per agent op. Een sessiebudget is gedeeld over alle threads en gebaseerd op de openbare lijstprijs. Zodra de grens is bereikt, starten geen nieuwe modelverzoeken, maar lopende verzoeken mogen afronden. Volgens Anthropics budgetdocumentatie kan de rekening tot maximaal één lopend verzoek per actieve thread boven de grens uitkomen.
De configuratie bepaalt per agent welke tools, MCP-servers en vaardigheden beschikbaar zijn. Codeopdrachten vragen daarom om afgebakende toegang en duidelijke taakverdeling. Voor teams die hun verbruik willen meten, limieten instellen en modellen op taken afstemmen, is er ook een aanpak voor tokenkosten met budgetten en modelroutering.
Een ontwikkelaar uit OpenAI’s Codex-team noemt de coördinatielast van parallelle agents een ‘coordination tax’: zonder strakke taakgrenzen kunnen agents elkaar extra laten controleren en tokens verbruiken. Ook bij de 388 pull requests die Claude Code bij Anthropic opende, waarvan er 180 na menselijke review werden gemerged, bleef review onderdeel van het proces.
De verschuiving zit in wie de taakverdeling uitschrijft: de hoofdagent kan nu een programma maken dat agents start, resultaten samenvoegt en controles herhaalt. De proef laat zien dat zo’n aanpak meer ingeplante fouten kan vinden dan één agent, maar publiceert geen kosten of fixkwaliteit. Een Nederlandse pilot krijgt daarom vier meetpunten: gevonden fouten, foutieve meldingen, fixes die review doorstaan en tokens per run.
Veelgestelde vragen
Van agents naar werkend proces
Ik denk mee over de taak, ontwerp de workflow en realiseer hem end-to-end, van eerste idee tot automatisering in je organisatie. Waar het kan bouw ik self-hosted, met kosten en toegangsrechten vanaf het begin in beeld.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
