Softwareontwikkelaar typt code op een laptop voor een groot beeldscherm.
Nieuws1 oktober · 22:343 min leestijd

AWS maakt Strands Decider 2B open source

AWS publiceert Strands Decider 2B onder Apache 2.0. Het beslismodel kiest uit vaste opties en haalt volgens AWS een mediane latentie van 115 milliseconden op een RTX 3090. Eigen rekenkracht en beheer blijven onderdeel van de kosten.

Strands Decider 2B, AWS’ open beslismodel van 1,9 miljard parameters, kiest uit vaste antwoorden en haalt volgens AWS een mediaan van 115 milliseconden op een Nvidia RTX 3090.

Voor Nederlandse organisaties kan zo’n beslislaag eenvoudige keuzes lokaal afhandelen, zodat een agent die niet telkens naar een groot, gehost taalmodel hoeft te sturen. Daarmee verschuift een deel van de rekensom naar eigen rekenkracht en beheer.

De aanleiding komt volgens AWS-ingenieur Marc Brooker uit gesprekken met klanten. Hij vertelde TechCrunch dat een beslismodel agentstappen met lagere latentie en mogelijk lagere kosten kan afhandelen.

Een keuze, geen gesprek

Strands Decider schrijft geen vrije tekst. Het kiest tussen opgegeven opties, beantwoordt ja-neevragen of geeft een score met een betrouwbaarheidsschatting. AWS noemt modelroutering, toolkeuze en het controleren van toolargumenten als mogelijke taken. De repository deelt de code, trainingsdata en scripts onder Apache 2.0.

Diagram van Strands Decider 2B: een kleine scorelaag rangschikt antwoordopties in plaats van tekst te genereren. Bron: Strands Agents
Diagram van Strands Decider 2B: een kleine scorelaag rangschikt antwoordopties in plaats van tekst te genereren. Bron: Strands Agents

De toepassing bepaalt zelf wat de uitkomst doet. In het Strands-voorbeeld koos een ontwikkelaar vragen en drempels handmatig; een aparte integratiebibliotheek is nog in ontwikkeling.

Snel, binnen een smalle test

Op de openbare JevBench-set behaalde versie v19 167 goede antwoorden uit 231 taken, oftewel 72,3 procent. AWS plaatst het model derde van 33 in de 2B-klasse en meldt 153 milliseconden mediaan voor kleine taken op een M3 MacBook.

De test voorspelt niet hoe het model op de eigen vragen van een bedrijf presteert. De modelkaart zegt dat de betrouwbaarheidsschatting alleen op korte classificatietaken is getest. Daarom is die score niet vanzelf een betrouwbare vrijgavegrens voor elke workflow.

Strands Decider sluit aan op AWS’ open agentlaag: bij dezelfde GPT- of Claude-modellen mat AWS in zes benchmarks 28 procent minder tokens. Die rollen kunnen het werk verdelen: een klein model voor vaste keuzes, een groot taalmodel voor open antwoorden en complex redeneerwerk. De snelheid is meetbaar; de totale kostprijs hangt af van hardware, beheer en eigen gebruik.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Een eigen laag voor agentbesluiten

Ik denk mee over de beslissingen in je agentproces, ontwerp de hele oplossing en bouw die door tot de koppelingen en automatisering werken. Waar het kan draait de software op je eigen infrastructuur.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Cloudflare publiceert Clef-modellen voor agentbesluiten
Nieuws
3 min

1 okt 18:38

Cloudflare publiceert Clef-modellen voor agentbesluiten

Clef en Clef-flash geven agenten gestructureerde classificaties met kansen. Cloudflare publiceert de modelgewichten en modelcode onder Apache 2.0, terwijl de RL-finetuning voorlopig een begeleide dienst is.

OpenClaw introduceert zelf te hosten beheer voor AI-agenten
Nieuws
2 minBijgewerkt om 07:06

30 sep 04:49

OpenClaw introduceert zelf te hosten beheer voor AI-agenten

OpenClaw Enterprise biedt een zelf te hosten beheerlaag voor AI-agenten, met modelkeuze en hosting losser gekoppeld. De software valt onder MIT, maar is nog in ontwikkeling en bedoeld voor interne pilots.

CLEER schat energie en uitstoot van gesloten AI-modellen
Nieuws
3 min

29 sep 22:55

CLEER schat energie en uitstoot van gesloten AI-modellen

CLEER schat energie en uitstoot van gesloten AI-modellen met metingen aan open modellen. De cijfers kunnen modelkeuze naast kosten en kwaliteit leggen, maar blijven schattingen waar leveranciersdata ontbreekt.

OpenAI brengt GPT-6.1 Sol uit voor een vijfde van Astra’s API-prijs
Nieuws
3 min

29 sep 20:52

OpenAI brengt GPT-6.1 Sol uit voor een vijfde van Astra’s API-prijs

OpenAI brengt GPT-6.1 Sol naar de API. De standaard input- en outputprijs is een vijfde van Astra’s tarief, maar gelijk aan die van GPT-6 Sol; gecachte invoer wordt wel gehalveerd.

Anthropic claimt tot 30% lagere taakkosten met Sonnet 5.5
Nieuws
2 minBijgewerkt om 04:28

28 sep 22:23

Anthropic claimt tot 30% lagere taakkosten met Sonnet 5.5

Claude Sonnet 5.5 kost volgens Anthropic tot 30 procent minder per typische taak dan Sonnet 5, terwijl de input- en outputtarieven gelijk blijven. De besparing komt volgens het bedrijf uit lager tokenverbruik.

AWS lanceert Dogwood Local Engine voor lokale agentcontrole
Nieuws
3 min

1 okt 20:21

AWS lanceert Dogwood Local Engine voor lokale agentcontrole

AWS maakt Dogwood Local Engine beschikbaar als lokaal in te bouwen beleidsengine voor AI-agenten. De software toetst toolaanroepen vooraf, bewaart sessiegeschiedenis en laat het agent-harnas de uitkomst afdwingen.