Programmacode weergegeven op een computerscherm.
Nieuws22 juli · 06:114 min leestijd

Poolside brengt Laguna S 2.1 uit: westers open codeermodel dat je zelf host

Poolside brengt Laguna S 2.1 uit, een open-weight codeermodel van 118 miljard parameters dat op één NVIDIA DGX Spark draait. Een westers alternatief naast de Chinese open modellen Kimi, GLM en Qwen, met volledige controle over waar je code draait.

Poolside heeft Laguna S 2.1 uitgebracht, een open-weight codeermodel van 118 miljard parameters dat op één NVIDIA DGX Spark draait en volgens het bedrijf de grootste open codeermodellen bijbeent.

Voor een Nederlands ontwikkelteam verandert dat de rekensom rond zelf-hosting. De open-weight codeermodellen die de buurt van de gesloten top haalden, waren tot nu toe vooral Chinees: Kimi, GLM en Qwen. Wie code en data binnen de eigen muren wil houden, moest dus kiezen tussen een Amerikaanse gesloten API en een open model onder Chinese vlag. Laguna S 2.1 zet daar een westers alternatief naast dat je op desktop-klasse hardware draait.

Wat Laguna S 2.1 is

Het model is een Mixture-of-Experts van 118 miljard parameters, waarvan er per token 8 miljard daadwerkelijk meedoen. Het verwerkt tot 1 miljoen tokens context in één keer, genoeg voor een flinke codebase in één prompt. De gewichten staan open op Hugging Face onder de OpenMDW-1.1-licentie, in formaten van BF16 tot 4-bit, met kant-en-klare GGUF- en MLX-conversies.

Het self-hosting-verhaal is de kern. In 4-bit precisie past het model in ongeveer 59 GB op één NVIDIA DGX Spark, het compacte AI-werkstation dat Nvidia dit jaar op de markt bracht. Je draait het lokaal met vLLM, SGLang of Ollama. Wil je niet zelf hosten, dan staat het ook bij Baseten, OpenRouter en Vercel's AI Gateway, met bij OpenRouter een gratis laag tot 256.000 tokens context.

De benchmarks, eerlijk gelezen

Op SWE-Bench Multilingual, een test die codeertaken in meerdere programmeertalen meet, haalt Laguna S 2.1 78,5 procent en leidt het daarmee de gepubliceerde open modellen, net voor Qwen 3.7 Max (78,3 procent). Het gesloten Claude Fable 5 blijft met 80,3 procent nog voor.

Dat patroon tekent het hele beeld. Laguna S 2.1 houdt zich staande tegen modellen die een veelvoud groter zijn, waaronder DeepSeek-V4-Pro-Max en Nvidia's Nemotron 3 Ultra, maar het topt de gesloten frontier niet. Op langere, meerstaps-taken zoals Terminal-Bench 2.1 (70,2 procent) en DeepSWE (40,4 procent) lopen zowel het Chinese Kimi K3 als Claude Fable 5 nog een flink stuk voor. De winst zit dus niet in de absolute top, maar in wat je krijgt voor de omvang: bijna-frontier codeerwerk uit een model dat op één machine past.

SWE-Bench Multilingual, score in procenten (bron: Poolside)

De sprong komt vooral van gedrag, niet van meer parameters. Co-head Applied Research Pengming Wang beschrijft de verbetering als meer verificatie, minder dingen voor lief nemen en niet te vroeg victorie kraaien, waardoor het model taken langer volhoudt.

Waarom een westers open model ertoe doet

De inzet is soevereiniteit, niet alleen snelheid. Open gewichten lossen vendor lock-in in theorie op, maar in de praktijk verplaatsen ze de afhankelijkheid vaak naar Chinese labs en hun jurisdictie. Precies dat is de leegte die Poolside claimt te vullen. Co-CEO Jason Warner stelt dat het Westen open-weight modellen nodig heeft die het kan vertrouwen, zelf draaien en waarop het kan doorbouwen.

Voor een team dat agentic codeerwerk in hoog volume draait, betekent self-hosting dat gevoelige code en sleutels de eigen omgeving niet verlaten en dat je niet per token bij een externe API afrekent. Dat is dezelfde afweging die eerder speelde bij Kimi K2.7-Code, een open codeermodel dat fors goedkoper is maar onder de gesloten top duikt, nu met een aanbieder die niet onder Chinees recht valt.

Daarmee is de open-weight codeerhoek niet langer een keuze tussen een Amerikaanse gesloten API en een Chinees open model. De echte vraag verschuift van onder welke vlag je model valt naar of je architectuur draagbaar blijft: of je een model kunt vervangen zonder je hele stack om te bouwen. Een westers alternatief dat op één machine draait, maakt die vraag concreter dan ze een half jaar geleden was.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Zelf AI draaien, in eigen beheer

Een open model kiezen is stap één; de agents, koppelingen en de self-hosted infrastructuur eromheen laten werken is het echte werk. Dat traject ontwerp en bouw ik end-to-end mee, van meedenken tot draaiende automatisering.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Alibaba brengt Qwen 3.8 uit als betaalde preview, open gewichten volgen later
Nieuws
4 min

19 jul 18:09

Alibaba brengt Qwen 3.8 uit als betaalde preview, open gewichten volgen later

Alibaba bracht Qwen 3.8 uit, een model van 2,4 biljoen parameters dat het bedrijf “op één na Fable 5” noemt. Voorlopig alleen als betaalde preview; open gewichten volgen “binnenkort” en onafhankelijke benchmarks ontbreken.

Meituan brengt LongCat-2.0 uit: een open codeermodel van 1,6 biljoen parameters, getraind zonder Nvidia
Nieuws
6 min

30 jun 08:32

Meituan brengt LongCat-2.0 uit: een open codeermodel van 1,6 biljoen parameters, getraind zonder Nvidia

Het Chinese Meituan geeft LongCat-2.0 vrij onder de MIT-licentie: een open codeermodel van 1,6 biljoen parameters, volledig getraind op Chinese chips zonder een enkele Nvidia-kaart. Dat verschuift opnieuw de prijs-kwaliteitverhouding.

Welk open-weight AI-model past bij jouw bedrijf: vergelijking en stappenplan
Gids
9 min

20 jun 19:05

Welk open-weight AI-model past bij jouw bedrijf: vergelijking en stappenplan

Er zijn opeens tien capabele open-weight modellen en ze claimen allemaal de beste te zijn. Dit is hoe je in een halve dag de juiste kiest voor jouw taak, budget en data-eisen.

Zhipu maakt GLM-5.2 open source en vult het gat dat Anthropic achterliet
Nieuws
5 min

15 jun 10:11

Zhipu maakt GLM-5.2 open source en vult het gat dat Anthropic achterliet

Het Chinese Zhipu AI geeft zijn krachtigste model GLM-5.2 vrij onder een MIT-licentie, met een context van 1 miljoen tokens. Een gratis inzetbaar alternatief, precies nu Anthropic buiten de VS offline ging.

Kimi K2.7-Code: een open codeermodel dat fors onder GPT-5.5 en Claude duikt
Nieuws
5 min

13 jun 14:04

Kimi K2.7-Code: een open codeermodel dat fors onder GPT-5.5 en Claude duikt

Het Chinese Moonshot AI bracht Kimi K2.7-Code uit, een open-weight codeermodel met 1 biljoen parameters. Op de prijs per token gaat het tot 12 keer onder de duurste Claude. Wat betekent dat voor jouw bedrijf?

Bessent dreigt met sancties tegen China om diefstal van AI-modellen
Nieuws
3 min

21 jul 16:40

Bessent dreigt met sancties tegen China om diefstal van AI-modellen

Minister van Financiën Scott Bessent zegt dat de VS Chinese AI-modellen doorlicht op diefstal van Amerikaanse technologie via distillatie, met sancties als dreiging. Voor Nederlandse teams die op goedkope Chinese open modellen bouwen groeit daarmee het leveranciersrisico.