Sakana AI brengt op 11 september Fugu Max en Fugu Ultra v2 uit, twee nieuwe varianten van zijn multi-agent-orkestrator die modelkeuze en kosten achter één OpenAI-compatibele API bundelen.
Voor een Nederlandse organisatie die een AI-agent bouwt, verschuift daarmee de rekensom achter de toepassing: één integratie kan meerdere modellen inzetten, terwijl de kosten per taak afhangen van de gekozen route en het soort werk. De afhankelijkheid verdwijnt niet. De orkestrator blijft een gehoste dienst van Sakana en is voor gebruikers in de EU en EER nog niet beschikbaar.

Twee varianten, één orkestratielaag
Fugu Max en Fugu Ultra v2 zijn geen losse productlijnen, maar dezelfde kernarchitectuur met een ander doel. Max routeert een taak naar het lichtste model dat het werk aankan. Ultra v2 zet juist een diepere pool in voor complexe meerstapsopdrachten, zoals onderzoek, softwareontwikkeling en analyse van visuele gegevens.
Voor Fugu Max noemt Sakana een prijs van 2 dollar per miljoen inputtokens en 6 dollar per miljoen outputtokens. Het bedrijf zegt dat de outputprijs daarmee 40 tot 60 procent lager ligt dan bij Sonnet 5, GPT 5.6 Terra en Kimi K3. Sakana meldt ook de beste totaalscore op zes benchmarks en een uitbreiding van de kosten-prestatiegrens op zeven van tien benchmarks.
Fugu Ultra v2 kiest de andere kant van die grens. De console vermeldt 5 dollar per miljoen inputtokens en 30 dollar per miljoen outputtokens; voor contexten boven 272.000 tokens stijgen die tarieven naar 10 en 45 dollar. De console voert de nieuwe versies als fugu-max-v1.0 en fugu-ultra-v2.0.

Welke modellen zitten erin
De release noemt voor Fugu Max expliciet een grotere pool van open en gespecialiseerde modellen, met NVIDIA’s Nemotron-familie als concreet voorbeeld. MarkTechPost beschrijft dezelfde pool als een uitbreiding met open gewichten en gespecialiseerde modellen. Een volledige lijst van de modellen die Fugu per verzoek kiest, publiceert Sakana niet. De eigen productpagina noemt die routering bedrijfsgeheim.
Voor Ultra v2 maakt Sakana wel duidelijk welke bekende modellen niet worden gebruikt: Fable 5, Fable 5.1 en GPT-6-Astra zitten niet in de agentpool. De cijfers komen uit Sakana’s eigen vergelijkingen, niet uit een onafhankelijke test. Op Chartography scoort Ultra v2 volgens de release 48,3, tegenover 27,3 voor Opus 5 en 29,5 voor Fable 5. Op DeepSWE komt het model op 74,3.
Wat er voor Nederlandse bedrijven verandert
De praktische winst zit in een vervangbare modelkeuze achter een vaste aansluiting. Bestaande Fugu-gebruikers kunnen volgens Sakana met één parameterwijziging naar Max of Ultra v2 gaan, zonder hun integratie te migreren. Dat verlaagt de overstap binnen Sakana’s eigen laag, maar zegt niets over een exit uit de dienst zelf.
Voor Nederlandse organisaties wegen daarom drie grenzen mee. De prijs per token is zichtbaar, maar de route naar een onderliggend model niet. De productpagina zegt dat specifieke modellen per verzoek niet worden getoond, en dat Fugu niet beschikbaar is in EU en EER zolang Sakana aan GDPR- en andere Europese vereisten werkt. MarkTechPost beschrijft het aanbod bovendien als een gehoste API zonder open gewichten om zelf te draaien.
De stap bouwt voort op Fugu’s eerdere orkestratielaag die meerdere frontier-LLM’s achter één API combineert, maar maakt de onderliggende inzet concreter. Modelkeuze verhuist van de applicatiecode naar een aparte infrastructuurlaag. De prijs is daar het makkelijkste onderdeel om te vergelijken; de zichtbaarheid van de pool, de verwerkingslocatie en de uitweg bepalen hoeveel keuze er werkelijk overblijft.
Veelgestelde vragen
Meer grip op modelkeuze
Ik ontwerp en bouw AI-systemen waarin modelkeuze, koppelingen en automatisering bij jouw proces passen. Van meedenken en ontwerp tot realiseren, met self-hosted waar dat kan, zodat je niet alleen een losse AI-tool krijgt.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
