Close-up van een printplaat met computerchips
Nieuws11 september · 10:344 min leestijd

Sakana AI brengt Fugu Max en Fugu Ultra v2 uit

Sakana AI brengt Fugu Max en Fugu Ultra v2 uit als twee varianten van dezelfde orkestratielaag. Max stuurt op kosten, Ultra v2 op kwaliteit, met nieuwe tokenprijzen en een bredere pool van open en gespecialiseerde modellen.

Sakana AI brengt op 11 september Fugu Max en Fugu Ultra v2 uit, twee nieuwe varianten van zijn multi-agent-orkestrator die modelkeuze en kosten achter één OpenAI-compatibele API bundelen.

Voor een Nederlandse organisatie die een AI-agent bouwt, verschuift daarmee de rekensom achter de toepassing: één integratie kan meerdere modellen inzetten, terwijl de kosten per taak afhangen van de gekozen route en het soort werk. De afhankelijkheid verdwijnt niet. De orkestrator blijft een gehoste dienst van Sakana en is voor gebruikers in de EU en EER nog niet beschikbaar.

Schematische weergave van Fugu Max boven een pool van open en gesloten modellen, bron: Sakana AI
Schematische weergave van Fugu Max boven een pool van open en gesloten modellen, bron: Sakana AI

Twee varianten, één orkestratielaag

Fugu Max en Fugu Ultra v2 zijn geen losse productlijnen, maar dezelfde kernarchitectuur met een ander doel. Max routeert een taak naar het lichtste model dat het werk aankan. Ultra v2 zet juist een diepere pool in voor complexe meerstapsopdrachten, zoals onderzoek, softwareontwikkeling en analyse van visuele gegevens.

Voor Fugu Max noemt Sakana een prijs van 2 dollar per miljoen inputtokens en 6 dollar per miljoen outputtokens. Het bedrijf zegt dat de outputprijs daarmee 40 tot 60 procent lager ligt dan bij Sonnet 5, GPT 5.6 Terra en Kimi K3. Sakana meldt ook de beste totaalscore op zes benchmarks en een uitbreiding van de kosten-prestatiegrens op zeven van tien benchmarks.

Fugu Ultra v2 kiest de andere kant van die grens. De console vermeldt 5 dollar per miljoen inputtokens en 30 dollar per miljoen outputtokens; voor contexten boven 272.000 tokens stijgen die tarieven naar 10 en 45 dollar. De console voert de nieuwe versies als fugu-max-v1.0 en fugu-ultra-v2.0.

Officiële benchmarkvergelijking van Fugu Ultra v2 met andere AI-modellen, bron: Sakana AI
Officiële benchmarkvergelijking van Fugu Ultra v2 met andere AI-modellen, bron: Sakana AI

Welke modellen zitten erin

De release noemt voor Fugu Max expliciet een grotere pool van open en gespecialiseerde modellen, met NVIDIA’s Nemotron-familie als concreet voorbeeld. MarkTechPost beschrijft dezelfde pool als een uitbreiding met open gewichten en gespecialiseerde modellen. Een volledige lijst van de modellen die Fugu per verzoek kiest, publiceert Sakana niet. De eigen productpagina noemt die routering bedrijfsgeheim.

Voor Ultra v2 maakt Sakana wel duidelijk welke bekende modellen niet worden gebruikt: Fable 5, Fable 5.1 en GPT-6-Astra zitten niet in de agentpool. De cijfers komen uit Sakana’s eigen vergelijkingen, niet uit een onafhankelijke test. Op Chartography scoort Ultra v2 volgens de release 48,3, tegenover 27,3 voor Opus 5 en 29,5 voor Fable 5. Op DeepSWE komt het model op 74,3.

Wat er voor Nederlandse bedrijven verandert

De praktische winst zit in een vervangbare modelkeuze achter een vaste aansluiting. Bestaande Fugu-gebruikers kunnen volgens Sakana met één parameterwijziging naar Max of Ultra v2 gaan, zonder hun integratie te migreren. Dat verlaagt de overstap binnen Sakana’s eigen laag, maar zegt niets over een exit uit de dienst zelf.

Voor Nederlandse organisaties wegen daarom drie grenzen mee. De prijs per token is zichtbaar, maar de route naar een onderliggend model niet. De productpagina zegt dat specifieke modellen per verzoek niet worden getoond, en dat Fugu niet beschikbaar is in EU en EER zolang Sakana aan GDPR- en andere Europese vereisten werkt. MarkTechPost beschrijft het aanbod bovendien als een gehoste API zonder open gewichten om zelf te draaien.

De stap bouwt voort op Fugu’s eerdere orkestratielaag die meerdere frontier-LLM’s achter één API combineert, maar maakt de onderliggende inzet concreter. Modelkeuze verhuist van de applicatiecode naar een aparte infrastructuurlaag. De prijs is daar het makkelijkste onderdeel om te vergelijken; de zichtbaarheid van de pool, de verwerkingslocatie en de uitweg bepalen hoeveel keuze er werkelijk overblijft.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Meer grip op modelkeuze

Ik ontwerp en bouw AI-systemen waarin modelkeuze, koppelingen en automatisering bij jouw proces passen. Van meedenken en ontwerp tot realiseren, met self-hosted waar dat kan, zodat je niet alleen een losse AI-tool krijgt.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Amerikaanse AI-labs verlagen tarieven, tokenindex een kwart lager
Nieuws
5 min

15 aug 06:10

Amerikaanse AI-labs verlagen tarieven, tokenindex een kwart lager

Klanten van OpenAI en Anthropic betalen sinds midden juli bijna een kwart minder per miljoen tokens. Anthropic schrapte bovendien een verhoging die op 1 september zou ingaan, terwijl de topmodellen onveranderd duur blijven.

OpenAI past benchmarkcijfers van GPT-6 Astra aan zonder correctiemelding
Nieuws
5 min

5 sep 14:21

OpenAI past benchmarkcijfers van GPT-6 Astra aan zonder correctiemelding

OpenAI paste na de lancering van GPT-6 Astra benchmarkscores op zijn eigen pagina aan zonder correctiemelding. Archiefopnames tonen wijzigingen op Terminal-Bench, HealthBench, GeneBench Pro en ExploitBench tussen 3 en 5 september.

Astra blokkeert directe prompt-injecties, verstopte lukken in 8,5 procent
Nieuws
5 min

4 sep 20:10

Astra blokkeert directe prompt-injecties, verstopte lukken in 8,5 procent

Gray Swan kreeg GPT-6 Astra in 8,5 procent van de scenario's toch zover dat het instructies uitvoerde die in een document verstopt zaten, tegen 4,8 procent bij Claude Opus 5. Directe injecties blokkeert het model wel.

Alibaba zet de gewichten van Qwen3.8-Max volgende week open
Nieuws
5 min

3 aug 06:12

Alibaba zet de gewichten van Qwen3.8-Max volgende week open

Alibaba maakt Qwen3.8-Max wereldwijd beschikbaar en zet de gewichten volgende week open, samen met een kleinere 27B-versie. Het gehoste model kost 2 dollar per miljoen invoertokens, ruim onder Claude Opus 5.

Palantir stelt retentie-eis, Nvidia en Booz Allen beperken Anthropic
Nieuws
5 min

14 sep 18:22

Palantir stelt retentie-eis, Nvidia en Booz Allen beperken Anthropic

Palantir eist onherroepelijke nulretentie, Nvidia beperkt Anthropic tot minder gevoelige taken en Booz Allen blokkeert het commerciële model voor vertrouwelijk cyberwerk. Retentie wordt zo een directe modelkeuze.

GPT-6 Astra leidt fysieke en zakelijke agenttests
Nieuws
5 minBijgewerkt om 16:19

13 sep 14:19

GPT-6 Astra leidt fysieke en zakelijke agenttests

Nieuwe evaluaties van Andon Labs laten GPT-6 Astra een drone door een kantoor sturen en een jaar lang een gesimuleerd verkoopbedrijf beheren. De beste drone-run haalt de referentie op alle vijf taken; Vending-Bench zet Astra bovenaan.