Close-up van een verlichte printplaat met digitale schakelingen
Nieuws20 september · 12:154 min leestijd

StepFun presenteert Step 5 Preview met context van 1 miljoen tokens

StepFun presenteert Step 5 Preview met 600 miljard parameters, 27 miljard actieve parameters per token en 1 miljoen tokens context. De aangekondigde gewichten op 15 oktober maken API versus zelf hosten concreet.

StepFun presenteert Step 5 Preview als sparse-MoE-model met 600 miljard parameters, 27 miljard actieve parameters per token en een contextvenster van 1 miljoen tokens.

Voor een Nederlandse ondernemer maakt dat de grens tussen een externe model-API en zelf beheren concreter. De API is nu beschikbaar. StepFun zegt de gewichten op 15 oktober vrij te geven, waardoor teams straks ook de hardware-, hosting- en beheerkeuze moeten maken.

Wat Step 5 Preview brengt

Step 5 Preview is een model voor softwareontwikkeling, agenttaken, professioneel kenniswerk en financiële analyse. Het verwerkt tekst en afbeeldingen en is gebouwd voor lange taken waarin een agent informatie verzamelt, gereedschap gebruikt en meerdere keren bijstuurt. Een contextvenster van 1 miljoen tokens geeft daarvoor veel meer ruimte dan een gewone chatprompt, bijvoorbeeld voor omvangrijke code, contracten of onderzoeksdossiers.

De sparse-MoE-opzet betekent dat niet alle 600 miljard parameters bij ieder token actief zijn. Per token gebruikt het model volgens StepFun 27 miljard parameters. Dat maakt de actieve berekening lichter dan de totale modelomvang doet vermoeden, maar het neemt de opslag, infrastructuur en het beheer van de volledige gewichten niet weg.

De deploymentkeuze verschuift

Tot 15 oktober is Step 5 Preview voor Nederlandse teams vooral een API-keuze. Daarna ontstaat er ook een route waarbij de gewichten zelf of via een Europese hostingpartij kunnen worden gedraaid, als de licentie, hardware en operationele inrichting dat toelaten. De data kan dan binnen een eigen omgeving blijven, maar de verantwoordelijkheid verschuift mee: updates, toegangsbeheer, logging, capaciteit en incidentafhandeling komen niet meer vanzelf bij de API-leverancier te liggen.

Grafiek van StepFun over intelligentiescore en kosten per taak, Bron: StepFun
Grafiek van StepFun over intelligentiescore en kosten per taak, Bron: StepFun

Dat is een andere afweging dan alleen de vraag welk model het slimste antwoord geeft. Een team dat lange documenten of meerstapsprocessen verwerkt, vergelijkt vanaf oktober ook de kosten van API-gebruik met de vaste kosten en beheertijd van een eigen omgeving. De 27 miljard actieve parameters zijn daarbij relevant voor de inferentie, maar geen bewijs dat een model van deze omvang op een gewone bedrijfsserver past.

Benchmarks geven richting

StepFun rapporteert op de eigen pagina een score van 49,0 procent op StepCodeBench, 66,4 op FrontierFinance en een score van 44 op de Artificial Analysis Intelligence Index. Die cijfers laten zien waar het bedrijf de preview positioneert, maar ze beantwoorden niet of het model goed genoeg is voor de eigen Nederlandse documenten, software of financiële processen.

De praktische betekenis zit daarom in de combinatie van context en inzetbaarheid. Een miljoen tokens kan de invoer van een groot dossier vereenvoudigen, maar een lang venster maakt bronkwaliteit, toegangsrechten en controleerbare uitkomsten niet overbodig. Voor agenttaken blijft ook van belang hoe goed het model fouten herkent en wanneer het stopt.

De release past in een bredere verschuiving naar open gewichten: open-weightmodellen verwerkten in augustus 56 procent van de tokens op Vercels AI Gateway, maar slechts 14 procent van de geschatte uitgaven. Step 5 Preview voegt daar een model aan toe waarbij lange context, agentisch werk en zelf beheren tegelijk op de agenda komen.

De belangrijkste verandering is dus niet alleen een groter model. Vanaf 15 oktober wordt de keuze tastbaarder tussen snelheid via een API en controle over de volledige modelomgeving. Dat maakt modelkeuze steeds meer een infrastructuurbesluit.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van modelkeuze naar eigen regie

Ik help je de keuze tussen API en self-hosting vertalen naar een werkende oplossing. Van meedenken en ontwerpen tot bouwen en automatiseren, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Verken verder

Concepten

Open-weight modellenSelf-hostingBenchmarkingContextvensterDeploymentkeuze: API versus self-hostedAPI deploymentLange contextvenstersSparse mixture-of-experts (MoE)

Gerelateerde artikelen

Open modellen halen 62 procent van het tokenverkeer op Vercels AI Gateway
Nieuws
5 min

24 aug 02:11

Open modellen halen 62 procent van het tokenverkeer op Vercels AI Gateway

Op 22 augustus liep 62 procent van alle tokens op Vercels AI Gateway over open modellen, tegen 28,4 procent in juni. De uitgaven volgen die verschuiving niet: daar houdt Anthropic de meerderheid vast.

Vercel vervangt OpenAI-model in veiligheidsclassifier door Jev
Nieuws
4 min

18 sep 22:17

Vercel vervangt OpenAI-model in veiligheidsclassifier door Jev

Een Vercel-engineer meldt dat TypeSafe's Jev in een veiligheidsclassifier 5 tot 18 keer sneller en nauwkeuriger was dan GPT-5.6 Luna. De test maakt gespecialiseerde AI-beslissingen concreet voor agentsoftware.

Amerikaanse AI-labs verlagen tarieven, tokenindex een kwart lager
Nieuws
5 min

15 aug 06:10

Amerikaanse AI-labs verlagen tarieven, tokenindex een kwart lager

Klanten van OpenAI en Anthropic betalen sinds midden juli bijna een kwart minder per miljoen tokens. Anthropic schrapte bovendien een verhoging die op 1 september zou ingaan, terwijl de topmodellen onveranderd duur blijven.

DeepSeek passeert Google in tokenvolume, prijs per token daalt 13,6 procent
Nieuws
5

13 aug 08:33

DeepSeek passeert Google in tokenvolume, prijs per token daalt 13,6 procent

DeepSeek verwerkte in juli een kwart van het tokenverkeer op Vercels AI Gateway en passeerde daarmee Google, terwijl de gemiddelde prijs per token 13,6 procent daalde. Die daling komt volledig uit de modelkeuze van bedrijven zelf.

Anthropic overweegt nieuw AI-model na opmars GPT-6 Astra
Nieuws
4 min

19 sep 08:12

Anthropic overweegt nieuw AI-model na opmars GPT-6 Astra

Anthropic overweegt een nieuw model omdat OpenAI met GPT-6 Astra terrein wint bij bedrijven. De mogelijke release legt bloot hoe snel modelkeuze, hertesten en leveranciersrisico voor Nederlandse organisaties verschuiven.

Open modellen halen 56 procent van AI Gateway-tokens
Nieuws
4 min

18 sep 16:26

Open modellen halen 56 procent van AI Gateway-tokens

Open-weight-modellen verwerken voor het eerst meer dan de helft van de tokens op Vercels AI Gateway. Toch gaat 64 procent van de uitgaven naar Anthropic, wat modelrouting tot een kostenkeuze maakt.