Zwarte serverracks in een datacenter met veel bekabeling
Nieuws16 juli · 16:403 min leestijd

Fireworks bereikt 17,5 miljard dollar waardering door vraag naar goedkopere AI-modellen

Inferentieplatform Fireworks haalde 1,5 miljard dollar op en staat nu op 17,5 miljard waardering. De inzet: kleinere open modellen die de tokenkosten tot tien keer verlagen voor bedrijven die nu op dure frontier-API's leunen.

Fireworks, het platform waarmee bedrijven goedkopere open-source AI-modellen draaien in plaats van dure gesloten API's, is gewaardeerd op 17,5 miljard dollar na een nieuwe ronde van 1,5 miljard dollar onder leiding van Menlo Ventures.

Voor een Nederlands bedrijf dat nu voor elke AI-functie afrekent bij een dure frontier-API, verschuift dat de rekensom. Medeoprichter Lin Qiao stelt dat kleinere, op maat afgestemde modellen de tokenkosten 5 tot 10 keer kunnen verlagen voor specifieke taken. Klant Factory, een ontwikkelplatform, haalt naar eigen zeggen vijftien keer zoveel werk uit hetzelfde budget door open modellen te draaien.

Fireworks draait open modellen als DeepSeek en Qwen tegen betaling per token, met een eigen inferentielaag die op lage latentie mikt. De waardering sprong in enkele maanden van rond de 4 miljard naar 17,5 miljard dollar; sommige koppen ronden dat af naar 18 miljard. Nvidia en Sequoia Capital behoren tot de investeerders.

De cijfers laten zien hoeveel geld er in deze hoek omgaat. Het dagelijkse tokenvolume op het platform verdrievoudigde sinds eind 2025 van 15 biljoen naar 43 biljoen, en de omzet op jaarbasis nadert volgens hoofdinvesteerder Menlo Ventures de 1 miljard dollar. Codeertool Cursor trainde er zijn model Composer 2 op.

De ronde past in een bredere verschuiving. Concurrent Baseten haalde vorige maand eveneens 1,5 miljard dollar op als goedkoper alternatief voor OpenAI en Anthropic, en Amazon-topman Werner Vogels ziet bedrijven als Uber en Coinbase overstappen op goedkopere open-source modellen. De inzet is telkens dezelfde: dezelfde taak voor een fractie van de prijs van een gesloten frontier-model.

Wel is goedkoper niet automatisch goedkoper. Zodra je alle verborgen kosten van zelf draaien meerekent, blijkt een cloud-API vaak toch voordeliger, en het echte omslagpunt hangt af van je volume en beheerlast. Wat de opmars van spelers als Fireworks vooral signaleert, is dat de dure frontier-API niet langer de standaardkeuze is, maar één optie in een afweging die je per taak maakt.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Kies je AI-model op kosten

Ik help je afwegen welk model per taak het goedkoopst en betrouwbaarst is, van open modellen zelf draaien tot een slimme koppeling met een API, en bouw de laag eromheen zodat het in je proces past.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

OpenAI en Anthropic overbieden elkaar met gratis rekenkracht voor startups
Nieuws
3 min

7 jul 14:23

OpenAI en Anthropic overbieden elkaar met gratis rekenkracht voor startups

OpenAI en Anthropic overbieden elkaar met miljoenen aan gratis rekenkracht om AI-startups binnen te halen. Aantrekkelijk op korte termijn, maar de credits vergroten je afhankelijkheid van één modelleverancier. Wat dat betekent voor een Nederlandse AI-startup.

Nvidia ruilt AI-rekenkracht voor een deel van je omzet in plaats van kapitaal vooraf
Nieuws
5 min

2 jul 10:40

Nvidia ruilt AI-rekenkracht voor een deel van je omzet in plaats van kapitaal vooraf

Nvidia biedt AI-startups sinds 1 juli een omzetdelingsmodel: snellere toegang tot rekenkracht zonder grote investering vooraf, in ruil voor een percentage van je clouddiensten. Handig, maar het verdiept de afhankelijkheid van een enkele leverancier.

Nvidia versnelt Chinese open modellen en noemt een verbod erop een omzetrisico
Nieuws
4 min

28 aug 06:23

Nvidia versnelt Chinese open modellen en noemt een verbod erop een omzetrisico

Nvidia versnelt Qwen3.8-27B op zijn eigen RTX-kaarten en noemt in het kwartaalrapport van 26 augustus een verbod op DeepSeek, Qwen of Kimi een risico voor zijn resultaten. Die risicoparagraaf staat er al sinds februari.

Nvidia wil met de Poolside-licentie een open-weight topmodel bouwen
Nieuws
5 min

23 aug 06:07

Nvidia wil met de Poolside-licentie een open-weight topmodel bouwen

Nvidia wil de licentiedeal van 6 miljard dollar met Poolside gebruiken om een van 's werelds krachtigste open-weight modellen te bouwen, meldt The Wall Street Journal. Wat dat verandert voor teams die nu op Chinese gewichten zelf hosten.

Qwen passeert 3 miljard downloads en verdringt Llama en Gemma
Nieuws
5 min

15 aug 12:35

Qwen passeert 3 miljard downloads en verdringt Llama en Gemma

Alibaba's open Qwen-modellen zijn in zes maanden 3 miljard keer gedownload en gaan Meta en Google voorbij. Het cijfer komt van Alibaba zelf, terwijl Hugging Face op de eigen Hub ruim 2 miljard telt.

Witte Huis blaast sancties en cloudverbod op Chinese open modellen af
Nieuws
4 min

4 aug 16:25

Witte Huis blaast sancties en cloudverbod op Chinese open modellen af

Het Witte Huis overwoog sancties, een handelszwarte lijst en een verbod voor Amerikaanse cloudbedrijven om zaken te doen met Chinese makers van open AI-modellen. Na verzet uit Silicon Valley ging dat pakket van tafel, meldt The New York Times.