Close-up van een rack met computerapparatuur in een serverruimte.
Nieuws28 september · 08:202 min leestijd

NaiveAI brengt 309B-model uit onder MIT

NaiveAI geeft de gewichten en inferentiecode van Naive-N0.5-Flash vrij onder MIT. Het model telt 309 miljard parameters, maar circa 315 GB aan FP8-gewichten maakt GPU-capaciteit en beheer doorslaggevend.

Naive-N0.5-Flash, het 309 miljard parameters tellende model van NaiveAI, verscheen op 27 september onder MIT met open gewichten en inferentiecode voor code en AI-onderzoek, meldt het bedrijf.

Voor Nederlandse ontwikkelteams verandert de afweging tussen een gehoste model-API en zelfbeheer. De MIT-licentie staat downloaden, aanpassen en commercieel gebruik toe. De nieuwe vrijheid vraagt wel om eigen GPU-capaciteit en beheer van de modelruntime.

De gewichten vragen forse capaciteit

Naive-N0.5-Flash is een mixture-of-expertsmodel met 309 miljard parameters in totaal en 15,5 miljard actieve parameters per token. De FP8-gewichten nemen circa 315 GB in beslag en vragen extra GPU-geheugen en FP8-capabele NVIDIA-GPU's. De modelrepository toont 49 downloadbare safetensors-bestanden. De actieve parameterwaarde maakt het model dus niet licht om lokaal te draaien.

Schema van het SWA-DSA-modelnetwerk en de selectie van maximaal 2.048 tokens per DSA-laag, afbeelding: NaiveAI
Schema van het SWA-DSA-modelnetwerk en de selectie van maximaal 2.048 tokens per DSA-laag, afbeelding: NaiveAI

Lange context vraagt geheugen

Voor een contextvenster van 1 miljoen tokens combineert het model meestal een lokaal aandachtsvenster van 128 tokens met een sparse laag die 2.048 eerdere tokens selecteert. De volledige KV-cache, het geheugen voor eerdere tokens, blijft behouden. Grote codebases of onderzoeksdossiers passen daardoor in een langer gesprek, terwijl de geheugenvraag blijft bestaan.

NaiveAI kondigt ook API-toegang aan met tarieven van $0,10 per miljoen invoertokens, $0,40 per miljoen uitvoertokens en $0,01 per miljoen tokens die uit de cache worden gelezen. De modelrepository noemt geen startdatum voor die API.

De licentie opent het model, maar lokale inzet blijft afhankelijk van GPU-capaciteit en runtimebeheer. Nederlandse teams kunnen straks de aangekondigde API afwegen tegen het draaien en onderhouden van 315 GB aan eigen gewichten.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van model naar AI-toepassing

Ik denk mee over de modelkeuze, ontwerp de toepassing en bouw en automatiseer het hele traject tot livegang. Waar het past, draait die oplossing in jouw eigen omgeving.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Altman noemt Hugging Face-inbraak OpenAI’s ergste ongeluk
Nieuws
3 min

16 sep 04:15

Altman noemt Hugging Face-inbraak OpenAI’s ergste ongeluk

Sam Altman noemt de Hugging Face-inbraak het ergste ongeluk van OpenAI. De erkenning verschuift het zakelijke gesprek naar leveranciers die agentgedrag kunnen monitoren, begrenzen en aantoonbaar melden.

Vier AI-labs brengen in één week nieuwe modellen uit
Nieuws
5 min

6 sep 18:11

Vier AI-labs brengen in één week nieuwe modellen uit

Anthropic, Meta, Google en OpenAI brachten tussen 1 en 3 september alle vier een nieuw model uit. CNBC noemt het model fatigue. Wat dat betekent voor je tarieven, je prompts en je evaluatiecyclus.

Open Secure AI Alliance stapt van Nvidia over naar de Linux Foundation
Nieuws
4 min

3 sep 04:21

Open Secure AI Alliance stapt van Nvidia over naar de Linux Foundation

De AI-beveiligingsalliantie die Nvidia in juli startte valt nu onder de Linux Foundation. Neutraal bestuur, aanmelden via LFX en meldstandaard SAFE als eerste proef voor wie zijn AI-verdediging zelf in handen wil houden.

116 bedrijven roepen op tot gezamenlijke verdediging tegen AI-aanvallen
Nieuws
5 min

27 aug 20:11

116 bedrijven roepen op tot gezamenlijke verdediging tegen AI-aanvallen

OpenAI, Anthropic, Google, Microsoft en 112 andere bedrijven waarschuwen in een open brief dat het venster om cyberdefensie te versterken nog maar maanden duurt. Wat er concreet van elke organisatie wordt gevraagd.

Nvidia werkt aan open Nemotron 4 met minstens een biljoen parameters
Nieuws
4 min

12 aug 02:22

Nvidia werkt aan open Nemotron 4 met minstens een biljoen parameters

Nvidia werkt volgens The Information aan Nemotron 4, een open model van minstens een biljoen parameters. Er is geen releasedatum en Nvidia bevestigt de details niet, maar de hardwaredrempel om zelf te draaien groeit wel mee.

Linux Foundation legt meldregels voor incidenten met AI-agents ter consultatie
Nieuws
4 min

4 aug 20:12

Linux Foundation legt meldregels voor incidenten met AI-agents ter consultatie

De Linux Foundation legt SAFE ter consultatie, een vrijwillige meldstandaard voor incidenten met AI-agents. Leden waarschuwen klanten binnen 72 uur en melden binnen vier werkdagen. De alliantie erachter groeide van 37 naar ruim 120 leden.