Het logo van Nvidia in 3D op een tafel
Nieuws12 augustus · 02:224 min leestijd

Nvidia werkt aan open Nemotron 4 met minstens een biljoen parameters

Nvidia werkt volgens The Information aan Nemotron 4, een open model van minstens een biljoen parameters. Er is geen releasedatum en Nvidia bevestigt de details niet, maar de hardwaredrempel om zelf te draaien groeit wel mee.

Nvidia ontwikkelt Nemotron 4, een nieuwe generatie van zijn open modelfamilie waarvan de grootste versie minstens een biljoen parameters moet tellen, meldde The Information dinsdag op basis van meerdere medewerkers aan het project.

Het is een plan en geen release, en juist dat maakt het nu relevant. Wie vandaag een gesloten API kiest, legt die keuze meestal voor een jaar of langer vast in contracten, koppelingen en werkwijzen. Komt er over enkele maanden een Amerikaans open model op frontier-schaal bij, dan verschuift de vraag van of open gewichten goed genoeg zijn naar of je de machines eronder wilt kopen, huren of laten draaien door een ander.

Wat Nvidia wel en niet bevestigt

Er ligt geen releasedatum en de laatste trainingsronde is nog niet af, al zeggen medewerkers dat het model op zijn vroegst laat in het najaar klaar kan zijn. Nvidia verwees naar eerdere uitspraken dat het aan Nemotron 4 werkt, maar bevestigde de details uit het bericht niet. Kari Briski, vicepresident generatieve AI, liet in een schriftelijke reactie weten dat Nvidia in Nemotron investeert omdat elk bedrijf en elk land volgens haar toegankelijke open frontier-modellen nodig heeft om veiligheid te versterken en innovatie te versnellen.

De naam zelf is niet nieuw, en dat kan verwarren. Nvidia bracht in juni 2024 al een Nemotron-4 van 340 miljard parameters uit, bedoeld om synthetische trainingsdata mee te maken en destijds uitgegeven onder Nvidia's eigen open model license. Het model waar het nu over gaat is een nog niet uitgebrachte opvolger van de huidige Nemotron 3-generatie, niet die oudere 340B-familie.

Wat een biljoen parameters vraagt van je hardware

Het grootste open Nemotron dat je vandaag kunt downloaden is Nemotron 3 Ultra, sinds 4 juni beschikbaar met 550 miljard parameters waarvan er 55 miljard per token actief zijn, inclusief de trainingsdata en de trainingsrecepten. Voor de gekwantiseerde NVFP4-versie noemt Nvidia als ondergrens vier B200-kaarten in een enkele node, of acht H100's. Een model van minstens een biljoen parameters is bijna twee keer zo groot, en die rekening begint bij precies dat soort machines.

Aan de andere kant van dezelfde familie staat Nemotron 3.5 Lightning, een agentmodel van 30 miljard parameters waarvan er 3 miljard per token actief zijn en dat op een enkele GPU draait. Dat gat tekent de afweging: het topmodel bepaalt of open gewichten de frontier halen, het kleine model bepaalt wat je er in de praktijk dagelijks mee doet. De rekensom eronder is bekend, want GPU-leegloop en beheer bepalen waar het omslagpunt ligt tussen zelf hosten en een API. Een groter model duwt dat punt richting de API, tenzij je de kaarten echt vol krijgt.

Prijs is ook zelden het enige argument. Palantir en Nvidia verkopen sinds eind juni een engine waarmee organisaties open Nemotron-modellen volledig afgesloten van het internet draaien en hun eigen data en gewichten houden. Dat patroon, eigen gewichten op eigen of Europese infrastructuur, is voor Nederlandse organisaties meestal de reden om naar open modellen te kijken.

Het hoofdkantoor van Nvidia in Santa Clara, met het bedrijfslogo bij de ingang. Bron: Coolcaesar / Wikimedia Commons (CC BY-SA 4.0)
Het hoofdkantoor van Nvidia in Santa Clara, met het bedrijfslogo bij de ingang. Bron: Coolcaesar / Wikimedia Commons (CC BY-SA 4.0)

Waarom een chipmaker de bovenkant van open modellen wil

Nvidia is een van de weinige grote Amerikaanse bedrijven die open modellen uitbrengt. Reuters zet dat tegen twee bewegingen: AI-rekeningen die oplopen, en goedkope Chinese modellen die de mogelijkheden van de topsystemen van Anthropic en OpenAI naderen. Daar komt bij dat open modellen geen ingebouwde rem hebben op gebruik voor cyberbeveiliging, iets wat na een reeks recent bekend geworden hacks met autonome AI-agents extra aandacht kreeg.

De chipmaker zet er ook politiek gewicht achter. In juli richtte het met 36 andere bedrijven een alliantie op die open beveiligingsmodellen en tooling deelt, en eerder die maand zetten vijftig bedrijven, van Meta en Mistral tot Hugging Face en Ollama, hun handtekening onder een pleidooi richting Washington voor open gewichten.

Het belang is niet ingewikkeld. Elk open model dat ergens op eigen hardware draait, draait op kaarten die Nvidia verkoopt. Hoe hoger de bovenkant van het open aanbod, hoe meer bedrijven het de moeite waard vinden om zelf iets neer te zetten in plaats van tokens af te nemen bij een lab dat inmiddels ook zijn eigen chips laat ontwerpen.

Voor wie in Nederland nu tussen een gesloten API en eigen gewichten kiest, betekent dit vooral dat de keuze niet gesloten blijft. Er komt waarschijnlijk een open model bij dat groter is dan alles wat er nu vrij te downloaden valt, met een hardwaredrempel die evenredig meegroeit. Tot die gewichten er echt staan blijft het een plan, opgetekend uit de mond van medewerkers, bij een bedrijf dat de cijfers zelf niet bevestigt.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Open model of gesloten API

Ik help je die keuze concreet maken en daarna ook uitvoeren: van meedenken over wat er echt op je eigen infrastructuur hoort tot het ontwerpen, bouwen en automatiseren van de werkstroom eromheen, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Open-weight-brief aan Washington verdubbelt naar 50 ondertekenaars
Nieuws
4 min

26 jul 16:09

Open-weight-brief aan Washington verdubbelt naar 50 ondertekenaars

De open-weight-brief aan Washington telt nu 50 ondertekenaars, dubbel zoveel als bij publicatie. Google staat er alsnog op. Alleen Anthropic, Amazon en xAI blijven weg, en dat verschuift het politieke risico voor open modellen.

Nvidia, Microsoft en Meta bepleiten open AI-modellen bij Washington
Nieuws
4 min

24 jul 18:21

Nvidia, Microsoft en Meta bepleiten open AI-modellen bij Washington

Voor het eerst zetten de grootste Amerikaanse AI-leveranciers zelf, niet alleen startups, gezamenlijk hun gewicht achter open modellen. In een brief aan Washington vragen Nvidia, Microsoft, Meta en Palantir om geen beperkingen op open-weight AI.

Nvidia geeft agentmodel Nemotron 3.5 Lightning vrij met een modelrouter erbij
Nieuws
5 min

11 aug 16:10

Nvidia geeft agentmodel Nemotron 3.5 Lightning vrij met een modelrouter erbij

Nvidia publiceert de gewichten van agentmodel Nemotron 3.5 Lightning onder OpenMDW-1.1, een licentie zonder gebruiksbeperkingen, en levert er een routeerlaag bij die in LangChains test 74 procent van de kosten wegneemt.

Witte Huis rondt AI-cybertests af en spreekt dinsdag met OpenAI, Anthropic, Google en Meta
Nieuws
4 min

4 aug 00:11

Witte Huis rondt AI-cybertests af en spreekt dinsdag met OpenAI, Anthropic, Google en Meta

Het Witte Huis rondde de vrijwillige cybertests voor frontier-AI af en zit dinsdag om tafel met OpenAI, Anthropic, Google en Meta. De normen blijven geclassificeerd, terwijl Brussel sinds 2 augustus wel kan handhaven.

Zuckerberg bekritiseert gesloten AI-koers van OpenAI en Anthropic
Nieuws
5 min

29 jul 06:12

Zuckerberg bekritiseert gesloten AI-koers van OpenAI en Anthropic

Zuckerberg noemt de gesloten aanpak van OpenAI en Anthropic gevaarlijker dan open ontwikkeling, in een WSJ-opiniestuk en een NYT-interview. Meta's eigen beste model zit sinds 9 juli achter een betaalde API.

OpenAI tekent alsnog de open-weight-brief, Anthropic en Google blijven weg
Nieuws
4 min

25 jul 10:15

OpenAI tekent alsnog de open-weight-brief, Anthropic en Google blijven weg

OpenAI staat sinds vrijdagavond alsnog op de open-weight-brief aan Washington, die inmiddels 35 ondertekenaars telt. Anthropic en Google blijven als enige grote frontier-aanbieders buiten de coalitie die pleit tegen beperkingen op open modellen.