Het logo van Nvidia in 3D op een tafel
Nieuws12 augustus · 02:224 min leestijd

Nvidia werkt aan open Nemotron 4 met minstens een biljoen parameters

Nvidia werkt volgens The Information aan Nemotron 4, een open model van minstens een biljoen parameters. Er is geen releasedatum en Nvidia bevestigt de details niet, maar de hardwaredrempel om zelf te draaien groeit wel mee.

Nvidia ontwikkelt Nemotron 4, een nieuwe generatie van zijn open modelfamilie waarvan de grootste versie minstens een biljoen parameters moet tellen, meldde The Information dinsdag op basis van meerdere medewerkers aan het project.

Het is een plan en geen release, en juist dat maakt het nu relevant. Wie vandaag een gesloten API kiest, legt die keuze meestal voor een jaar of langer vast in contracten, koppelingen en werkwijzen. Komt er over enkele maanden een Amerikaans open model op frontier-schaal bij, dan verschuift de vraag van of open gewichten goed genoeg zijn naar of je de machines eronder wilt kopen, huren of laten draaien door een ander.

Wat Nvidia wel en niet bevestigt

Er ligt geen releasedatum en de laatste trainingsronde is nog niet af, al zeggen medewerkers dat het model op zijn vroegst laat in het najaar klaar kan zijn. Nvidia verwees naar eerdere uitspraken dat het aan Nemotron 4 werkt, maar bevestigde de details uit het bericht niet. Kari Briski, vicepresident generatieve AI, liet in een schriftelijke reactie weten dat Nvidia in Nemotron investeert omdat elk bedrijf en elk land volgens haar toegankelijke open frontier-modellen nodig heeft om veiligheid te versterken en innovatie te versnellen.

De naam zelf is niet nieuw, en dat kan verwarren. Nvidia bracht in juni 2024 al een Nemotron-4 van 340 miljard parameters uit, bedoeld om synthetische trainingsdata mee te maken en destijds uitgegeven onder Nvidia's eigen open model license. Het model waar het nu over gaat is een nog niet uitgebrachte opvolger van de huidige Nemotron 3-generatie, niet die oudere 340B-familie.

Wat een biljoen parameters vraagt van je hardware

Het grootste open Nemotron dat je vandaag kunt downloaden is Nemotron 3 Ultra, sinds 4 juni beschikbaar met 550 miljard parameters waarvan er 55 miljard per token actief zijn, inclusief de trainingsdata en de trainingsrecepten. Voor de gekwantiseerde NVFP4-versie noemt Nvidia als ondergrens vier B200-kaarten in een enkele node, of acht H100's. Een model van minstens een biljoen parameters is bijna twee keer zo groot, en die rekening begint bij precies dat soort machines.

Aan de andere kant van dezelfde familie staat Nemotron 3.5 Lightning, een agentmodel van 30 miljard parameters waarvan er 3 miljard per token actief zijn en dat op een enkele GPU draait. Dat gat tekent de afweging: het topmodel bepaalt of open gewichten de frontier halen, het kleine model bepaalt wat je er in de praktijk dagelijks mee doet. De rekensom eronder is bekend, want GPU-leegloop en beheer bepalen waar het omslagpunt ligt tussen zelf hosten en een API. Een groter model duwt dat punt richting de API, tenzij je de kaarten echt vol krijgt.

Prijs is ook zelden het enige argument. Palantir en Nvidia verkopen sinds eind juni een engine waarmee organisaties open Nemotron-modellen volledig afgesloten van het internet draaien en hun eigen data en gewichten houden. Dat patroon, eigen gewichten op eigen of Europese infrastructuur, is voor Nederlandse organisaties meestal de reden om naar open modellen te kijken.

Het hoofdkantoor van Nvidia in Santa Clara, met het bedrijfslogo bij de ingang. Bron: Coolcaesar / Wikimedia Commons (CC BY-SA 4.0)
Het hoofdkantoor van Nvidia in Santa Clara, met het bedrijfslogo bij de ingang. Bron: Coolcaesar / Wikimedia Commons (CC BY-SA 4.0)

Waarom een chipmaker de bovenkant van open modellen wil

Nvidia is een van de weinige grote Amerikaanse bedrijven die open modellen uitbrengt. Reuters zet dat tegen twee bewegingen: AI-rekeningen die oplopen, en goedkope Chinese modellen die de mogelijkheden van de topsystemen van Anthropic en OpenAI naderen. Daar komt bij dat open modellen geen ingebouwde rem hebben op gebruik voor cyberbeveiliging, iets wat na een reeks recent bekend geworden hacks met autonome AI-agents extra aandacht kreeg.

De chipmaker zet er ook politiek gewicht achter. In juli richtte het met 36 andere bedrijven een alliantie op die open beveiligingsmodellen en tooling deelt, en eerder die maand zetten vijftig bedrijven, van Meta en Mistral tot Hugging Face en Ollama, hun handtekening onder een pleidooi richting Washington voor open gewichten.

Het belang is niet ingewikkeld. Elk open model dat ergens op eigen hardware draait, draait op kaarten die Nvidia verkoopt. Hoe hoger de bovenkant van het open aanbod, hoe meer bedrijven het de moeite waard vinden om zelf iets neer te zetten in plaats van tokens af te nemen bij een lab dat inmiddels ook zijn eigen chips laat ontwerpen.

Voor wie in Nederland nu tussen een gesloten API en eigen gewichten kiest, betekent dit vooral dat de keuze niet gesloten blijft. Er komt waarschijnlijk een open model bij dat groter is dan alles wat er nu vrij te downloaden valt, met een hardwaredrempel die evenredig meegroeit. Tot die gewichten er echt staan blijft het een plan, opgetekend uit de mond van medewerkers, bij een bedrijf dat de cijfers zelf niet bevestigt.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Open model of gesloten API

Ik help je die keuze concreet maken en daarna ook uitvoeren: van meedenken over wat er echt op je eigen infrastructuur hoort tot het ontwerpen, bouwen en automatiseren van de werkstroom eromheen, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Open-weight-brief aan Washington verdubbelt naar 50 ondertekenaars
Nieuws
4 min

26 jul 16:09

Open-weight-brief aan Washington verdubbelt naar 50 ondertekenaars

De open-weight-brief aan Washington telt nu 50 ondertekenaars, dubbel zoveel als bij publicatie. Google staat er alsnog op. Alleen Anthropic, Amazon en xAI blijven weg, en dat verschuift het politieke risico voor open modellen.

Nvidia, Microsoft en Meta bepleiten open AI-modellen bij Washington
Nieuws
4 min

24 jul 18:21

Nvidia, Microsoft en Meta bepleiten open AI-modellen bij Washington

Voor het eerst zetten de grootste Amerikaanse AI-leveranciers zelf, niet alleen startups, gezamenlijk hun gewicht achter open modellen. In een brief aan Washington vragen Nvidia, Microsoft, Meta en Palantir om geen beperkingen op open-weight AI.

Palantir stelt retentie-eis, Nvidia en Booz Allen beperken Anthropic
Nieuws
5 min

14 sep 18:22

Palantir stelt retentie-eis, Nvidia en Booz Allen beperken Anthropic

Palantir eist onherroepelijke nulretentie, Nvidia beperkt Anthropic tot minder gevoelige taken en Booz Allen blokkeert het commerciële model voor vertrouwelijk cyberwerk. Retentie wordt zo een directe modelkeuze.

Nvidia koopt Hugging Face voor 12,9 miljard dollar, meldt The Information
Nieuws
5 min

27 aug 04:09

Nvidia koopt Hugging Face voor 12,9 miljard dollar, meldt The Information

The Information meldt een akkoord van 12,9 miljard dollar, Business Insider spreekt nog van lopende gesprekken. Geen van beide bedrijven bevestigt iets. Voor teams die modellen en inferentie van de hub halen, telt de neutraliteit.

Nvidia wil met de Poolside-licentie een open-weight topmodel bouwen
Nieuws
5 min

23 aug 06:07

Nvidia wil met de Poolside-licentie een open-weight topmodel bouwen

Nvidia wil de licentiedeal van 6 miljard dollar met Poolside gebruiken om een van 's werelds krachtigste open-weight modellen te bouwen, meldt The Wall Street Journal. Wat dat verandert voor teams die nu op Chinese gewichten zelf hosten.

AT&T verlaagt kosten van AI-taken met 56 procent via open modellen
Nieuws
4 min

21 aug 04:09

AT&T verlaagt kosten van AI-taken met 56 procent via open modellen

AT&T stuurt vragen van medewerkers via een LiteLLM-router naar open modellen en verlaagde de kosten van codeer- en andere AI-taken met tot 56 procent, bij 2 procent kwaliteitsverlies. De uitgaven aan Anthropic en OpenAI blijven bevroren.