Een AI-processorchip op een tafel.
Nieuws7 augustus · 14:364 min leestijd

ByteDance traint volgens de FT een model van maximaal 10 biljoen parameters

ByteDance traint volgens de Financial Times een AI-model van maximaal 10 biljoen parameters, ruim drie keer Kimi K3. Het project zit in vroege pre-training, ByteDance bevestigt niets en een release is er nog niet.

ByteDance traint een AI-model met maximaal 10 biljoen parameters, meldt de Financial Times op basis van ingewijden, waarmee het Chinese concern in de buurt komt van de geschatte omvang van Anthropics Mythos.

Het project zit in een vroege fase van pre-training en het definitieve aantal parameters ligt nog niet vast. ByteDance zelf heeft niets bevestigd en wilde niet reageren.

Voor een Nederlands bedrijf dat zijn modelkeuze bewust spreidt, verandert er deze maand niets. Pre-training duurt gewoonlijk drie tot zes maanden, en daarna volgen nog afstemming en een release. Wat wel verschuift is waar je shortlist voor volgend jaar vandaan komt: het grootste taalmodel dat op dit moment in aanbouw is, wordt volgens deze berichtgeving niet in Californië getraind maar in China.

Wat er over de omvang bekend is

Tien biljoen parameters is een bovengrens, geen bevestigd eindpunt. De uiteindelijke omvang is nog niet gekozen en kan tijdens het traject nog veranderen.

Ter vergelijking: het model zou ruim drie keer zo groot worden als Kimi K3 van Moonshot, dat met 2,8 biljoen parameters het grootste open-weight model ter wereld is. Anthropic maakt de omvang van zijn eigen modellen niet openbaar. De industrie schat Mythos 5 op ongeveer 8 biljoen parameters en Fable 5 op ongeveer 5 biljoen.

Daarbij hoort een kanttekening die in de koppen wegvalt. Een parameteraantal meet omvang, niet kwaliteit. Het zegt iets over de ambitie en over de rekenkracht die een bedrijf bereid is te verbranden, niet over hoe het model straks scoort op benchmarks of wat het per miljoen tokens gaat kosten. Die cijfers bestaan nog niet.

Wie het bouwt

Het werk ligt bij Seed, de AI-eenheid die ByteDance begin 2023 oprichtte. Volgens de FT werken er inmiddels zo'n 2.000 mensen, van onderzoekers tot infrastructuur-engineers, dataspecialisten en vertalers, in China en daarbuiten. Aan het hoofd staat Wu Yonghui, voorheen vicepresident bij Google DeepMind.

Oprichter Zhang Yiming zit er dicht bovenop. Hij besteedt naar schatting de helft van zijn tijd aan Seed, de eenheid waar ByteDance het grootste deel van zijn mankracht, rekenkracht en budget in stopt. De gedachte erachter is dat het model uiteindelijk de gemeenschappelijke onderlaag wordt waarop alle producten draaien, zoals het aanbevelingsalgoritme dat eerder was voor TikTok en Douyin.

Een kantoorgebouw van ByteDance in Peking, met het bedrijfslogo op het dak. (bron: N509FZ / Wikimedia Commons, CC BY-SA 4.0)
Een kantoorgebouw van ByteDance in Peking, met het bedrijfslogo op het dak. (bron: N509FZ / Wikimedia Commons, CC BY-SA 4.0)

Zelf bouwen in plaats van distilleren

Seed kiest er al ruim een jaar voor om modellen zelfstandig te ontwikkelen in plaats van ze te distilleren uit het werk van andere labs. Distillatie is het trainen van een kleiner model op de uitvoer van een groter model: een goedkope route naar prestaties, en volgens de FT een verklaring waarom Seed lange tijd trager oogde dan de concurrentie. Zhang Yiming noemt eigen ontwikkeling de enige weg naar modelcapaciteiten van wereldniveau.

Die keuze is niet alleen technisch. Het Witte Huis beschuldigde Moonshot er in juli openlijk van dat het Kimi K3 bouwde door Anthropics Fable-model te distilleren, en dat verwijt is de onderbouwing geworden onder Amerikaanse plannen om Chinese modellen per stuk te beperken. Een model waarvan de maker kan volhouden dat het zonder distillatie is getraind, is op precies dat punt lastiger aan te vallen.

Waar dit heen wijst

In Nederland is ByteDance vooral bekend van TikTok, maar het bedrijf levert al langer AI-modellen. Eind juni bracht het Seedance 2.5 uit, dat in één take realistische video van 30 seconden genereert. Een taalmodel op frontier-schaal zou de logische volgende stap zijn, en het zou het eerste zijn dat een Chinees bedrijf openlijk boven de gesloten Amerikaanse modellen probeert te tillen in plaats van ernaast.

Dat past in een lijn die dit jaar snel is getrokken. Eind juni kwamen zes van de tien populairste modellen op een veelgevolgde ranglijst uit China, na een Amerikaans exportbevel dat precies het tegenovergestelde beoogde. Wat er nu bijkomt is schaal.

De vraag die daarboven hangt gaat alleen niet over parameters, maar over toegang. Kimi K3 kwam met open gewichten, Qwen 3.8 verscheen eerst als betaalde preview, en Peking weegt al maanden of het de buitenlandse toegang tot de beste Chinese modellen wil beperken. Of het grootste model in aanbouw straks bruikbaar is vanuit Nederland, is dus een andere vraag dan of het gebouwd wordt. Op die eerste vraag is nog geen antwoord gegeven.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Modelkeuze zonder vastroesten

De vraag is zelden welk model het grootst is, maar of je van model kunt wisselen zonder je halve systeem opnieuw te bouwen. Ik denk daarin mee als ondernemer, ontwerp de opzet en bouw en automatiseer hem, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Exportcontrole op AI klimt de stack op: van chip naar model naar jouw contract
Signaal
8 min

28 jul 00:44

Exportcontrole op AI klimt de stack op: van chip naar model naar jouw contract

In januari 2025 stond de regel er al: modelgewichten onder exportvergunning. Hij werd ingetrokken. Anderhalf jaar later doet Washington hetzelfde per brief, en Beijing bouwt het instrument na.

Washington, Beijing en Stripe grijpen alledrie naar dezelfde laag
Signaal
7 min

27 jul 12:04

Washington, Beijing en Stripe grijpen alledrie naar dezelfde laag

In tien dagen greep iedereen naar dezelfde laag in de AI-keten, en dat was niet het model. Het schaarse goed blijkt de capaciteit om een model te serveren, en daar verschuift de macht nu naartoe.

Alibaba zet de gewichten van Qwen3.8-Max volgende week open
Nieuws
5 min

3 aug 06:12

Alibaba zet de gewichten van Qwen3.8-Max volgende week open

Alibaba maakt Qwen3.8-Max wereldwijd beschikbaar en zet de gewichten volgende week open, samen met een kleinere 27B-versie. Het gehoste model kost 2 dollar per miljoen invoertokens, ruim onder Claude Opus 5.

Anthropic beconcurreert zijn partners, klanten wijken uit naar open modellen
Nieuws
5 min

29 jul 04:15

Anthropic beconcurreert zijn partners, klanten wijken uit naar open modellen

Oprichters en softwarebestuurders stappen over op goedkopere open modellen uit wantrouwen jegens Anthropic, meldt The Wall Street Journal. Aanleiding: een eigen designtool die de markt van partner Figma raakt, plus een bewaarbeleid dat gevoelige sectoren afschrikt.

Witte Huis beschuldigt Moonshot AI van modeldiefstal voor Kimi K3
Nieuws
4 min

22 jul 20:12

Witte Huis beschuldigt Moonshot AI van modeldiefstal voor Kimi K3

Witte Huis-directeur Michael Kratsios beschuldigt het Chinese Moonshot AI ervan dat het Kimi K3 bouwde door Anthropics Fable-model te distilleren, en dat het daarvoor Nvidia-chips via Thailand gebruikte. Voor Nederlandse teams groeit het leveranciers- en jurisdictierisico.

OpenAI zou de Amerikaanse overheid een belang van 5% hebben aangeboden
Nieuws
6 min

2 jul 08:11

OpenAI zou de Amerikaanse overheid een belang van 5% hebben aangeboden

OpenAI besprak volgens de Financial Times een belang van 5% voor de Amerikaanse overheid om politieke druk te verlichten. Noch OpenAI noch het Witte Huis bevestigt het. Wat betekent een overheid als aandeelhouder voor jouw AI-leverancier?