Close-up van een computerprintplaat met meerdere chips.
Nieuws30 september · 11:323 min leestijd

DeepSeek maakt zes modules voor Huawei Ascend open source

DeepSeek heeft zes softwaremodules voor Huawei’s Ascend-platform open source gemaakt. Een eigen benchmark haalt 431 TFLOPS op één matrixbewerking, maar zegt niets over de snelheid van een volledig model.

DeepSeek maakte op 30 september zes softwaremodules voor Huawei’s Ascend-platform open source, waaronder TileLang en bibliotheken voor rekenwerk en dataverkeer, meldt de South China Morning Post.

Voor Nederlandse organisaties verandert daarmee de overstapberekening rond AI-infrastructuur: naast de accelerator tellen ook de programmeertools, rekenkernen en communicatiecode die teams op een andere chip moeten laten werken. Open source maakt die laag inspecteerbaar en testbaar, maar levert hardware of technische ondersteuning niet vanzelf.

Van programmeertaal tot communicatie

TileLang is een hogere programmeertaal en compiler voor AI-rekenkernen, de kleine routines die berekeningen op een chip uitvoeren. Een toelichting die Huawei aan QbitAI aanleverde noemt zes onderdelen: TileLang, DeepGEMM, FlashMLA, TileKernel, DeepSelect en DeepEP. Die vullen de softwarelaag aan met rekenbibliotheken voor onder meer matrixbewerkingen en aandacht, plus communicatie tussen chips.

Huawei rapporteert voor DeepEP 375 GB/s bij het verdelen van gegevens en 347 GB/s bij het samenbrengen op een UBL128-supernode met 128 kaarten. Het gaat om metingen van dataverkeer in één systeem, niet om de snelheid van een volledig model.

De bestaande CUDA-stack vormt een overstapdrempel omdat ontwikkelaars voor andere hardware ook passende programmeersoftware en bibliotheken nodig hebben, schrijft Techzine Global. Open broncode maakt deze onderdelen controleerbaar en aanpasbaar. Bestaande CUDA-programma’s draaien daardoor niet automatisch op Ascend; teams moeten hun toepassingen nog steeds testen.

Wat de benchmark meet

DeepSeek’s openbare repository voor DeepGEMM-Ascend rapporteert 431 TFLOPS, 99,8 procent van de theoretische limiet, voor één BF16-matrixbewerking op Ascend 950DT. De testmatrix was 4096 × 7168 × 16384 en gebruikte CANN 9.20. BF16 is een 16-bits getalformaat. De meting gaat over één rekenroutine, niet over de prestaties, kosten of reactiesnelheid van een volledig AI-model.

Ook de DeepEP-cijfers beschrijven een afzonderlijk onderdeel: hoeveel gegevens één testsysteem tussen kaarten kan verplaatsen. Ze voorspellen niet hoe snel een concrete AI-toepassing in productie werkt. Voor organisaties die AI-infrastructuur vergelijken, zijn de openbare libraries dus een concreet testpunt, geen kant-en-klare benchmark voor de eigen werkbelasting.

Hardware blijft een aparte vraag

Huawei plant de beschikbaarheid van Ascend 950DT voor het vierde kwartaal van 2026. De door ingewijden gemelde DeepSeek-planning voor minstens 160.000 Ascend 950DT-chips in Binnen-Mongolië bleef afhankelijk van schaarse productie en levering die meer dan een jaar kon duren.

Voor Nederlandse organisaties maakt de vrijgave vooral de softwarekant van een alternatief beter toetsbaar. De verschuiving wordt praktisch als programmeertools, rekenbibliotheken, communicatiecode en leverbare chips samenkomen. De chipkeuze wordt daarmee ook een keuze voor de softwarelaag eromheen.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Grip op je AI-stack

Ik denk mee over je softwarelaag en AI-keuzes, ontwerp de oplossing en realiseer en automatiseer het traject tot livegang. Waar het kan, host ik software op eigen infrastructuur zodat je grip houdt op systemen en data.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

DeepSeek wil 160.000 Huawei-chips in zijn nieuwe datacenter zetten
Nieuws
4

4 sep 12:12

DeepSeek wil 160.000 Huawei-chips in zijn nieuwe datacenter zetten

DeepSeek wil minstens 160.000 Huawei Ascend 950DT-chips in zijn gigawattdatacenter in Binnen-Mongolië zetten, meldt Bloomberg. De chip is pas eind 2026 leverbaar en het uitleveren van de order kan meer dan een jaar duren.

Nvidia verliest Chinese AI-chipmarkt aan Huawei: wat de machtsverschuiving betekent voor je AI-infrastructuur
Nieuws
6 min

30 jun 06:19

Nvidia verliest Chinese AI-chipmarkt aan Huawei: wat de machtsverschuiving betekent voor je AI-infrastructuur

Nvidia's aandeel in de Chinese AI-chipmarkt stort in van 95 procent naar bijna nul, terwijl Huawei naar de helft groeit. Wat de machtsverschuiving betekent voor het GPU-aanbod en jouw AI-infrastructuur.

Huawei introduceert OceanStor M900 voor AI-inferentie
Nieuws
4 min

18 sep 01:32

Huawei introduceert OceanStor M900 voor AI-inferentie

Huawei introduceert OceanStor M900 voor AI-inferentie met gedeelde KV-cache tot 64 petabyte per cluster. De opslaglaag moet lange contexten sneller verwerken en de kosten van grootschalige inferentie verlagen.

Huawei plant Ascend 960DT en 960PR voor 2027
Nieuws
3 min

17 sep 08:41

Huawei plant Ascend 960DT en 960PR voor 2027

Huawei brengt de 960DT in Q1 2027 en de 960PR in Q3, eerder dan gepland. De roadmap maakt alternatieve AI-hardware concreter en legt voor Nederlandse organisaties de nadruk op software die tussen infrastructuren kan bewegen.

Alibaba maakt SAIL open source om CUDA-ontwikkelaars naar eigen AI-chips te halen
Nieuws
4 min

19 jul 12:08

Alibaba maakt SAIL open source om CUDA-ontwikkelaars naar eigen AI-chips te halen

Alibaba geeft de softwarelaag SAIL vrij zodat ontwikkelaars van Nvidia's CUDA kunnen overstappen naar de eigen Zhenwu-chips. De aanval geldt niet de hardware, maar de software die Nvidia echt vasthoudt.

De vlucht weg van Nvidia is begonnen, en de echte muur is CUDA
Signaal
8 min

12 jul 19:02

De vlucht weg van Nvidia is begonnen, en de echte muur is CUDA

Amazon, Meta, Anthropic en zelfs een Chinees maaltijdbedrijf bewegen in dertien dagen tegelijk weg van Nvidia. Los is het bedrijfsnieuws, samen een beweging, en de echte muur blijkt niet de chip maar de software eronder.