DeepSeek maakte op 30 september zes softwaremodules voor Huawei’s Ascend-platform open source, waaronder TileLang en bibliotheken voor rekenwerk en dataverkeer, meldt de South China Morning Post.
Voor Nederlandse organisaties verandert daarmee de overstapberekening rond AI-infrastructuur: naast de accelerator tellen ook de programmeertools, rekenkernen en communicatiecode die teams op een andere chip moeten laten werken. Open source maakt die laag inspecteerbaar en testbaar, maar levert hardware of technische ondersteuning niet vanzelf.
Van programmeertaal tot communicatie
TileLang is een hogere programmeertaal en compiler voor AI-rekenkernen, de kleine routines die berekeningen op een chip uitvoeren. Een toelichting die Huawei aan QbitAI aanleverde noemt zes onderdelen: TileLang, DeepGEMM, FlashMLA, TileKernel, DeepSelect en DeepEP. Die vullen de softwarelaag aan met rekenbibliotheken voor onder meer matrixbewerkingen en aandacht, plus communicatie tussen chips.
Huawei rapporteert voor DeepEP 375 GB/s bij het verdelen van gegevens en 347 GB/s bij het samenbrengen op een UBL128-supernode met 128 kaarten. Het gaat om metingen van dataverkeer in één systeem, niet om de snelheid van een volledig model.
De bestaande CUDA-stack vormt een overstapdrempel omdat ontwikkelaars voor andere hardware ook passende programmeersoftware en bibliotheken nodig hebben, schrijft Techzine Global. Open broncode maakt deze onderdelen controleerbaar en aanpasbaar. Bestaande CUDA-programma’s draaien daardoor niet automatisch op Ascend; teams moeten hun toepassingen nog steeds testen.
Wat de benchmark meet
DeepSeek’s openbare repository voor DeepGEMM-Ascend rapporteert 431 TFLOPS, 99,8 procent van de theoretische limiet, voor één BF16-matrixbewerking op Ascend 950DT. De testmatrix was 4096 × 7168 × 16384 en gebruikte CANN 9.20. BF16 is een 16-bits getalformaat. De meting gaat over één rekenroutine, niet over de prestaties, kosten of reactiesnelheid van een volledig AI-model.
Ook de DeepEP-cijfers beschrijven een afzonderlijk onderdeel: hoeveel gegevens één testsysteem tussen kaarten kan verplaatsen. Ze voorspellen niet hoe snel een concrete AI-toepassing in productie werkt. Voor organisaties die AI-infrastructuur vergelijken, zijn de openbare libraries dus een concreet testpunt, geen kant-en-klare benchmark voor de eigen werkbelasting.
Hardware blijft een aparte vraag
Huawei plant de beschikbaarheid van Ascend 950DT voor het vierde kwartaal van 2026. De door ingewijden gemelde DeepSeek-planning voor minstens 160.000 Ascend 950DT-chips in Binnen-Mongolië bleef afhankelijk van schaarse productie en levering die meer dan een jaar kon duren.
Voor Nederlandse organisaties maakt de vrijgave vooral de softwarekant van een alternatief beter toetsbaar. De verschuiving wordt praktisch als programmeertools, rekenbibliotheken, communicatiecode en leverbare chips samenkomen. De chipkeuze wordt daarmee ook een keuze voor de softwarelaag eromheen.
Veelgestelde vragen
Grip op je AI-stack
Ik denk mee over je softwarelaag en AI-keuzes, ontwerp de oplossing en realiseer en automatiseer het traject tot livegang. Waar het kan, host ik software op eigen infrastructuur zodat je grip houdt op systemen en data.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
