Modular geeft de programmeertaal Mojo vanaf 18 augustus volledig vrij onder Apache 2.0 met LLVM-uitzonderingen, compiler en tooling inbegrepen, maakte het bedrijf bekend op zijn eigen ModCon-conferentie.
Voor een Nederlands team dat AI-werk in productie draait, gaat dit niet over een taal maar over de rekensom eronder. Mojo is de laag die modellen op andere chips dan die van Nvidia laat landen, en zolang de compiler gesloten was, ruilde je de ene afhankelijkheid in voor de andere. Die taal is nu vrij, met een patentlicentie erbij. Het platform waarmee je in productie serveert is dat niet, en precies dat verschil bepaalt hoeveel bewegingsruimte je koopt.
Wat er precies vrijkomt
De broncode van de compiler, de tooling en alles wat je nodig hebt om de taal te bouwen staat nu in de publieke modular-repository op GitHub. De LLVM-uitzondering op de Apache-licentie is het deel dat commercieel telt: verspreid je software waarin gecompileerde Mojo-code zit, dan hoef je de licentie- en attributievoorwaarden niet mee te leveren.
De standaardbibliotheek was al open sinds 2024 en de MAX-kernels sinds 2025. Bijdragen aan de compiler zelf kan nog niet, daarvoor mikt Modular op het einde van dit jaar. De taal bereikte vorige week versie 1.0 met een stabiliteitsbelofte: code die je vandaag schrijft, breekt niet bij een volgende release. Dat uitgerekend een chipmaker de softwarelaag opengooit die zijn grootste concurrent overeind houdt, past in een strategie die in juni al zichtbaar werd. Qualcomm betaalde naar verluidt rond de vier miljard dollar voor Modular om Nvidia's softwarevoorsprong aan te vallen en rondde die overname eind juli af.
MAX houdt een eigen licentie
Mojo is de taal. MAX is het framework en de inferentieserver waarmee je modellen daadwerkelijk serveert, en dat valt onder de Modular Community License in plaats van onder Apache 2.0. Gebruik is gratis, eeuwigdurend en royaltyvrij, en op 18 augustus zijn de beperkingen op welke apparaten je MAX mag draaien uit die licentie gehaald.
Drie voorwaarden blijven staan die je in een inkoopgesprek wilt kennen. Afgeleide werken mag je alleen in objectcode verspreiden, niet als broncode. Modular verzamelt telemetrie over je gebruik en mag die data vrij inzetten. En bied je MAX commercieel aan als gehoste of beheerde inferentiedienst voor andere bedrijven, dan moet je het merk Powered by Modular voeren en je uitingen vooraf laten goedkeuren.
Modular kondigde wel aan MAX source-available te maken en er een alliantieprogramma omheen te bouwen voor hardwareleveranciers, modelaanbieders en clouds. Source-available is geen open source: je mag meelezen en meebouwen binnen voorwaarden die de eigenaar stelt en later kan aanpassen.

Van GPU naar Trainium, TPU en Dragonfly
Het platform draait productiewerk op GPU's van Nvidia en AMD en heeft daar nu AWS Trainium, Google TPU's, de Qualcomm Cloud AI 100 Ultra en Qualcomm Dragonfly bij gekregen. Modular zegt die architecturen met meer dan tien keer minder engineeringwerk te hebben aangesloten dan zulke trajecten normaal vragen. Dienstverlener HTEC bracht de ondersteuning voor Google TPU's in enkele maanden met een handvol engineers zelf binnen, met Modular in een ondersteunende rol. AMD-bestuurders stonden op het ModCon-podium naast Qualcomm in plaats van aan de zijlijn.
Praktischer voor wie nu tokens inkoopt: Modular Cloud is algemeen beschikbaar met OpenAI-compatibele endpoints die per token afrekenen, en dezelfde stack kan op je eigen infrastructuur draaien. MiniMax serveert er zijn M3-model op met miljarden tokens per minuut.
Waar dit heen wijst
Het patroon is inmiddels herkenbaar. Alibaba gaf in juli de SAIL-laag vrij zodat ontwikkelaars binnen zeven dagen van CUDA naar de eigen Zhenwu-chips kunnen, en Huawei deed dat eerder met CANN. Nieuw is dat de aanval nu uit het Amerikaanse kamp zelf komt, van een chipmaker met een eigen datacenterlijn en met AMD zichtbaar aan boord.
Daarmee verschuift de vraag bij het inrichten van een AI-stack. Niet welke chip je koopt, maar hoeveel werk het kost om van chip te wisselen als de prijs of de roadmap verandert. Met inferentiekosten per agentische workflow die tot 2028 meer dan vervijfvoudigen is dat geen architectuurvoorkeur meer maar een begrotingspost. De taal is vrij. De laag waarop je serveert nog niet helemaal, en daar zit de afhankelijkheid die overblijft.
Veelgestelde vragen
AI-stack zonder vastzitten
Ik denk met je mee over waar je AI-werk draait en bouw de stack zo dat je van model, leverancier en hardware kunt wisselen, van ontwerp tot livegang en self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
