Close-up van een donkerblauwe printplaat met chips en schakelingen.
Nieuws10 juli · 02:244 min leestijd

Meta start in september productie van eigen AI-chip Iris

Meta begint in september met de productie van zijn eigen AI-chip Iris en wil zijn rekencapaciteit in 2027 verdubbelen naar 14 gigawatt. Een intern memo dat Reuters inzag legt de compute-strategie onder je cloudrekening bloot.

Meta begint in september met de productie van zijn eigen AI-chip Iris, blijkt uit een intern memo dat Reuters inzag, als eerste stap in een plan om de rekencapaciteit van het bedrijf volgend jaar te verdubbelen naar 14 gigawatt.

Dat raakt een keten waar vrijwel elk Nederlands bedrijf inmiddels aan hangt. De AI-functies die je afneemt, van een chatbot tot documentverwerking, draaien op rekenkracht die je huurt bij cloudpartijen, en die kracht komt grotendeels van chips van Nvidia. Nu een van de grootste afnemers ter wereld een deel van die chips zelf gaat bakken om kosten te drukken en minder afhankelijk te zijn van één leverancier, verschuift er iets aan de prijs, de beschikbaarheid en de machtsverhoudingen onderaan je cloudrekening.

De chip: Iris, en elke zes maanden een nieuwe

De chip, met de codenaam Iris, hoort bij Meta's MTIA-lijn (Meta Training and Inference Accelerator): een reeks eigen versnellers die het bedrijf zelf ontwerpt om de AI achter Facebook en Instagram te draaien. Voor het ontwerp werkt Meta samen met Broadcom en de chip zelf laat het bij het Taiwanese TSMC produceren. Het testen van Iris kostte volgens het memo slechts zes weken en leverde geen grote problemen op, een opvallend snelle stap voor een eigen-chip-project dat sinds de start ruim vijf jaar geleden moeizaam liep.

Iris vervangt de Nvidia-kaarten niet, maar vult ze aan: Meta blijft grote aantallen GPU's van Nvidia en AMD kopen. Wel wil het bedrijf elke zes maanden een nieuwe AI-chip uitbrengen, tot in 2027, waar de meeste fabrikanten er hooguit één per jaar of langer uitbrengen. “Je kunt geen AI-titan worden als je voor je chips afhankelijk bent van een ander bedrijf”, zegt Forrester-analist Mike Gualtieri over de reden dat zelfs SpaceX eigen silicium plant.

Zeven gigawatt nu, veertien in 2027

De echte inzet van het memo is schaal. Meta wil dit jaar zeven gigawatt aan rekeninfrastructuur draaien en verwacht die capaciteit in 2027 nog eens te verdubbelen naar veertien gigawatt. Eén gigawatt is genoeg om ongeveer 800.000 huishoudens van stroom te voorzien. Om daar te komen trekt het bedrijf dit jaar tot 145 miljard dollar uit voor AI-infrastructuur, een fors deel van de ruim 700 miljard die de grote techbedrijven samen begroten.

Meta's geplande rekencapaciteit in gigawatt (bron: Reuters)

Die honger naar rekenkracht loopt inmiddels vast op de toelevering. Meta sloot langlopende contracten voor geheugenchips met Samsung, voor flashopslag met Sandisk en voor glasvezel met Sumitomo Electric, precies omdat geheugen schaars wordt. Die schaarste stuwt de prijzen zo hard op dat analisten van Morgan Stanley al spreken van “chipflatie” als macro-economisch risico. Dat Meta zelfs bij Google tegen een rekencapaciteitsplafond aanliep en zijn Gemini-toegang gerantsoeneerd zag, tekent hoe krap die markt inmiddels is.

Het gebouw van een Facebook-datacenter met de Amerikaanse en Oregonse vlag ervoor. Bron: Intel Free Press / Wikimedia Commons (CC BY 2.0)
Het gebouw van een Facebook-datacenter met de Amerikaanse en Oregonse vlag ervoor. Bron: Intel Free Press / Wikimedia Commons (CC BY 2.0)

Wat de eigen-chip-race betekent

Meta is niet de enige. Amazon, Google, Microsoft en OpenAI ontwerpen inmiddels allemaal eigen silicium, en Meta onderhandelt naar verluidt daarnaast met Samsung over een order van 6,5 miljard dollar om een deel van zijn chipproductie weg te halen bij TSMC. Wie de rekenkracht bezit, bepaalt straks de prijs ervan: hetzelfde bedrijf bouwt ook een eigen cloudtak om die capaciteit door te verkopen.

Voor wie AI afneemt in plaats van bouwt, wijst dat op twee kanten van dezelfde beweging. Meer bronnen van rekenkracht naast Nvidia kunnen de prijs op termijn drukken, wat AI-functies goedkoper maakt. Tegelijk verschuift de macht naar een handvol partijen die zowel de chips als de cloud in handen krijgen, en dat is precies het soort afhankelijkheid waar je bij het inrichten van je eigen AI-stack rekening mee houdt. De vraag is straks niet langer welk model het slimste is, maar wiens infrastructuur er onder je toepassing draait.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Grip op je eigen AI-stack

De grote spelers bouwen eigen silicium om niet vast te zitten aan één leverancier. Op jouw schaal help ik je hetzelfde principe toepassen: ik denk mee, ontwerp en bouw je AI-oplossingen end-to-end, self-hosted waar dat kan, zodat je niet vastgeklonken raakt aan één aanbieder.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Meta metselt zich in, en de open fakkel verhuist
Signaal
7 min

17 jul 16:01

Meta metselt zich in, en de open fakkel verhuist

Meta ruilde zijn open Llama in voor een gesloten Muse Spark en metselt er een eigen chip, cloud en app-laag omheen. Los is het bedrijfsnieuws, samen een beweging. En de open fakkel? Die verhuist gewoon.

Microsoft wil zijn Maia 300-AI-chip mogelijk al in september onthullen
Nieuws
4 min

10 aug 20:34

Microsoft wil zijn Maia 300-AI-chip mogelijk al in september onthullen

Microsoft wil zijn AI-chip Maia 300 dit najaar onthullen, mogelijk al in september, en onderhandelt met TSMC over ruim 300.000 exemplaren voor 2027. Wat dat betekent voor Azure-klanten die nu rekenkracht inkopen.

Samsung verhoogt chipprijzen voor 4 en 5 nanometer met tot 15 procent
Nieuws
4 min

19 aug 12:08

Samsung verhoogt chipprijzen voor 4 en 5 nanometer met tot 15 procent

Samsung verhoogde in juli de prijzen voor chipproductie op 4 en 5 nanometer met 10 tot 15 procent, meldt Reuters op basis van twee ingewijden. Wat die verhoging doet met je hardware- en cloudrekening.

Anthropic verkent eigen AI-chip en klopt bij Samsung aan voor productie
Nieuws
5 min

2 jul 20:26

Anthropic verkent eigen AI-chip en klopt bij Samsung aan voor productie

Claude-maker Anthropic zet volgens The Information eerste stappen naar een eigen AI-chip en sprak met Samsung als mogelijke producent. Bevestigd is er niets, maar de zet raakt de compute-kosten en het leveranciersrisico achter Claude.

Anthropic bevestigt eigen chipteam voor Claude en werft siliciumingenieurs
Nieuws
4 min

5 aug 18:12

Anthropic bevestigt eigen chipteam voor Claude en werft siliciumingenieurs

Anthropic bevestigt dat het een eigen siliciumteam opbouwt om maatwerkchips voor Claude te ontwerpen, met vacatures tot 485.000 dollar. Chips van AWS, Google, Nvidia en AMD blijven volgens het bedrijf centraal staan.

Google bouwt inference-chip Frozen v2 die Gemini in silicium bakt
Nieuws
4

20 jul 18:11

Google bouwt inference-chip Frozen v2 die Gemini in silicium bakt

Google werkt aan Frozen v2, een inference-chip die delen van Gemini in het silicium legt en per token zes tot tien keer zuiniger zou zijn dan zijn huidige AI-chips. Wat dat betekent voor wie AI op Google Cloud draait.