Een blauw glazen wolk-icoon met datalagen boven een zilverkleurig hangslot
Nieuws22 augustus · 12:124 min leestijd

SpaceXAI brengt Grok 4.6 naar Google Cloud, in preview en zonder EU-regio

Grok 4.6 staat sinds 21 augustus in Model Garden op Google Cloud. Google zet het model op preview, met alleen een wereldwijd endpoint en een vast quotum van dertien verzoeken per minuut.

Grok 4.6 is sinds 21 augustus binnen Google Cloud af te nemen via Model Garden, meldt SpaceXAI, waardoor organisaties met een Google Cloud-contract het model kunnen gebruiken zonder apart contract bij de modelbouwer.

Daarmee verandert vooral de inkoop, niet de techniek. Wie al op Google Cloud draait, krijgt het model in dezelfde console, op dezelfde factuur en onder hetzelfde toegangsbeheer als de rest van zijn projecten: geen extra leverancier om langs inkoop te loodsen, geen tweede sleutel om te beheren. In de documentatie van Google staan drie voorwaarden die de aankondiging zelf niet noemt, en juist die bepalen of het model in een Nederlands productieproces past. Google heeft Vertex AI inmiddels omgedoopt tot Gemini Enterprise Agent Platform; Model Garden is de catalogus daarbinnen.

Alleen het wereldwijde endpoint

Op de modelpagina van Grok 4.6 staat bij beschikbaarheid precies één optie: het wereldwijde endpoint. Een regionale variant ontbreekt, en Google waarschuwt daar zelf voor. Gebruik dat endpoint niet als je eisen stelt aan de plaats van verwerking, want je kunt niet bepalen of weten naar welke regio een verzoek gaat, schrijft het bedrijf in zijn uitleg over endpoints.

Het platform kent die regionale route wel. Voor partnermodellen bestaat een EU-multiregio-endpoint dat dataresidentie binnen een bredere geografie zoals de Europese Unie vasthoudt, met een voorbeeld-URL die naar de Claude-modellen van Anthropic wijst. Bij Grok 4.6 vermeldt Google die optie niet. Voor een organisatie die in haar verwerkingsregister heeft vastgelegd dat klantdata de EU niet verlaat, is dat het einde van de afweging. Hoe je dat per systeem vastlegt staat in het stappenplan om per leverancier de grondslag op te vragen, EU-residency in te stellen en je verwerkersovereenkomsten bij te werken.

Een doek met het logo van Google Cloud op een CloudOnBoard-dag voor ontwikkelaars, met bezoekers ervoor (Bron: Corsario CL / Wikimedia Commons, CC BY-SA 4.0)
Een doek met het logo van Google Cloud op een CloudOnBoard-dag voor ontwikkelaars, met bezoekers ervoor (Bron: Corsario CL / Wikimedia Commons, CC BY-SA 4.0)

Preview, en dertien verzoeken per minuut

In de release notes van het platform staat Grok 4.6 op 21 augustus als preview in Model Garden. Preview betekent bij Google de Pre-GA-voorwaarden: de functie wordt geleverd zoals hij is, met beperkte ondersteuning en zonder de garanties van een algemeen beschikbaar product.

De harde grens zit in het quotum. Google zet Grok 4.6 op 13 verzoeken per minuut, 188.000 invoertokens en 16.000 uitvoertokens per minuut, met een contextlengte van 524.288 tokens. Dat laatste getal is het venster van 500k dat SpaceXAI adverteert. De eerste drie zijn het probleem: een klantenservice-assistent met een handvol gelijktijdige gesprekken tikt 13 verzoeken per minuut zo aan, en 16.000 uitvoertokens per minuut komt neer op zestien antwoorden van duizend tokens in diezelfde minuut. Verruimen kan niet zomaar. Het model draait op een vast quotum; gewoon betalen naar gebruik en capaciteit vooraf inkopen worden er allebei niet ondersteund, net zomin als batchverwerking.

Eén factuur, maar niet één set voorwaarden

Google plaatst de Grok-modellen expliciet buiten zijn eigen product. Ze vallen onder de zogeheten Separate Offerings in de dienstspecifieke voorwaarden, plus aparte voorwaarden op de modelkaart zelf. In die voorwaarden staat dat Google alle aansprakelijkheid afwijst die voortkomt uit het gebruik van zulke aanbiedingen en dat zijn vrijwaringsverplichtingen er niet op van toepassing zijn. De vrijwaring die Google bij zijn eigen generatieve modellen biedt, dekt Grok dus niet.

Aan de andere kant blijft een deel van het platform wel gelden. De certificeringen voor generatieve AI op het platform lopen door bij partnermodellen die als beheerde API worden gebruikt, prompts en antwoorden worden niet met derden gedeeld, en data blijft in rust binnen de gekozen regio, al kan de regionalisering van de verwerking volgens Google per model verschillen. Het tarief is gelijk aan dat van de eigen API: SpaceXAI noemt 2 dollar per miljoen invoertokens, 0,50 dollar voor gecachete invoer en 6 dollar per miljoen uitvoertokens. Op de prijslijst van Google staat Grok 4.6 zelf nog niet, en bij de Grok-modellen die er wel op staan gaan alle tokens naar het dubbele langecontext-tarief zodra de invoer boven de 200.000 tokens komt.

De route verschuift naar het cloudcontract

Bij de lancering op 12 augustus, waarin Grok 4.6 met 61 punten op de Artificial Analysis Intelligence Index gelijk kwam met GPT-5.6 Sol tegen een ongewijzigde tokenprijs, liepen de afnamekanalen via Cursor, Grok Build, de eigen API en partners als OpenRouter, Vercel en Cloudflare, met alleen Amerikaanse clusters in de documentatie. Model Garden is daar een vijfde route naast, en de eerste die door het cloudcontract loopt dat een organisatie al heeft.

Dat is precies waar de verschuiving zit. Modeldistributie loopt steeds vaker via de marktplaats van de hyperscaler, waar het inkoopgemak vooruit rent op de juridische en regionale voorwaarden. De vraag of een model in je proces mag, verhuist daarmee van de modelbouwer naar de kleine lettertjes onder je eigen cloudabonnement.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Modelkeuze zonder verrassingen

Welk model in welk proces mag, hangt net zo goed af van quota en voorwaarden als van benchmarks. Ik denk mee over die afweging, ontwerp de oplossing en bouw en automatiseer hem ook, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

OpenAI sluit op 12 november de modeltoegang voor Cursor af
Nieuws
5 min

29 aug 06:10

OpenAI sluit op 12 november de modeltoegang voor Cursor af

OpenAI stopt op 12 november met het leveren van zijn modellen aan Cursor, omdat het eigenaar SpaceX niet vertrouwt. Wat een Nederlands ontwikkelteam verliest en welke routes er tot die datum openliggen.

SpaceX verdrievoudigt AI-omzet met rekenkracht voor Anthropic en Google
Nieuws
4 min

5 aug 04:24

SpaceX verdrievoudigt AI-omzet met rekenkracht voor Anthropic en Google

De AI-divisie van SpaceX verdrievoudigde haar omzet naar 2,56 miljard dollar, doordat Anthropic en andere AI-labs er rekenkracht huren. De eerste kwartaalcijfers sinds de beursgang laten zien hoeveel rekenkracht wordt doorverkocht, en tegen welke investering.

Musk kondigt externe modelroutes voor Grok Bot aan
Nieuws
4 min

7 okt 20:19

Musk kondigt externe modelroutes voor Grok Bot aan

Musk zegt dat Grok Bot per taak externe modellen kan kiezen, waaronder Claude Opus 5.5, Midjourney en Suno. De agentcomputer staat in de VS; Cursor beheert de modelkeuze.

SpaceXAI lanceert Grok 4.7 tegen dezelfde prijs
Nieuws
4 min

21 sep 20:32

SpaceXAI lanceert Grok 4.7 tegen dezelfde prijs

SpaceXAI houdt Grok 4.7 op 2 dollar input en 6 dollar output per miljoen tokens. Grok 4.7 kost minder per CursorBench-taak dan Claude, maar Artificial Analysis meet een groot gat op de onafhankelijke agenttest Terminal-Bench.

Antitrustklacht beschuldigt vier AI-bedrijven van afspraak over lager tempo
Nieuws
4 min

20 sep 04:15

Antitrustklacht beschuldigt vier AI-bedrijven van afspraak over lager tempo

Een federale klacht beschuldigt Anthropic, OpenAI, SpaceXAI en Google van afspraken over een lager AI-tempo. De zaak maakt releaseplanning, leveranciersrisico en antitrust onderdeel van modelkeuzes, zonder dat er al een rechterlijk oordeel ligt.

Google laat engineers Claude Opus 5 gebruiken via Antigravity
Nieuws
4 min

15 sep 06:39

Google laat engineers Claude Opus 5 gebruiken via Antigravity

Google laat engineers Claude Opus 5 gebruiken voor intern codeerwerk via Antigravity, maar houdt Gemini als basis en begrenst het rivaliserende model met quota. De stap toont modelvrijheid binnen gecontroleerde grenzen, niet een algemene klantlancering.