Grok 4.6 is sinds 21 augustus binnen Google Cloud af te nemen via Model Garden, meldt SpaceXAI, waardoor organisaties met een Google Cloud-contract het model kunnen gebruiken zonder apart contract bij de modelbouwer.
Daarmee verandert vooral de inkoop, niet de techniek. Wie al op Google Cloud draait, krijgt het model in dezelfde console, op dezelfde factuur en onder hetzelfde toegangsbeheer als de rest van zijn projecten: geen extra leverancier om langs inkoop te loodsen, geen tweede sleutel om te beheren. In de documentatie van Google staan drie voorwaarden die de aankondiging zelf niet noemt, en juist die bepalen of het model in een Nederlands productieproces past. Google heeft Vertex AI inmiddels omgedoopt tot Gemini Enterprise Agent Platform; Model Garden is de catalogus daarbinnen.
Alleen het wereldwijde endpoint
Op de modelpagina van Grok 4.6 staat bij beschikbaarheid precies één optie: het wereldwijde endpoint. Een regionale variant ontbreekt, en Google waarschuwt daar zelf voor. Gebruik dat endpoint niet als je eisen stelt aan de plaats van verwerking, want je kunt niet bepalen of weten naar welke regio een verzoek gaat, schrijft het bedrijf in zijn uitleg over endpoints.
Het platform kent die regionale route wel. Voor partnermodellen bestaat een EU-multiregio-endpoint dat dataresidentie binnen een bredere geografie zoals de Europese Unie vasthoudt, met een voorbeeld-URL die naar de Claude-modellen van Anthropic wijst. Bij Grok 4.6 vermeldt Google die optie niet. Voor een organisatie die in haar verwerkingsregister heeft vastgelegd dat klantdata de EU niet verlaat, is dat het einde van de afweging. Hoe je dat per systeem vastlegt staat in het stappenplan om per leverancier de grondslag op te vragen, EU-residency in te stellen en je verwerkersovereenkomsten bij te werken.

Preview, en dertien verzoeken per minuut
In de release notes van het platform staat Grok 4.6 op 21 augustus als preview in Model Garden. Preview betekent bij Google de Pre-GA-voorwaarden: de functie wordt geleverd zoals hij is, met beperkte ondersteuning en zonder de garanties van een algemeen beschikbaar product.
De harde grens zit in het quotum. Google zet Grok 4.6 op 13 verzoeken per minuut, 188.000 invoertokens en 16.000 uitvoertokens per minuut, met een contextlengte van 524.288 tokens. Dat laatste getal is het venster van 500k dat SpaceXAI adverteert. De eerste drie zijn het probleem: een klantenservice-assistent met een handvol gelijktijdige gesprekken tikt 13 verzoeken per minuut zo aan, en 16.000 uitvoertokens per minuut komt neer op zestien antwoorden van duizend tokens in diezelfde minuut. Verruimen kan niet zomaar. Het model draait op een vast quotum; gewoon betalen naar gebruik en capaciteit vooraf inkopen worden er allebei niet ondersteund, net zomin als batchverwerking.
Eén factuur, maar niet één set voorwaarden
Google plaatst de Grok-modellen expliciet buiten zijn eigen product. Ze vallen onder de zogeheten Separate Offerings in de dienstspecifieke voorwaarden, plus aparte voorwaarden op de modelkaart zelf. In die voorwaarden staat dat Google alle aansprakelijkheid afwijst die voortkomt uit het gebruik van zulke aanbiedingen en dat zijn vrijwaringsverplichtingen er niet op van toepassing zijn. De vrijwaring die Google bij zijn eigen generatieve modellen biedt, dekt Grok dus niet.
Aan de andere kant blijft een deel van het platform wel gelden. De certificeringen voor generatieve AI op het platform lopen door bij partnermodellen die als beheerde API worden gebruikt, prompts en antwoorden worden niet met derden gedeeld, en data blijft in rust binnen de gekozen regio, al kan de regionalisering van de verwerking volgens Google per model verschillen. Het tarief is gelijk aan dat van de eigen API: SpaceXAI noemt 2 dollar per miljoen invoertokens, 0,50 dollar voor gecachete invoer en 6 dollar per miljoen uitvoertokens. Op de prijslijst van Google staat Grok 4.6 zelf nog niet, en bij de Grok-modellen die er wel op staan gaan alle tokens naar het dubbele langecontext-tarief zodra de invoer boven de 200.000 tokens komt.
De route verschuift naar het cloudcontract
Bij de lancering op 12 augustus, waarin Grok 4.6 met 61 punten op de Artificial Analysis Intelligence Index gelijk kwam met GPT-5.6 Sol tegen een ongewijzigde tokenprijs, liepen de afnamekanalen via Cursor, Grok Build, de eigen API en partners als OpenRouter, Vercel en Cloudflare, met alleen Amerikaanse clusters in de documentatie. Model Garden is daar een vijfde route naast, en de eerste die door het cloudcontract loopt dat een organisatie al heeft.
Dat is precies waar de verschuiving zit. Modeldistributie loopt steeds vaker via de marktplaats van de hyperscaler, waar het inkoopgemak vooruit rent op de juridische en regionale voorwaarden. De vraag of een model in je proces mag, verhuist daarmee van de modelbouwer naar de kleine lettertjes onder je eigen cloudabonnement.
Veelgestelde vragen
Modelkeuze zonder verrassingen
Welk model in welk proces mag, hangt net zo goed af van quota en voorwaarden als van benchmarks. Ik denk mee over die afweging, ontwerp de oplossing en bouw en automatiseer hem ook, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
