Google kondigt Gemini 4 Argon op 30 september 2026 aan voor code, kenniswerk en cyberverdediging; de eerste uitrol gaat naar een kleine groep cyberverdedigers en vertrouwde testers.
Voor een Nederlandse ondernemer of IT-team is Argon daarmee een nieuwe kandidaat voor codehulp, documentanalyse en beveiligingswerk, maar nog geen model dat iedere Google-klant kan gebruiken. Google maakt niet bekend of Nederlandse organisaties tot de eerste testgroep behoren en noemt geen datum voor een bredere uitrol.
Van ontwikkeling naar beperkte uitrol
Op 24 september zat Gemini 4 nog in de vroege post-trainingfase en noemde Google geen vaste releasedatum. De aankondiging voegt daar een productnaam, toepassingsgebieden, eerste testgroep, benchmarkresultaten en API-prijzen aan toe. De stap is dus van interne ontwikkeling naar een beperkte externe test, niet naar algemene beschikbaarheid.
Scores verschillen per taak
Google zegt dat Argon complexe, langlopende opdrachten voor softwareontwikkeling en kenniswerk aankan, waaronder financiële en juridische taken. Google DeepMind rapporteert 68,9% op de Vals Index en 51,3% op AutomationBench, tegenover 63,1% en 41,4% voor GPT-6 Astra.
Voor financiële taken noemt dezelfde tabel 65,4% op Vals Finance Agent v2, tegenover 53,5% voor Astra. Op Harvey’s Legal Agent Benchmark scoort Argon 19,6%, tegenover 5,4% voor Astra.
Bij programmeerwerk haalt Argon 77,9% op DeepSWE v1.1, maar 55,0% op FrontierSWE v2, waar GPT-6 Astra 65,5% haalt. Op Terminal-bench 4.0 blijft Argon met 57,4% achter bij Claude Opus 5.5 met 66,4%. De resultaten lopen dus uiteen per taaksoort.
Dit zijn scores uit Googles eigen evaluaties, geen gemeten besparing of foutmarge bij Nederlandse organisaties. De cijfers geven een vergelijking per benchmark, maar voorspellen niet hoe Argon op de code, documenten of processen van een bedrijf presteert.
Cyberverdediging en toegang
Google zegt dat Argon zelfstandig kritieke softwarekwetsbaarheden kan vinden, valideren en patchen. Op CWE-bench v1 haalt het 68%, evenveel als GPT-6 Astra. De eerste groep vertrouwde cyberverdedigers en Googles eigen teams krijgt Argon voor die beveiligingstaken zonder de gebruikelijke beperkingen op cybergebruik; bredere toegang volgt pas na aanvullende tests en feedback.
Via het programma Scan for Good gebruikt beveiligingsbedrijf Wiz Argon voor het opsporen en verhelpen van kwetsbaarheden. Google meldt dat het model daar een kritieke fout vond in zorgsoftware die ziekenhuizen wereldwijd gebruiken. Die fout kon gevoelige persoonsgegevens blootleggen en was volgens Google niet door eerdere topmodellen ontdekt. Google noemt de betrokken software niet.
Voor bredere toegang zegt Google vier beveiligingsgebieden verder te testen: misbruik, indirecte promptinstructies, toezicht op modelgedrag en afgesloten testomgevingen. Het bedrijf zegt dat die bewaking Argons redenering en acties kan volgen en uitvoering kan stoppen wanneer dat nodig is.
Na de testfase wil Google toegang uitbreiden naar ontwikkelaars, bedrijven en consumenten, te beginnen met betalende API-klanten en Google AI Ultra-abonnees. Axios meldt dat Google meedoet aan het vrijwillige pre-releaseproces van de Amerikaanse overheid. Het bericht noemt geen datum of landen voor die bredere uitrol. De gepubliceerde API-prijs na de introductieperiode is $4 per miljoen inputtokens en $20 per miljoen outputtokens. Een miljoen inputtokens plus een miljoen outputtokens komt daarmee op $24, vóór eventuele kortingen. De uiteindelijke rekening hangt af van het tokengebruik van de toepassing.
De aankondiging verplaatst de vraag van wanneer Gemini 4 verschijnt naar wie Argon mag testen, tegen welke prijs en op welke taken het in de praktijk presteert. Voor Nederlandse organisaties zijn toegang en resultaten op eigen werk nog de open punten.
Veelgestelde vragen
Van modeltest naar maatwerk
Ik denk mee over de toepassing, ontwerp de oplossing en realiseer het volledige traject, inclusief koppelingen en automatisering. Waar het kan, host ik zelf.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

