Promotionele afbeelding met de naam Gemini 4 Argon op een blauwe achtergrond.
Nieuws1 oktober · 00:303 min leestijd

Google kondigt Gemini 4 Argon aan voor code, kenniswerk en cyberverdediging

Google kondigt Gemini 4 Argon aan voor code, kenniswerk en cyberverdediging. De eerste uitrol gaat naar cyberverdedigers en vertrouwde testers; algemene toegang voor Nederlandse teams is nog niet aangekondigd.

Google kondigt Gemini 4 Argon op 30 september 2026 aan voor code, kenniswerk en cyberverdediging; de eerste uitrol gaat naar een kleine groep cyberverdedigers en vertrouwde testers.

Voor een Nederlandse ondernemer of IT-team is Argon daarmee een nieuwe kandidaat voor codehulp, documentanalyse en beveiligingswerk, maar nog geen model dat iedere Google-klant kan gebruiken. Google maakt niet bekend of Nederlandse organisaties tot de eerste testgroep behoren en noemt geen datum voor een bredere uitrol.

Van ontwikkeling naar beperkte uitrol

Op 24 september zat Gemini 4 nog in de vroege post-trainingfase en noemde Google geen vaste releasedatum. De aankondiging voegt daar een productnaam, toepassingsgebieden, eerste testgroep, benchmarkresultaten en API-prijzen aan toe. De stap is dus van interne ontwikkeling naar een beperkte externe test, niet naar algemene beschikbaarheid.

Scores verschillen per taak

Google zegt dat Argon complexe, langlopende opdrachten voor softwareontwikkeling en kenniswerk aankan, waaronder financiële en juridische taken. Google DeepMind rapporteert 68,9% op de Vals Index en 51,3% op AutomationBench, tegenover 63,1% en 41,4% voor GPT-6 Astra.

Voor financiële taken noemt dezelfde tabel 65,4% op Vals Finance Agent v2, tegenover 53,5% voor Astra. Op Harvey’s Legal Agent Benchmark scoort Argon 19,6%, tegenover 5,4% voor Astra.

Bij programmeerwerk haalt Argon 77,9% op DeepSWE v1.1, maar 55,0% op FrontierSWE v2, waar GPT-6 Astra 65,5% haalt. Op Terminal-bench 4.0 blijft Argon met 57,4% achter bij Claude Opus 5.5 met 66,4%. De resultaten lopen dus uiteen per taaksoort.

Dit zijn scores uit Googles eigen evaluaties, geen gemeten besparing of foutmarge bij Nederlandse organisaties. De cijfers geven een vergelijking per benchmark, maar voorspellen niet hoe Argon op de code, documenten of processen van een bedrijf presteert.

Cyberverdediging en toegang

Google zegt dat Argon zelfstandig kritieke softwarekwetsbaarheden kan vinden, valideren en patchen. Op CWE-bench v1 haalt het 68%, evenveel als GPT-6 Astra. De eerste groep vertrouwde cyberverdedigers en Googles eigen teams krijgt Argon voor die beveiligingstaken zonder de gebruikelijke beperkingen op cybergebruik; bredere toegang volgt pas na aanvullende tests en feedback.

Via het programma Scan for Good gebruikt beveiligingsbedrijf Wiz Argon voor het opsporen en verhelpen van kwetsbaarheden. Google meldt dat het model daar een kritieke fout vond in zorgsoftware die ziekenhuizen wereldwijd gebruiken. Die fout kon gevoelige persoonsgegevens blootleggen en was volgens Google niet door eerdere topmodellen ontdekt. Google noemt de betrokken software niet.

Voor bredere toegang zegt Google vier beveiligingsgebieden verder te testen: misbruik, indirecte promptinstructies, toezicht op modelgedrag en afgesloten testomgevingen. Het bedrijf zegt dat die bewaking Argons redenering en acties kan volgen en uitvoering kan stoppen wanneer dat nodig is.

Na de testfase wil Google toegang uitbreiden naar ontwikkelaars, bedrijven en consumenten, te beginnen met betalende API-klanten en Google AI Ultra-abonnees. Axios meldt dat Google meedoet aan het vrijwillige pre-releaseproces van de Amerikaanse overheid. Het bericht noemt geen datum of landen voor die bredere uitrol. De gepubliceerde API-prijs na de introductieperiode is $4 per miljoen inputtokens en $20 per miljoen outputtokens. Een miljoen inputtokens plus een miljoen outputtokens komt daarmee op $24, vóór eventuele kortingen. De uiteindelijke rekening hangt af van het tokengebruik van de toepassing.

De aankondiging verplaatst de vraag van wanneer Gemini 4 verschijnt naar wie Argon mag testen, tegen welke prijs en op welke taken het in de praktijk presteert. Voor Nederlandse organisaties zijn toegang en resultaten op eigen werk nog de open punten.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van modeltest naar maatwerk

Ik denk mee over de toepassing, ontwerp de oplossing en realiseer het volledige traject, inclusief koppelingen en automatisering. Waar het kan, host ik zelf.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Google, OpenAI en Anthropic bespreken AI-veiligheidsorgaan
Nieuws
4 min

14 sep 12:13

Google, OpenAI en Anthropic bespreken AI-veiligheidsorgaan

Google, OpenAI en Anthropic bespreken een mogelijk gezamenlijk orgaan voor veiligheidsstandaarden rond frontier-AI. De gesprekken kunnen later bepalen hoe leveranciers modellen testen, uitbrengen en beschikbaar maken buiten de Verenigde Staten.

Vier AI-labs brengen in één week nieuwe modellen uit
Nieuws
5 min

6 sep 18:11

Vier AI-labs brengen in één week nieuwe modellen uit

Anthropic, Meta, Google en OpenAI brachten tussen 1 en 3 september alle vier een nieuw model uit. CNBC noemt het model fatigue. Wat dat betekent voor je tarieven, je prompts en je evaluatiecyclus.

Artificial Analysis herziet zijn AI-index en zet 40 procent op geheime tests
Nieuws
5 min

5 sep 22:07

Artificial Analysis herziet zijn AI-index en zet 40 procent op geheime tests

Artificial Analysis herziet zijn Intelligence Index naar v4.2. Veertig procent van de weging rust nu op geheime testsets. GPT-6 Astra en GPT-5.6 Sol stonden gelijk op 61 punten en staan nu vier punten uit elkaar.

ChatGPT, Claude en Grok vallen tegelijk uit, oorzaak onbekend
Nieuws
4 min

3 sep 20:19

ChatGPT, Claude en Grok vallen tegelijk uit, oorzaak onbekend

ChatGPT, Claude en Grok lagen donderdag ruim anderhalf uur tegelijk plat. Geen van de drie aanbieders noemt een oorzaak. Voor wie AI in een productieproces heeft, verliest een tweede leverancier als terugvaloptie daarmee zijn waarde.

Google lanceert Gemini 3.8 Flash tegen dezelfde tokenprijs
Nieuws
5 min

2 sep 20:08

Google lanceert Gemini 3.8 Flash tegen dezelfde tokenprijs

Google brengt Gemini 3.8 Flash uit tegen exact dezelfde tokenprijs als 3.7 Flash. Het model scoort hoger op vrijwel elke benchmark, maar verbruikt meer tokens per taak, waardoor de rekening per opdracht juist oploopt.

Abbott houdt de Texaanse datacenterpauze aan en eist eerst lokale goedkeuring
Nieuws
4 min

24 aug 04:09

Abbott houdt de Texaanse datacenterpauze aan en eist eerst lokale goedkeuring

Gouverneur Abbott houdt de pauze op nieuwe datacenteraansluitingen in Texas aan en eist eerst lokale goedkeuring. De rem op de Amerikaanse AI-bouwgolf is daarmee politiek geworden, en dat raakt levertijd en prijs van rekenkracht vanaf 2027.