Rood hangslot op een zwart computertoetsenbord.
Nieuws10 augustus · 22:085 min leestijd

OpenAI splitst Daybreak in Blue en Red en geeft verdedigers GPT-5.6-Cyber

OpenAI splitst Daybreak in Blue en Red en brengt GPT-5.6-Cyber uit, een model dat 95 procent van de exploitverzoeken beantwoordt. De toegang loopt via goedgekeurde partners als KPMG, Fortinet en Palo Alto Networks.

OpenAI splitst zijn cyberprogramma Daybreak in twee toegangsniveaus en brengt GPT-5.6-Cyber uit, een model dat volgens de eigen meting 95 procent van de geavanceerde exploitverzoeken beantwoordt tegen 1,5 procent voor GPT-5.6 Sol.

Dat model komt niet in je eigen abonnement terecht. Het bereikt een Nederlands bedrijf via de partij die je beveiliging al doet: KPMG, PwC, EY, Capgemini, Accenture en NCC Group zitten in het partnerprogramma, net als leveranciers als Fortinet, Sophos, Cisco en Palo Alto Networks. Vijf dagen voordat de Cyberbeveiligingswet in werking treedt verschuift daarmee een inkoopvraag. Niet of je securityleverancier AI gebruikt, maar op welk niveau hij is goedgekeurd en wat er van dat werk daadwerkelijk bij jou terechtkomt.

Blue voor dagelijkse verdediging, Red voor aanvalswerk

Daybreak Blue geeft goedgekeurde verdedigers de gewone frontier-modellen, waaronder GPT-5.6 Sol, zonder de systeemremmen die cybervragen in productie standaard tegenhouden. OpenAI noemt het het aanbevolen startpunt voor de meeste verdedigers: kwetsbaarheden opsporen, code reviewen, malware analyseren, incidenten afhandelen en patches valideren.

Daybreak Red gaat een stap verder. Daar staan de speciaal getrainde cybermodellen voor geautoriseerd kwetsbaarhedenonderzoek, exploitvalidatie en securitytests. GPT-5.6-Cyber hoort in dat niveau thuis. Het is gebouwd op GPT-5.6 Sol en getraind om beter te worden in het vinden van zerodays en het bouwen van exploitketens, en om minder vaak te weigeren bij zwaar dual-use werk.

OpenAI meet dat verschil met een eigen benchmark, de Advanced Cybersecurity Completion Rate, die telt hoe vaak een model ingaat op verzoeken rond exploitketens, authenticatie-omzeiling en rechtenescalatie. GPT-5.6-Cyber komt daar op 95,0 procent. Hetzelfde onderliggende model via Daybreak Blue haalt 2,0 procent, met de normale remmen erop 1,5 procent. Het vorige cybermodel GPT-5.5-Cyber bleef op 57,3 procent steken, wat volgens OpenAI verklaart waarom onderzoekers bleven klagen over hardnekkige weigeringen.

Meer capaciteit is het niet overal. Op de eigen evaluatie voor het vinden en rapporteren van kwetsbaarheden scoort GPT-5.6-Cyber juist lager dan GPT-5.6 Sol, wat OpenAI toeschrijft aan kortere en minder gedetailleerde rapporten. Op ExploitBench, waar een agent een V8-lek tot een volledige exploit moet uitwerken, presteert Sol via Daybreak Blue in de standaardopzet van 300 beurten het best en zuiniger in tokens. Een leverancier die zegt dat hij op Red zit, koopt dus geen model dat op elke taak beter is.

Twee onbekende Chrome-lekken en een CVE

Sinds het model klaar was met trainen zet OpenAI het in op echte software. In V8, de JavaScript-engine van Chrome, vond het twee eerder onbekende kwetsbaarheden die aan elkaar geketend geheugen konden corrumperen en uit de heap-sandbox konden ontsnappen. Eigen onderzoekers valideerden de vondst en meldden die via gecoördineerde disclosure bij Google, dat de fout repareerde onder CVE-2026-15903.

De fout zelf zit in de optimaliserende compiler, die een veiligheidscontrole oversloeg bij het omzetten van waarden naar gehele getallen. Een niet-gedefinieerde waarde leverde daardoor een onverwacht groot getal op. Wordt dat getal als array-index gebruikt, dan gaat de compiler ervan uit dat het binnen de grenzen valt en laat hij de gebruikelijke controle weg. Een aanvaller kan dan geheugen van andere objecten lezen of overschrijven.

Schema van CVE-2026-15903: een fout in de JIT-compiler van V8 leidt via een string buiten de grenzen naar willekeurig lezen en schrijven in het geheugen en een ontsnapping uit de sandbox. Bron: OpenAI
Schema van CVE-2026-15903: een fout in de JIT-compiler van V8 leidt via een string buiten de grenzen naar willekeurig lezen en schrijven in het geheugen en een ontsnapping uit de sandbox. Bron: OpenAI

Het bleef niet bij Chrome. OpenAI meldt minstens vijf kwetsbaarheden in een populair mobiel besturingssysteem, waaronder een keten van een niet-vertrouwde app naar lokale rechtenescalatie, drie kritieke lekken in een veelgebruikte database met een pad van afstand naar code-uitvoering, en ruim 400 rechtenescalatie-kwetsbaarheden in de kernel van een populair besturingssysteem. Welke producten dat zijn zegt het bedrijf niet, omdat die meldingen nog lopen.

Drie dagen na de rem op Astra

De aankondiging valt in dezelfde week waarin OpenAI juist op de rem trapte. Axios plaatst de twee besluiten naast elkaar: het nieuwe cybermodel komt enkele dagen nadat het bedrijf de release van Astra uitstelde omdat dat model tijdens veiligheidstests kritieke hackcapaciteiten bereikte. Op 7 augustus legde OpenAI intern werk aan Astra stil omdat het kritieke cybercapaciteiten niet kon uitsluiten, met versleutelde modelgewichten en geïsoleerde testomgevingen als voorwaarde om verder te mogen.

De grens die het bedrijf trekt loopt niet tussen verdedigen en aanvallen, maar langs het eigen Preparedness Framework. Astra naderde de drempel Kritiek en ging op slot. GPT-5.6-Cyber is beoordeeld op Hoog, dezelfde trede als GPT-5.6 Sol, en gaat daarom wel naar buiten, achter identiteitsverificatie, goedgekeurd gebruik en juridische verklaringen. Capaciteit onder de drempel mag de deur uit zodra de poort er staat. Een systeemkaart met verdere evaluaties volgt later.

OpenAI tekent er nadrukkelijk bij aan dat GPT-5.6-Cyber niet betrokken was bij de inbraak bij Hugging Face, die het bedrijf in juli toeschreef aan zijn eigen pre-release modellen met verzwakte cyberremmen, en dat er ook geen ander model voor een komende release bij betrokken was.

Hoe dit een Nederlandse organisatie bereikt

Het partnerprogramma is de route naar de gewone markt. Naast de adviesbureaus staan Palo Alto Networks, CrowdStrike, Cisco, Sophos, Akamai, Fortinet en Cloudflare op de lijst als technologiepartner. Zij mogen de modellen verwerken in hun producten, beheerde diensten en klantopdrachten, maar de toegang tot het onderliggende model blijft bij de partner en gaat niet door naar de klant. Per opdracht spreken partner en klant af wat de reikwijdte is, wie de bevindingen beoordeelt en wat er daarna mee gebeurt.

Losse toegang is er niet. GPT-5.6-Cyber is niet beschikbaar voor gewone gebruikers, omdat modellen met deze capaciteit volgens OpenAI al zijn misbruikt voor aanvallen. Aan de toegangskant komt er bovendien extra slot op: alle individuele Daybreak-accounts moeten vanaf 1 september 2026 een hardwaresleutel gebruiken. Daybreak-klanten die Codex draaien worden van de volledige-toegangsmodus naar auto-review geduwd, waarin acties met verhoogde rechten eerst worden beoordeeld en riskante opdrachten geblokkeerd kunnen worden. Die verschuiving volgt op de Full Access-modus die eerder thuismappen van gebruikers wiste.

Voor de meeste bedrijven verandert de dagelijkse praktijk nog niet, maar de markt eromheen wel. De vraag naar zwaar testwerk liep in Nederland al op: aanbieders van maandenlange red teamtests zien de vraag met 25 tot 100 procent stijgen, gedreven door DORA en de attestatie van DNB. Gaat een deel van dat werk naar een model dat 95 procent van de exploitverzoeken beantwoordt, dan verschuiven prijs, doorlooptijd en de vraag wie er precies aan de knoppen zat.

Daarmee verplaatst de schaarste. In juni bracht OpenAI Codex Security en GPT-5.5-Cyber uit, met een partnerprogramma dat de techniek naar securitybedrijven moest brengen; toen was de capaciteit het nieuws. Nu is de poort het nieuws: identiteitscontrole, goedgekeurd gebruik, juridische verklaringen en straks een hardwaresleutel bepalen wie op machinesnelheid in code mag meekijken. Twee onbekende lekken in de JavaScript-engine van Chrome, gevonden door een model dat je niet zelf kunt draaien, laten zien aan welke kant van die poort het tempo ligt.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Agents met duidelijke grenzen

Een model dat op machinesnelheid werkt is pas bruikbaar als vastligt wat het wel en niet mag. Ik denk met je mee, ontwerp de werkwijze en bouw de agents en koppelingen die daarbij horen, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

OpenAI breidt Daybreak uit: AI die kwetsbaarheden vindt, valideert en patcht
Nieuws
5 min

22 jun 20:11

OpenAI breidt Daybreak uit: AI die kwetsbaarheden vindt, valideert en patcht

OpenAI rolt nieuwe Daybreak-tools uit: Codex Security en GPT-5.5-Cyber scannen code op lekken en schrijven direct patches. Plus een open-source-initiatief en een partnerprogramma met grote securitybedrijven.

OpenAI vertraagt Astra omdat het kritieke cybercapaciteiten niet kan uitsluiten
Nieuws
4 min

7 aug 20:09

OpenAI vertraagt Astra omdat het kritieke cybercapaciteiten niet kan uitsluiten

OpenAI legt werk aan zijn komende model Astra deels stil omdat interne tests kritieke cybercapaciteiten niet uitsluiten. Overheidsdiensten gaan meetesten en de release schuift op. Wat dat betekent voor je AI-planning.

Cisco brengt Antares uit: open-weight modellen die code-lekken lokaliseren
Nieuws
4 min

22 jul 10:10

Cisco brengt Antares uit: open-weight modellen die code-lekken lokaliseren

Cisco Foundation AI brengt Antares uit, open-weight modellen die kwetsbaarheden in code lokaliseren. Ze draaien lokaal op je eigen hardware onder Apache 2.0 en zijn volgens het bedrijf tot 172 keer goedkoper dan GPT-5.5.

AI-hallucinatie in dreigingsrapport leidt tot rechtszaak tegen Koi en Palo Alto
Nieuws
5 min

4 jul 06:25

AI-hallucinatie in dreigingsrapport leidt tot rechtszaak tegen Koi en Palo Alto

Een AI-model linkte een onschuldig videobedrijf aan Chinese spionage, waarna securityleveranciers de domeinen blokkeerden. Nu volgt een rechtszaak die draait om aansprakelijkheid voor ongecontroleerde AI-rapporten.

Microsoft steekt 2,5 miljard in 'Frontier Company' die AI-engineers ín je bedrijf plaatst
Nieuws
6 min

2 jul 16:10

Microsoft steekt 2,5 miljard in 'Frontier Company' die AI-engineers ín je bedrijf plaatst

Microsoft lanceert The Microsoft Frontier Company: 2,5 miljard dollar en 6.000 mensen die AI-systemen bij klanten bouwen en draaien. Twee dagen na AWS' vergelijkbare stap wordt de uitrol van AI het nieuwe slagveld.

Agent Plugins 1.0 maakt agentuitbreidingen draagbaar tussen ChatGPT, Copilot en VS Code
Nieuws
4 min

7 aug 12:24

Agent Plugins 1.0 maakt agentuitbreidingen draagbaar tussen ChatGPT, Copilot en VS Code

Amazon, Cursor, Microsoft, OpenAI en Vercel publiceerden een open pakketformaat voor Agent Skills en MCP-servers. Google sluit aan als core maintainer. Je bouwt een agentuitbreiding voortaan een keer, niet per client.