Een beeldscherm met regels broncode in een code-editor.
Nieuws27 juli · 20:134 min leestijd

Microsoft lanceert eigen securitymodel MAI-Cyber-1-Flash

Microsoft lanceert zijn eerste eigen cybersecuritymodel MAI-Cyber-1-Flash en opent Project Perception op 3 augustus als publieke preview. Het systeem scoort 95,95 procent op CyberGym, maar de beloofde halve prijs geldt tegenover Microsofts eigen opstelling.

Microsoft lanceert MAI-Cyber-1-Flash, zijn eerste eigen cybersecuritymodel, en zet het agentsysteem Project Perception op 3 augustus in publieke preview, schrijft beveiligingsbaas Hayete Gallot op het bedrijfsblog.

Voor een Nederlands bedrijf dat AI-gestuurde kwetsbaarheidsdetectie overweegt, ligt er nu iets tastbaars waar tien dagen geleden nog een ingewijde bij Caixin sprak over een tool zonder naam, zonder prijs en zonder benchmark. Er is een modelnaam, een score en een kostenclaim. Alleen slaat die claim van vijftig procent besparing niet op de prijs van Anthropic. Het is een besparing op Microsofts eigen rekening, en dat verschil bepaalt of je er iets aan hebt zodra je leveranciers naast elkaar legt.

Wat nu draait en wat nog preview is

MAI-Cyber-1-Flash zit vanaf vandaag in MDASH, de scanmachine van ruim honderd samenwerkende agents waarmee Microsoft softwarelekken opspoort, valideert en dicht. Dat deel is er echt.

Project Perception is dat nog niet. Het gaat 3 augustus open als publieke preview, en draait dan nog niet op Microsofts eigen model: het bedrijf schrijft dat Perception MAI-Cyber-1-Flash binnenkort ook voor meer beveiligingstaken gaat gebruiken, buiten het kwetsbaarhedenwerk om. De volgorde is dus model eerst, agentsysteem daarna, brede inzet later.

95,95 procent op CyberGym

Staafdiagram van de CyberGym-evaluatie. MDASH met MAI-Cyber-1-Flash en GPT-5.4 haalt 95,95 procent, de vier andere configuraties blijven tussen 83,2 en 85,6 procent. Bron: Microsoft AI.
Staafdiagram van de CyberGym-evaluatie. MDASH met MAI-Cyber-1-Flash en GPT-5.4 haalt 95,95 procent, de vier andere configuraties blijven tussen 83,2 en 85,6 procent. Bron: Microsoft AI.

CyberGym meet hoe goed een systeem in grote codebases echte kwetsbaarheden vindt. Binnen MDASH haalt de combinatie van MAI-Cyber-1-Flash en OpenAI's GPT-5.4 daar 95,95 procent. Anthropics Mythos 5 staat op 83,8 procent, GPT-5.5 Cyber op 85,6, GPT-5.6 Sol op 83,6 en Gemini 3.5 Flash Cyber binnen Googles CodeMender op 83,2. Twaalf punten voorsprong op Mythos, in Microsofts eigen samenvatting.

Dat is een flinke sprong sinds mei, toen MDASH nog op 88,45 procent stond. Het blijft wel een benchmark die Microsoft zelf draait, over zijn eigen opstelling, en die niemand anders heeft nagemeten.

De helft van welke prijs

Boven de aankondiging staat de zin die de koppen haalde: wereldklasse-beveiliging tegen de helft van de kosten. Firstpost nam die formulering over en meldde dat Microsoft beveiliging van wereldklasse tegen de halve prijs belooft. In het kleine lettertype geldt die vijftig procent besparing tegenover Microsofts eigen beste MDASH-opstelling van dit moment: GPT-5.4, GPT-5.4 mini en GPT-5.3 codex naast elkaar. Niet tegenover de prijs van Mythos, die Microsoft nergens noemt. Een lijstprijs voor Project Perception ontbreekt ook nog.

De besparing komt uit een taakverdeling. MAI-Cyber-1-Flash is gebouwd om tot negentig procent van de taken zelf af te handelen, waarna MDASH de tien procent uitzonderlijk lastige gevallen doorschuift naar GPT-5.4. Het eigen model vervangt het dure topmodel dus niet. Het verlaagt hoe vaak je ervoor betaalt.

Dat is precies het verhaal dat Microsoft aan tafel wil kunnen vertellen: het bedrijf traint zijn verkopers er al maanden op om OpenAI en Anthropic op kosten en beveiliging af te vallen. Maar de router loopt nog altijd langs OpenAI. Een lagere rekening koop je hier met een verschuiving in wie de kaart van je ongedichte lekken ziet, niet met minder afhankelijkheid.

Rood, blauw en groen

Schema van Project Perception met drie agentteams. Rood simuleert aanvallen, blauw detecteert en beoordeelt, groen herstelt en verhelpt. Bron: Microsoft.
Schema van Project Perception met drie agentteams. Rood simuleert aanvallen, blauw detecteert en beoordeelt, groen herstelt en verhelpt. Bron: Microsoft.

Project Perception verdeelt het werk over drie soorten agents. Rode agents zoeken aanvalspaden voordat een aanvaller ze gebruikt, blauwe agents beoordelen signalen op echt risico en groene agents voeren herstelacties uit en verharden de omgeving. Samen vormen ze een gesloten lus, waarbij mensen de zware ingrepen blijven goedkeuren.

Daaronder legt Microsoft een Cyber Stack van zes lagen: sensoren en signalen, een contextlaag, de modellen, de harness die alles aanstuurt, de agents zelf en actuators die beslissingen omzetten in ingrepen. Die contextlaag doet het echte werk. Agents krijgen een continu bijgewerkt beeld van assets, identiteiten, relaties en risico's, zodat ze dat niet elke keer uit ruwe signalen hoeven te reconstrueren. Dat scheelt tokens, en tokens zijn in dit domein de kostenpost. De grondstof eronder is schaal: meer dan 100 biljoen beveiligingssignalen per dag en operationeel inzicht uit 1,6 miljoen klanten.

Waar de scanner belandt

Gallot brengt dit als een verandering in de fysica van beveiliging. Wat er feitelijk verschuift, is wie de scanner in handen heeft. Anthropics Mythos opende deze markt, maar ging na een Amerikaans exportbevel op slot voor vrijwel iedereen buiten een klein groepje vroege testers. Een systeem dat op dezelfde benchmark twaalf punten hoger scoort, gaat volgende week gewoon in publieke preview. Microsoft-bestuurders betogen dat krachtige beveiligingssystemen juist breed verspreid horen te worden, tegen de zorg in Washington in dat zulke systemen aanvallers te veel helpen.

Voor Nederlandse organisaties verplaatst de scan zich daarmee naar de leverancier die je identiteiten, endpoints en mail toch al beheert. De vraag wie jouw keten het eerst scant krijgt een standaardantwoord, en dat antwoord is niet langer de duurste tool, maar degene die er al in zit.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Beveiliging die in je proces past

Een goedkoper securitymodel lost je proces niet op. Ik denk mee over waar AI in je keten echt werk overneemt, ontwerp de koppelingen en bouw en automatiseer het geheel, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Microsoft bouwt met Project Perception een goedkoper alternatief voor Anthropics Mythos
Nieuws
3 min

17 jul 14:24

Microsoft bouwt met Project Perception een goedkoper alternatief voor Anthropics Mythos

Microsoft ontwikkelt Project Perception, een AI-tool die softwarelekken opspoort en automatisch dicht, als goedkoper alternatief voor Anthropics dure Mythos. De tool combineert modellen van meerdere aanbieders en moet nog deze maand verschijnen. Wat betekent dat voor je beveiliging?

OpenAI zou de Amerikaanse overheid een belang van 5% hebben aangeboden
Nieuws
6 min

2 jul 08:11

OpenAI zou de Amerikaanse overheid een belang van 5% hebben aangeboden

OpenAI besprak volgens de Financial Times een belang van 5% voor de Amerikaanse overheid om politieke druk te verlichten. Noch OpenAI noch het Witte Huis bevestigt het. Wat betekent een overheid als aandeelhouder voor jouw AI-leverancier?

Twee weken Mythos offline: de impasse met Washington verergert
Nieuws
6 min

26 jun 18:31

Twee weken Mythos offline: de impasse met Washington verergert

Veertien dagen na het exportbevel staan Anthropics zwaarste modellen nog uit en zit het overleg met het Witte Huis muurvast. De expert die het bewijs las, noemt de aanleiding overdreven.

Trump-regering laat OpenAI GPT-5.6 gefaseerd uitbrengen om veiligheidsredenen
Nieuws
5 min

26 jun 01:05

Trump-regering laat OpenAI GPT-5.6 gefaseerd uitbrengen om veiligheidsredenen

Op verzoek van de Trump-regering brengt OpenAI zijn nieuwe model GPT-5.6 eerst in beperkte preview uit, met toegang die de overheid per klant goedkeurt. Bedrijven die op het model rekenen, lopen vertraging op.

Open-weight-brief aan Washington verdubbelt naar 50 ondertekenaars
Nieuws
4 min

26 jul 16:09

Open-weight-brief aan Washington verdubbelt naar 50 ondertekenaars

De open-weight-brief aan Washington telt nu 50 ondertekenaars, dubbel zoveel als bij publicatie. Google staat er alsnog op. Alleen Anthropic, Amazon en xAI blijven weg, en dat verschuift het politieke risico voor open modellen.

Witte Huis neigt naar beperkingen per Chinees AI-model, niet naar een breed verbod
Nieuws
4 min

26 jul 12:11

Witte Huis neigt naar beperkingen per Chinees AI-model, niet naar een breed verbod

Amerikaanse functionarissen neigen naar beperkingen per Chinees AI-model in plaats van een breed verbod, meldt The New York Times. Silicon Valley ligt er openlijk over overhoop, met Nvidia, Microsoft en Meta tegenover OpenAI en Anthropic.