Microsoft lanceert MAI-Cyber-1-Flash, zijn eerste eigen cybersecuritymodel, en zet het agentsysteem Project Perception op 3 augustus in publieke preview, schrijft beveiligingsbaas Hayete Gallot op het bedrijfsblog.
Voor een Nederlands bedrijf dat AI-gestuurde kwetsbaarheidsdetectie overweegt, ligt er nu iets tastbaars waar tien dagen geleden nog een ingewijde bij Caixin sprak over een tool zonder naam, zonder prijs en zonder benchmark. Er is een modelnaam, een score en een kostenclaim. Alleen slaat die claim van vijftig procent besparing niet op de prijs van Anthropic. Het is een besparing op Microsofts eigen rekening, en dat verschil bepaalt of je er iets aan hebt zodra je leveranciers naast elkaar legt.
Wat nu draait en wat nog preview is
MAI-Cyber-1-Flash zit vanaf vandaag in MDASH, de scanmachine van ruim honderd samenwerkende agents waarmee Microsoft softwarelekken opspoort, valideert en dicht. Dat deel is er echt.
Project Perception is dat nog niet. Het gaat 3 augustus open als publieke preview, en draait dan nog niet op Microsofts eigen model: het bedrijf schrijft dat Perception MAI-Cyber-1-Flash binnenkort ook voor meer beveiligingstaken gaat gebruiken, buiten het kwetsbaarhedenwerk om. De volgorde is dus model eerst, agentsysteem daarna, brede inzet later.
95,95 procent op CyberGym

CyberGym meet hoe goed een systeem in grote codebases echte kwetsbaarheden vindt. Binnen MDASH haalt de combinatie van MAI-Cyber-1-Flash en OpenAI's GPT-5.4 daar 95,95 procent. Anthropics Mythos 5 staat op 83,8 procent, GPT-5.5 Cyber op 85,6, GPT-5.6 Sol op 83,6 en Gemini 3.5 Flash Cyber binnen Googles CodeMender op 83,2. Twaalf punten voorsprong op Mythos, in Microsofts eigen samenvatting.
Dat is een flinke sprong sinds mei, toen MDASH nog op 88,45 procent stond. Het blijft wel een benchmark die Microsoft zelf draait, over zijn eigen opstelling, en die niemand anders heeft nagemeten.
De helft van welke prijs
Boven de aankondiging staat de zin die de koppen haalde: wereldklasse-beveiliging tegen de helft van de kosten. Firstpost nam die formulering over en meldde dat Microsoft beveiliging van wereldklasse tegen de halve prijs belooft. In het kleine lettertype geldt die vijftig procent besparing tegenover Microsofts eigen beste MDASH-opstelling van dit moment: GPT-5.4, GPT-5.4 mini en GPT-5.3 codex naast elkaar. Niet tegenover de prijs van Mythos, die Microsoft nergens noemt. Een lijstprijs voor Project Perception ontbreekt ook nog.
De besparing komt uit een taakverdeling. MAI-Cyber-1-Flash is gebouwd om tot negentig procent van de taken zelf af te handelen, waarna MDASH de tien procent uitzonderlijk lastige gevallen doorschuift naar GPT-5.4. Het eigen model vervangt het dure topmodel dus niet. Het verlaagt hoe vaak je ervoor betaalt.
Dat is precies het verhaal dat Microsoft aan tafel wil kunnen vertellen: het bedrijf traint zijn verkopers er al maanden op om OpenAI en Anthropic op kosten en beveiliging af te vallen. Maar de router loopt nog altijd langs OpenAI. Een lagere rekening koop je hier met een verschuiving in wie de kaart van je ongedichte lekken ziet, niet met minder afhankelijkheid.
Rood, blauw en groen

Project Perception verdeelt het werk over drie soorten agents. Rode agents zoeken aanvalspaden voordat een aanvaller ze gebruikt, blauwe agents beoordelen signalen op echt risico en groene agents voeren herstelacties uit en verharden de omgeving. Samen vormen ze een gesloten lus, waarbij mensen de zware ingrepen blijven goedkeuren.
Daaronder legt Microsoft een Cyber Stack van zes lagen: sensoren en signalen, een contextlaag, de modellen, de harness die alles aanstuurt, de agents zelf en actuators die beslissingen omzetten in ingrepen. Die contextlaag doet het echte werk. Agents krijgen een continu bijgewerkt beeld van assets, identiteiten, relaties en risico's, zodat ze dat niet elke keer uit ruwe signalen hoeven te reconstrueren. Dat scheelt tokens, en tokens zijn in dit domein de kostenpost. De grondstof eronder is schaal: meer dan 100 biljoen beveiligingssignalen per dag en operationeel inzicht uit 1,6 miljoen klanten.
Waar de scanner belandt
Gallot brengt dit als een verandering in de fysica van beveiliging. Wat er feitelijk verschuift, is wie de scanner in handen heeft. Anthropics Mythos opende deze markt, maar ging na een Amerikaans exportbevel op slot voor vrijwel iedereen buiten een klein groepje vroege testers. Een systeem dat op dezelfde benchmark twaalf punten hoger scoort, gaat volgende week gewoon in publieke preview. Microsoft-bestuurders betogen dat krachtige beveiligingssystemen juist breed verspreid horen te worden, tegen de zorg in Washington in dat zulke systemen aanvallers te veel helpen.
Voor Nederlandse organisaties verplaatst de scan zich daarmee naar de leverancier die je identiteiten, endpoints en mail toch al beheert. De vraag wie jouw keten het eerst scant krijgt een standaardantwoord, en dat antwoord is niet langer de duurste tool, maar degene die er al in zit.
Veelgestelde vragen
Beveiliging die in je proces past
Een goedkoper securitymodel lost je proces niet op. Ik denk mee over waar AI in je keten echt werk overneemt, ontwerp de koppelingen en bouw en automatiseer het geheel, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
