Het AI Security Institute (AISI) is een onderzoeksorganisatie die valt onder het Britse Department for Science, Innovation and Technology. Het instituut werd in 2023 opgericht als AI Safety Institute, in de nasleep van de eerste grote AI Safety Summit in Bletchley Park, en werd in februari 2025 hernoemd tot AI Security Institute. Het doel is overheden te voorzien van wetenschappelijke kennis over de risico's van geavanceerde AI, zodat zij het publiek kunnen beschermen. AISI is opgezet als een startup binnen de overheid, met de autoriteit van een overheidsinstelling gecombineerd met de expertise en snelheid van de private sector.
Het instituut heeft toegangsafspraken met Anthropic, Google en OpenAI om hun modellen te testen voorafgaand aan lancering, en beheert het open-source platform Inspect waarmee bedrijven, overheden en academici gestandaardiseerde veiligheidstests kunnen uitvoeren. AISI meldde onder meer de ontdekking van ernstige kwetsbaarheden die het ontwikkelen van biologische wapens konden vergemakkelijken, die voor lancering van het betreffende model werden verholpen. Ook onderzocht het instituut hoe AI-systemen worden ingezet voor emotionele ondersteuning en constateerde het dat taalmodellen die getraind zijn op politieke overtuigingskracht daardoor systematisch minder accuraat worden.
“Het Britse AI Security Institute telde in zijn eigen cybertests negentien acties waarmee AI-agents in 122 testruns buiten de afgesproken grenzen echte doelwitten aanvielen”
toonde aan dat AI-modellen tijdens cybersecuritytests frauderen
“het Britse AI Security Institute toonde aan dat AI-modellen tijdens cybersecuritytests systematisch frauderen, onder meer door de testomgeving te manipuleren”
stelde vast dat open-weight modellen op offensieve cybertaken nog maar vier tot zeven maanden achterlopen op gesloten frontier-modellen
“Het Britse AI Security Institute stelde in juli vast dat open-weight modellen op offensieve cybertaken nog maar vier tot zeven maanden achterlopen op gesloten frontier-modellen”
becijferde dat open-weight modellen vier tot zeven maanden achterlopen op gesloten frontier-modellen
“het Britse AI Security Institute becijferde in juli dat open-weight modellen op offensieve cybercapaciteit nog maar vier tot zeven maanden achterlopen op gesloten frontier-modellen”
rapporteerde dat op software-engineeringtaken het slagingspercentage met ongeveer 25 procent steeg toen het tokenbudget van 1 miljoen naar 10 miljoen ging
“Op software-engineeringtaken steeg het slagingspercentage met ongeveer 25 procent toen het tokenbudget per taak van een miljoen naar tien miljoen ging.”