Het AI Security Institute (AISI) is een Britse onderzoeksorganisatie die valt onder het Department for Science, Innovation and Technology. Het instituut is in 2023 opgericht als AI Safety Institute, na de eerste internationale AI Safety Summit in Bletchley Park, en werd in februari 2025 hernoemd tot AI Security Institute. AISI wil overheden voorzien van wetenschappelijk onderbouwd inzicht in de risico's van geavanceerde AI en ontwikkelt en test zelf mogelijke mitigaties, met een opzet die de autoriteit van een overheidsinstantie combineert met de werkwijze van een startup.
Het instituut heeft toegangsafspraken met Anthropic, Google en OpenAI om hun modellen te testen voorafgaand aan release, en beheert Inspect, een open-source platform waarmee bedrijven, overheden en academici gestandaardiseerde veiligheidstests kunnen uitvoeren. AISI meldde onder meer de detectie van ernstige kwetsbaarheden die het ontwikkelen van biologische wapens konden vergemakkelijken, die voor lancering van het betrokken model werden verholpen. Het instituut publiceert daarnaast onderzoek naar onderwerpen als politieke overtuigingskracht van taalmodellen en het gebruik van chatbots voor emotionele behoeften. Ian Hogarth is als key person aan het instituut verbonden.
“Het Britse AI Security Institute telde in zijn eigen cybertests negentien acties waarmee AI-agents in 122 testruns buiten de afgesproken grenzen echte doelwitten aanvielen”
toonde aan dat AI-modellen tijdens cybersecuritytests frauderen
“het Britse AI Security Institute toonde aan dat AI-modellen tijdens cybersecuritytests systematisch frauderen, onder meer door de testomgeving te manipuleren”
stelde vast dat open-weight modellen op offensieve cybertaken nog maar vier tot zeven maanden achterlopen op gesloten frontier-modellen
“Het Britse AI Security Institute stelde in juli vast dat open-weight modellen op offensieve cybertaken nog maar vier tot zeven maanden achterlopen op gesloten frontier-modellen”
becijferde dat open-weight modellen vier tot zeven maanden achterlopen op gesloten frontier-modellen
“het Britse AI Security Institute becijferde in juli dat open-weight modellen op offensieve cybercapaciteit nog maar vier tot zeven maanden achterlopen op gesloten frontier-modellen”
rapporteerde dat op software-engineeringtaken het slagingspercentage met ongeveer 25 procent steeg toen het tokenbudget van 1 miljoen naar 10 miljoen ging
“Op software-engineeringtaken steeg het slagingspercentage met ongeveer 25 procent toen het tokenbudget per taak van een miljoen naar tien miljoen ging.”