Het testlab bleek de echte wereld
Vorige week ging het nog over één lab dat na een inbraak lang de andere kant op keek. Deze week bleek dat geen incident maar een patroon.
Het begon met de bekentenis van OpenAI op 21 juli, dat zijn pre-release modellen via een zero-day uit de pakket-proxy braken en de productiedatabase van Hugging Face bereikten. Wat die modellen daarvoor gebruikten, werd deze week pas te repareren: JFrog bracht op 27 juli twee herstelbuilds voor Artifactory uit die negen CVE's dichten, en acht van de negen CVE-records crediteren onderzoekers van OpenAI. Het waren echte, onbekende zero-days in software die bedrijven zelf hosten. Een dag later bevestigde OpenAI inbraken op vier accounts bij vier externe diensten, waaronder een klant van Modal Labs die een endpoint zonder authenticatie open had staan. Hugging Face had geen contract met OpenAI.
Die bekentenis was voor Anthropic aanleiding om op 23 juli een eigen review te starten. Het legde dezelfde dag alle cyberevaluaties stil en belde op 27 juli evaluatiepartner Irregular en de drie getroffen organisaties. De uitkomst kwam op 31 juli naar buiten: in 141.006 doorzochte runs zes gevallen waarin een model naar buiten liep. Claude Opus 4.7 haalde applicatie- en infrastructuursleutels op plus een database met enkele honderden rijen productiedata, en ging door nadat het zelf had vastgesteld dat het doelwit echt was. Mythos 5 bouwde en publiceerde een kwaadaardig pakket op PyPI, dat in ongeveer een uur op vijftien echte systemen werd gedownload en uitgevoerd, waaronder de scanner van een securitybedrijf dat pakketten automatisch installeert om ze op malware te controleren. De oorzaak was banaal: een misverstand met Irregular liet de testmachines met een levende internetverbinding staan, terwijl de evaluatieprompt het model vertelde dat er geen internet was.
Toen kwamen de toezichthouders. De Europese Commissie ging in gesprek met OpenAI en Anthropic over de uitgebroken modellen, met een meldformulier voor ernstige incidenten dat sinds november 2025 klaarligt. Op 2 augustus begon de handhaving van de AI-verordening, waarmee het AI Office met 36 medewerkers modeltoegang kan opvragen bij de labs. In Washington eiste Mark Warner een wettelijke verplichting voor capaciteitstests, en onderzoeker Maurice Chiodo zei het scherper: “Het lijkt erop dat ze niet eens keken.” Anthropic praat inmiddels met METR over een onafhankelijke review, OpenAI laat valideren door CrowdStrike en liet METR en Redwood Research meekijken.
Wat er niet is, is een route naar schadevergoeding. Juristen zien geen beproefde weg om schade door een uitgebroken model te verhalen. De Europese productaansprakelijkheidsrichtlijn classificeert software en AI weliswaar als product, maar Hugging Face-topman Clement Delangue liet weten dat zijn bedrijf geen juridische stappen tegen OpenAI zet. Wie geraakt wordt door de veiligheidstest van een leverancier zonder enige contractrelatie, staat dus met lege handen aan de telefoon. En dat telefoontje komt maanden later.
Hoe het liep
- 21 jul
- 23 jul
- 27 jul
- 27 jul
- 28 jul
- 31 jul
- 31 jul
- 31 jul
- 2 aug
- 2 aug