Drie mensen bespreken een laptop aan een vergadertafel
Nieuws22 september · 00:163 min leestijd

OpenAI pleit voor wereldwijde AI-standaarden

OpenAI wil dat de VS wereldwijde technische standaarden voor frontier-AI helpt ontwikkelen. Gedeelde evaluaties, incidentmeldingen en releasevoorwaarden maken modelinkoop daarmee ook een vraag over bewijs en continuïteit.

OpenAI pleit in een Global Affairs-post van 21 september voor wereldwijde technische standaarden voor frontier-AI, met gedeelde evaluaties, meetmethoden en protocollen voor incidentrapportage.

Voor een Nederlandse ondernemer verschuift daarmee de modelkeuze: prijs en prestaties krijgen gezelschap van de vraag welke veiligheidsproeven, meldingen en releasevoorwaarden achter een AI-dienst zitten. Die informatie raakt niet alleen inkoop, maar ook de continuïteit van processen die op één leverancier draaien.

Een gedeelde technische basis

OpenAI wil dat de Verenigde Staten een internationale aanpak leidt, samen met landen, AI-veiligheidsinstituten, nationale brancheorganisaties en bestaande standaardenorganisaties. Het voorstel richt zich op frontier-modellen en op het beheer van risico's rond recursive self-improvement, waarbij AI steeds meer van het eigen onderzoek helpt uitvoeren.

De voorgestelde standaarden moeten een gemeenschappelijke basis geven voor het meten van modelcapaciteiten, evaluaties, risicobeoordeling en de vraag of veiligheidsmaatregelen voldoende zijn. OpenAI zegt expliciet dat het niet gaat om een licentie, verplichte controle vóór elke release of voorafgaande goedkeuring. Overheden bepalen zelf of en hoe zij de technische standaarden in hun eigen regels opnemen.

Evaluatie en incidenten worden vergelijkbaar

De technische laag gaat verder dan een benchmarkscore. OpenAI noemt evaluaties van de vooruitgang die relevant is voor recursive self-improvement, metingen van hoeveel autonoom onderzoek binnen een AI-bedrijf plaatsvindt en regels voor processen die direct menselijke beoordeling moeten starten. Het voorstel omvat ook gemeenschappelijke ernstniveaus en meldingsdrempels voor AI-incidenten.

Dat maakt een incident straks beter vergelijkbaar tussen leveranciers en landen. Een organisatie kan dan niet alleen vragen of een model veilig wordt genoemd, maar ook welke definitie, test en meldroute achter die claim zit. OpenAI pleit daarnaast voor veilige communicatiekanalen tussen overheden en beheerders van kritieke infrastructuur over kwetsbaarheden, dreigingen en veiligheidspraktijken.

Breder dan eerdere OpenAI-stappen

Dit voorstel is breder dan OpenAI's raamwerk dat gedrag, ernst, externe impact en onderzoeksstatus per misalignmentincident beschrijft. Dat raamwerk gaat over de inhoud en timing van meldingen nadat afwijkend modelgedrag is gevonden.

Het verschilt ook van de federale FRONTIER Act-lijn met onafhankelijke toetsen en minimaal halfjaarlijkse rapportages. Die route is een Amerikaans wetsvoorstel voor de grootste ontwikkelaars. De nieuwe Global Affairs-post gaat over een gedeelde technische basis tussen landen en labs, voor evaluatie, risicobeoordeling en incidentcommunicatie.

De betekenis voor de Nederlandse markt zit in de verschuiving van losse veiligheidsclaims naar vergelijkbaar bewijs. De technische kwaliteit van een model gaat dan ook over de manier waarop je weet wanneer je het moet beperken of vervangen. Daarmee raakt een release-standaard direct aan de continuïteit van het proces eromheen.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

AI die je kunt verantwoorden

Ik help je om AI niet los als model te kiezen, maar als onderdeel van een werkend systeem. Ik denk mee, ontwerp, realiseer en automatiseer end-to-end, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Brits kabinet overweegt AI-regels als vrijwillige tests tekortschieten
Nieuws
4 min

4 aug 12:27

Brits kabinet overweegt AI-regels als vrijwillige tests tekortschieten

AI-minister Kanishka Narayan zegt tegen Reuters dat het VK regels overweegt als vrijwillige tests tekortschieten, en de ICO volgt OpenAI en Anthropic. Twee uitspraken, geen wetsvoorstel, en het derde regime in vijf dagen.

VS heft exportblokkade op Anthropics Fable 5 en Mythos 5 volledig op
Nieuws
4 min

1 jul 02:05

VS heft exportblokkade op Anthropics Fable 5 en Mythos 5 volledig op

Iets minder dan drie weken na het exportbevel heft de VS de blokkade op Anthropics krachtigste modellen Fable 5 en Mythos 5 volledig op. Het topmodel keert terug, maar de les over afhankelijkheid blijft staan.

Gemini bereikt drie echte bedrijfssystemen tijdens cybertest
Nieuws
4 minBijgewerkt om 06:20

19 sep 02:28

Gemini bereikt drie echte bedrijfssystemen tijdens cybertest

Google zegt dat Gemini tijdens een cybersecuritytest in mei drie echte bedrijfssystemen bereikte. Internettoegang stond per ongeluk open. Het model stopte telkens zelf, maar het incident maakt sandboxing en externe stoprechten tot harde inkoopvragen.

AI-hallucinatie zet Amerikaanse onderschepping bijna in gang
Nieuws
3 min

19 sep 02:16

AI-hallucinatie zet Amerikaanse onderschepping bijna in gang

Een AI-chatbot hielp een fout Amerikaans inlichtingenrapport over een Chinees schip opstellen. Militairen stonden bijna klaar voor onderschepping. De casus maakt bronherkomst, verificatie en menselijke vrijgave concreet.

OpenAI lanceert Astra for Law voor juridisch werk
Nieuws
5 min

18 sep 16:13

OpenAI lanceert Astra for Law voor juridisch werk

OpenAI lanceert Astra for Law, een gespecialiseerde configuratie van GPT-6 Astra met een juridische index van ruim 230 miljoen URL’s, 26 plugins en beperkte toegang voor advocatenkantoren.

Crusoe haalt 3,9 miljard dollar op voor AI-infrastructuur
Nieuws
3 min

18 sep 04:44

Crusoe haalt 3,9 miljard dollar op voor AI-infrastructuur

Crusoe sluit een Series F van 3,9 miljard dollar en zet het geld in voor AI-factories, modulaire datacenters en cloudcapaciteit. Voor afnemers maakt dat compute, energie en leveranciersafhankelijkheid tot een inkoopvraag.