Common Sense Media noemt ChatGPT for Teens een ‘onaanvaardbaar risico’: nieuwe accounts gekoppeld aan een ouder kregen na expliciete gesprekken over zelfbeschadiging geen melding binnen een uur.
Voor een Nederlandse ondernemer die AI aan jongeren aanbiedt, raakt de audit de hele meldketen: welk gesprek activeert een waarschuwing, wie ontvangt die en hoeveel vertraging ontstaat na accountkoppeling? Voor scholen, uitgevers en softwareleveranciers wordt die route daarmee een onderdeel van productselectie, implementatie en periodieke controle.
De 4.000 prompts waren niet allemaal meldingstests
De audit omvat ruim 4.000 prompts in twee vensters: 13 juli tot 17 augustus en 25 augustus tot 28 september 2026, ongeveer half vóór en half na de introductie van ChatGPT for Teens. Dit brede promptonderzoek staat los van de aparte meldingstest.
Voor de meldingstest maakten onderzoekers ruim twaalf accounts voor tieners van 13 tot 17 jaar en koppelden die vóór het gesprek aan een ouder. In vier scenario’s over zelfbeschadiging, suïcidegedachten en eetstoornissen deden ze expliciete uitspraken over de eigen situatie. Ze controleerden vijf tot zestig minuten op meldingen. Geen account kreeg binnen een uur een melding.
In een crisistest van ongeveer een week registreerde Common Sense Media vier meldingen. Twee kwamen vóór de introductie: één drie uur en één drie dagen na de eerste crisisuiting. Na de introductie kwamen twee meldingen binnen een uur op een gekoppeld account van een 13-jarige, nadat het honderden prompts over meerdere onderwerpen had gekregen. Volgens de onderzoekers hangt de meldroute mogelijk af van opgebouwde gespreksgeschiedenis, niet alleen van één expliciet signaal.

Bij meer dan een kwart van de gesprekken waarin een verwijzing naar hulp nodig was, ontbrak die volgens de onderzoekers. Op drie van vijf categorieën ernstige schade bleef ChatGPT onder hun grens van 95 procent. Dit meet de reactie van de chatbot, niet het versturen van een oudermelding.
OpenAI zegt dat de meldingen niet realtime zijn
OpenAI introduceerde ChatGPT for Teens op 18 augustus met leeftijdsgerichte bescherming en beperkte oudermeldingen bij ernstige signalen. De wereldwijde uitrol plaatste 13- tot 17-jarigen standaard in Teen mode, terwijl leeftijdsinschatting in de EU door AVG-vragen en Europese richtsnoeren werd uitgesteld.
OpenAI meldt dat oudermeldingen alleen in beperkte situaties worden verstuurd en geen realtime toezicht vormen. Een speciaal getrainde beoordelaar controleert ernstige signalen voordat een melding volgt. Ook kan het na het koppelen van accounts enkele uren duren voordat meldingen kunnen worden verstuurd. Common Sense Media zegt dat een deel van de geteste accounts al langer dan drie uur gekoppeld was en toch geen melding gaf.
OpenAI betwistte de testmethode en zei dat bulk testen mogelijk begon voordat ouderlijk toezicht volledig actief was. Common Sense Media antwoordde dat de functies actief waren en dat sommige accounts langer dan drie uur gekoppeld waren; het instituut houdt vast aan de bevindingen. Zo verschillen OpenAI’s uitleg van de activeringsperiode en wat de onderzoekers in hun accounts waarnamen.
Google-tests raken dezelfde hulproute
In juli onderzocht hetzelfde Common Sense Media-instituut Google Search. In 2.624 interacties op kinder- en tieneraccounts verwees AI Overview naar hulpbronnen in 58 procent van de situaties waarin dat volgens de onderzoekers nodig was; AI Mode deed dat in 77 procent. De percentages zijn niet vergelijkbaar met de ChatGPT-audit, maar laten zien dat externe evaluaties ook bij zoeken meten wat er gebeurt wanneer een jongere om hulp vraagt.
Omdat hetzelfde instituut beide tests uitvoerde, is dit context en geen onafhankelijke bevestiging van de ChatGPT-uitkomst. De ChatGPT-tests vonden alleen in de Verenigde Staten plaats en betroffen tekst, geen spraak, beeldgeneratie of groepsgesprekken. De methodesectie rapporteert geen maat voor overeenstemming tussen beoordelaars. Ook kan de vergelijking tussen periodes veranderingen in het model en in de tienerinstellingen omvatten.
De toets zit in de route na het antwoord
Common Sense Media vermeldt zijn financiering en meldt dat het instituut steun ontvangt van filantropische en industriële partijen, waaronder de OpenAI Foundation en makers van beoordeelde technologie. Het instituut zegt volledige redactionele onafhankelijkheid te hebben. De financiering is relevante context, geen bewijs dat de uitkomst daardoor is gestuurd.
OpenAI publiceerde in september zeven uitgangspunten voor onafhankelijke AI-beoordelingen, met duidelijke reikwijdte, transparante methoden en onzekerheden. De zeven principes en vier technische domeinen voor externe AI-toetsing maken de toetsbare praktijk concreet. Die principes vragen dat een beoordeling toont welke accounts, functies en signalen zijn getest en waar onzekerheid blijft.
Voor organisaties die AI aan jongeren aanbieden, is de praktische toets daarom concreet: wat gebeurt er na de eerste expliciete crisismelding, wie ontvangt het signaal, binnen welke tijd en hoe is bewezen dat accountkoppeling en escalatie actief waren? Leg accountstatus, productversie, scenario en tijdstippen vast. Een melding die pas na uren of na honderden berichten verschijnt, is een wezenlijk andere waarborg dan een ouder of hulpverlener die na het eerste ernstige signaal wordt gewaarschuwd.
Veelgestelde vragen
AI met jongeren doordacht inzetten
Ik denk mee over de rol en grenzen van AI voor jongeren, ontwerp de ervaring en realiseer de software van eerste idee tot livegang. Waar het kan, houd ik systemen self-hosted en in eigen beheer.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
