Hangslot op een laptoptoetsenbord met gekleurde lichtsporen
Nieuws14 september · 20:194 min leestijd

OpenAI laat contractreviewers ChatGPT-prompts beoordelen

Gelekte documenten over Project Lily tonen hoe contractreviewers echte ChatGPT-prompts beoordelen voor modelverbetering. Voor Nederlandse organisaties zit de kern in het verschil tussen consumenteninstellingen, zakelijke data en contractueel afgedekte reviewtoegang.

OpenAI laat honderden contractreviewers echte ChatGPT-prompts lezen voor modelverbetering, meldt 404 Media op 14 september op basis van gelekte documenten en gesprekken met een betrokken reviewer.

Voor Nederlandse bedrijven ligt de inzet bij de grens tussen consumentengebruik en zakelijk gebruik. Wie een medewerker een Free-, Plus- of Pro-account laat gebruiken voor klantdata, persoonsgegevens of interne stukken, zet die informatie in een route waar modelverbetering en menselijke review mogelijk zijn. OpenAI zegt dat zakelijke input standaard niet voor training wordt gebruikt, maar dat beperkte toegang voor veiligheid, support en juridische zaken blijft bestaan.

Wat Project Lily doet

404 Media zag interne handleidingen, Slack-berichten, echte prompts en het beoordelingssysteem van Project Lily. Reviewers krijgen een echte gebruikersprompt te zien, schrijven eerst op wat de gebruiker probeert te bereiken en beoordelen daarna vier antwoorden van ChatGPT. Elk antwoord krijgt een score van 1 tot 7 en moet worden voorzien van minimaal drie concrete opmerkingen over wat wel of niet werkt.

De review gaat dus verder dan een automatische controle op verboden inhoud. De documenten beschrijven ook instructies om overdreven vleierij, onnodig menselijk taalgebruik en een onnatuurlijke toon terug te dringen. Soms verschijnt boven de prompt een samenvatting van eerdere gebruikersherinneringen, met bijvoorbeeld een indicatie van de regio waar iemand woont. De gebruikersnaam staat niet in het dashboard, maar de inhoud kan nog steeds persoonlijke details bevatten.

ChatGPT-instellingen met Data controls en de optie Improve the model for everyone uit, bron: OpenAI Help Center
ChatGPT-instellingen met Data controls en de optie Improve the model for everyone uit, bron: OpenAI Help Center

De instelling is een opt-out

Bij consumentenaccounts staat de instelling Improve the model for everyone standaard aan bij Free, Plus en Pro, schrijft 404 Media. Wie haar uitzet via Settings en Data Controls, voorkomt dat nieuwe gesprekken voor modeltraining worden gebruikt. Dat geldt niet met terugwerkende kracht voor oude gesprekken.

Temporary Chat is een aparte route. OpenAI zegt dat zulke gesprekken niet in de geschiedenis verschijnen, geen herinneringen maken en niet voor training worden gebruikt. Ze worden na 30 dagen uit de systemen verwijderd en mogen in die periode alleen voor misbruikmonitoring worden bekeken.

OpenAI beschrijft menselijke toegang zelf als beperkt tot geautoriseerde medewerkers en vertrouwde dienstverleners. Die toegang kan volgens OpenAI nodig zijn voor misbruikonderzoek, beveiligingsincidenten, ondersteuning, juridische zaken of modelverbetering. Toegang hoort technisch afgeschermd, gelogd en beperkt tot medewerkers met een concrete noodzaak te zijn.

Een privacyfilter blijft een filter

OpenAI zegt dat gesprekken vóór deze review door een versie van Privacy Filter gaan. Dat model moet persoonsgegevens herkennen en maskeren. De fabrikant schrijft zelf dat het filter ongewone identificerende gegevens of dubbelzinnige privéverwijzingen kan missen, en in beperkte context ook te veel of te weinig kan weghalen. Anonimiseren van een accountnaam betekent daarom niet dat elke gevoelige passage verdwenen is.

Dat onderscheid bepaalt de zakelijke lezing van het nieuws. Een medewerker die via een persoonlijk ChatGPT-account een klantmail, contract of personeelskwestie invoert, gebruikt een consumentenroute met een andere standaard dan een beheerde bedrijfsomgeving. De vraag is dan niet alleen of een model antwoord geeft, maar ook welke reviewketen achter de invoer zit.

Zakelijke chats volgen een andere standaard

OpenAI schrijft dat het standaard niet traint op input en output van ChatGPT Business, ChatGPT Enterprise en de API. Organisaties zijn alleen ingeschakeld voor het delen van data voor modelverbetering als ze daar expliciet voor kiezen. De gepubliceerde regels wijzen er daarmee op dat de specifieke Project Lily-route voor modelverbetering normaal buiten zakelijke chats valt, tenzij een organisatie zelf delen toestaat.

Dat betekent niet dat zakelijke gesprekken nooit door mensen kunnen worden gezien. Dezelfde OpenAI-FAQ noemt beperkte toegang voor veiligheid, ondersteuning en juridische verplichtingen. OpenAI bevestigt in de geraadpleegde bronnen ook niet expliciet dat Project Lily nooit zakelijke data ontvangt. Accounttype, instellingen en contractvoorwaarden bepalen dus samen welke standaard geldt.

Voor organisaties sluit dit aan op de vraag of persoonsgegevens überhaupt nodig zijn voordat je generatieve AI inzet. Met testdata of een geanonimiseerde invoer blijft de gevoelige brondata buiten de reviewketen omdat die niet wordt doorgestuurd. Zodra echte klant- of personeelsinformatie in een prompt belandt, hoort de datastroom bij de governance van die AI-toepassing.

Project Lily maakt vooral zichtbaar wat een chatvenster verbergt: modelverbetering is een keten van prompts, filters, menselijke beoordelingen en toegangsregels. Het verschil tussen een persoonlijke en een zakelijke ChatGPT-omgeving zit daarom niet in het label op het scherm, maar in de datastroom en de afspraken erachter.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

AI met duidelijke grenzen

Ik help je AI-werkplek ontwerpen en realiseren, van meedenken en datastromen tot automatiseren, met afspraken over toegang en self-hosting waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

ChatGPT, Claude en Grok vallen tegelijk uit, oorzaak onbekend
Nieuws
4 min

3 sep 20:19

ChatGPT, Claude en Grok vallen tegelijk uit, oorzaak onbekend

ChatGPT, Claude en Grok lagen donderdag ruim anderhalf uur tegelijk plat. Geen van de drie aanbieders noemt een oorzaak. Voor wie AI in een productieproces heeft, verliest een tweede leverancier als terugvaloptie daarmee zijn waarde.

OpenAI herstelt ChatGPT-inlogstoring na 52 minuten
Nieuws
3 min

20 aug 04:08

OpenAI herstelt ChatGPT-inlogstoring na 52 minuten

OpenAI verhielp een storing die inloggen en aanmelden op ChatGPT 52 minuten blokkeerde. De API bleef draaien. Het breekpunt lag in de authenticatie, de laag waar geen tweede modelaanbieder je opvangt.

OpenAI geeft gratis ChatGPT onbeperkte tekstgesprekken op GPT-5.6 Luna
Nieuws
5 min

6 aug 20:10

OpenAI geeft gratis ChatGPT onbeperkte tekstgesprekken op GPT-5.6 Luna

OpenAI maakt tekstgesprekken in gratis ChatGPT onbeperkt en zet GPT-5.6 Luna als standaardmodel. Dat verschuift de rekensom voor betaalde werkplekken en vergroot het gebruik van privéaccounts zonder zakelijke afspraken over data.

OpenAI bevestigt wereldwijde storing in ChatGPT, API en Codex
Nieuws
4

25 jul 12:12

OpenAI bevestigt wereldwijde storing in ChatGPT, API en Codex

OpenAI bevestigt een wereldwijde storing in ChatGPT, de API en Codex. Vanaf 11.17 uur liepen inlogpogingen en API-aanroepen vast. Voor bedrijven die hun processen op de API bouwden is dat geen hinder maar uitval.

OpenAI brengt GPT-5.6 Sol breed uit en claimt 54 procent minder tokens op agentic coding
Nieuws
3 min

9 jul 18:24

OpenAI brengt GPT-5.6 Sol breed uit en claimt 54 procent minder tokens op agentic coding

OpenAI heeft topmodel GPT-5.6 Sol breed uitgebracht via ChatGPT, de API en Codex. Sam Altman noemt het 54 procent zuiniger op agentic coding-taken, maar onafhankelijke tests laten zien waarom je dat cijfer beter zelf controleert.

Hassabis steunt Amodei’s koers voor tragere frontier-AI
Nieuws
4 minBijgewerkt om 00:22

13 sep 08:10

Hassabis steunt Amodei’s koers voor tragere frontier-AI

Google DeepMind-topman Demis Hassabis steunt de richting van Amodei’s voorstel om frontier-AI af te remmen. Zijn steun verbreedt de leveranciers- en governancecontext voor Nederlandse organisaties die op frontier-modellen bouwen.