OpenAI laat honderden contractreviewers echte ChatGPT-prompts lezen voor modelverbetering, meldt 404 Media op 14 september op basis van gelekte documenten en gesprekken met een betrokken reviewer.
Voor Nederlandse bedrijven ligt de inzet bij de grens tussen consumentengebruik en zakelijk gebruik. Wie een medewerker een Free-, Plus- of Pro-account laat gebruiken voor klantdata, persoonsgegevens of interne stukken, zet die informatie in een route waar modelverbetering en menselijke review mogelijk zijn. OpenAI zegt dat zakelijke input standaard niet voor training wordt gebruikt, maar dat beperkte toegang voor veiligheid, support en juridische zaken blijft bestaan.
Wat Project Lily doet
404 Media zag interne handleidingen, Slack-berichten, echte prompts en het beoordelingssysteem van Project Lily. Reviewers krijgen een echte gebruikersprompt te zien, schrijven eerst op wat de gebruiker probeert te bereiken en beoordelen daarna vier antwoorden van ChatGPT. Elk antwoord krijgt een score van 1 tot 7 en moet worden voorzien van minimaal drie concrete opmerkingen over wat wel of niet werkt.
De review gaat dus verder dan een automatische controle op verboden inhoud. De documenten beschrijven ook instructies om overdreven vleierij, onnodig menselijk taalgebruik en een onnatuurlijke toon terug te dringen. Soms verschijnt boven de prompt een samenvatting van eerdere gebruikersherinneringen, met bijvoorbeeld een indicatie van de regio waar iemand woont. De gebruikersnaam staat niet in het dashboard, maar de inhoud kan nog steeds persoonlijke details bevatten.

De instelling is een opt-out
Bij consumentenaccounts staat de instelling Improve the model for everyone standaard aan bij Free, Plus en Pro, schrijft 404 Media. Wie haar uitzet via Settings en Data Controls, voorkomt dat nieuwe gesprekken voor modeltraining worden gebruikt. Dat geldt niet met terugwerkende kracht voor oude gesprekken.
Temporary Chat is een aparte route. OpenAI zegt dat zulke gesprekken niet in de geschiedenis verschijnen, geen herinneringen maken en niet voor training worden gebruikt. Ze worden na 30 dagen uit de systemen verwijderd en mogen in die periode alleen voor misbruikmonitoring worden bekeken.
OpenAI beschrijft menselijke toegang zelf als beperkt tot geautoriseerde medewerkers en vertrouwde dienstverleners. Die toegang kan volgens OpenAI nodig zijn voor misbruikonderzoek, beveiligingsincidenten, ondersteuning, juridische zaken of modelverbetering. Toegang hoort technisch afgeschermd, gelogd en beperkt tot medewerkers met een concrete noodzaak te zijn.
Een privacyfilter blijft een filter
OpenAI zegt dat gesprekken vóór deze review door een versie van Privacy Filter gaan. Dat model moet persoonsgegevens herkennen en maskeren. De fabrikant schrijft zelf dat het filter ongewone identificerende gegevens of dubbelzinnige privéverwijzingen kan missen, en in beperkte context ook te veel of te weinig kan weghalen. Anonimiseren van een accountnaam betekent daarom niet dat elke gevoelige passage verdwenen is.
Dat onderscheid bepaalt de zakelijke lezing van het nieuws. Een medewerker die via een persoonlijk ChatGPT-account een klantmail, contract of personeelskwestie invoert, gebruikt een consumentenroute met een andere standaard dan een beheerde bedrijfsomgeving. De vraag is dan niet alleen of een model antwoord geeft, maar ook welke reviewketen achter de invoer zit.
Zakelijke chats volgen een andere standaard
OpenAI schrijft dat het standaard niet traint op input en output van ChatGPT Business, ChatGPT Enterprise en de API. Organisaties zijn alleen ingeschakeld voor het delen van data voor modelverbetering als ze daar expliciet voor kiezen. De gepubliceerde regels wijzen er daarmee op dat de specifieke Project Lily-route voor modelverbetering normaal buiten zakelijke chats valt, tenzij een organisatie zelf delen toestaat.
Dat betekent niet dat zakelijke gesprekken nooit door mensen kunnen worden gezien. Dezelfde OpenAI-FAQ noemt beperkte toegang voor veiligheid, ondersteuning en juridische verplichtingen. OpenAI bevestigt in de geraadpleegde bronnen ook niet expliciet dat Project Lily nooit zakelijke data ontvangt. Accounttype, instellingen en contractvoorwaarden bepalen dus samen welke standaard geldt.
Voor organisaties sluit dit aan op de vraag of persoonsgegevens überhaupt nodig zijn voordat je generatieve AI inzet. Met testdata of een geanonimiseerde invoer blijft de gevoelige brondata buiten de reviewketen omdat die niet wordt doorgestuurd. Zodra echte klant- of personeelsinformatie in een prompt belandt, hoort de datastroom bij de governance van die AI-toepassing.
Project Lily maakt vooral zichtbaar wat een chatvenster verbergt: modelverbetering is een keten van prompts, filters, menselijke beoordelingen en toegangsregels. Het verschil tussen een persoonlijke en een zakelijke ChatGPT-omgeving zit daarom niet in het label op het scherm, maar in de datastroom en de afspraken erachter.
Veelgestelde vragen
AI met duidelijke grenzen
Ik help je AI-werkplek ontwerpen en realiseren, van meedenken en datastromen tot automatiseren, met afspraken over toegang en self-hosting waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
