Pinterest draait zijn AI-assistent deels op Qwen, het open model van het Chinese Alibaba, meldt Semafor, terwijl topman Bill Ready op de kwartaalcijfers uitgebreid over open source sprak en de herkomst onbenoemd liet.
Daarmee is Pinterest de best gedocumenteerde casus van een gat waar elke inkoper mee te maken krijgt. Een leverancier die zegt open modellen te gebruiken, vertelt je iets over zijn kostenstructuur en niets over de jurisdictie waaronder die modellen zijn gemaakt. Draait die leverancier de gewichten in zijn eigen cloud, dan verschijnt er ook geen extra naam op de lijst met subverwerkers in je verwerkersovereenkomst. Er is technisch immers niemand bijgekomen.
Wat Ready wel zei, en wat niet
Op de cijferpresentatie van 4 augustus beschreef Ready de opzet: eigen compacte modellen voor specifieke Pinterest-taken, daarnaast geschikte open modellen die het bedrijf natraint op eigen data binnen zijn eigen cloudomgeving, en in een beperkt aantal gevallen een gesloten model van derden. Voor die open modellen ligt de kostprijs per transactie onder de 8 procent van wat een vergelijkbaar gesloten model kost, zei hij. Zijn conclusie voor de analisten: elke topman die open modellen links laat liggen, verspilt vrijwel zeker veel geld van zijn aandeelhouders.
In dat hele betoog viel geen enkele modelnaam. Ready noemde wel dat open modellen "ook van Amerikaanse labs" steeds beter worden, en dat je ze in je eigen cloudomgeving kunt draaien zonder bang te zijn dat er iets naar huis belt. De woorden China en Qwen kwamen op de call niet voor. DeepSeek viel één keer, als tijdsaanduiding voor het moment waarop de discussie anderhalf jaar geleden begon.
Financieel directeur Julia Donnelly voegde er de architectuur aan toe: een gecentraliseerde routeerlaag stuurt het productieverkeer per taak naar het model met de beste balans tussen kwaliteit, kosten, snelheid en betrouwbaarheid. Complex werk gaat naar een duurder model, routinewerk naar een lichter en goedkoper exemplaar. Dat is precies de opzet die de vraag "welk model gebruikt u" onbeantwoordbaar maakt in enkelvoud. Pinterest Assistant, de gesprekslaag waar het om draait, staat sinds eind juli open voor het overgrote deel van de Amerikaanse gebruikers.
Wat Semafor eraan toevoegt
Qwen, natraind op Pinterest-data, zit onder de winkelassistent en de klantenchatbots van het platform, schrijft Semafor in een exclusief stuk van techverslaggever J.D. Capelouto. Hij voerde tientallen gesprekken met chatbots van merken. Vrijwel geen enkele wilde zeggen op welk model hij draait, hoe hij het ook probeerde. De reisassistent van Kayak antwoordde dat hij in elkaar was gezet door de fijne mensen bij Kayak, met een beetje hulp van wat AI-tovenaars. Een woordvoerder bevestigde later dat er OpenAI-technologie onder zit.

Pinterest is niet de enige. DoorDash roemde onlangs de besparingen van Chinese modellen en kreeg eind juli een brief van twee commissies uit het Amerikaanse Huis. Dat bedrijf was er zelf wel open over: in zijn eigen DashBench-test kwam de opstelling met het Chinese Kimi K2.6 uit op 65,2 procent gewogen dekking tegen 3,81 dollar per pull request, boven de Amerikaanse combinatie die in productie draaide. Eerder gingen vergelijkbare brieven naar Airbnb en Cursor-maker Anysphere.
Volledige openheid is technisch lastig, zegt Amit Jain, topman van het Amerikaanse modellenlab Luma AI, tegen Semafor. Bij een klantenchatbot kan een goedkoop model eerst bepalen hoe er geantwoord moet worden en of de vraag door het beleid komt, waarna een sterker model het echte antwoord schrijft. Zo'n gelaagde opzet laat zich niet in één modelnaam vangen.
Dat de opzet ondoorzichtig is, blijkt ook uit Pinterests eigen publicaties. De aankondiging van vier nieuwe AI-tools in juni noemt geen enkel model en geen enkele leverancier, en de hulppagina over de generatieve chatbot in de klantenservice zwijgt over de aanbieder maar vermeldt wel dat menselijke beoordelaars je gesprekken kunnen lezen en verwerken.
Wat je in je eigen inkoop wel kunt vastleggen
Modelherkomst is de vraag welk lab de gewichten trainde, onder welk recht dat lab valt, en waar die gewichten nu draaien. Die drie zijn losse feiten, en geen ervan komt automatisch boven water uit een AVG-vraag over subverwerkers, want zelfgehoste open gewichten voegen geen verwerker toe. Vier dingen die je wel kunt neerleggen bij een leverancier of in je eigen DPIA:
- Modelinventaris per functie. Vraag om modelfamilie, versie, herkomstlab en hostingregio per AI-functie, niet één regel voor het hele product. Bij een routeerlaag draaien er meerdere naast elkaar.
- Meldplicht bij wisseling. Een routeerlaag verandert stilletjes van samenstelling. Leg vast dat een wijziging van modelfamilie of hostingregio binnen een afgesproken termijn wordt gemeld.
- Herkomst zelf natrekken. Het opgegeven basismodel op Hugging Face is een tekstveld dat niemand controleert. Cisco zette bijna 900 open modellen in een gratis database die de afstamming meet aan de gewichten zelf, zonder account of ander product.
- Licentierisico meewegen. Gratis gewichten blijven niet vanzelf gratis. Alibaba wil grote gebruikers van de volgende open-source Qwen een deel van hun omzet laten afdragen, meldde Reuters deze week op basis van twee ingewijden.
Het doel is niet dat je een Chinees model afwijst. Het doel is dat je binnen een week kunt laten zien welk model waar draait, welke data eraan is gegeven, en hoe snel je het kunt vervangen als de prijs, de licentie of de wet verandert.
Een kostenargument, geen herkomstverklaring
Wat hier zichtbaar wordt, is dat "open source" in een leveranciersverhaal is verschoven naar een marge-argument. Ready gebruikt de term om aandeelhouders gerust te stellen over de kosten van AI, en op dat punt is hij volledig transparant: minder dan 8 procent, met de cijfers erbij. Voor wie de dienst afneemt zegt diezelfde term niets over het lab dat de gewichten trainde of over wat er gebeurt als die licentie volgende maand verandert.
Dat verschil ontstond niet doordat iemand iets verzweeg. Het ontstond doordat het inkoopgesprek nog geen veld heeft waar dit antwoord in past.
Veelgestelde vragen
Weten wat er draait
Bij elke AI-functie die ik ontwerp of koppel leg ik vast welk model waar draait en waarom, zodat je het later kunt aantonen of vervangen. Ik doe het hele traject, van meedenken en ontwerp tot bouwen, koppelen en automatiseren, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
