DoorDash moet aan twee commissies van het Amerikaanse Huis van Afgevaardigden uitleggen waarom het het Chinese AI-model Kimi K2.6 gebruikt. De voorzitters stuurden de brief vrijdag aan medeoprichter en topman Tony Xu.
De aanleiding was geen datalek en geen incident, maar een openbare post van DoorDash-medeoprichter Andy Fang over een doodgewone technische keuze: het zwaarste werk bij een westers topmodel laten, het eenvoudiger werk doorschuiven naar een goedkoper Chinees model. Dat is precies de afweging die Nederlandse teams nu ook maken. Wat dit dossier zichtbaar maakt, is dat zo'n keuze niet meer binnen de muren van het engineeringteam blijft. De vraag welk model onder je product draait, komt inmiddels van buiten.

Wat de commissies willen weten
John Moolenaar, voorzitter van de Select Committee on China, en Andrew Garbarino, voorzitter van de commissie voor Homeland Security, vragen om een overzicht van elk Chinees model dat DoorDash inzet en van de veiligheidstests die het bedrijf daarop deed. Het bedrijf moet de gevraagde informatie op 14 augustus aanleveren en uiterlijk 21 augustus een mondelinge briefing geven, meldt de South China Morning Post.
De brief wuift de bedrijfslogica niet weg. Amerikaanse bedrijven zetten Chinese open-weight modellen in omdat die concurrerende capaciteiten, lagere kosten en meer maatwerk bieden, erkennen de twee voorzitters, maar die praktische overwegingen maken risicogerichte waarborgen niet overbodig en nemen de zorg over groeiende afhankelijkheid van modellen onder Chinees recht niet weg. Een woordvoerder van DoorDash zegt dat het bedrijf graag met de commissies in gesprek gaat over veilig en verantwoord AI-gebruik, zowel met Amerikaanse frontier-modellen als met open modellen.
De cijfers achter de keuze
De onderbouwing publiceerde DoorDash begin juli zelf. In een eigen benchmark, DashBench, speelde het bedrijf 105 eerdere codewijzigingen opnieuw af om te meten welke modelcombinatie in code-review de echte problemen vindt. Kimi K2.6 als verkenner met Anthropics Claude Fable 5 als reviewer kwam uit op 537 echte bevindingen, 65,2 procent gewogen dekking en 3,81 dollar per pull request. De opstelling die in productie draaide, met Claude Sonnet 4.6 en Opus 4.8, bleef steken op 504 bevindingen en 53,6 procent, tegen 3,91 dollar.
Op de veertig kritieke bevindingen was het gat het grootst. De combinatie met het Chinese model ving er 80 procent, de Amerikaanse 62,5 procent.
Daarmee valt het makkelijke tegenargument weg. Dit was geen bedrijf dat kwaliteit inruilde voor een lagere rekening. Het goedkopere model was in deze test ook het betere.
Van Airbnb naar DoorDash
Het onderzoek loopt sinds eind april, toen dezelfde twee voorzitters begonnen met brieven aan verhuurplatform Airbnb, dat Alibaba's Qwen gebruikt, en aan Cursor-maker Anysphere. Met beide bedrijven zijn sindsdien gesprekken gevoerd. DoorDash is de volgende stap. De commissies kijken naar de herkomst van de Chinese modellen, naar de data en technieken waarmee ze zijn getraind en naar de vraag of hun capaciteiten zijn opgebouwd via ongeoorloofde distillatie uit toonaangevende Amerikaanse systemen.
Die verdenking raakt Moonshot rechtstreeks. Het Amerikaanse Office of Science and Technology Policy stelde op 22 juli dat het lab mogelijk een verborgen platform gebruikte om op grote schaal Amerikaanse modellen af te tappen, waarna Beijing dreigde met tegenmaatregelen als Washington Chinese AI-bedrijven sanctioneert. De Amerikaanse lijn ligt intussen allerminst vast: bijna tweehonderd Amerikaanse startups, waaronder Y Combinator en Proton, vroegen de regering juist om de toegang tot Chinese open modellen niet af te snijden.
Een technische keuze die bestuurlijk werd
Voor Nederlandse bedrijven volgt hier geen Amerikaanse regel uit die je moet naleven, wel een patroon. Het gratis, zelf te draaien alternatief waarmee bedrijven onder de greep van één Amerikaanse leverancier uit willen komen, komt inmiddels overwegend uit Chinese labs en brengt daarmee een nieuwe jurisdictie mee. DoorDash is daarvan de eerste concrete casus: een bedrijf dat op de cijfers gelijk had en er tóch verantwoording over moet afleggen.
De vraag die daaruit volgt gaat niet over welk model het hoogst scoort. Ze gaat over of je binnen een week kunt laten zien welk model waar in je stack draait, welke data eraan gegeven is, en hoe snel je het kunt vervangen als de prijs, de wet of de politiek verandert.
Veelgestelde vragen
Weet jij welk model draait?
Ik help je van meedenken en ontwerp tot realisatie en automatisering, zo gebouwd dat het model een vervangbaar onderdeel is en niet je fundament. Self-hosted waar dat kan, zodat je kunt wisselen als de prijs of de politiek verandert.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
