Computerschermen die regels programmeercode tonen
Nieuws29 juni · 20:345 min leestijd

Meta zet zijn engineers op rantsoen met Claude Code en Codex, uit angst dat rivalen-AI in zijn eigen trainingsdata lekt

Volgens The Information beperkt Meta hoe zijn AI-engineers Claude Code en Codex mogen gebruiken, om te voorkomen dat output van concurrenten in zijn eigen model MetaCode terechtkomt. De onderliggende vraag raakt elk bedrijf dat AI-codeertools inzet.

Meta legt zijn eigen AI-engineers aan banden in hoe ze de codeerassistenten van concurrenten mogen gebruiken. Volgens interne documenten die The Information inzag, mag het applied-AI-team dat aan Meta's eigen codeermodel MetaCode werkt Anthropics Claude Code en OpenAI's Codex nog maar beperkt inzetten. De reden is geen kostenkwestie maar angst voor distillatie: dat de output van een sterker model van een concurrent ongemerkt in Meta's eigen trainingsdata belandt.

Distillatie is het trainen van een minder krachtig model op de output van een sterker model. Het is een gangbare, legitieme techniek wanneer een lab het op zijn eigen modellen toepast, maar problematisch zodra je het op de modellen van een concurrent doet. En precies dat is wat Meta vreest: dat zijn engineers, door de hele dag met Claude en Codex te werken, per ongeluk de intelligentie van Anthropic en OpenAI in MetaCode verweven.

Wat Meta precies verbiedt

De maatregel is gericht en niet zomaar een algeheel verbod. Volgens de berichtgeving moeten engineers in het applied-AI-team de programmeeropgaven en de trainings- en evaluatiedatasets voor MetaCode zelf bedenken, op basis van hun eigen technische kennis, in plaats van leunend op door AI gegenereerde concepten. Externe AI-tools mogen voor sommige doeleinden nog wel, maar hun output mag niet de trainingspijplijn of de evaluatiesets in. Een interne memo waarschuwde zelfs voor serieuze escalaties met partnerbedrijven als hun modeloutput in Meta's trainingsdata zou lekken, een verwijzing naar het feit dat de gebruiksvoorwaarden van zowel OpenAI als Anthropic verbieden om hun output te gebruiken om concurrerende modellen te bouwen.

Het bredere plaatje: Meta bouwt met MetaCode een eigen codeerassistent om zijn afhankelijkheid van externe tools af te bouwen, en verwacht dit jaar miljarden aan interne AI uit te geven. Het is daarmee niet de enige die zenuwachtig is over distillatie. Anthropic beschuldigde eerder Alibaba van een grootschalige distillatie-aanval, en documenteerde campagnes via DeepSeek, Moonshot en MiniMax die ruim 16 miljoen uitwisselingen genereerden via zo'n 24.000 frauduleuze accounts. De strijd om wie welke intelligentie bezit, woedt op elk niveau.

Het hoofdkantoor van Meta Platforms in Menlo Park, Californië, met het infinity-logo bij de weg. Bron: InvadingInvader / Wikimedia Commons (CC BY-SA 4.0)
Het hoofdkantoor van Meta Platforms in Menlo Park, Californië, met het infinity-logo bij de weg. Bron: InvadingInvader / Wikimedia Commons (CC BY-SA 4.0)

Waarom dit ook zonder eigen model relevant is voor jouw bedrijf

Het is verleidelijk om dit af te doen als een ver-van-mijn-bed-show voor reuzen die foundationmodellen bouwen. Jij bouwt geen eigen Claude, dus Meta's exacte probleem is niet het jouwe. Maar onder de oppervlakte zit een vraag die elk bedrijf raakt dat AI-codeertools inzet: waar gaan de invoer en de output eigenlijk heen, en wat mag je ermee?

Drie dingen worden hier concreet. Ten eerste de contractuele kant: de voorwaarden van OpenAI en Anthropic verbieden uitdrukkelijk om hun output te gebruiken om een concurrerend model te trainen. Mocht je ooit je eigen modellen willen finetunen op door Claude of Codex gegenereerde code, dan loop je tegen diezelfde clausule aan die Meta nu zo voorzichtig maakt. Ten tweede de dataknoop: wat jij in een codeerassistent stopt, je codebase, je bedrijfslogica, soms klantgegevens, verlaat je omgeving. De vraag of dat materiaal wordt gebruikt om het model te trainen hoort schriftelijk vastgelegd in je verwerkersovereenkomst, niet in een geruststellend verkoopgesprek. Het is dezelfde reflex die je nodig hebt bij elke AI-leverancier: weten welk model eronder draait, waar je data heen gaat en of je later kunt wisselen.

Ten derde de governance van AI-gegenereerde code zelf. Anthropic onthulde dat inmiddels 65 procent van de code in zijn eigen productteam door Claude wordt geschreven, een aandeel dat ook bij gewone bedrijven hard oploopt. Als zelfs de grootste AI-uitgever ter wereld de herkomst van gegenereerde code als een serieus risico behandelt en er harde interne regels omheen zet, is dat een signaal voor het MKB: leg vast welke tools je engineers mogen gebruiken, wat er met de output mag gebeuren en hoe je de provenance bewaakt. Niet uit angst, maar omdat onduidelijkheid over wie de code bezit en wat ermee mag, je later in de weg gaat zitten, bij een audit, een overname of een juridisch geschil.

De kernles van Meta's voorzichtigheid is niet dat AI-codeertools gevaarlijk zijn. Het is dat de waarde, en het risico, in de herkomst zit. Wie zijn eigen spelregels vastlegt voordat de tools alomtegenwoordig zijn, heeft straks geen reden tot paniek.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Grip op AI-gegenereerde code

Ik help je vastleggen welke AI-tools je team gebruikt, wat er met je code en data mag gebeuren en hoe je de herkomst bewaakt. Van meedenken en ontwerp tot bouwen en automatiseren, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

DeepSeek geeft agentharnas Harness vrij onder MIT-licentie
Nieuws
5 min

13 aug 20:27

DeepSeek geeft agentharnas Harness vrij onder MIT-licentie

DeepSeek zet zijn agentharnas Harness onder de MIT-licentie op GitHub, als zelf te draaien alternatief voor Claude Code en Codex. Elk model past erachter, en de API-tarieven van DeepSeek gaan zondag omhoog.

Open-weight ontwijkt de Amerikaanse lock-in en belandt in Beijing
Inzicht
6 min

18 jul 17:00

Open-weight ontwijkt de Amerikaanse lock-in en belandt in Beijing

Bedrijven kiezen open-weight modellen om onder de Amerikaanse AI-lock-in uit te komen. Maar de sterkste open modellen komen nu uit Chinese labs. Zo ruil je één afhankelijkheid in voor een jurisdictierisico, tenzij je echt zelf host.

Meta wil naar verluidt voor 6,5 miljard dollar AI-chips bij Samsung laten maken
Nieuws
5 min

4 jul 02:11

Meta wil naar verluidt voor 6,5 miljard dollar AI-chips bij Samsung laten maken

Meta onderhandelt volgens de Koreaanse zakenkrant Seoul Economic Daily met Samsung Foundry over een order van ruim 6,5 miljard dollar voor eigen MTIA-AI-chips op 2 nanometer, deels weg van TSMC.

Amazon kopieert intern Anthropic's Claude-modellen om hogere tokenprijzen voor te zijn
Nieuws
5 min

29 jun 22:34

Amazon kopieert intern Anthropic's Claude-modellen om hogere tokenprijzen voor te zijn

Amazon-engineers maken volgens The Information goedkopere interne kopieen van Anthropic's Claude-modellen, vlak voor een overstap naar tokenprijzen. Voor bedrijven die Claude via AWS Bedrock draaien is dat een signaal over kosten en leveranciersrisico.

AT&T verlaagt kosten van AI-taken met 56 procent via open modellen
Nieuws
4 min

21 aug 04:09

AT&T verlaagt kosten van AI-taken met 56 procent via open modellen

AT&T stuurt vragen van medewerkers via een LiteLLM-router naar open modellen en verlaagde de kosten van codeer- en andere AI-taken met tot 56 procent, bij 2 procent kwaliteitsverlies. De uitgaven aan Anthropic en OpenAI blijven bevroren.

Meta bevestigt inbraak door eigen AI-model bij ander bedrijf
Nieuws
5 min

6 aug 02:22

Meta bevestigt inbraak door eigen AI-model bij ander bedrijf

Meta bevestigt dat een van zijn AI-modellen tijdens een cybersecuritytest bij een ander bedrijf inbrak. Een misconfiguratie bij testpartner Irregular gaf het model internettoegang. Het is het derde lab met dit probleem bij dezelfde tester.