Een nachtelijke hemel vol sterren als losse lichtpunten, sommige dicht bij elkaar geclusterd.
Uitgelegd10 juli · 11:097 min leestijd

Wat zijn embeddings? Zo wordt betekenis een plek

Zoeken is geen trefwoorden matchen. Een embedding maakt van tekst een punt in een betekenisruimte, waar 'goedkope laptop' en 'betaalbare notebook' naast elkaar liggen zonder een woord te delen. Typ, kies, en zie hoe afstand betekenis wordt.

Wat je leert

Je kunt uitleggen wat een embedding is: hoe een stuk tekst een punt in een betekenisruimte wordt, waarom afstand daar betekenis is, hoe je dat meet met cosine similarity, en waar het model tekortschiet.

Basis ~7 minRetrieval & RAG

Handig vooraf: Wat is een token

Volg de interactieve lesDoe het zelf, stap voor stap, met een kennischeck om te zien of het zit.

Je denkt waarschijnlijk dat een computer zoekt door dezelfde woorden terug te vinden: typ "laptop", krijg pagina's met het woord "laptop". Of net het omgekeerde, dat de AI je zin gewoon begrijpt zoals een mens dat doet. Geen van beide klopt. Wat er echt gebeurt is vreemder en veel bruikbaarder: je tekst wordt een punt op een landkaart, en de afstand tot andere punten is de betekenis.

Kijk eerst wat dat oplevert voor je het een naam geeft. Je zoekt "goedkope laptop voor studenten". Hieronder staan drie documenten. Kies welke het best past, niet op woorden maar op bedoeling.

Zoek op bedoeling: welk document hoort bij deze zoekopdracht?

Je zoekt 'goedkope laptop voor studenten'. Welk document past het best op bedoeling?

Merk je wat er net gebeurde? Het winnende document, "betaalbare notebooks voor school", deelt geen enkel woord met je zoekopdracht. En het document dat het woord "laptop" letterlijk bevat, viel af. Trefwoord-overlap is geen betekenis-overlap.

Dat punt op de kaart heet een embedding. Een embedding is een lijst getallen, een vector, die een stuk tekst omzet in een punt in een ruimte met honderden tot duizenden dimensies. Een embedding-model is zo getraind dat teksten met vergelijkbare betekenis dicht bij elkaar belanden. Afstand in die ruimte staat voor verschil in betekenis, dus een machine zoekt op bedoeling in plaats van op trefwoord.

Het model leest je tekst niet als losse woorden, maar eerst als tokens, de stukjes uit een vaste lijst. Die tokens gaan erin; er komt één vector uit voor het hele stuk tekst. Hoe die vector ontstaat en waar hij tekortschiet, zit in deze drie lagen.

Kies je diepte

Elk stukje tekst krijgt een plek op een gigantische landkaart van betekenis. Wat hetzelfde bedoelt, woont in dezelfde buurt: 'appel', 'peer' en 'banaan' liggen bij elkaar, ver van 'banklening'. Zoeken wordt dan simpel: welke buren liggen het dichtst bij je vraag?

Hoe kan een zin zonder gedeelde woorden toch de beste match zijn?

Hoe dichter twee vectoren bij elkaar liggen, hoe verwanter hun betekenis. De gangbare maat is cosine similarity: de hoek tussen de twee vectoren. Kleine hoek, verwant; grote hoek, onverwant. OpenAI normaliseert zijn embeddings op lengte 1, waardoor die hoek een simpel inwendig product wordt. Zo ligt "appel" naast "peer" en "banaan", en ver van "banklening". En "bank" belandt in een andere buurt afhankelijk van de zin: geld of meubel.

Daarom is dit zo krachtig. Je vindt relevante tekst zonder gedeelde trefwoorden. Synoniemen, parafrases, zelfs een Nederlandse vraag op een Engels document matchen op betekenis. Dit is de motor onder semantisch zoeken, aanbevelingen en clustering, en de kern van RAG: je embed de vraag en haalt de dichtstbijzijnde stukken tekst op, precies wat er gebeurt als je een AI-chatbot op je eigen documenten bouwt.

Richtingen in de ruimte dragen zelfs betekenis. In de klassieke word-embeddings van word2vec en GloVe gold een verrassende rekensom: koning min man plus vrouw ligt het dichtst bij koningin. Richtingen coderen relaties: geslacht, meervoud, tijd. Mooi als intuïtie, maar overschat het niet. Het klopt het schoonst in die vroege modellen; moderne zins-embeddings doen die som lang niet zo netjes.

Waarom meer dimensies niet altijd winnen

Meer assen betekent meer nuance, maar ook meer opslag en rekenwerk, en de winst vlakt af. OpenAI's text-embedding-3-small geeft 1536 getallen, de large 3072. Toch verslaat diezelfde large ingekort tot 256 getallen nog steeds het oudere ada-002 op volle 1536. Het aantal dimensies zegt op zich niets over de kwaliteit.

Dan de belangrijkste grens. Een embedding is een lossy samenvatting van betekenis, gedestilleerd uit trainingsdata. Hij vangt statistische, correlationele betekenis, geen echt begrip, en erft de vooroordelen die in de data zaten: word-embeddings op Google News koppelden 'programmeur' aan man en 'huisvrouw' aan vrouw. Nabijheid is geen waarheid, en niet per se relevantie voor jouw specifieke taak.

Haal het even terug voor je verder gaat.

Snap je embeddings? Drie checks.

Twee zinnen delen geen enkel woord. Kunnen hun embeddings toch dicht bij elkaar liggen?

Betekenis werd plaats, en plaats is te meten. Dat is de hele truc: niet dat de machine je woorden begrijpt, maar dat ze veranderen in een coördinaat waar afstand iets zegt. Zodra je zoeken zo bekijkt, snap je meteen waarom een goed systeem soms feilloos het juiste stuk vindt zonder een gedeeld woord, en soms zelfverzekerd naast zit.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Je eigen kennis doorzoekbaar op bedoeling

Betekenis als plek maakt je eigen documenten doorzoekbaar op bedoeling in plaats van op trefwoord. Ik denk met je mee, ontwerp de aanpak en bouw de semantische zoek- of RAG-laag op je eigen data, van eerste idee tot iets dat live staat.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Jouw leerpad

Elke les staat op zichzelf, maar samen vormen ze een pad. Dit is waar deze les in dat pad zit.

Eerst dit

Hierna

  • Je leert het model niets nieuws. Je geeft het op het juiste moment de juiste pagina’s, zodat het antwoordt vanuit jouw kennis in plaats van te gokken.

    Start de les
  • Wat is GraphRAGsterk verwant

    Gewone RAG vindt losse pagina’s die op je vraag lijken. Een kennisgraaf kent ook de verbanden, zodat het model redeneert over hoe dingen samenhangen, niet alleen wat erop lijkt.

    Start de les

Gerelateerde artikelen

Van werkbon naar factuur: de servicedienst van je installatiebedrijf automatiseren
Gids
Uitgebreide gids13 min

25 aug 17:00

Van werkbon naar factuur: de servicedienst van je installatiebedrijf automatiseren

De keten na de opdracht: hoe een ingesproken werkbon vanzelf uren, materiaal en factuurregels oplevert, en hoe je onderhoudscontracten zichzelf laat inplannen per installatie, monteur en postcode. Met de drie routes en de echte valkuilen.

Microsoft-medewerkers melden mediaan 300 dollar AI-verbruik per maand
Nieuws
4 min

25 aug 14:24

Microsoft-medewerkers melden mediaan 300 dollar AI-verbruik per maand

Een interne loonspreadsheet bij Microsoft toont voor het eerst gerealiseerde AI-uitgaven per medewerker: mediaan zo'n 300 dollar over 28 dagen, met een uitschieter van 28.000 dollar en grote verschillen per team.

Advieskantoren werven forward deployed engineers nu AI naar productie moet
Nieuws
6 min

25 aug 10:27

Advieskantoren werven forward deployed engineers nu AI naar productie moet

Deloitte, Accenture, Capgemini en McKinsey zoeken forward deployed engineers die AI in de dagelijkse bedrijfsvoering inpassen. Het profiel is schaars, en dat verandert de rekensom voor wie een AI-traject uitbesteedt.

Chinese staatshackers verdubbelen hun aanvalsvolume met DeepSeek
Nieuws
5 min

25 aug 08:12

Chinese staatshackers verdubbelen hun aanvalsvolume met DeepSeek

Aan de Chinese overheid gelieerde hackgroepen verdubbelden hun aanvalsvolume sinds ze verkenning, exploitcode en malware uitbesteden aan DeepSeek, meet TeamT5. Niet het slimste model wint, maar het goedkoopste zonder werkende remmen.

Scalable Capital laat klanten handelen via ChatGPT en Claude
Nieuws
4 min

25 aug 06:10

Scalable Capital laat klanten handelen via ChatGPT en Claude

De Duitse broker Scalable Capital, ook actief in Nederland, laat klanten voortaan via ChatGPT en Claude hun portefeuille analyseren en orders plaatsen. Elke transactie moet de klant nog steeds zelf bevestigen.

Alabama dagvaardt OpenAI en eist alle stukken over de Hugging Face-inbraak
Nieuws
5 min

25 aug 00:08

Alabama dagvaardt OpenAI en eist alle stukken over de Hugging Face-inbraak

Alabama eist met een dagvaarding zestien categorieën documenten van OpenAI over de Hugging Face-inbraak, met deadline 14 september. Wat een toezichthouder kan opvragen bij je AI-leverancier, en wat jij alleen vooraf vastlegt.