Kennisbank · Begrip

Vector embedding: betekenis als getallenreeks

Een reeks getallen die de betekenis van een stuk tekst weergeeft, zodat systemen teksten op betekenis in plaats van op woorden kunnen vergelijken.

Door , Content Strategist & GEO Editor · Laatst bijgewerkt:

Belangrijkste punten

  • Een embedding zet tekst om in een reeks getallen die betekenis representeert.
  • Teksten met vergelijkbare betekenis liggen dicht bij elkaar in die ruimte.
  • Daardoor vindt zoeken passages zonder dat de exacte woorden overeenkomen.
  • Vage of dubbelzinnige tekst krijgt een vage positie en wordt minder gevonden.
  • Eén onderwerp per sectie levert een scherpere embedding op.

Wat een embedding is

Een vector embedding is een lijst getallen — vaak enkele honderden tot duizenden — die de betekenis van een stuk tekst representeert. Een model berekent die reeks op basis van alles wat het over taal geleerd heeft. Je kunt het zien als een coördinaat in een enorme betekenisruimte: 'linkbuilding uitbesteden' en 'linkbuildingbureau inschakelen' landen daar vlak bij elkaar, ook al delen ze nauwelijks woorden.

Hoe zoeken erop werkt

Bij semantisch zoeken wordt de vraag van de gebruiker ook naar een vector omgezet. Het systeem zoekt vervolgens de opgeslagen tekstblokken waarvan de vector het dichtst bij die van de vraag ligt, meestal gemeten met cosinusgelijkenis. Er wordt dus niet op trefwoorden gematcht maar op betekenis. Daarom kan een passage die het gevraagde woord nergens bevat, tóch het beste antwoord zijn.

Wat dit voor je tekst betekent

Een sectie die over drie onderwerpen tegelijk gaat, krijgt een embedding die het gemiddelde van die drie is — en dus nergens echt dicht bij ligt. Eén helder onderwerp per sectie levert een scherpe positie op. Datzelfde geldt voor vaag taalgebruik: 'wij ontzorgen u volledig' bevat betekenistechnisch bijna niets, terwijl 'wij verzorgen maandelijks vier redactionele backlinks voor Nederlandse mkb-bedrijven' een precieze plaats krijgt.

Synoniemen en jargon

Omdat embeddings betekenis vangen, hoef je niet meer elk synoniem letterlijk te herhalen. Wel loont het om de vocabulaire van je doelgroep te gebruiken: schrijft je publiek over 'vindbaar in ChatGPT' terwijl jij consequent 'generative engine optimization' schrijft, dan liggen de vectoren verder uit elkaar dan nodig. Noem beide één keer expliciet en gebruik daarna de term die je publiek hanteert.

Grenzen van de techniek

Embeddings begrijpen geen waarheid en geen actualiteit. Twee passages die hetzelfde bewéren, liggen dicht bij elkaar, ongeacht welke klopt. Daarom bepalen andere signalen — merkherkenning, datering, bronvermelding, autoriteit — welke van de gevonden passages uiteindelijk in het antwoord belandt. Semantische scherpte brengt je in de selectie; entity-signalen bepalen of je wint.

Veelgestelde vragen

Wat is een vector embedding?+

Een vector embedding is een reeks getallen die de betekenis van een stuk tekst weergeeft, zodat systemen teksten op betekenis kunnen vergelijken.

Waarom vindt AI teksten zonder het zoekwoord?+

Omdat er op betekenis wordt gematcht en niet op letterlijke woorden. Een passage met dezelfde strekking ligt dicht bij de vraag in de vectorruimte.

Hoe schrijf ik voor betere embeddings?+

Behandel één helder onderwerp per sectie, wees concreet in plaats van vaag en gebruik de woorden die je doelgroep zelf hanteert.

Zijn synoniemen nog nodig?+

Minder dan vroeger. Noem belangrijke varianten één keer expliciet en schrijf verder in de taal van je publiek.

Bepaalt de embedding of ik geciteerd word?+

Alleen of je in de selectie komt. Welke gevonden passage uiteindelijk geciteerd wordt, hangt af van autoriteit, actualiteit en merkherkenning.

Verder lezen

Gerelateerde artikelen

Alles in de kennisbank →

Alles over dit thema op één plek: hub AI-strategie

Ready?

Klaar om gespot te worden?

Plan een gratis kennismaking van 30 minuten. We kijken mee naar je huidige vindbaarheid en vertellen eerlijk wat we zouden doen — wel of geen samenwerking.

Stuur ons een bericht