Kennisbank · Begrip

Retrieval: eerst opgehaald, dan geciteerd

De ophaalstap waarin een AI-systeem passages zoekt die bij de vraag passen, vóórdat het antwoord wordt geschreven. Wie hier niet wordt opgehaald, kan niet worden geciteerd.

Door , Content Strategist & GEO Editor · Laatst bijgewerkt:

Belangrijkste punten

  • Zonder retrieval geen citatie: de ophaalstap komt vóór het antwoord.
  • Er worden passages opgehaald, geen hele pagina's.
  • Semantische match op de deelvraag is belangrijker dan zoekwoorddichtheid.
  • Kerninhoud in de server-HTML is een voorwaarde.

Wat retrieval doet

Bij een vraag maakt het systeem eerst een of meer zoekopdrachten, haalt kandidaat-passages op uit een index of via een zoekmachine, en bepaalt welke daarvan de vraag beantwoorden. Pas daarna schrijft het model het antwoord op basis van die passages. Wie niet in die kandidatenset zit, kan niet in het antwoord verschijnen.

Passages, niet pagina's

De eenheid is een blok tekst van enkele honderden woorden. Een lange pagina die zeven onderwerpen half behandelt levert zwakke blokken op; een pagina met duidelijke koppen en zelfstandige antwoorden levert sterke blokken. Daarom werkt de structuur kop-vraag, antwoord-eerste-zin zo goed.

Wat de kans op ophalen verhoogt

Woorden die je doelgroep echt gebruikt, expliciete entiteiten, één deelvraag per sectie, geen verwijswoorden, cijfers met datum, en een schone HTML-structuur met headings. Daarnaast: snelle levering en kerninhoud die zonder JavaScript zichtbaar is, zodat crawlers zonder rendering je tekst zien.

Wat het verhindert

Inhoud achter interactie, inlog of client-side rendering. Blokkades voor AI-crawlers in robots.txt of in je firewall. Passages die alleen begrijpelijk zijn met de rest van de pagina erbij. En pagina's zonder actualiteitssignaal, die bij twijfel worden overgeslagen.

Meten

Volg per vaste vraag welke bronnen worden geciteerd en of jouw domein daartussen zit. Zie je concurrenten wel en jezelf niet terwijl je content bestaat, dan heb je een ophaalprobleem — niet een contentprobleem. Kijk dan eerst naar toegankelijkheid en passage-structuur.

Veelgestelde vragen

Is retrieval hetzelfde als ranken in Google?+

Verwant maar niet gelijk. Retrieval selecteert passages op semantische match; klassiek ranken sorteert hele pagina's.

Hoe lang moet een passage zijn?+

Vijftig tot honderd woorden voor het kernantwoord, binnen een sectie van een paar honderd woorden.

Helpt schema bij retrieval?+

Het maakt structuur en vraag-antwoordparen expliciet, wat afbakening helpt. De tekst zelf blijft het belangrijkst.

Moet ik llms.txt hebben?+

Het kan helpen bij oriëntatie, maar het vervangt goede, ophaalbare content nooit.

Verder lezen

Gerelateerde artikelen

Alles in de kennisbank →

Alles over dit thema op één plek: hub AI-strategie

Ready?

Klaar om gespot te worden?

Plan een gratis kennismaking van 30 minuten. We kijken mee naar je huidige vindbaarheid en vertellen eerlijk wat we zouden doen — wel of geen samenwerking.

Stuur ons een bericht