Begrippenlijst · Thema
Begrippen over taalmodellen en LLM-aanbieders
Achter elk AI-antwoord zit een model van een specifieke aanbieder, met een eigen ontstaansgeschiedenis, sterke punten en publiek. Deze begrippen zetten die aanbieders en de bijbehorende modeltermen op een rij.
34 begrippen · 19 met een volledig uitgewerkte pagina · terug naar de complete begrippenlijst
- Bots van AI-aanbieders zoals GPTBot, OAI-SearchBot, ClaudeBot en PerplexityBot die pagina's ophalen voor training, een zoekindex of live antwoorden. Zonder crawl geen citatie.
- Bezoekers die via een AI-antwoord op je site komen, bijvoorbeeld uit ChatGPT, Perplexity of AI Overviews. Kleiner in volume dan organisch verkeer, maar vaak verder in de beslissing.
- Een AI-zichtbaarheidsaudit is een gestructureerde meting van hoe vaak en hoe je merk voorkomt in de antwoorden van ChatGPT, Perplexity, Gemini, Copilot en Google AI Overviews, inclusief de oorzaken van eventuele afwezigheid.
- Alibaba (Qwen)
- Qwen is de modelfamilie van Alibaba Cloud, sinds 2023 in open varianten beschikbaar. Qwen is sterk in meertaligheid (met name Aziatische talen) en in kleine modellen die op eigen hardware draaien, en wordt veel gebruikt als basis voor fine-tuning.
- Amazon (Nova & Bedrock)
- Amazon presenteerde in december 2024 de Nova-modellen en biedt via Bedrock (2023) ook modellen van derden aan. De propositie is niet het beste model, maar één beheerde omgeving waarin AWS-klanten meerdere modellen kunnen combineren en afrekenen.
- Anthropic is in 2021 opgericht door oud-OpenAI-medewerkers en lanceerde Claude in 2023. Claude staat bekend om lange documenten, zorgvuldig schrijven en coderen, en is vooral populair bij ontwikkelaars en bij organisaties die veiligheid en compliance zwaar wegen.
- Een link-element dat aangeeft welke URL de voorkeursversie is bij (bijna) identieke content. Voorkomt kannibalisatie tussen filter-, paginatie- en parametervarianten.
- De zoekfunctie binnen ChatGPT die live webresultaten ophaalt en samenvat met bronvermelding. Voor merken is het een eigen kanaal met eigen citatielogica, los van Google.
- Cohere
- Cohere (Canada, 2019) richt zich uitsluitend op zakelijk gebruik: zoeken, herordenen en RAG binnen bedrijfsdata. Doelgroep zijn enterprises in gereguleerde sectoren die modellen in hun eigen cloud of on-premise willen draaien.
- Het contextvenster is de hoeveelheid tekst die een taalmodel tegelijk kan meenemen bij het opstellen van een antwoord, gemeten in tokens. Past jouw passage er niet in, dan telt hij niet mee — hoe relevant hij ook is.
- Het aantal URL's dat een zoekmachine binnen een periode op je site crawlt. Relevant vanaf tienduizenden URL's; verspilling komt meestal van parameters, facetten en dunne pagina's.
- DeepSeek
- DeepSeek is een Chinees AI-lab (2023) dat begin 2025 opzien baarde met redeneermodellen die tegen een fractie van de gebruikelijke kosten waren getraind. Sterk punt is prijs-prestatie bij wiskunde en code; gebruik in Europa stuit vaak op vragen over datalocatie.
- Een design system is een vastgelegde set tokens, componenten en regels voor kleur, typografie en spacing. Het is de belangrijkste sturingshefboom bij AI-development: goede tokens leveren consistente UI op, ongeacht wie of wat de code schrijft.
- Distillatie
- Bij distillatie leert een klein model de output van een groter model imiteren. Zo krijg je een goedkoop, snel model dat op een afgebakende taak dicht bij het grote model presteert — de basis onder de meeste mini- en nano-varianten.
- Fine-tuning
- Fine-tuning is het bijtrainen van een bestaand model op eigen voorbeelden, zodat het toon, format of een specifieke taak beter beheerst. Voor feitenkennis is RAG bijna altijd goedkoper en actueler dan fine-tuning.
- Foundation model
- Een foundation model is een groot, breed getraind basismodel dat als fundament dient voor veel toepassingen. In plaats van per taak een eigen model te trainen, stuur je één basismodel met prompts, tools of een lichte fine-tune.
- Het optimaliseren van je zichtbaarheid in generatieve zoekmachines zoals ChatGPT, Perplexity, Claude en Google AI Overviews. Doel is niet een positie, maar een citatie.
- Google DeepMind ontstond in 2023 uit de fusie van DeepMind (2010) en Google Brain en levert de Gemini-modellen. Gemini is van huis uit multimodaal (tekst, beeld, audio, video), heeft een zeer groot contextvenster en bereikt via Search, Workspace en Android het grootste publiek van alle aanbieders.
- Knowledge cutoff
- De knowledge cutoff is de datum waarna een model geen trainingsdata meer heeft gezien. Alles wat daarna gebeurde kent het alleen als het live mag zoeken — de reden dat AI-antwoorden over recente onderwerpen op bronnen met verse, goed vindbare content leunen.
- Een LLM is een neuraal netwerk dat op enorme hoeveelheden tekst is getraind om het volgende tekstdeel te voorspellen. Daaruit ontstaan taalbegrip, samenvatten, vertalen, coderen en redeneren — zonder dat het model feiten opzoekt tenzij het daar expliciet gereedschap voor krijgt.
- LLM-benchmark
- Een benchmark is een gestandaardiseerde testset (zoals MMLU, GPQA of SWE-bench) waarmee modellen worden vergeleken. Scores zijn indicatief: benchmarks lekken in trainingsdata en meten zelden jouw taak — test daarom altijd op je eigen voorbeelden.
- Meta bracht in februari 2023 het eerste Llama-model uit en maakte open gewichten mainstream. Llama is de standaardkeuze voor partijen die een model zelf willen hosten — van startups tot overheden — omdat data dan binnen de eigen omgeving blijft.
- Mistral AI is in april 2023 opgericht in Parijs en is de Europese speler in het veld. De modellen zijn compact, snel en deels open, wat ze aantrekkelijk maakt voor Europese organisaties met AVG-eisen en voor toepassingen waar kosten en latency zwaarder wegen dan topprestaties.
- Mixture of experts (MoE)
- In een mixture-of-experts-model activeert elke vraag maar een deel van de parameters. Daardoor combineert het model de kennis van een groot netwerk met de kosten van een veel kleiner netwerk — de architectuur achter Mixtral, DeepSeek en de meeste recente frontier-modellen.
- Open weights (open model)
- Bij open weights zijn de modelgewichten te downloaden, zodat je het model zelf kunt hosten en aanpassen. Dat is niet hetzelfde als open source: trainingsdata en licentie kunnen beperkt blijven. Llama, Mistral, Qwen en gpt-oss zijn de bekendste voorbeelden.
- OpenAI is in 2015 opgericht in San Francisco en bracht met ChatGPT (november 2022) taalmodellen naar het grote publiek. De GPT-modellen zijn sterk in redeneren, code en agentische taken en worden gebruikt door consumenten, ontwikkelaars en zo goed als elke grote enterprise — deels via Microsoft Azure.
- Parameters
- Parameters zijn de instelbare gewichten van een model, meestal geteld in miljarden (B). Meer parameters betekent doorgaans meer kennis en nuance, maar ook hogere kosten en latency; goed getrainde kleine modellen verslaan vaak grote oudere modellen.
- Het gestructureerd formuleren van instructies aan een taalmodel — rol, context, opdracht en formaat — om voorspelbaar bruikbare output te krijgen.
- Techniek waarbij een taalmodel eerst relevante bronnen ophaalt en die als context gebruikt bij het genereren van een antwoord. Hierdoor kun je geciteerd worden zonder in trainingsdata te zitten.
- Reasoning model
- Een reasoning model besteedt vóór het antwoord extra rekentijd aan interne tussenstappen. Dat helpt bij wiskunde, code, analyse en meerstapsplannen, maar kost meer tijd en geld — voor eenvoudige tekstklussen is een snel model beter.
- Token
- Een token is het stukje tekst waarin een model rekent — gemiddeld ongeveer driekwart woord in het Nederlands. Prijzen, snelheid en contextlimieten worden allemaal in tokens uitgedrukt, voor zowel invoer als uitvoer.
- De teksten waarop een taalmodel is getraind. Wat daarin vaak en consistent over je merk staat, kleurt wat het model zegt als er geen live bronnen worden opgehaald.
- URL-parameters zijn de sleutel-waardeparen achter het vraagteken in een URL, zoals ?kleur=blauw of ?utm_source=nieuwsbrief. Ongecontroleerd leveren ze eindeloos veel bijna identieke URL's op en daarmee duplicate content en index bloat.
- xAI (Grok)
- xAI werd in 2023 opgericht door Elon Musk en levert Grok, dat rechtstreeks toegang heeft tot berichten op X. De doelgroep is vooral consumenten en marketeers die realtime meningen en trends willen meenemen; op zakelijke governance loopt het achter op OpenAI, Google en Anthropic.
GEO & AI-zoeken · uitgewerkt
GEO & AI-zoeken · uitgewerkt
GEO & AI-zoeken · uitgewerkt
Taalmodellen & aanbieders
Taalmodellen & aanbieders
Taalmodellen & aanbieders · uitgewerkt
Techniek · uitgewerkt
GEO & AI-zoeken · uitgewerkt
Taalmodellen & aanbieders
GEO & AI-zoeken · uitgewerkt
Techniek · uitgewerkt
Taalmodellen & aanbieders
AI-development & vibecoding · uitgewerkt
Taalmodellen & aanbieders
Taalmodellen & aanbieders
Taalmodellen & aanbieders
GEO & AI-zoeken · uitgewerkt
Taalmodellen & aanbieders · uitgewerkt
Taalmodellen & aanbieders
Taalmodellen & aanbieders · uitgewerkt
Taalmodellen & aanbieders
Taalmodellen & aanbieders · uitgewerkt
Taalmodellen & aanbieders · uitgewerkt
Taalmodellen & aanbieders
Taalmodellen & aanbieders
Taalmodellen & aanbieders · uitgewerkt
Taalmodellen & aanbieders
GEO & AI-zoeken · uitgewerkt
GEO & AI-zoeken · uitgewerkt
Taalmodellen & aanbieders
Taalmodellen & aanbieders
GEO & AI-zoeken · uitgewerkt
Techniek · uitgewerkt
Taalmodellen & aanbieders