Definitie
Een LLM (large language model) is een AI-model dat is getraind op een zeer grote hoeveelheid tekst en daardoor taal kan begrijpen, samenvatten, vertalen en genereren. ChatGPT, Gemini, Claude en de modellen achter Perplexity en Google AI Overviews zijn allemaal LLM's of systemen die erop gebouwd zijn. Het model voorspelt steeds het meest waarschijnlijke volgende stukje tekst, en doet dat zo goed dat er samenhangende antwoorden uit komen.
Een LLM heeft twee soorten kennis. De eerste zit in het model zelf: alles wat het tijdens de training heeft gezien, tot een bepaalde datum. Die kennis is breed maar bevroren en kan verouderd of onnauwkeurig zijn. De tweede soort komt van buiten: pagina's die het systeem live ophaalt via zoeken en aan het model geeft als context. Dat tweede mechanisme heet retrieval-augmented generation en is de reden dat een AI-assistent actuele bronnen kan citeren.
Voor SEO en GEO betekent dat onderscheid veel. Op de kennis in het model heb je alleen indirect invloed: door consistent en vaak genoemd te worden op het web, zodat toekomstige modelversies je merk kennen. Op de opgehaalde context heb je directe invloed: door pagina's te publiceren die bereikbaar zijn voor AI-crawlers en die een vraag zo direct en feitelijk beantwoorden dat het systeem ze als bron kiest.
Een LLM heeft ook beperkingen die je moet kennen. Het kan hallucineren: overtuigend klinkende maar onjuiste informatie produceren, bijvoorbeeld een verkeerde prijs of een niet-bestaand product. Het geeft per keer een ander antwoord op dezelfde vraag, omdat het met een zekere willekeur werkt. En het weegt bronnen niet zoals Google dat doet met links, maar op hoe goed een passage bij de vraag past.