Met een paar begrippen snap je waarom AI soms verrassend goed en soms verrassend slecht presteert. Dat maakt je direct een betere gebruiker.
Tokens: hoe een model tekst ziet
Een model leest geen woorden maar tokens: stukjes tekst van gemiddeld een paar letters. 'Automatisering' is voor een model meerdere tokens. Prijzen, limieten en snelheid van AI-diensten worden vaak in tokens uitgedrukt.
Het contextvenster: het werkgeheugen
Alles wat het model op één moment kan 'zien', jouw vraag, het gesprek tot nu toe en de documenten die je uploadt, moet in het contextvenster passen. Moderne modellen hebben grote contextvensters, maar ook daar geldt: hoe meer ruis erin zit, hoe slechter het model de belangrijke details vindt.
Waarom een model hallucineert
Een model genereert steeds het meest passende volgende stukje tekst. Als het iets niet weet, is een plausibel klinkend antwoord vaak 'passender' dan 'ik weet het niet'. Daarom verzint het soms bronnen, citaten of details.
- Geef zelf de bron mee (document, tekst, data) en vraag het model alleen die te gebruiken.
- Vraag om citaten of paginanummers bij elke bewering.
- Geef expliciet toestemming om 'dat weet ik niet' of 'staat niet in de bron' te zeggen.
- Laat berekeningen met code uitvoeren in plaats van uit het hoofd.
Kennis heeft een einddatum
Een model is getraind op data tot een bepaald moment. Wat daarna gebeurde, weet het niet, tenzij de tool kan zoeken op het web. Voor actuele informatie zoals regelgeving, prijzen en nieuws: laat zoeken of geef zelf de actuele bron.
Onthoud
- Het contextvenster is het werkgeheugen: geef relevante informatie, geen ruis.
- Hallucinaties beperk je door bronnen mee te geven en om citaten te vragen.
- Voor actuele informatie heb je een tool nodig die zoekt, of je eigen bron.
Volgende stap: Wat is generatieve AI, en wat niet?