AI-basis
Wat is een contextvenster?
Het contextvenster is de hoeveelheid tekst die een AI-model in één keer kan meenemen: de vraag, het voorgaande gesprek, de meegestuurde documenten en het antwoord samen. Het wordt in tokens uitgedrukt. Wat er buiten valt, bestaat voor het model niet — daar zit geen waarschuwing op.
Ook wel: Context window · Contextlengte
Moderne modellen halen honderdduizenden tokens, genoeg voor een flink dossier. Toch is groter niet automatisch beter: hoe meer je erin stopt, hoe duurder elke vraag wordt en hoe groter de kans dat het model het ene detail dat ertoe doet over het hoofd ziet.
In de praktijk is het daarom bijna altijd slimmer om alleen de relevante stukken mee te sturen in plaats van het hele archief. Dat is precies wat RAG doet.
Bij een lang telefoongesprek of een WhatsApp-draad die weken loopt, loop je vanzelf tegen de grens aan. Dan heb je een geheugenlaag nodig die samenvat wat er eerder is gezegd, in plaats van alles opnieuw mee te sturen.
Verwante begrippen
Wat is een token bij AI?
Een token is het stukje tekst waarin een AI-model rekent: ongeveer drie kwart van een woord. Modellen knippen elke invoer en elk antwoord op in tokens, en rekenen per duizend tokens af. Een pagina tekst is ruwweg 500 tokens, een gemiddeld chatgesprek een paar duizend.
Lees verderWat is RAG?
RAG staat voor retrieval-augmented generation. Het is de techniek waarbij een AI eerst de relevante stukken uit jouw eigen documenten opzoekt en pas daarna antwoord geeft, op basis van wat hij heeft gevonden. Zo beantwoordt een model vragen over jouw prijzen en processen zonder dat het daarop getraind is.
Lees verderWat is een LLM?
Een LLM of large language model is een AI-model dat getraind is op grote hoeveelheden tekst en daarmee voorspelt welk woord logischerwijs volgt. Daar komt het schrijven, samenvatten en beantwoorden van vragen uit voort. Het model begrijpt niets; het herkent patronen in taal, heel precies en op enorme schaal.
Lees verder