AI-basis
Wat is een token bij AI?
Een token is het stukje tekst waarin een AI-model rekent: ongeveer drie kwart van een woord. Modellen knippen elke invoer en elk antwoord op in tokens, en rekenen per duizend tokens af. Een pagina tekst is ruwweg 500 tokens, een gemiddeld chatgesprek een paar duizend.
Tokens zijn de eenheid op je factuur. Elke leverancier rekent een bedrag per miljoen tokens in en een hoger bedrag per miljoen tokens uit. Dat maakt de kosten van een AI-toepassing goed voorspelbaar zodra je weet hoeveel gesprekken je hebt en hoe lang ze zijn.
Voor het Nederlands is de verhouding iets ongunstiger dan voor het Engels: onze samenstellingen worden in meer stukken geknipt. Reken voor Nederlandse tekst op grofweg een kwart meer tokens dan voor dezelfde tekst in het Engels.
Tokens bepalen ook de grens van wat er in één keer in kan. Die grens heet het contextvenster, en die wordt in tokens uitgedrukt.
Verwante begrippen
Wat is een contextvenster?
Het contextvenster is de hoeveelheid tekst die een AI-model in één keer kan meenemen: de vraag, het voorgaande gesprek, de meegestuurde documenten en het antwoord samen. Het wordt in tokens uitgedrukt. Wat er buiten valt, bestaat voor het model niet — daar zit geen waarschuwing op.
Lees verderWat is een LLM?
Een LLM of large language model is een AI-model dat getraind is op grote hoeveelheden tekst en daarmee voorspelt welk woord logischerwijs volgt. Daar komt het schrijven, samenvatten en beantwoorden van vragen uit voort. Het model begrijpt niets; het herkent patronen in taal, heel precies en op enorme schaal.
Lees verderWat is een prompt?
Een prompt is de instructie die je aan een AI-model geeft. Bij een zakelijke toepassing gaat het zelden om één zin: er zit een systeemprompt onder die vastlegt wie de AI is, wat hij wel en niet mag zeggen, in welke toon hij antwoordt en wanneer hij doorverwijst naar een mens.
Lees verder