Waarom AI nu een heel boek in één keer leest
Door Chatday Editorial Team ·
Hier is een cijfer dat verzonnen lijkt: de AI die je vandaag gebruikt, kan in één keer bijna een miljoen woorden lezen. Dat is ongeveer een klein boekenplankje, in één teug opgenomen, voordat hij ook maar één vraag beantwoordt.
In de techwereld noemen ze dit het “contextvenster”, en de cijfers zijn de laatste tijd nogal absurd geworden. Dus wat levert een miljoen van wat dan ook je eigenlijk op, en waarom zou een gewoon mens zich daar druk om maken? Laten we het vertalen.
Wat een contextvenster eigenlijk is
Stel je voor dat je praat met iemand die alleen de laatste paar minuten van het gesprek onthoudt. Je vertelt een lang verhaal en aan het eind is hij vergeten hoe het begon. Dat is een AI met een klein contextvenster.
Het contextvenster is alles wat de AI tegelijk kan “zien” voor één taak: je vraag, het document dat je plakte, het eerdere heen en weer van de chat en het antwoord dat hij aan het schrijven is. Als het allemaal past, kan de AI over het geheel de puntjes verbinden. Past het niet, dan valt het oudste er aan de achterkant uit en antwoordt de AI alsof hij het nooit gezien heeft.
Een groter venster is dus simpelweg een groter bureau. Meer ruimte om alles uit te spreiden wat hij nodig heeft voordat hij aan de slag gaat. (Dit is iets anders dan een AI die zich tussen losse chats door jou herinnert, dat is een aparte functie. Het contextvenster gaat over één taak tegelijk.)
Tokens, geen woorden: de eenheid die AI echt telt
Dit is het enige stukje jargon dat de moeite waard is om te kennen, want elke kop gebruikt het.
AI’s tellen geen woorden. Ze tellen tokens. Een token is een klein stukje tekst, soms een heel kort woord, soms een deel van een langer woord. Als vuistregel in het Engels is een token zo’n vier tekens, of ruwweg driekwart van een woord. Dus 1.000 tokens zijn zo’n 750 woorden, en een miljoen tokens zo’n 750.000.
Waarom woorden überhaupt opknippen? Zo kan het model elke taal, elke typefout en verzonnen woorden aan zonder vast te lopen. Je hoeft de tokens niet zelf bij te houden. Weet gewoon dat als een bedrijf opschept over een “contextvenster van een miljoen tokens”, het eigenlijk zegt “het kan zo’n 750.000 woorden in één keer lezen”.
Een miljoen tokens is groter dan het klinkt
Zulke grote getallen zeggen op een gegeven moment niets meer, dus zetten we ze naast echte dingen die je een AI zou kunnen voeren.
| Wat je de AI wilt laten lezen | Ongeveer zoveel tokens | Past het in een venster van 1 mln? |
|---|---|---|
| Een lange e-maildraad | een paar duizend | Makkelijk |
| Een rapport van 50 pagina’s | zo’n 30.000 | Makkelijk |
| Een roman van 300 pagina’s | zo’n 150.000 | Probleemloos |
| Een dik juridisch contract met alle bijlagen | zo’n 200.000 | Ja |
| Meerdere boeken of een hele map onderzoek | 750.000 en meer | Tegen de grens aan |
Even ter vergelijking: een model als GPT-5.5 neemt bijna een miljoen tokens op. Een paar jaar geleden waren een paar duizend de norm. We zijn in heel korte tijd van “onthoudt deze alinea” naar “onthoudt deze kleine bibliotheek” gegaan.
Wat een groot geheugen je echt laat doen
Hier wordt het nuttig. Een groot contextvenster verandert de AI van een slimme automatische aanvulling in iets dat over een stapel van jouw eigen materiaal kan redeneren.
- Stel een lang document vragen in plaats van het te lezen. Gooi er een rapport van 90 pagina’s in en vraag “welke drie risico’s noemen ze, en waar?”. Hier is een stappenplan om te chatten met een PDF als je het nog nooit hebt geprobeerd.
- Vat samen zonder de draad te verliezen. Een klein venster dwingt de AI om in stukjes samen te vatten en die aan elkaar te naaien, en daar gaan details verloren. Een groot venster leest eerst het geheel, dus de samenvatting weerspiegelt ook echt het einde.
- Vergelijk meerdere bestanden tegelijk. Plak drie versies van een contract en vraag wat er tussen verschilde. Hij kan ze alle drie naast elkaar houden.
- Houd een lang project op koers. In een marathon-planningschat betekent een groter venster dat hij zich nog de beslissing herinnert die je een uur geleden nam.
Het eerlijke voordeel voor de meeste mensen is de eerste: je leest dat lange, saaie ding niet meer zelf, maar stelt het vragen.
Waar een groot contextvenster nog tekortschiet
Groter is geen toverij, en het is goed om de addertjes te kennen voordat je het iets belangrijks toevertrouwt.
- Het midden wordt vaag. Modellen letten het meest op het begin en het eind van wat je geeft. Begraaf een belangrijk getal midden in een dump van 500 pagina’s en hij kan het echt missen.
- Het is geen permanent geheugen. Sluit de chat en het venster loopt leeg. De volgende keer herinnert de AI zich je document niet, tenzij je het opnieuw plakt.
- Vol betekent niet begrepen. Een heel boek in het venster krijgen is niet hetzelfde als elke nuance vatten. Als de ruimte opraakt of hij de draad kwijtraakt, kan hij gaten gaan opvullen door dingen te verzinnen. Controleer het belangrijke altijd.
- Enorme invoer kan trager zijn. Een model een miljoen tokens laten doorkauwen duurt langer dan een snelle vraag.
De oplossing voor bijna dit alles is simpel: zet het deel dat jou aangaat dicht bij je vraag en vraag de AI om het document terug te citeren, zodat je het kunt controleren.
Welke AI’s nu de meeste ruimte hebben
De grote bedrijven zitten hier in een stille wedloop. De nieuwste modellen van OpenAI, Anthropic en Google zitten inmiddels rond het miljoen tokens, en Google heeft een Gemini-model aangekondigd dat voor twee miljoen is gebouwd. Open opties zoals Kimi rekken de lange context ook op, vaak tegen een vriendelijker prijs.
Voor dagelijks gebruik telt het exacte getal minder dan je denkt. Alles rond het miljoen tokens dekt al bijna elk document dat een gewoon mens ervoor gooit. De echte vraag is welk model zorgvuldig leest en welk haastig, en dat hangt van de taak af. We zetten de populaire modellen kop aan kop in ChatGPT vs Gemini vs Claude.
De makkelijkste manier om het verschil te voelen, is je langste document pakken en het op een paar modellen op één plek uitproberen.
Veelgestelde vragen
Kort samengevat
Een contextvenster is gewoon het kortetermijngeheugen van een AI, gemeten in tokens, en de nieuwste zijn groot genoeg om een heel boek te verzwelgen. Het praktische gevolg is dat je dat lange, saaie document niet meer zelf hoeft te lezen. Je kunt het overhandigen en vragen stellen.
Onthoud alleen dat het venster leegloopt als je de chat sluit, dat het midden van enorme bestanden kan wegglippen en dat het de moeite waard is om de antwoorden die ertoe doen te controleren. Zo gebruikt is een groot geheugen een van de nuttigste dingen die AI stilletjes voor je doet.