Een toets laten schrijven door AI duurt vandaag nog geen minuut. Tien vragen over de Franse Revolutie, een overhoring woordenschat Frans, een reeks oefeningen op eerstegraadsvergelijkingen: het staat er voor je koffie koud is. Toetsen maken met AI is dus geen technisch probleem meer. De vraag is of die toetsen góéd zijn — en dat is een heel andere kwestie.
Wie al eens zo'n gegenereerde toets kritisch heeft doorgelezen, kent het gevoel: alles oogt professioneel, en toch klopt er van alles niet. Kwaliteit zit niet in hoe de vragen ogen, maar in wat eronder ligt.
Een goede toets begint bij de verbetersleutel, niet bij de vragen
De meeste mensen — en de meeste AI-tools — beginnen bij de vragen. Draai het om. Stel je bij elke vraag eerst de vraag: wat moet een goed antwoord precies bevatten, en hoeveel punten staan er op elk element? Kun je dat niet opschrijven, dan is de vraag niet klaar.
De verbetersleutel is geen administratie achteraf, maar het kwaliteitsinstrument zelf:
- Ze dwingt je tot eenduidige vragen. Een vraag waar je zelf geen sluitend modelantwoord voor kunt schrijven, is dubbelzinnig gesteld.
- Ze maakt de puntenverdeling eerlijk vóór je het eerste blad ziet — en niet al verbeterend, beïnvloed door de eerste kopieën van de stapel.
- Ze houdt parallelklassen gelijk: als de vakgroep dezelfde verbetersleutel gebruikt, betekent zeven op tien in de ene klas hetzelfde als in de andere.
Spreid de denkniveaus — anders meet je alleen geheugen
Een toets die uitsluitend reproductie vraagt, meet wie het best van buiten leert. Wil je weten wat leerlingen kúnnen, dan spreid je bewust over denkniveaus — het klassieke model van Bloom is daarvoor nog altijd een bruikbaar kompas:
- Herkennen en onthouden: begrippen, feiten, definities. Nodig als basis, maar niet genoeg.
- Toepassen: een gekende methode gebruiken in een nieuwe situatie — een vergelijking oplossen die niet letterlijk in de cursus stond.
- Inzicht en analyse: verbanden leggen, een bron beoordelen, een redenering opbouwen en verantwoorden.
Spreek in de vakgroep een globale verdeling af en toets die aan wat de minimumdoelen van je richting eigenlijk vragen. AI kan je bij die spreiding helpen — als je er expliciet om vraagt. Doe je dat niet, dan krijg je bijna altijd een toets vol reproductie, want dat is wat het makkelijkst te genereren valt.
Plausibel is niet hetzelfde als juist: lees élke vraag na
Dit is de kern van kwaliteit eerst. AI-modellen genereren tekst die overtuigend klínkt; of die ook klopt, is een tweede. In gegenereerde toetsen duiken telkens dezelfde problemen op:
- Feitelijke fouten die zelfverzekerd geformuleerd staan — net die zie je het makkelijkst over het hoofd.
- Meerkeuzevragen met twee verdedigbare antwoorden, of afleiders die een slimme leerling terecht komt aanvechten.
- Vragen die naast je leerstof liggen: een andere notatie dan je handboek, een begrip dat je pas volgend schooljaar ziet.
- Puntengewichten die nergens op slaan: drie punten op een weetje, één punt op een volledige redenering.
De regel is simpel: lees elke gegenereerde vraag alsof een nieuwe collega ze schreef en jij ze moet goedkeuren. Beantwoord ze zelf. Twijfel je aan het modelantwoord, dan herschrijf je de vraag of schrap je ze. Jij zet je naam op die toets, niet de AI. Hoe je daar als school ook afspraken over maakt, lees je in ons artikel over AI op school.
Hoe Toetsen maken in Corrigo dat aanpakt
In Corrigo hebben we die volgorde ingebouwd. Je laadt je eigen leerstof op — jouw cursus, jouw hoofdstuk — en de toets wordt daaruit gegenereerd, niet uit wat het model toevallig over het onderwerp weet. Elke vraag komt met een modelantwoord en een puntenverdeling: de verbetersleutel ontstaat samen met de toets, niet erna. En alles is bewerkbaar vóór je downloadt — vragen herformuleren, schrappen, punten verschuiven. Eerlijk erbij: ook dan blijft nalezen jouw werk. De AI stelt voor, jij beslist; dat geldt bij ons voor het verbeteren en dus ook voor het genereren. Meer op de pagina Toetsen maken.
Veelgestelde vragen
Mag ik als leerkracht AI gebruiken om toetsen te maken?
Ja, dat mag. Jij blijft wel volledig verantwoordelijk voor de inhoud: elke vraag en elk modelantwoord moet jij gecontroleerd hebben. Zet geen leerlinggegevens in gratis chatbots; voor het genereren van een toets uit leerstof speelt dat gelukkig niet.
Hoe controleer ik snel of een AI-vraag deugt?
Beantwoord de vraag zelf en schrijf of controleer de verbetersleutel. Vind je twee verdedigbare antwoorden, klopt de notatie niet met je handboek of kun je de puntenverdeling niet verantwoorden, dan herschrijf of schrap je de vraag.
Waarom beginnen bij de verbetersleutel en niet bij de vragen?
Omdat de verbetersleutel je dwingt tot eenduidige vragen en een eerlijke puntenverdeling, en omdat je er nadien sneller en consequenter mee verbetert. Een vraag zonder sluitend modelantwoord is geen goede toetsvraag.
Worden AI-toetsen niet allemaal hetzelfde?
Generieke opdrachten geven generieke toetsen. Genereer je uit je eigen leerstof en bewerk je het resultaat, dan blijft de toets van jou — de AI levert een eerste versie, geen eindproduct.