Zo maak je van je aantekeningen oefenvragen die het antwoorden waard zijn
Bruikbare oefenvragen uit één college halen kost ongeveer veertien minuten voordat je er ook maar één beantwoordt, en het grootste deel daarvan ben jij die er drie met de hand schrijft om een maatstaf te zetten. Genereren kost twee minuten, en de controle die bepaalt of de set het antwoorden waard is ook. De uitgewerkte ronde aan het eind van dit artikel kost vijftig minuten van begin tot eind, omdat de vragen koud beantwoorden en de missers teruglezen het deel is waar je iets van leert. Sla je de controle over, dan studeer je op wat het model heeft gegokt. Een systematische review uit mei 2026 zette het foutpercentage over 71 studies op ergens tussen minder dan 1 procent en 45 procent.
Schrijf er eerst drie met de hand, daarna nooit meer
Open de diaset. Zoek drie regels die in hun eentje een antwoord kunnen beslissen: een mechanisme, een grenswaarde, een eerstekeusmiddel, een kenmerkende bevinding. Bouw uit elk een vraag, vijf opties, één juiste. Tien minuten, en je bent voorgoed klaar met met de hand schrijven.
Die tien minuten kopen je een maatstaf. Nu je er drie hebt geschreven, weet je dat een bruikbare vraagstam iets vraagt wat je met de opties afgedekt zou kunnen beantwoorden, dat vijf opties hetzelfde soort ding in dezelfde grammaticale vorm moeten zijn, en dat precies één zin in je bron het antwoord moet beslissen. Je leert ook hoe traag het gaat, en daarom schrijft niemand er veertig.
Bewaar die drie. Ze worden je maatstaf voor alles wat een model je later aanreikt, en als een gegenereerde vraag fout aanvoelt en je niet kunt zeggen waarom, wijst hem naast een van die van jou leggen het probleem meestal aan in de opties.
Waar je om vraagt, in de woorden die de uitvoer veranderen
Overhoor me hierover levert trivia over het document op in plaats van vragen over het onderwerp. Zes instructies veranderen wat je terugkrijgt. Plak ze boven je tekst en pas het aantal en het onderwerp aan.
Gebruik alleen de onderstaande tekst. Schrijf 12 vragen met één beste antwoord over cardiovasculaire fysiologie uit het tweede jaar, elk met vijf opties en precies één juist antwoord. Druk na elke vraag de letterlijke zin uit de tekst af die het antwoord juist maakt, plus het pagina- of dianummer waar die zin staat. Schrijf geen vraag tenzij die ene zin het antwoord in zijn eentje beslist. Geen alle bovenstaande, geen geen van bovenstaande, geen vraagstammen als welke van de volgende is juist. Houd de vijf opties even lang en in dezelfde grammaticale vorm.
- Gebruik alleen de onderstaande tekst. Laat je dat weg, dan antwoordt het model uit wat het toch al weet, en oefen je op stof die je examinator nooit heeft gegeven.
- Druk de letterlijke zin en de pagina af. Die zin doet van de zes het meeste werk. Citaten die je kunt opzoeken beslechten een discussie met de antwoordsleutel in tien seconden, en een model dat er een moet leveren schrijft minder beweringen die het niet kan onderbouwen.
- Eén zin moet het beslissen. Anders krijg je items waarvoor je de geciteerde regel plus drie feiten van elders nodig hebt, niet te controleren en oneerlijk om te beantwoorden.
- Noem het itemformaat. Vraag je om vragen, dan krijg je juist of onjuist, invulzinnen en reproductievragen van één regel door elkaar.
- Verbied de twee vraagstammen. Alle bovenstaande en welke van de volgende is juist zijn de fouten die generatoren het vaakst maken, en allebei verdwijnen ze zodra je erom vraagt.
- Even lang, dezelfde vorm. Itemschrijvers werken de optie waarvan ze weten dat die juist is verder uit, en een model dat op hun werk is getraind neemt die gewoonte over.
Vraag om een aantal dat je materiaal kan dragen. Het bericht over de dagelijkse voorraad vragen telt regel voor regel en komt uit in de buurt van het aantal dia’s, en dat is een telling van markeerbare regels, niet van vragen die je houdt. In de praktijk levert een set van 40 dia’s er 15 tot 20 op die je zou houden, want vragen om 50 levert vooral duplicaten op die de controles er daarna uit halen.
Wat er fout terugkomt, en hoe vaak: 71 studies, geteld
Twee gepubliceerde getallen zetten een eerlijke verwachting. Een systematische review in het Postgraduate Medical Journal, gepubliceerd op 20 mei 2026, bundelde 71 studies uit 24 landen over door AI geschreven meerkeuzevragen in het medisch onderwijs. De foutpercentages liepen van minder dan 1 procent tot 45 procent. De mediane moeilijkheid was 0,67 en het mediane onderscheidend vermogen 0,28, wat een item beschrijft dat studenten die de stof kennen scheidt van studenten die dat niet doen, maar niet scherp. De meeste van die studies beoordeelden de vragen via deskundigen in plaats van door ze aan lerenden voor te leggen, en de review concludeert dat het bewijs nog geen steun geeft aan "unsupervised use in summative assessment".
Ouder en botter: de Chobanian and Avedisian School of Medicine van Boston University meldde in december 2023 dat ChatGPT in 32 procent van de gevallen een juiste vraag met een juist antwoord en een juiste uitleg produceerde toen het items voor een tentamen aan een medische faculteit moest schrijven.
Derde getal, van deze site, die telt wat haar controles eruit gooien en die telling publiceert. Gelezen op 20 september 2026: tussen 14 september, waar het logboek met aanroepen begint, en die datum schreven de modellen 3.564 vragen in 1.398 aanroepen. Daarvan overleefde 43,1 procent alles. Structuurregels haalden er 32,8 procent uit, de duplicaatcontrole 13,5 procent, een tweede model dat uit het citaat antwoordde zonder de sleutel 6,7 procent, en 2,2 procent citeerde een zin die de controle niet kon vinden op de pagina waarnaar werd verwezen of verwees naar een pagina buiten de sectie. De overige 1,7 procent kwam binnen toen de opdracht al vol was of kwam terug in een vorm die de parser niet kon lezen.
Die aandelen bewegen met elke opdracht mee, en het aandeel duplicaten beweegt het meest. Het bericht van een dag eerder telde het op 17,6 procent over een korter venster, 14 tot 19 september 2026; deze aflezing telt 13,5 procent over 14 tot 20 september 2026. Allebei zijn het juiste aflezingen van hetzelfde lopende rapport, en daarom draagt de pagina met afwijzingspercentages het actuele cijfer en is alles hierboven één momentopname ervan.
Bij elkaar zeggen die drie niet: genereer geen vragen. Ze zeggen dat bijna de helft van wat terugkomt in de prullenbak hoort, en jouw enige beslissing is wie dat weggooien doet.
Wanneer je stopt met controleren, en wat een gezakte vraag waard is
De drie controles die het meeste ervan vangen staan al uitgeschreven op de pagina achter die tellingen: zoek de geciteerde zin op in je document, dek de antwoordsleutel af en beantwoord de vraag alleen uit het citaat, en lees daarna de vijf opties zonder de vraagstam. Draai ze op de eerste vijf vragen van een set, samen een minuut, en het artikel over nauwkeurigheid werkt uit wat elke controle vangt en waarom.
Die controles zijn niet van mij. Ze komen uit de taxonomie voor itemschrijven die twee bronnen uiteenzetten: de 31 regels die Haladyna, Downing en Rodriguez in 2002 in Applied Measurement in Education opschreven, en de werkversie die itemschrijvers meestal krijgen, de NBME Item-Writing Guide, inmiddels in de zesde editie en geplaatst in februari 2021.
Wat die pagina je niet vertelt, is wanneer je moet stoppen. Hier is het getal: controleer de eerste vijf vragen en niet meer. Bij twee missers op vijf stop je met controleren en ga je terug naar de prompt. Een set die zo vroeg twee keer zakt, zakt bijna altijd om één reden, en één reden is meestal één regel van de prompt, dus hem aanscherpen en opnieuw genereren kost twee minuten. Alle vijftien controleren kost er twintig en laat hetzelfde gebrek in de volgende batch zitten.
Een vraag die zakt gaat de prullenbak in, niet naar de reparatie. Een vraagstam herschrijven waarvan de geciteerde zin het antwoord niet beslist, betekent dat je het antwoord zelf bepaalt, en dan ben jij de itemschrijver en heeft het model je avond verspild. Blijf je onder één misser op vijf, gooi dan die ene weg en beantwoord de rest.
De weggegooide vraag levert toch iets op. Je hebt de dia geopend om haar te controleren, wat betekent dat je de regel hebt gelezen waarop de vraag was gebouwd, in de woorden van de bron. Schrijf die regel op waar je missers staan. Een vraag die een controle niet haalde en een vraag die je fout beantwoordde komen op dezelfde plek terecht, en dat is het begin van morgen.
De verpleegkundige versie, en wat een collegedia je niet geeft
Verpleegkundestudenten komen hier meestal met een smallere opdracht: items in NCLEX-stijl uit een hand-out van de les halen. De situatie is het ontbrekende stuk. Je dia over pathofysiologie geeft je een mechanisme, terwijl een item in NCLEX-stijl een cliënt nodig heeft, een setting, een paar bevindingen en een aanloop die om een prioriteit of een handeling vraagt, met vier opties die allemaal verdedigbaar zijn en één die het beste is. Niets daarvan staat op de dia, dus de prompt moet het erbij zetten.
Voeg een regel toe: schrijf elke vraag als een kort scenario met een cliënt in een ziekenhuis, eindigend met de vraag welke handeling de verpleegkundige als eerste moet doen, en maak alle vier de opties veilige verpleegkundige handelingen. Voeg voor deze vragen een vierde controle toe: draagt de vraagstam genoeg informatie om tussen die vier te kiezen? Kan elk van de vier redelijkerwijs de eerste zijn, dan is het item niet moeilijk maar onbeantwoordbaar, en leert het je gokken.
Volledig buiten bereik vanaf een hand-out: de Next Generation formats. Case study, matrix, bow tie, highlight en drop down items zijn gebouwd rond patiëntgegevens die zich ontvouwen, met eigen scoreregels, en niets dat uit een collegeset wordt gegenereerd levert ze op. Wie je dat vanuit een PDF verkoopt, belooft te veel. De NCLEX-RN pagina hier zegt hetzelfde. Dit is geen NCLEX-vragenbank en heeft geen band met de NCSBN; items worden in die stijl geschreven uit het bestand dat je uploadt.
Het op volume doen zonder in bijna-duplicaten te verdrinken
Vraag om 60 vragen uit een hand-out van 12 pagina’s en je krijgt dezelfde 12 feiten in 60 vermommingen terug. Niets in een chatvenster houdt dat tegen: bij vraag 47 is het model vraag 14 kwijt, en een parafrase herkennen van iets dat je twintig minuten geleden beantwoordde is lastig.
Drie gewoontes houden een lange reeks eerlijk. Genereer één hoofdstuk tegelijk in plaats van een hele module, want duplicaten klonteren binnen één bron. Verander het itemtype bij een tweede doorloop, zodat één beste antwoord een klinisch vignet wordt en hetzelfde feit als redeneren wordt getoetst. Scan de vraagstammen voordat je er een beantwoordt, want een herhaling die je vroeg ziet kost niets en een die je bij vraag 30 ziet kost je de sessie.
Machines zijn hier beter in dan jij. Een generator die elke nieuwe vraag vergelijkt met alles wat al uit hetzelfde document is geschreven, gooit een bijna-herhaling weg voordat je haar ooit ziet, en dat zijn de duplicaatafwijzingen die hierboven zijn geteld: vragen die nooit bij een lezer zijn aangekomen.
Een uitgewerkte ronde uit één collegeset van 40 dia’s
Dinsdagavond, een cardiologiecollege van 40 dia’s, in één zitting. Hieronder staan de tijden die het kost, niet de tijden die een plan zou willen.
- Eerste tien minuten. Drie vragen met de hand, uit dia’s waarbij je je herinnert dat de docent langzamer ging praten.
- Twee minuten. Plak de prompt boven de tekst van de dia’s en vraag om 15 vragen, niet 50. Vijftien is ongeveer wat 40 dia’s dragen zodra de herhalingen eruit zijn.
- Nog twee minuten. Draai de controles op de eerste vijf items. Reken erop dat er een of twee zakken. Bij twee missers pas je de prompt aan en genereer je opnieuw, wat twee minuten kost en er twintig bespaart.
- Drieëntwintig minuten. Beantwoord alle 15 koud, ongeveer 90 seconden per stuk, met de opties afgedekt tot je je keuze hebt vastgelegd.
- Dertien minuten. Open bij elke misser de dia waar de vraag naar verwijst en lees de regel waar ze vandaan komt. Schrijf die over in de woorden van de bron, niet in jouw samenvatting ervan.
- Morgen. Die missers openen de volgende sessie, vóór al het nieuwe. Waar ze in de weken daarna terugkomen, is het onderwerp van het schema voor gespreide herhaling.
Vijftig minuten, 15 vragen die je kunt verdedigen, en een handgeschreven lijst met de feiten die je te pakken hadden.
Vragen die mensen stellen
Met welke prompt schrijft ChatGPT goede examenvragen uit mijn aantekeningen?
Vier zinnen dragen bijna alle waarde. Zeg dat het alleen de tekst mag gebruiken die je hebt geplakt, noem het formaat als één beste antwoord met vijf opties en precies één juist antwoord, eis de letterlijke zin en het paginanummer die het antwoord juist maken, en verbied vraagstammen als alle bovenstaande en welke van de volgende is juist. De toevoeging dat de geciteerde zin het antwoord in zijn eentje moet beslissen, haalt het meeste weg van wat er dan nog overblijft.
Hoe accuraat zijn door AI gegenereerde oefenvragen?
Gepubliceerde studies geven niet één getal. Een systematische review van 71 studies in het Postgraduate Medical Journal, gepubliceerd op 20 mei 2026, vond foutpercentages van minder dan 1 procent tot 45 procent, en Boston University meldde in december 2023 dat ChatGPT in 32 procent van de gevallen een juiste vraag met een juist antwoord en een juiste uitleg produceerde. Wat je eigen set bepaalt, is of er iets controle op heeft gedaan. Deze site publiceert wat haar controles eruit gooien: gelezen op 20 september 2026 overleefde 43,1 procent van de 3.564 gegenereerde vragen elke controle, waarbij de duplicaatcontrole 13,5 procent van de rest voor haar rekening nam. Die aandelen bewegen met het venster mee, dus de pagina met afwijzingspercentages draagt het actuele cijfer.
Hoeveel oefenvragen moet ik uit één college maken?
Tel je markeerbare regels, dan komt een set van 40 dia’s uit op ongeveer één per dia, want zoveel regels kunnen in hun eentje een antwoord beslissen. Tel je vragen die je na controle zou houden, dan is het eerder 15 tot 20, want niet elke markeerbare regel overleeft. Vragen om 50 levert geen extra feiten op, het herhaalt dezelfde feiten in nieuwe bewoordingen en de duplicaatcontrole haalt ze eruit. Genereer één college tegelijk en stop zodra de nieuwe vragen je niet meer verrassen.
Wanneer moet ik stoppen met een gegenereerde set controleren en opnieuw beginnen?
Controleer de eerste vijf vragen en stop daar. Bij twee missers op vijf ga je terug naar de prompt in plaats van de set te repareren, want een set die zo vroeg twee keer zakt, zakt meestal om één reden en die ene reden is meestal één regel van de prompt. Opnieuw genereren kost twee minuten; vijftien vragen een voor een repareren kost je de avond.
Kan AI vragen in NCLEX-stijl schrijven uit mijn collegeaantekeningen?
Het kan scenario-items in die stijl schrijven als je het opdraagt een cliëntsituatie te bouwen met een aanloop naar een prioriteit of een handeling en vier veilige opties, want een collegedia levert de pathofysiologie maar nooit de setting. De Next Generation formats, dus case study, matrix, bow tie, highlight en drop down, zijn niet uit een document te maken. Dit is geen NCLEX-vragenbank en heeft geen band met de NCSBN.
Gepubliceerd .