MedUni Exam

Sådan laver du dine noter om til øvespørgsmål, der er værd at svare på

At få brugbare øvespørgsmål ud af én forelæsning koster cirka fjorten minutter, før du svarer på noget, og det meste af det er dig, der skriver tre i hånden for at sætte en standard. Genereringen tager to minutter, og det gør den kontrol, der afgør, om sættet er værd at svare på, også. Det gennemførte forløb sidst i artiklen tager halvtreds minutter fra ende til anden, fordi det at svare koldt og læse fejlene igennem bagefter er den del, der lærer dig noget. Springer du kontrollen over, læser du det, modellen gættede. Et systematisk review udgivet i maj 2026 satte fejlraten på tværs af 71 studier til alt fra under 1 procent til 45 procent.

Skriv tre i hånden først, og så aldrig igen

Åbn slidesættet. Find tre linjer, der kunne afgøre et svar på egen hånd: en mekanisme, en grænseværdi, et førstevalgspræparat, et karakteristisk fund. Byg ét spørgsmål ud af hver, fem svarmuligheder, ét rigtigt. Ti minutter, og så er du færdig med at skrive i hånden for altid.

De ti minutter køber dig en standard. Når du har skrevet tre, ved du, at en brugbar stamme spørger om noget, du kunne svare på med svarmulighederne dækket til, at fem svarmuligheder skal være den samme slags ting i den samme grammatiske form, og at præcis én sætning i din kilde skal afgøre svaret. Du lærer også, hvor langsomt det går, og det er derfor, ingen skriver fyrre.

Behold de tre. De bliver din målestok for alt det, en model senere leverer, og når et genereret spørgsmål ser forkert ud, uden at du kan sige hvorfor, finder du som regel problemet i svarmulighederne ved at stille det ved siden af et af dine egne.

Hvad du skal bede om, med de ord, der ændrer resultatet

Et "stil mig nogle spørgsmål om det her" giver dig trivia om dokumentet i stedet for spørgsmål om faget. Seks instruktioner ændrer det, du får tilbage. Indsæt dem over din tekst, og skift antallet og emnet ud.

Brug kun teksten nedenfor. Skriv 12 spørgsmål med ét bedste svar om kardiovaskulær fysiologi på andet år, hvert med fem svarmuligheder og præcis ét rigtigt svar. Efter hvert spørgsmål skal du udskrive den ordrette sætning fra teksten, der gør svaret rigtigt, og det side- eller slidenummer, den står på. Skriv ikke et spørgsmål, medmindre den ene sætning afgør svaret helt af sig selv. Ingen alle ovenstående, ingen ingen af ovenstående, ingen stammer af typen hvilket af følgende er sandt. Hold de fem svarmuligheder i samme længde og samme grammatiske form.

  • Brug kun teksten nedenfor. Udelader du den, svarer modellen ud fra det, den i forvejen ved, og så øver du dig på stof, din eksaminator aldrig har undervist i.
  • Udskriv den ordrette sætning og siden. Den sætning gør mest arbejde af de seks. Citater, du kan slå op, afgør en uenighed med facitlisten på ti sekunder, og en model, der skal levere et, skriver færre påstande, den ikke kan underbygge.
  • Én sætning skal afgøre det. Ellers får du spørgsmål, der kræver den citerede linje plus tre fakta andre steder fra, umulige at kontrollere og urimelige at svare på.
  • Nævn spørgsmålsformatet. Skriver du bare spørgsmål, får du sandt eller falsk, udfyld det manglende og enlinjers genkaldelse blandet sammen.
  • Forbyd de to stammer. Alle ovenstående og hvilket af følgende er sandt er de fejl, generatorer laver flest af, og begge forsvinder, når du beder om det.
  • Samme længde, samme form. Spørgsmålsforfattere uddyber den svarmulighed, de ved er rigtig, og en model, der er trænet på deres arbejde, kopierer vanen.

Bed om et antal, dit materiale kan bære. Indlægget om den daglige forsyning af spørgsmål tæller en linje ad gangen og lander tæt på antallet af slides, og det er et tal for linjer, der kan bære et spørgsmål, ikke for spørgsmål, du beholder. I praksis giver et slidesæt på 40 slides 15 til 20, du ville beholde, for at bede om 50 køber mest af alt dubletter, som kontrollerne bagefter fjerner.

Hvad der kommer forkert tilbage, og hvor ofte: 71 studier, talt op

To offentliggjorte tal sætter en rimelig forventning. Et systematisk review i Postgraduate Medical Journal, udgivet den 20. maj 2026, samlede 71 studier fra 24 lande om AI-skrevne multiple choice-spørgsmål i den medicinske undervisning. Fejlraterne lå fra under 1 procent til 45 procent. Mediansværhedsgraden var 0,67 og mediandiskriminationen 0,28, hvilket beskriver et spørgsmål, der skiller de studerende, som kan stoffet, fra dem, der ikke kan, men ikke skarpt. De fleste af de studier bedømte spørgsmålene ved ekspertgennemgang frem for ved at lægge dem foran studerende, og reviewet konkluderer, at evidensen endnu ikke understøtter "unsupervised use in summative assessment".

Ældre og mere kontant: Boston Universitys Chobanian and Avedisian School of Medicine rapporterede i december 2023, at ChatGPT leverede et rigtigt spørgsmål med et rigtigt svar og en rigtig forklaring i 32 procent af tilfældene, når den blev bedt om at skrive spørgsmål til en eksamen på medicinstudiet.

Tredje tal, fra dette site, som tæller, hvad dets kontroller kasserer, og offentliggør tallet. Aflæst den 20. september 2026: mellem den 14. september, hvor kaldloggen starter, og den dato skrev modellerne 3.564 spørgsmål fordelt på 1.398 kald. Af dem overlevede 43,1 procent alt. Strukturelle regler fjernede 32,8 procent, dubletkontrollen 13,5 procent, en anden model, der svarede ud fra citatet uden facit, 6,7 procent, og 2,2 procent citerede enten en sætning, kontrollen ikke kunne finde på den side, de henviste til, eller henviste til en side uden for afsnittet. De resterende 1,7 procent kom frem, efter jobbet allerede var fyldt op, eller kom tilbage i en form, fortolkeren ikke kunne læse.

De andele flytter sig med hvert job, og dubletandelen flytter sig mest. Indlægget, der udkom dagen før, talte den til 17,6 procent over et kortere vindue, den 14. til 19. september 2026; denne aflæsning tæller 13,5 procent fra den 14. til den 20. september 2026. Begge er korrekte aflæsninger af den samme rullende rapport, og derfor bærer siden med kassationsrater det aktuelle tal, mens alt ovenfor er ét øjebliksbillede af det.

Lagt sammen siger de tre ikke, at du skal lade være med at generere spørgsmål. De siger, at tæt på halvdelen af det, der kommer tilbage, hører hjemme i skraldespanden, og din eneste beslutning er, hvem der smider ud.

Hvornår du skal stoppe kontrollen, og hvad et spørgsmål, der falder igennem, er værd

De tre kontroller, der fanger det meste af det, står allerede beskrevet på siden bag de tal: find den citerede sætning i dit dokument, dæk facit til og svar ud fra citatet alene, og læs så de fem svarmuligheder uden stammen. Kør dem på de første fem spørgsmål i et sæt, et minut i alt, og artiklen om præcision gennemgår, hvad hver enkelt fanger, og hvorfor.

De kontroller er ikke mine. De kommer fra den taksonomi for spørgsmålsskrivning, som de to kilder opstiller: de 31 regler, Haladyna, Downing og Rodriguez opstillede i Applied Measurement in Education i 2002, og den arbejdsudgave, spørgsmålsforfattere som regel får udleveret, NBME Item-Writing Guide, nu i sjette udgave og lagt op i februar 2021.

Det, den side ikke fortæller dig, er, hvornår du skal stoppe. Her er tallet: kontrollér de første fem spørgsmål og ikke flere. Ved to fejl ud af fem stopper du kontrollen og går tilbage til prompten. Et sæt, der fejler to gange så tidligt, fejler næsten altid af én grund, og én grund er som regel én linje i prompten, så at stramme den og generere igen koster to minutter. At kontrollere alle femten koster tyve og efterlader den samme fejl i næste batch.

Et spørgsmål, der falder igennem, ryger i skraldespanden, ikke til reparation. At skrive en stamme om, hvis citerede sætning ikke afgør svaret, betyder, at du selv bestemmer svaret, og så er det dig, der er spørgsmålsforfatteren, og modellen har spildt din aften. Er der under én fejl ud af fem, så smid den ene ud og svar på resten.

Det kasserede spørgsmål giver stadig noget. Du åbnede slidet for at kontrollere det, og det betyder, at du læste den linje, spørgsmålet var bygget på, med kildens ord. Skriv den linje ned dér, hvor dine fejl står. Et spørgsmål, der faldt igennem en kontrol, og et spørgsmål, du svarede forkert på, ender samme sted, og det sted er starten på i morgen.

Sygeplejeversionen, og hvad et forelæsningsslide ikke giver dig

Sygeplejestuderende kommer som regel hertil med en smallere opgave: at få spørgsmål i NCLEX-stil ud af et handout fra undervisningen. Situationen er den manglende brik. Dit patofysiologiske slide giver dig en mekanisme, mens et spørgsmål i NCLEX-stil kræver en patient, en ramme, nogle fund og en indledning, der spørger efter en prioritet eller en handling, med fire svarmuligheder, der alle kan forsvares, og én, der er bedst. Intet af det står på slidet, så prompten må lægge det ind.

Tilføj en linje: skriv hvert spørgsmål som et kort patientscenarie på et hospital, der slutter med, hvilken handling sygeplejersken skal udføre først, og lad alle fire svarmuligheder være forsvarlige sygeplejehandlinger. Tilføj en fjerde kontrol til dem: bærer stammen nok information til at vælge mellem de fire? Hvis en hvilken som helst af dem med rimelighed kunne være den første, er spørgsmålet ikke svært, det er ubesvarligt, og det lærer dig at gætte.

Helt uden for rækkevidde fra et handout: Next Generation-formaterne. Spørgsmål af typen case study, matrix, bow tie, highlight og drop down er bygget op om patientdata, der folder sig ud, med deres egne pointregler, og intet genereret ud fra et forelæsningssæt laver dem. Sælger nogen dig det ud fra en PDF, lover de for meget. NCLEX-RN-siden her siger det samme. Dette er ikke en NCLEX-spørgsmålsbank og har ingen forbindelse til NCSBN; spørgsmålene skrives i den stil ud fra den fil, du uploader.

Sådan gør du det i stor mængde uden at drukne i næsten ens spørgsmål

Bed om 60 spørgsmål ud fra et handout på 12 sider, og du får de samme 12 fakta i 60 forklædninger. Intet i et chatvindue forhindrer det: ved spørgsmål 47 har modellen mistet spørgsmål 14, og det er svært at få øje på en omskrivning af noget, du svarede på for tyve minutter siden.

Tre vaner holder et langt forløb ærligt. Generér ét kapitel ad gangen frem for et helt modul, for dubletter klumper sig sammen inde i en kilde. Skift spørgsmålstype ved anden gennemgang, så ét bedste svar bliver til en klinisk vignet, og den samme kendsgerning bliver testet som ræsonnement. Skim stammerne igennem, før du svarer på nogen af dem, for en gentagelse fanget tidligt koster ingenting, mens en fanget ved spørgsmål 30 koster dig hele sessionen.

Maskiner er bedre til den del, end du er. En generator, der holder hvert nyt spørgsmål op mod alt, der allerede er skrevet ud fra det samme dokument, smider en næsten ens gentagelse væk, før du overhovedet ser den, og det er netop det, de kasserede dubletter talt op ovenfor er: spørgsmål, der aldrig nåede frem til en læser.

Et gennemført forløb fra ét slidesæt på 40 slides

Tirsdag aften, en kardiologiforelæsning på 40 slides, ét gennemløb. Nedenfor står de tider, det tager, ikke dem en plan kunne ønske sig.

  1. De første ti minutter. Tre spørgsmål i hånden, fra de slides, hvor du husker, at underviseren satte farten ned.
  2. To minutter. Indsæt prompten over teksten fra slidesættet, og bed om 15 spørgsmål, ikke 50. Femten er cirka det, 40 slides kan bære, når gentagelserne er pillet ud.
  3. To minutter til. Kør kontrollerne på de første fem spørgsmål. Regn med, at et eller to falder igennem. Ved to fejl retter du prompten og genererer igen, hvilket koster to minutter og sparer tyve.
  4. Treogtyve minutter. Svar på alle 15 koldt, cirka 90 sekunder til hvert, med svarmulighederne dækket til, indtil du har bundet dig.
  5. Tretten minutter. For hver fejl åbner du det slide, spørgsmålet henviser til, og læser den linje, det kommer fra. Skriv den af med kildens ord, ikke med dit eget referat.
  6. I morgen. De fejl åbner næste session, før noget nyt kommer til. Hvor i de følgende uger de vender tilbage, handler planen for gentagelse med intervaller om.

Halvtreds minutter, 15 spørgsmål, du kan stå inde for, og en håndskrevet liste over de fakta, der slog dig.

Spørgsmål folk stiller

Hvilken prompt får ChatGPT til at skrive gode eksamensspørgsmål ud fra mine noter?

Fire sætninger bærer næsten hele værdien. Bed den om kun at bruge den tekst, du har indsat, nævn formatet som ét bedste svar med fem svarmuligheder og ét rigtigt svar, kræv den ordrette sætning og det sidetal, der gør svaret rigtigt, og forbyd stammer af typen alle ovenstående og hvilket af følgende er sandt. Tilføjer du, at den citerede sætning skal afgøre svaret på egen hånd, fjerner det det meste af resten.

Hvor præcise er AI-genererede øvespørgsmål?

Offentliggjorte studier giver ikke ét tal. Et systematisk review af 71 studier i Postgraduate Medical Journal, udgivet den 20. maj 2026, fandt fejlrater fra under 1 procent til 45 procent, og Boston University rapporterede i december 2023, at ChatGPT leverede et rigtigt spørgsmål med et rigtigt svar og en rigtig forklaring i 32 procent af tilfældene. Det, der afgør dit eget sæt, er, om noget kontrollerede det. Dette site offentliggør, hvad dets kontroller kasserer: aflæst den 20. september 2026 overlevede 43,1 procent af 3.564 genererede spørgsmål alle kontroller, og dubletkontrollen stod for 13,5 procent af resten. De andele flytter sig med vinduet, så siden med kassationsrater bærer det aktuelle tal.

Hvor mange øvespørgsmål bør jeg lave ud fra én forelæsning?

Tæller man linjer, der kan bære et spørgsmål, lander et slidesæt på 40 slides tæt på én per slide, for så mange linjer kan afgøre et svar på egen hånd. Tæller man spørgsmål, du ville beholde efter kontrollen, er det nærmere 15 til 20, fordi ikke hver linje overlever. At bede om 50 skaber ikke flere fakta, det gentager de samme med nye ord, og dubletkontrollen fjerner dem. Generér én forelæsning ad gangen, og stop, når de nye spørgsmål holder op med at overraske dig.

Hvornår bør jeg holde op med at kontrollere et genereret sæt og starte forfra?

Kontrollér de første fem spørgsmål, og stop dér. Ved to fejl ud af fem går du tilbage til prompten i stedet for at reparere sættet, for et sæt, der fejler to gange så tidligt, fejler som regel af én grund, og én grund er som regel én linje i prompten. At generere igen koster to minutter; at reparere femten spørgsmål ét ad gangen koster hele aftenen.

Kan AI skrive spørgsmål i NCLEX-stil ud fra mine undervisningsnoter?

Den kan skrive scenariespørgsmål i den stil, hvis du beder den bygge en patientsituation med en indledning om prioritet eller handling og fire forsvarlige svarmuligheder, for et forelæsningsslide giver patofysiologien, men aldrig rammen. Next Generation-formaterne, altså case study, matrix, bow tie, highlight og drop down, kan ikke laves ud fra et dokument. Dette er ikke en NCLEX-spørgsmålsbank og har ingen forbindelse til NCSBN.

Udgivet .