# Jak dokładne są pytania egzaminacyjne pisane przez AI? Co pokazują prawdziwe zadania

> Wskaźniki odrzuceń z prawdziwych generowań na podręcznikach medycznych: jak często pytanie AI nie zdaje testu cytatu, ślepej drugiej odpowiedzi ani duplikatu.

Kopia w Markdown strony https://meduniexam.com/pl/blog/how-accurate-are-ai-exam-questions (strony HTML), opublikowana przez MedUni Exam. Opublikowano 16 września 2026. Przewodnik po stronie dla agentów: https://meduniexam.com/llms.txt.

Autor: [Nicholas](https://meduniexam.com/pl/about.md). Sprawdzono 24 września 2026.

Every question this site writes is checked before a student sees it, and the checks keep a count. This is what the 10 days since September 14, 2026 of real jobs on medical textbooks, lecture decks and notes show: how many questions a model writes that cannot be traced to the page, that a second model answers differently, or that repeat one already written.

## Liczby, policzone z dziennika wywołań

| What the checks counted | Share of questions written |
| --- | --- |
| Questions the models wrote | 6,183 in 2,459 calls |
| Kept, every check passed | 44.0% |
| Thrown out, all reasons | 56.0% |
| Cytatu nie ma na wskazanej stronie | 6.5% |
| Second model answered differently | 5.4% |
| Repeat of a question already written | 11.2% |
| Structural flaw (all of the above, a vague stem, an option that gives itself away) | 30.9% |

Counted from the call log over September 14, 2026 to September 24, 2026, refreshed twice an hour. The same report, split by model family and with a CSV, is on the [rejection rates page](https://meduniexam.com/pl/stats/rejections.md).

## Co oznacza każde odrzucenie

**Cytatu nie ma na wskazanej stronie.** Każde pytanie musi nieść jedno albo dwa zdania przepisane z dokumentu razem ze stroną, na której stoją. Serwer wyszukuje to zdanie w zapisanym tekście tej strony. Jeśli go tam nie ma, model napisał pytanie o coś, czego materiał nie mówi, albo źle zapamiętał brzmienie, i pytanie odpada. To jest test, który wyłapuje wymyślony fakt.

**Drugi model odpowiedział inaczej.** Model z innej rodziny dostaje pytanie i cytaty, i nic więcej: żadnego klucza odpowiedzi, żadnego dokumentu. Jeśli nie dojdzie z samych cytatów do odpowiedzi z klucza, to znaczy, że cytaty nie dowodzą odpowiedzi, i pytanie odpada. To jest test, który wyłapuje dobrze brzmiące pytanie ze złym kluczem albo klucz, którego cytat nie potwierdza.

**Powtórzenie już napisanego pytania.** Każde nowe pytanie jest porównywane ze wszystkim, co już powstało z tego dokumentu. Prawie powtórzenie odpada, więc długa seria daje różne pytania zamiast tych samych faktów opowiedzianych na nowo.

**Wada strukturalna.** "Wszystkie powyższe", "żadne z powyższych", pytanie o to, które stwierdzenie jest prawdziwe, opcja rzucająco dłuższa od pozostałych, pytanie odwołujące się do "tekstu". To są sygnały, których egzaminatorzy uczą się pozbywać, i tutaj są usuwane regułą, zanim ruszą pozostałe testy. [Sprawdzarka wad pytań MCQ](https://meduniexam.com/pl/tools/mcq-checker.md) stosuje te same reguły do dowolnego pytania, które wkleisz.

## Dlaczego generator, który nie pokazuje cytatu, nie może podać swojej dokładności

Narzędzie, które podaje Ci test bez zdania, z którego wzięło się każde pytanie, nie ma jak policzyć, ile jego pytań było niepotwierdzonych, bo nic w jego procesie tego nie sprawdzało. Jego dokładność to tyle, ile sam znajdziesz, sprawdzając pytania, a to jest właśnie praca, którą chciałeś oddać. Strona pomocy jednego z konkurencyjnych narzędzi prosi użytkowników, żeby przejrzeli wygenerowany test, zanim zaczną na nim polegać, co jest uczciwym postawieniem sprawy, kiedy nic nie zostało sprawdzone. Liczby powyżej istnieją, bo sprawdzanie dzieje się, zanim student cokolwiek zobaczy, i bo to, co odpadło, zostało policzone, a nie po cichu wyrzucone.

## Jak samemu sprawdzić pytanie od AI w dwadzieścia sekund

1. **Znajdź zdanie.** Jeśli pytanie nie pokazuje, skąd pochodzi, poszukaj w dokumencie jego kluczowej frazy. Jeśli tej frazy tam nie ma, pytanie nie pochodzi z Twojego materiału.
2. **Zasłoń klucz i odpowiedz z cytatu.** Przeczytaj tylko cytowane zdanie i wybierz opcję. Jeśli cytat tego nie rozstrzyga, pytanie sprawdza coś, czego cytat nie mówi.
3. **Popatrz na opcje.** Jedna opcja dużo dłuższa od reszty, opcja powtarzająca treść pytania, "wszystkie powyższe": każde z tego jest sygnałem i każde jest powodem, żeby pytaniu nie ufać, a nie żeby się z niego uczyć.

## Co to znaczy dla przygotowania do egzaminu

Zestaw pytań, który przeszedł te testy, to zestaw, na którym możesz ćwiczyć bez ponownego czytania rozdziału, żeby upewnić się, że każde pytanie jest prawdziwe. Odrzucona część to nie stracony wysiłek; to ta część każdej bazy pytań pisanej przez AI, z której uczyłby się student korzystający z niesprawdzanego narzędzia. Darmowy plan na tej stronie stosuje te same testy do każdego pytania, które pisze, a [strona z przykładami](https://meduniexam.com/pl/sample.md) pokazuje trzy, które przeszły, razem ze stroną, którą każde cytuje.

## Pytania, które zadają studenci

### Czy wysoki wskaźnik odrzuceń oznacza słaby model?

Sam z siebie nie. Model, który pisze ambitne opisy przypadków klinicznych, traci ich więcej na drugim modelu niż model piszący pytania o odtworzenie faktu, a długa seria z krótkiego rozdziału traci pytania na teście duplikatów, bo w rozdziale jest tylko tyle faktów. Wskaźnik jest własnością modelu, materiału i konkretnego zadania razem wziętych, i dlatego raport jest publikowany razem z liczbą, z której został policzony.

### Czy pytania, które przechodzą, są na pewno poprawne?

Nie. Testy wyłapują pytanie, którego cytatu nie ma na wskazanej stronie, pytanie, na które drugi model odpowiada inaczej niż klucz, pytanie powtarzające wcześniejsze oraz zestaw wad strukturalnych. Nie ocenią medycyny. Dlatego każde zachowane pytanie jest pokazane z cytatem i numerem strony, żeby student mógł przeczytać zdanie, z którego pytanie powstało.

### Dlaczego powtórzone pytanie liczy się jako odrzucenie?

Bo generator poproszony o czterdzieści pytań z dwunastostronicowego materiału powtórzy te same dwanaście faktów innymi słowami, jeśli nic go nie zatrzyma. Każde nowe pytanie jest porównywane ze wszystkim, co już powstało z dokumentu, a prawie powtórzenie odpada, zamiast trafić do studenta jako nowe ćwiczenie.

### Gdzie są surowe dane?

Strona ze wskaźnikami odrzuceń publikuje raport według rodziny modeli i według toru, razem z plikiem CSV do pobrania, a liczby na tej stronie są czytane z tego samego raportu. Dziennik wywołań jest prowadzony od 14 września 2026.

[Wypróbuj na własnym pliku PDF](https://meduniexam.com/#/?lang=pl)

[Zobacz wskaźniki według modelu](https://meduniexam.com/pl/stats/rejections.md)

Żeby spróbować, konto nie jest potrzebne. Rejestracja zachowuje bibliotekę, oceny i kolejkę powtórek na wszystkich urządzeniach.

## Powiązane strony

- [Wskaźniki odrzuceń](https://meduniexam.com/pl/stats/rejections.md): Publikowane wskaźniki odrzuceń dla każdej rodziny modeli z ostatnich 30 dni, z liczbą N i plikiem CSV do pobrania.
- [Jak to działa](https://meduniexam.com/pl/how-it-works.md): Proces weryfikacji krok po kroku, razem z tym, co jest odrzucane i dlaczego.
- [Artykuły](https://meduniexam.com/pl/blog.md): Spis artykułów: wszystkie wpisy, najnowsze na górze.
- [Ile pytań ćwiczeniowych dziennie wystarczy](https://meduniexam.com/pl/blog/how-many-practice-questions-per-day.md): Dzienny cel pytań ćwiczeniowych wyznaczony przez to, ile różnych pytań udźwignie Twój własny materiał; policzony na tej stronie wskaźnik powtórzeń 17,6 procent wyznacza granicę, za którą ćwiczenie zmienia się w ponowne czytanie.
- [Plan powtórek rozłożonych w czasie: 3 tygodnie do egzaminu](https://meduniexam.com/pl/blog/spaced-repetition-three-weeks-before-exam.md): Jak zbudować plan powtórek rozłożonych w czasie do egzaminu za trzy albo cztery tygodnie: licz sesje wstecz od daty, z każdej powtórki zrób próbę przypomnienia i pozwól pytaniom, w których się pomyliłeś, wybrać następną sesję.
