# Les questions d’examen écrites par IA sont-elles exactes ? Ce que montrent des travaux réels

> Taux de rejet de vrais lots générés sur des manuels de médecine : combien de questions IA ratent la citation, la seconde réponse à l’aveugle ou les doublons.

Copie Markdown de https://meduniexam.com/fr/blog/how-accurate-are-ai-exam-questions (la page HTML), publiée par MedUni Exam. Publié le 16 septembre 2026. Guide du site pour les agents : https://meduniexam.com/llms.txt.

Écrit par [Nicholas](https://meduniexam.com/fr/about.md). Vérifié le 24 septembre 2026.

Every question this site writes is checked before a student sees it, and the checks keep a count. This is what the 10 days since September 14, 2026 of real jobs on medical textbooks, lecture decks and notes show: how many questions a model writes that cannot be traced to the page, that a second model answers differently, or that repeat one already written.

## Les chiffres, comptés dans le journal des appels

| What the checks counted | Share of questions written |
| --- | --- |
| Questions the models wrote | 6,183 in 2,459 calls |
| Kept, every check passed | 44.0% |
| Thrown out, all reasons | 56.0% |
| Citation absente de la page citée | 6.5% |
| Second model answered differently | 5.4% |
| Repeat of a question already written | 11.2% |
| Structural flaw (all of the above, a vague stem, an option that gives itself away) | 30.9% |

Counted from the call log over September 14, 2026 to September 24, 2026, refreshed twice an hour. The same report, split by model family and with a CSV, is on the [rejection rates page](https://meduniexam.com/fr/stats/rejections.md).

## Ce que signifie chaque rejet

**Citation introuvable sur la page citée.** Chaque question doit porter une ou deux phrases recopiées du document, avec la page où elles se trouvent. Le serveur cherche la phrase dans le texte enregistré de cette page. Si elle n’y est pas, le modèle a écrit une question sur quelque chose que le matériel ne dit pas, ou a mal retenu la formulation, et la question est écartée. C’est le contrôle qui attrape un fait inventé.

**Le second modèle a répondu autrement.** Un modèle d’une autre famille reçoit la question et les citations, et rien d’autre : pas de réponse attendue, pas de document. S’il ne peut pas arriver à la réponse attendue à partir des seules citations, les citations ne prouvent pas la réponse, et la question est écartée. C’est le contrôle qui attrape une question qui sonne juste avec une mauvaise réponse attendue, ou une réponse attendue que la citation ne soutient pas.

**Répétition d’une question déjà écrite.** Chaque nouvelle question est comparée à tout ce qui a déjà été généré à partir du document. Une quasi-répétition est écartée, si bien qu’une longue série donne des questions différentes plutôt que les mêmes faits reformulés.

**Défaut de structure.** « Toutes les réponses ci-dessus », « aucune des réponses ci-dessus », un énoncé qui demande quelle affirmation est vraie, une option visiblement plus longue que les autres, une question qui renvoie à « le texte ». Ce sont les indices que les examinateurs sont formés à supprimer, et ils sont supprimés ici par règle avant que les autres contrôles s’exécutent. Le [vérificateur de défauts de QCM](https://meduniexam.com/fr/tools/mcq-checker.md) applique les mêmes règles à toute question que vous collez.

## Pourquoi un générateur qui ne montre aucune citation ne peut pas vous dire son exactitude

Un outil qui vous remet un quiz sans la phrase dont vient chaque question n’a aucun moyen de compter combien de ses questions n’étaient pas étayées, parce que rien dans sa chaîne n’a regardé. Son exactitude est ce que vous trouvez en vérifiant les questions vous-même, c’est-à-dire le travail que vous essayiez de déléguer. La page d’aide d’un outil concurrent demande à ses utilisateurs de relire un quiz généré avant de s’y fier, ce qui est la chose honnête à dire quand rien n’a été vérifié. Les chiffres ci-dessus existent parce que la vérification a lieu avant que l’étudiant voie quoi que ce soit, et parce que ce qui a été écarté a été compté plutôt que discrètement supprimé.

## Comment vérifier vous-même une question d’IA en vingt secondes

1. **Retrouvez la phrase.** Si la question ne montre pas d’où elle vient, cherchez sa formule clé dans le document. Si la formule n’y est pas, la question ne vient pas de votre matériel.
2. **Cachez la réponse attendue et répondez à partir de la citation.** Lisez seulement la phrase citée et choisissez une option. Si la citation ne tranche pas, la question teste quelque chose que la citation ne dit pas.
3. **Regardez les options.** Une option bien plus longue que les autres, une option qui répète l’énoncé, « toutes les réponses ci-dessus » : chacun est un indice, et chacun est une raison de se méfier de la question, pas d’en apprendre quelque chose.

## Ce que cela signifie pour la préparation aux examens

Un ensemble de questions qui a survécu à ces contrôles est un ensemble sur lequel vous pouvez vous entraîner sans relire le chapitre pour vérifier que chacune est réelle. La part rejetée n’est pas un effort perdu ; c’est la part de n’importe quelle banque de questions générée par IA sur laquelle un étudiant utilisant un outil non vérifié aurait révisé. La formule gratuite de ce site applique les mêmes contrôles à chaque question qu’elle écrit, et la [page d’exemples](https://meduniexam.com/fr/sample.md) en montre trois qui ont survécu, avec la page que chacune cite.

## Les questions que posent les étudiants

### Un taux de rejet élevé signifie-t-il que le modèle est mauvais ?

Pas à lui seul. Un modèle qui écrit des vignettes cliniques ambitieuses en perd davantage face au second modèle qu’un modèle qui écrit des questions de rappel, et une longue série tirée d’un chapitre court perd des questions au contrôle des doublons parce que le chapitre ne contient qu’un nombre limité de faits. Le taux est une propriété du modèle, du matériel et de la série pris ensemble, c’est pourquoi le rapport est publié avec le nombre à partir duquel il a été compté.

### Les questions qui passent sont-elles garanties exactes ?

Non. Les contrôles attrapent une question dont la citation n’est pas sur la page qu’elle cite, une question à laquelle un second modèle répond autrement que la réponse attendue, une question qui en répète une précédente, et un ensemble de défauts de structure. Ils ne peuvent pas juger la médecine. C’est pourquoi chaque question conservée est montrée avec sa citation et son numéro de page, afin que l’étudiant puisse lire la ligne dont la question est tirée.

### Pourquoi une question répétée compte-t-elle comme un rejet ?

Parce qu’un générateur à qui l’on demande quarante questions à partir d’un polycopié de douze pages reformulera les mêmes douze faits si rien ne l’en empêche. Chaque nouvelle question est comparée à tout ce qui a déjà été écrit à partir du document, et une quasi-répétition est écartée plutôt que remise à l’étudiant comme un nouvel entraînement.

### Où sont les données brutes ?

La page des taux de rejet publie le rapport par famille de modèles et par voie avec un téléchargement CSV, et les chiffres de cette page sont lus dans le même rapport. Le journal des appels est tenu depuis le 14 septembre 2026.

[Essayer sur votre propre PDF](https://meduniexam.com/#/?lang=fr)

[Voir les taux par modèle](https://meduniexam.com/fr/stats/rejections.md)

Aucun compte n’est nécessaire pour l’essayer. L’inscription conserve votre bibliothèque, vos notes et votre file de révision sur tous vos appareils.

## Pages liées

- [Taux de rejet](https://meduniexam.com/fr/stats/rejections.md): Les taux de rejet publiés par famille de modèles sur les 30 derniers jours, avec le N et un téléchargement CSV.
- [Comment ça marche](https://meduniexam.com/fr/how-it-works.md): La chaîne de vérification, étape par étape, y compris ce qui est rejeté et pourquoi.
- [Articles](https://meduniexam.com/fr/blog.md): L’index des articles : tous les billets, du plus récent au plus ancien.
- [Combien de questions d’entraînement par jour suffisent](https://meduniexam.com/fr/blog/how-many-practice-questions-per-day.md): Un objectif quotidien de questions d’entraînement fixé par le nombre de questions distinctes que vos propres documents peuvent porter, avec le taux de répétition de 17,6 pour cent compté sur ce site comme repère de l’endroit où l’entraînement devient de la relecture.
- [Planning de répétition espacée : 3 semaines avant l’examen](https://meduniexam.com/fr/blog/spaced-repetition-three-weeks-before-exam.md): Comment bâtir un planning de répétition espacée pour un examen dans trois ou quatre semaines : comptez les séances à rebours depuis la date, faites de chaque répétition une tentative de rappel, et laissez les questions ratées choisir la séance suivante.
