كيف تحوّل ملاحظاتك إلى أسئلة تدريب تستحق الإجابة
الحصول على أسئلة تدريب صالحة من محاضرة واحدة يكلف نحو أربع عشرة دقيقة قبل أن تجيب عن أي شيء، ومعظم ذلك أنت تكتب ثلاثة أسئلة بخط يدك لتضع معيارًا. والتوليد يستغرق دقيقتين، ومثلهما الفحص الذي يقرر هل تستحق المجموعة الإجابة عنها. والتجربة العملية في آخر هذا المقال تستغرق خمسين دقيقة من أولها إلى آخرها، لأن الإجابة عن الأسئلة على البارد وقراءة الأخطاء هي الجزء الذي يعلّمك شيئًا. تجاوز الفحص وستدرس ما خمّنه النموذج. وقد وضعت مراجعة منهجية نُشرت في مايو 2026 معدل الخطأ عبر 71 دراسة بين أقل من 1 بالمئة و45 بالمئة.
اكتب ثلاثة بخط اليد أولًا، ثم لا تعد إلى ذلك أبدًا
افتح العرض. جد ثلاثة سطور تستطيع وحدها أن تحسم إجابة: آلية، أو عتبة، أو دواء خط أول، أو موجودة مميزة. ابنِ من كل واحد سؤالًا بخمسة خيارات وإجابة صحيحة واحدة. عشر دقائق، وتكون قد انتهيت من الكتابة اليدوية إلى الأبد.
وتلك العشر دقائق تشتري لك معيارًا. فبعد أن كتبت ثلاثة، تعرف أن المقدمة الصالحة تسأل شيئًا تستطيع الإجابة عنه والخيارات مغطاة، وأن الخيارات الخمسة يجب أن تكون من النوع نفسه وبالصيغة النحوية نفسها، وأن جملة واحدة بالضبط في مصدرك يجب أن تحسم الإجابة. وتتعلم أيضًا كم هي بطيئة، ولهذا لا أحد يكتب أربعين.
احتفظ بالثلاثة. فهي تصير مرجعك لكل ما يسلّمك إياه نموذج لاحقًا، وحين يبدو سؤال مولَّد خاطئًا ولا تستطيع أن تقول لماذا، فإن وضعه بجوار واحد من أسئلتك يحدد المشكلة عادة في الخيارات.
ماذا تطلب، بالكلمات التي تغيّر المخرجات
جملة "اختبرني في هذا" تعطيك معلومات متفرقة عن المستند بدل أسئلة عن الموضوع. وستة أوامر تغيّر ما يعود إليك. الصقها فوق نصك، مع تغيير العدد والموضوع.
استخدم النص أدناه فقط. اكتب 12 سؤالًا من نوع أفضل إجابة واحدة في فيزيولوجيا القلب والأوعية للسنة الثانية، لكل سؤال خمسة خيارات وإجابة صحيحة واحدة بالضبط. وبعد كل سؤال، اطبع الجملة الحرفية من النص التي تجعل الإجابة صحيحة، ورقم الصفحة أو الشريحة التي تقع فيها. ولا تكتب سؤالًا إلا إذا حسمت تلك الجملة وحدها الإجابة. ممنوع كل ما سبق، وممنوع لا شيء مما سبق، وممنوع مقدمات أي مما يلي صحيح. وأبقِ الخيارات الخمسة بالطول نفسه والصيغة النحوية نفسها.
- استخدم النص أدناه فقط. إن أغفلت هذا، أجاب النموذج مما يعرفه أصلًا، وتدربت على مادة لم يدرّسها ممتحنك قط.
- اطبع الجملة الحرفية والصفحة. هذا البند أكثر الستة عملًا. فالاقتباسات التي يمكنك الرجوع إليها تحسم خلافًا مع مفتاح الإجابة في عشر ثوانٍ، والنموذج المُلزَم بإنتاج اقتباس يكتب ادعاءات أقل مما لا يستطيع إسناده.
- جملة واحدة يجب أن تحسم الأمر. وإلا حصلت على بنود تحتاج السطر المقتبس زائد ثلاث حقائق من مكان آخر، يستحيل فحصها ويظلم من يجيب عنها.
- سمِّ صيغة البند. قل "أسئلة" فقط وستأتيك أسئلة صح وخطأ وملء فراغ واسترجاع بسطر واحد مختلطة معًا.
- امنع المقدمتين. "كل ما سبق" و"أي مما يلي صحيح" هما أكثر العيوب التي تنتجها المولّدات، وكلاهما يختفي بمجرد أن تطلب ذلك.
- الطول نفسه والصيغة نفسها. كاتبو البنود يُسهبون في الخيار الذي يعرفون أنه الصحيح، والنموذج المدرَّب على إنتاجهم ينسخ العادة نفسها.
اطلب عددًا تحتمله مادتك. منشور العدد اليومي من الأسئلة يعدّ سطرًا سطرًا ويصل إلى ما يقارب عدد الشرائح، وهو عدد السطور القابلة للتحويل إلى بنود لا عدد الأسئلة التي تحتفظ بها. وعمليًا، عرض من 40 شريحة يعطي 15 إلى 20 سؤالًا تحتفظ بها، لأن طلب 50 يشتري في الغالب مكررات تزيلها الفحوص بعد ذلك.
ما الذي يعود خاطئًا، وكم مرة: 71 دراسة، بالعد
رقمان منشوران يضعان توقعًا منصفًا. فمراجعة منهجية في Postgraduate Medical Journal، نُشرت في 20 مايو 2026، جمعت 71 دراسة من 24 بلدًا عن أسئلة الاختيار من متعدد المكتوبة بالذكاء الاصطناعي في التعليم الطبي. وتراوحت معدلات الخطأ من أقل من 1 بالمئة إلى 45 بالمئة. وكان وسيط صعوبة البند 0.67 ووسيط التمييز 0.28، وهذا يصف بندًا يفصل الطلاب الذين يعرفون المادة عمن لا يعرفونها، لكن دون حدة. ومعظم تلك الدراسات حكمت على الأسئلة بمراجعة الخبراء لا بوضعها أمام متعلمين، وتخلص المراجعة إلى أن الأدلة لا تدعم بعد "unsupervised use in summative assessment".
أقدم وأصرح: أفادت Boston University's Chobanian and Avedisian School of Medicine في ديسمبر 2023 بأن ChatGPT أنتج سؤالًا صحيحًا بإجابة وشرح صحيحين في 32 بالمئة من الحالات حين طُلب منه كتابة بنود لامتحان كلية طب.
ورقم ثالث، من هذا الموقع، الذي يعدّ ما ترميه فحوصه وينشر العدد. قُرئ في 20 سبتمبر 2026: بين 14 سبتمبر، حيث يبدأ سجل الاستدعاءات، وذلك التاريخ، كتبت النماذج 3,564 سؤالًا عبر 1,398 استدعاء. ومنها نجا 43.1 بالمئة من كل شيء. وأزالت القواعد البنيوية 32.8 بالمئة، وفحص التكرار 13.5 بالمئة، ونموذج ثانٍ يجيب من الاقتباس دون المفتاح 6.7 بالمئة، و2.2 بالمئة إما اقتبست جملة لم يجدها الفاحص في الصفحة التي استشهدت بها وإما استشهدت بصفحة خارج القسم. أما الـ1.7 بالمئة الباقية فوصلت بعد أن كانت المهمة ممتلئة أصلًا أو عادت بصيغة لم يستطع المحلل قراءتها.
وهذه الحصص تتحرك مع كل مهمة، وحصة التكرار أكثرها تحركًا. فالمنشور الصادر قبل يوم واحد عدّها 17.6 بالمئة على نافذة أقصر، من 14 إلى 19 سبتمبر 2026؛ وهذه القراءة تعدّها 13.5 بالمئة على المدة من 14 إلى 20 سبتمبر 2026. وكلتاهما قراءة صحيحة للتقرير المتحرك نفسه، ولهذا تحمل صفحة معدلات الرفض الرقم المباشر، وكل ما سبق لقطة واحدة منه.
ومجتمعةً، لا تقول هذه الثلاثة تجنّب توليد الأسئلة. بل تقول إن قرابة نصف ما يعود إليك مكانه سلة المهملات، وقرارك الوحيد هو من يقوم بالرمي.
متى تتوقف عن الفحص، وكم يساوي السؤال الساقط
والفحوص الثلاثة التي تلتقط معظم ذلك مكتوبة أصلًا في الصفحة التي وراء تلك الأعداد: جد الجملة المقتبسة في مستندك، وغطِّ المفتاح وأجب من الاقتباس وحده، ثم اقرأ الخيارات الخمسة بلا المقدمة. نفّذها على الأسئلة الخمسة الأولى من مجموعة، دقيقة واحدة إجمالًا، ومقال الدقة يشرح ما يلتقطه كل فحص ولماذا.
وتلك الفحوص ليست من عندي. إنها من تصنيف صياغة البنود الذي وضعه المصدران: القواعد الـ31 التي وضعها Haladyna وDowning وRodriguez في Applied Measurement in Education عام 2002، والنسخة العملية التي تُعطى عادة لكاتبي البنود، وهي NBME Item-Writing Guide، وهو الآن في طبعته السادسة ونُشر في فبراير 2021.
وما لا تخبرك به تلك الصفحة هو متى تتوقف. وهذا هو الرقم: افحص الأسئلة الخمسة الأولى ولا أكثر. وعند سقوط اثنين من خمسة، توقف عن الفحص وارجع إلى التعليمات. فالمجموعة التي تسقط مرتين بهذه السرعة تسقط دائمًا تقريبًا لسبب واحد، والسبب الواحد يكون عادة سطرًا واحدًا في التعليمات، فشدّه وولّد من جديد بتكلفة دقيقتين. أما فحص الخمسة عشر كلها فيكلف عشرين دقيقة ويترك العيب نفسه في الدفعة التالية.
السؤال الذي يسقط في الفحص يذهب إلى سلة المهملات لا إلى الإصلاح. فإعادة كتابة مقدمة لا تحسم جملتها المقتبسة الإجابة تعني أن تقرر الإجابة بنفسك، وعندها تصير أنت كاتب البند ويكون النموذج قد أضاع أمسيتك. وما دام السقوط دون واحد من كل خمسة، ارمِ ذلك السؤال وأجب عن البقية.
والسؤال المرمي يكسب شيئًا مع ذلك. فقد فتحت الشريحة لتفحصه، أي أنك قرأت السطر الذي بُني عليه السؤال، بكلمات المصدر. اكتب ذلك السطر حيث تضع أخطاءك. فالسؤال الذي سقط في فحص والسؤال الذي أخطأت فيه ينتهيان إلى المكان نفسه، وهو بداية الغد.
النسخة التمريضية، وما لا تعطيه إياك شريحة المحاضرة
طلاب التمريض يصلون إلى هنا عادة بمهمة أضيق: استخراج بنود على نمط NCLEX من نشرة صفية. والموقف هو الجزء الناقص. فشريحة الفيزيولوجيا المرضية تسلّمك آلية، بينما يحتاج البند على نمط NCLEX إلى مريض وبيئة وبضع موجودات ومقدمة تسأل عن أولوية أو إجراء، مع أربعة خيارات كلها قابلة للدفاع وواحد منها الأفضل. ولا شيء من ذلك على الشريحة، فعلى التعليمات أن تضعه هناك.
أضف سطرًا: اكتب كل سؤال كسيناريو قصير لمريض في بيئة مستشفى، ينتهي بسؤال عن الإجراء الذي ينبغي للممرض أن يتخذه أولًا، واجعل الخيارات الأربعة كلها إجراءات تمريضية آمنة. وأضف فحصًا رابعًا لهذه الأسئلة: هل تحمل المقدمة معلومات كافية للاختيار بين الأربعة؟ فحيثما جاز لأي منها أن يكون الأول، لا يكون البند صعبًا بل بلا إجابة، وهو يعلّمك التخمين.
وما يتعذر تمامًا من نشرة: صيغ الجيل الجديد. فبنود دراسة الحالة والمصفوفة وربطة العنق والتظليل والقائمة المنسدلة مبنية حول بيانات مريض تتكشف تدريجيًا، ولها قواعد تقدير خاصة بها، ولا شيء مولَّد من عرض شرائح محاضرة ينتجها. ومن يبيعك ذلك من ملف PDF يبالغ في الادعاء. وصفحة NCLEX-RN هنا تقول الشيء نفسه. وهذا ليس بنك أسئلة NCLEX ولا صلة له بـNCSBN، وإنما تُكتب البنود بذلك النمط من الملف الذي ترفعه.
كيف تفعل ذلك بكميات كبيرة دون أن تغرق في أشباه المكررات
اطلب 60 سؤالًا من نشرة من 12 صفحة وستتلقى الحقائق الـ12 نفسها في 60 أزياء. ولا شيء في نافذة دردشة يمنع ذلك: فعند السؤال 47 يكون النموذج قد نسي السؤال 14، واكتشاف إعادة صياغة لشيء أجبت عنه قبل عشرين دقيقة أمر صعب.
ثلاث عادات تبقي الشوط الطويل نزيهًا. ولّد فصلًا واحدًا في كل مرة بدل وحدة كاملة، لأن المكررات تتجمع داخل المصدر الواحد. وغيّر نوع البند في المرور الثاني، فتصير أفضل إجابة واحدة حالة سريرية وتُختبر الحقيقة نفسها كاستدلال. وتصفّح المقدمات قبل الإجابة عن أي منها، لأن مكررًا يُلتقط مبكرًا لا يكلف شيئًا، ومكررًا يُلتقط عند السؤال 30 يكلفك الجلسة.
الآلات أفضل منك في هذا الجزء. فالمولّد الذي يقارن كل سؤال جديد بكل ما كُتب سابقًا من المستند نفسه يسقط شبه المكرر قبل أن تراه، وهذا هو معنى حالات الرفض بسبب التكرار المحسوبة أعلاه: أسئلة لم تصل إلى قارئ قط.
تجربة منفَّذة على عرض شرائح واحد من 40 شريحة
مساء الثلاثاء، محاضرة في أمراض القلب من 40 شريحة، في جلسة واحدة. وفيما يلي الأوقات التي تستغرقها فعلًا، لا التي تتمناها خطة.
- أول عشر دقائق. ثلاثة أسئلة بخط يدك، من شرائح تتذكر أن المحاضر تمهّل عندها.
- دقيقتان. الصق التعليمات فوق نص الشرائح واطلب 15 سؤالًا لا 50. فخمسة عشر هي تقريبًا ما تحتمله 40 شريحة بعد إخراج المكرر.
- دقيقتان أخريان. أجرِ الفحوص على البنود الخمسة الأولى. توقّع أن يسقط واحد أو اثنان. وعند سقوط اثنين، أصلح التعليمات وولّد من جديد، وهذا يكلفك دقيقتين ويوفّر عشرين.
- ثلاث وعشرون دقيقة. أجب عن الأسئلة الـ15 كلها على البارد، نحو 90 ثانية لكل سؤال، مع تغطية الخيارات حتى تلتزم بإجابة.
- ثلاث عشرة دقيقة. مع كل خطأ، افتح الشريحة التي يستشهد بها السؤال واقرأ السطر الذي جاء منه. انقله بكلمات المصدر، لا بخلاصتك أنت.
- غدًا. تلك الأخطاء تفتتح الجلسة التالية، قبل أي شيء جديد. وأين تعود في الأسابيع التالية هو موضوع جدول المراجعة المتباعدة.
خمسون دقيقة، و15 سؤالًا تستطيع الدفاع عنها، وقائمة بخط اليد بالحقائق التي هزمتك.
أسئلة يطرحها الناس
ما التعليمات التي تجعل ChatGPT يكتب أسئلة امتحان جيدة من ملاحظاتي؟
أربعة بنود تحمل القيمة كلها تقريبًا. قل له أن يستخدم النص الذي لصقته فقط، وسمِّ الصيغة بأنها أفضل إجابة واحدة بخمسة خيارات وإجابة صحيحة واحدة، واشترط الجملة الحرفية ورقم الصفحة اللذين يجعلان الإجابة صحيحة، وامنع مقدمات "كل ما سبق" و"أي مما يلي صحيح". وإضافة أن الجملة المقتبسة يجب أن تحسم الإجابة وحدها تزيل معظم ما تبقى.
ما مدى دقة أسئلة التدريب المولَّدة بالذكاء الاصطناعي؟
الدراسات المنشورة لا تعطي رقمًا واحدًا. فمراجعة منهجية لـ71 دراسة في Postgraduate Medical Journal، نُشرت في 20 مايو 2026، وجدت معدلات خطأ من أقل من 1 بالمئة إلى 45 بالمئة، وأفادت Boston University في ديسمبر 2023 بأن ChatGPT أنتج سؤالًا صحيحًا بإجابة وشرح صحيحين في 32 بالمئة من الحالات. وما يقرر حال مجموعتك أنت هو هل فحصها شيء أصلًا. وهذا الموقع ينشر ما ترميه فحوصه: قُرئ في 20 سبتمبر 2026 أن 43.1 بالمئة من 3,564 سؤال مولَّد نجت من كل فحص، وأن فحص التكرار يمثل 13.5 بالمئة من الباقي. وهذه الحصص تتحرك مع النافذة، فصفحة معدلات الرفض تحمل الرقم المباشر.
كم عدد أسئلة التدريب التي ينبغي أن أصنعها من محاضرة واحدة؟
بعدّ السطور القابلة للتحويل إلى بنود، يقترب عرض من 40 شريحة من سطر واحد لكل شريحة، لأن هذا عدد السطور التي تستطيع وحدها أن تحسم إجابة. وبعدّ الأسئلة التي تحتفظ بها بعد الفحص، يقترب العدد من 15 إلى 20، لأن ليس كل سطر قابل للتحويل ينجو. وطلب 50 لا يخلق حقائق أكثر، بل يعيد صياغة الحقائق نفسها بكلمات جديدة ثم يزيلها فحص التكرار. ولّد محاضرة واحدة في كل مرة وتوقف حين تكفّ الأسئلة الجديدة عن مفاجأتك.
متى أتوقف عن فحص مجموعة مولَّدة وأبدأ من جديد؟
افحص الأسئلة الخمسة الأولى وتوقف عندها. وعند سقوط اثنين من خمسة، ارجع إلى التعليمات بدل إصلاح المجموعة، لأن المجموعة التي تسقط مرتين بهذه السرعة تسقط عادة لسبب واحد، والسبب الواحد يكون عادة سطرًا واحدًا في التعليمات. وإعادة التوليد تكلف دقيقتين، أما إصلاح خمسة عشر سؤالًا واحدًا واحدًا فيكلف الأمسية كلها.
هل يستطيع الذكاء الاصطناعي كتابة أسئلة على نمط NCLEX من ملاحظات محاضراتي؟
يستطيع كتابة بنود سيناريو بذلك النمط إن طلبت منه بناء موقف لمريض مع مقدمة تسأل عن أولوية أو إجراء وأربعة خيارات آمنة، لأن شريحة المحاضرة تعطي الفيزيولوجيا المرضية ولا تعطي البيئة أبدًا. أما صيغ الجيل الجديد، أي دراسة الحالة والمصفوفة وربطة العنق والتظليل والقائمة المنسدلة، فلا يمكن إنتاجها من مستند. وهذا ليس بنك أسئلة NCLEX ولا صلة له بـNCSBN.
نُشرت .