وحدة 8 / 11

إنتاج الأسئلة والامتحانات

المكاسب:

  • القدرة على جعل الذكاء الاصطناعي ينتج أسئلة الاختيار من متعدد، والمشتتات بناءً على الأخطاء النموذجية، ومفاتيح الحل من خلال تحديد الموضوع والمستوى وتوزيع الصعوبة.
  • القدرة على اكتشاف المفتاح الخاطئ وأخطاء الخيارات الصحيحة المتعددة/الصفر من خلال التحقق بشكل مستقل من صحة كل سؤال ومفتاح إجابة، ويفضل أن يكون ذلك بشكل مجمّع باستخدام SymPy
  • القدرة على تقييم جودة المتشتتات وعدم الغموض وصعوبة التوازن في الأسئلة والموافقة على كل سؤال قبل إجراء الامتحان.

يعد إعداد أسئلة الاختبار والتدريب أحد أكثر المهام استهلاكًا للوقت في تعليم الرياضيات: حيث يستغرق تحديد الأسئلة ذات الصعوبة المناسبة، وتصميم عوامل التشتيت المعقولة (خيارات خاطئة ولكن معقولة)، وإعداد مفتاح الإجابة، وموازنة الصعوبة ساعات. يمكن للذكاء الاصطناعي تسريع هذه العملية، حيث يقوم بإنشاء العشرات من أشكال الأسئلة المختلفة وخيارات الاختيار المتعدد ومفاتيح الحلول من موضوع واحد. ولكن يجب التحقق بشكل مستقل من دقة كل سؤال يتم طرحه وخلو كل مفتاح إجابة من الأخطاء؛ المفتاح غير الصحيح يعني أن الطلاب يفقدون النقاط بشكل غير عادل. ستتعلم في هذه الوحدة كيفية استخدام الذكاء الاصطناعي كشريك في توليد الأسئلة وكيفية إدارة كل سؤال.

بعض التعاريف. المُشتت هو خيار في سؤال الاختيار من متعدد وهو غير صحيح ولكنه يتوافق مع خطأ شائع قد يقع فيه الطالب. إن المُشتت الجيد ليس عشوائيًا؛ يعكس خطأً نموذجيًا (خطأ في التوقيع، ارتباك في القواعد). مفتاح الإجابة هو قائمة الإجابات الصحيحة على الأسئلة. توازن الصعوبة هو التوزيع المناسب للأسئلة السهلة والمتوسطة الصعوبة في الاختبار.

مساهمة الذكاء الاصطناعي في توليد الأسئلة

  • تنويع السؤال: أسئلة متعددة متشابهة من نمط (تغيير الأرقام).
  • تصميم التشتيت: اختيارات غير صحيحة بشكل معقول بناءً على أخطاء شائعة.
  • مخطط مفتاح الحل: حل خطوة بخطوة لكل مشكلة.
  • تصنيف الصعوبة: تصنيف الأسئلة إلى سهلة/متوسطة/صعبة.
  • تغطية الموضوع: مجموعة من الأسئلة تغطي موضوعات فرعية مختلفة من المنهج.
  • ملاءمة تصنيف بلوم: السؤال وفق المستويات المعرفية مثل التذكر والتطبيق والتحليل.

خطوة بخطوة: توليد مجموعة موثوقة من الأسئلة

1. تحديد الموضوع والمستوى وعدد الأسئلة. مثل "الصف العاشر الثانوي، المعادلات التربيعية، 10 أسئلة متعددة الاختيارات."

2. اسأل عن نوع السؤال وتوزيع الصعوبة. اطلب توزيعًا مثل "4 سهل، 4 متوسط، 2 صعب".

3. حل كل سؤال على حدة. قم بحل كل سؤال بنفسك أو باستخدام SymPy؛ قارنه بمفتاح الإجابة المقدم من YZ. هذه الخطوة غير قابلة للتفاوض.

4. تحقق من وجود عناصر تشتيت الانتباه. هل الخيارات الخاطئة خاطئة حقًا؟ في بعض الأحيان يُنتج الذكاء الاصطناعي أكثر من خيار صحيح، أو يكون المُشتت صحيحًا بالفعل. تحقق من كل خيار.

5. ضمان وجود إجابة واحدة صحيحة بالضبط. في الاختيار المتعدد، يجب أن يكون هناك خيار واحد صحيحًا؛ يجب ألا يكون هناك صفر أو أكثر من واحد صحيح.

6. التحقق من عدم اليقين والازدواجية. هل السؤال أحادي؟ هل السؤالان يقيسان نفس الشيء؟ هل الأرقام معقولة (على سبيل المثال، إذا كان الجذر سالبًا)؟

انتبه: يرتكب الذكاء الاصطناعي خطأين شائعين عند إنشاء أسئلة الاختيار من متعدد: (1) الخيار الذي تم وضع علامة "صحيح" عليه هو في الواقع خطأ، (2) أكثر من خيار واحد صحيح، أو لا شيء منهم صحيح. لا تستخدم أي سؤال دون حل كل سؤال بشكل مستقل وتقييم كل خيار من الخيارات الأربعة بشكل منفصل على أنه صحيح/خطأ.

سؤال مخطط مراقبة الجودة

التحكم

سؤال

ما الذي تبحث عنه

الدقة

هل مفتاح الإجابة صحيح؟

التأكيد عن طريق الحل المستقل

صحيح فقط

هل خيار واحد فقط صحيح؟

يجب أن تكون الثلاثة الأخرى خاطئة

نوعية التشتيت

هل الأخطاء معقولة؟

ينبغي أن يستند إلى خطأ نموذجي

الوضوح

هل السؤال أحادي؟

لا ينبغي أن يكون هناك عدم اليقين

الامتثال المستوى

هل الصعوبة مناسبة للهدف؟

ليست سهلة للغاية ولا صعبة للغاية

النطاق

هل تم تمثيل الموضوع بشكل جيد؟

المواضيع الفرعية متوازنة

ثلاث حالات صغيرة

الحالة 1 - مفتاح خاطئ. أنتج المعلم مجموعة اختيارات متعددة مكونة من 12 سؤالًا. عندما قام بحل كل سؤال باستخدام SymPy، وجد أنه في 3 من الأسئلة الـ 12، كان الخيار الذي حدده الذكاء الاصطناعي بـ "صحيح" غير صحيح - وكانت الإجابة الصحيحة الفعلية خيارًا آخر. قام المعلم بتسوية المفاتيح. إذا تم استخدام هذه المجموعة دون التحقق، فسيتم تقييم الفصل بأكمله بشكل غير عادل في 3 أسئلة.

الحالة 2 - خياران صحيحان. في أحد الأسئلة، أدخل الذكاء الاصطناعي كلا من "x = 2" و"x = 2 أو x = −2"؛ كلاهما كان صحيحا إلى حد ما، وكان السؤال غير واضح. أعاد المعلم ترتيب الخيارات وترك إجابة واحدة صحيحة فقط. يجب أن تكون المُشتتات غير صحيحة بشكل واضح.

الحالة 3 - إلهاء ضعيف. في فصل الهندسة، يضع الذكاء الاصطناعي عناصر تشتيت غير ذات صلة مثل "42" و"أكساراي" و"أزرق" و"17" وما إلى ذلك في سؤال؛ من الواضح أن الإجابة الصحيحة كانت "17". سأل المعلم عن عوامل تشتيت رقمية بناءً على أخطاء حسابية نموذجية (على سبيل المثال، القيمة الناتجة عن خطأ في الإشارة)، وأصبحت الأسئلة تمييزية حقيقية. يمثل الإلهاء الجيد طريقًا خاطئًا حقيقيًا.

أربعة قوالب قابلة للنسخ

1) مجموعة أسئلة الاختيار من متعدد:

قم بإنشاء [n] أسئلة الاختيار من متعدد حول [الموضوع]. المستوى: [المستوى]. الصعوبة: [x سهل، y متوسط، z صعب]. ليكن لكل سؤال 4 خيارات؛ دع بالضبط 1 يكون صحيحًا والثلاثة الأخرى هي عوامل تشتيت معقولة بناءً على أخطاء نموذجية. اكتب أيضًا الحل خطوة بخطوة والإجابة الصحيحة لكل سؤال. سأقوم بالتحقق منها جميعًا باستخدام SymPy.

2) اختلاف السؤال (من النمط):

خذ هذا السؤال كنموذج: [نموذج سؤال]. قم بإنشاء [n] إصدارات مختلفة تقيس نفس المفهوم ولكن بأرقام/سياق مختلف. حل الإجابات لكل إصدار خطوة بخطوة. دع الإجابات تكون مختلفة عن بعضها البعض.

3) توليد مفتاح الحل:

قم بإنتاج حل خطوة بخطوة وإجابة نهائية لكل سؤال من الأسئلة أدناه. حدد القاعدة التي تستخدمها. ضع علامة على الحل الذي لست متأكدًا منه؛ سأتحقق من كل إجابة بشكل مستقل. الأسئلة: [هنا]

4) تحسين التشتيت:

قم بمراجعة عوامل التشتيت لسؤال الاختيار من متعدد هذا. اشرح ما هو خطأ الطالب النموذجي الذي يتوافق مع كل مشتت غير صحيح. استبدل عوامل التشتيت غير الصحيحة أو غير ذات الصلة بأخرى مبنية على أخطاء فعلية. السؤال: [هنا]

موجه ضعيف / موجه قوي

ضعيف: "اطرح لي 10 أسئلة مشتقة."
النتيجة: مستوى غير مؤكد، توزيع عشوائي للصعوبة، مفتاح إجابة لم يتم التحقق منه، مجموعة عشوائية من المشتتات (إن وجدت).
قوي: "أنتج 10 أسئلة مشتقة متعددة الاختيارات للصف الثاني عشر من المدرسة الثانوية: 4 سهلة (قواعد أساسية)، 4 متوسطة (قاعدة السلسلة/المنتج)، 2 صعبة (وظائف مركبة). فليكن هناك 4 اختيارات في كل سؤال، واحد بالضبط صحيح، والأخرى عبارة عن مشتتات تعتمد على أخطاء نموذجية (نسيان المشتق الداخلي، خطأ في الإشارة). قم بحل كل سؤال خطوة بخطوة وحدد الإجابة الصحيحة."
النتيجة: مجموعة مستوية ومتوازنة ومشتتات ذات معنى وكل إجابة قابلة للتدقيق.

الأخطاء الشائعة

  • عدم التحقق من مفتاح الإجابة. ما يقوله الذكاء الاصطناعي "صحيح" غالبًا ما يكون خاطئًا؛ حل كل سؤال بشكل مستقل.
  • أكثر من واحد/صفر هو الخيار الصحيح. في الاختيار المتعدد يجب أن تكون هناك حقيقة واحدة بالضبط؛ تحقق من كل خيار على حدة.
  • عوامل تشتيت انتباه ضعيفة. الخيارات غير ذات الصلة أو غير الصحيحة بشكل واضح تجعل السؤال غير مميز.
  • عدم تحديد توزيع الصعوبة. يبدو أنهم جميعا نفس الصعوبة. لا يمكن إجراء تقييم المستوى.
  • التكرار والتداخل. قد تقيس الأسئلة المختلفة نفس المفهوم؛ التحقق من رصيد التغطية.
  • تعبير غامض. الأسئلة ذات المعاني المزدوجة تضلل الطلاب بشكل غير عادل.
نصيحة: الطريقة الأكثر فعالية للتحقق من صحة مجموعة من الأسئلة هي كتابة التعليمات البرمجية التي تحل جميع الأسئلة مرة واحدة باستخدام SymPy. أخبر الذكاء الاصطناعي "بكتابة التعليمات البرمجية التي تحل كل مشكلة من هذه المشكلات العشرة باستخدام SymPy"، وتشغيل التعليمات البرمجية، ومقارنة نتائج SymPy بشكل مجمّع مع مفتاح الإجابة الخاص بالذكاء الاصطناعي. بهذه الطريقة، يمكنك التحقق من الأسئلة العشرة، ليس واحدًا تلو الآخر، ولكن بشكل جماعي وحتمي.

في ملخص

يعمل الذكاء الاصطناعي على تسريع عملية إنشاء الأسئلة والاختبارات الرياضية بشكل كبير: تنوع الأسئلة، وتصميم التشتيت، ومفتاح الحل، وتقييم الصعوبة. ولكن يجب التحقق من صحة كل سؤال وكل مفتاح إجابة بشكل مستقل - ويفضل التحقق منه بشكل مجمّع باستخدام SymPy. الأخطاء الأكثر شيوعًا هي مفتاح الإجابة الخاطئ، والخيارات الصحيحة المتعددة/الصفر، والمشتتات الضعيفة. تحديد الموضوع والمستوى وتوزيع الصعوبة من البداية يزيد من الجودة. أي أسئلة لم يتم التحقق منها لا ينبغي أن تدخل الامتحان.

مهمة التطبيق

اختر موضوعا. اطلب من الذكاء الاصطناعي إنتاج 8-10 أسئلة متعددة الاختيارات + حلول مع توزيع صعوبة معينة باستخدام القالب الأول. بعد ذلك، تذكر من الوحدة 4، اطلب من الذكاء الاصطناعي كتابة رمز يحل جميع الأسئلة باستخدام SymPy وتشغيل الكود. قارن نتائج SymPy مع مفتاح الإجابة الخاص بـ YZ. تأكد من وجود اختيار واحد صحيح في كل سؤال وأن عوامل التشتيت غير صحيحة بالفعل. ابحث عن خطأ واحد أو مصدر تشتيت ضعيف على الأقل وقم بتصحيحه.

قائمة مرجعية

  • [ ] لقد ذكرت بوضوح الموضوع والمستوى وتوزيع الصعوبة.
  • [ ] لقد قمت بحل كل سؤال بشكل مستقل (يفضل أن يكون ذلك دفعة واحدة مع SymPy).
  • [ ] لقد قمت بمقارنة مفتاح الإجابة بنتائج SymPy.
  • [ ] لقد تأكدت من وجود خيار واحد صحيح في كل سؤال.
  • [ ] لقد تأكدت من أن أدوات التشتيت كانت مبنية على أخطاء نموذجية وكانت خاطئة بالفعل.
  • [ ] لقد تأكدت من عدم وجود عبارات غامضة وعدم وجود أسئلة متكررة.