רווחים:
- היכולת לבינה מלאכותית מייצרת שאלות ברירות רבות, הסחות דעת המבוססות על שגיאות טיפוסיות ומפתחות פתרון על ידי ציון נושא, רמה וחלוקת קושי.
- יכולת לתפוס מפתח שגוי ומספר רב/אפס שגיאות אפשרויות נכונות על ידי אימות עצמאי של כל מפתח שאלה ותשובה, רצוי בכמות גדולה, עם SymPy
- יכולת להעריך את איכות המסיחים, את חד הבהירות ואיזון הקושי של שאלות, ולאשר כל שאלה לפני הבחינה.
הכנת שאלות לבחינה ותרגול היא אחת המשימות הגוזלות זמן רב בחינוך המתמטי: הגדרת שאלות בעלות קושי מתאים, עיצוב מסיחים סבירים (אפשרויות שגויות אך סבירות), הכנת מפתח התשובה וקושי האיזון נמשכים שעות. בינה מלאכותית יכולה להאיץ את התהליך הזה - לייצר עשרות וריאציות של שאלות, אפשרויות בחירה מרובות ומפתחות פתרון מנושא אחד. אבל יש לוודא את הדיוק של כל שאלה המופקת ואת חוסר השגיאות של כל מפתח תשובה באופן עצמאי; מפתח שגוי פירושו שהתלמידים מאבדים נקודות באופן לא הוגן. ביחידה זו תלמדו כיצד להשתמש בבינה מלאכותית כשותף ליצירת שאלות וכיצד להנחות כל שאלה.
כמה הגדרות. מסיח הוא אופציה בשאלה מרובה בחירה שאינה נכונה אך מתאימה לטעות נפוצה שהתלמיד עשוי לעשות. מסיח טוב אינו אקראי; משקף שגיאה אופיינית (שגיאת סימן, בלבול כללים). מפתח התשובה הוא רשימה של תשובות נכונות לשאלות. איזון קושי הוא החלוקה המתאימה של שאלות קלות-בינוניות-קשות בבחינה.
תרומה של AI ליצירת שאלות
- וריאציה של שאלות: מספר שאלות דומות מתבנית (שינוי המספרים).
- עיצוב מסיחים: בחירות שגויות מן הסתם המבוססות על שגיאות נפוצות.
- מתווה מפתח פתרון: פתרון שלב אחר שלב לכל בעיה.
- דירוג קושי: סיווג שאלות קלות/בינוניות/קשות.
- כיסוי נושא: קבוצות של שאלות המכסות תת-נושאים שונים של סילבוס.
- התאמה לטקסונומיה של בלום: שאלה לפי רמות קוגניטיביות כמו זכירה, יישום, ניתוח.
שלב אחר שלב: יצירת מערך אמין של שאלות
1. ציין את הנושא, הרמה ומספר השאלות. כמו "תיכון כיתה י', משוואות ריבועיות, 10 שאלות ברירות רבות".
2. בקשו את סוג השאלה וחלוקת הקושי. בקשו חלוקה כמו "4 קלים, 4 בינוניים, 2 קשים".
3. פתרו כל שאלה באופן עצמאי. פתרו כל שאלה בעצמכם או באמצעות SymPy; השווה אותו עם מפתח התשובה שסופק על ידי YZ. שלב זה אינו נתון למשא ומתן.
4. בדוק אם יש מסיחים. האם אופציות שגויות באמת שגויות? לפעמים הבינה המלאכותית מייצרת יותר מאפשרות נכונה אחת, או שמסיח דעת הוא למעשה נכון. סמן כל אפשרות.
5. מבטיחים שיש בדיוק תשובה אחת נכונה. בבחירה מרובה, בדיוק אפשרות אחת חייבת להיות נכונה; אסור שיהיה אפס או יותר מאחד נכון.
6. בדקו אי ודאות וכפילות. האם השאלה חד משמעית? האם שתי השאלות מודדות אותו דבר? האם המספרים סבירים (למשל אם השורש צריך להיות שלילי)?
שימו לב: בינה מלאכותית עושה שתי טעויות נפוצות ביותר בעת יצירת שאלות מרובות בחירה: (1) האפשרות שסימנה כ"נכון" היא למעשה שגויה, (2) יותר מאפשרות אחת נכונה, או שאף אחת מהן לא נכונה. אל תשתמש בשום שאלה מבלי לפתור כל שאלה באופן עצמאי ולהעריך כל אחת מארבע האפשרויות בנפרד כאמת/לא נכון.
תרשים בקרת איכות שאלה
שליטה
שאלה
מה לחפש
דיוק
האם מקש התשובה נכון?
אישור על ידי פתרון עצמאי
רק נכון
האם רק אפשרות 1 נכונה?
3 האחרים בטח טועים
איכות מסיחים
האם הטעויות סבירות?
צריך להתבסס על שגיאה טיפוסית
בהירות
האם השאלה חד משמעית?
לא צריכה להיות אי ודאות
עמידה ברמות
האם הקושי מתאים למטרה?
לא קל מדי ולא קשה מדי
היקף
האם הנושא מיוצג היטב?
נושאי המשנה מאוזנים
שלושה מיני תיקים
מקרה 1 - מפתח שגוי. מורה הפיק מערך ברירות מרובות של 12 שאלות. כאשר הוא פתר כל שאלה עם SymPy, הוא גילה שב-3 מתוך 12 השאלות, האפשרות שה-AI סימן "נכונה" הייתה שגויה - התשובה הנכונה בפועל הייתה אפשרות נוספת. המורה יישר את המפתחות. אם נעשה שימוש בסט זה ללא אימות, כל הכיתה הייתה מוערכת בצורה לא הוגנת ב-3 שאלות.
מקרה 2 - שתי אפשרויות נכונות. בשאלה אחת, ה-AI הכניס גם "x = 2" וגם "x = 2 או x = -2"; שניהם היו נכונים במובן מסוים, והשאלה לא הייתה ברורה. המורה סידרה מחדש את האפשרויות והשאירה רק תשובה אחת נכונה. המסיחים חייבים להיות שגויים בעליל.
מקרה 3 - מסיח דעת חלש. בשיעור הנדסה, ה-AI הציב מסיחי דעת לא רלוונטיים כמו "42", "aksaray", "כחול", "17" וכו' בשאלה; התשובה הנכונה הייתה ללא ספק "17". המורה ביקשה מסיחים מספריים על סמך טעויות חישוב טיפוסיות (למשל, ערך הנובע משגיאת סימן), והשאלות הפכו למבדילות אמיתיות. המסיח הטוב מייצג נתיב שקרי אמיתי.
ארבע תבניות הניתנות להעתקה
1) ערכת שאלות מרובות:
צור [n] שאלות ריבוי בחירה בנושא [נושא]. רמה: [רמה]. קושי: [x קל, y בינוני, z קשה]. לכל שאלה יהיו 4 אפשרויות; תן בדיוק 1 להיות נכון ו-3 האחרים הם מסיחים סבירים המבוססים על שגיאות אופייניות. כתבו גם פתרון שלב אחר שלב ותשובה נכונה לכל שאלה. אני אאמת את כולם עם SymPy.
2) וריאציה של שאלה (מתוך דפוס):
קח את השאלה הזו כתבנית: [שאלה לדוגמה]. צור [n] גרסאות שונות המודדות את אותו מושג אך עם מספרים/הקשר משתנים. פתרו את התשובות עבור כל גרסה צעד אחר צעד. תן לתשובות להיות שונות זו מזו.
3) יצירת מפתח פתרון:
הפק פתרון שלב אחר שלב ותשובה סופית לכל אחת מהשאלות שלהלן. ציין את הכלל שבו אתה משתמש. סמן את הפתרון שאינך בטוח בו; אני אאמת כל תשובה באופן עצמאי. שאלות: [כאן]
4) שיפור מסיחים:
סקור את המסיחים לשאלה מרובת ברירה זו. הסבר לאיזו שגיאה טיפוסית של תלמיד מתאים כל מסיח שגוי. החלף מסיחים לא רלוונטיים או שגויים ברורים בגורמים המבוססים על שגיאות בפועל. שאלה: [כאן]
הנחיה חלשה / הנחיה חזקה
חלש: "תעשה לי 10 שאלות נגזרות".
תוצאה: רמה לא בטוחה, חלוקת קושי אקראית, מפתח תשובה לא מאומת, קבוצה אקראית של מסיחים (אם יש).
חזק: "הפק 10 שאלות נגזרות ברירות רבות לכיתה י"ב בתיכון: 4 קלות (כללים בסיסיים), 4 בינוניות (כלל שרשרת/מוצר), 2 קשות (פונקציות מורכבות). בכל שאלה יהיו 4 אפשרויות בחירה, בדיוק אחת נכונה, האחרות מסיחים על סמך שגיאות אופייניות (שוכחים את הנגזרת הפנימית, פתרו כל שאלה שלב שלב ופתרו את השגיאה של סימן שלב).
תוצאה: מערך ברמה, מאוזנת, מסיחים משמעות וכל תשובה ניתנת לביקורת.
טעויות נפוצות
- לא מאמת את מפתח התשובה. מה ש-AI אומר הוא "נכון" הוא לעתים קרובות שגוי; פתרו כל שאלה באופן עצמאי.
- יותר מאחד/אפס היא האפשרות הנכונה. בבחירה מרובה חייבת להיות אמת אחת בדיוק; סמן כל אפשרות בנפרד.
- מסיחים חלשים. אפשרויות לא רלוונטיות או שגויות בעליל הופכות את השאלה לבלתי מובחנת.
- לא מפרט את התפלגות הקושי. כולם נראים כאותו קושי; לא ניתן לבצע הערכת רמה.
- חזרה וחפיפה. שאלות שונות עשויות למדוד את אותו מושג; בדוק את יתרת הכיסוי.
- ביטוי מעורפל. שאלות בעלות משמעויות כפולות מטעות את התלמידים בצורה בלתי הוגנת.
טיפ: הדרך היעילה ביותר לאמת קבוצת שאלות היא לכתוב קוד שפותר את כל השאלות בבת אחת עם SymPy. אמור ל-AI "כתוב קוד שפותר כל אחת מ-10 הבעיות הללו עם SymPy", הרץ את הקוד והשווה בכמות גדולה את תוצאות SymPy עם מפתח התשובה של ה-AI. בדרך זו, אתה בודק את 10 השאלות לא אחת אחת, אלא באופן קולקטיבי ודטרמיניסטי.
לסיכום
בינה מלאכותית מזרזת באופן דרמטי את יצירת שאלות ובחינות במתמטיקה: שונות של שאלות, עיצוב מסיחים, מפתח פתרון, דירוג קושי. אבל כל שאלה וכל מפתח תשובה חייבים להיות מאומתים באופן עצמאי - רצוי לאמת בתפזורת עם SymPy. השגיאות הנפוצות ביותר הן מקש תשובה שגוי, ריבוי/אפס אפשרויות נכונות ומסיחים חלשים. ציון הנושא, הרמה וחלוקת הקושי מההתחלה מעלה את האיכות. שאלות לא מאומתות לא אמורות להיכנס לבחינה.
משימת יישום
בחר נושא. בקש מה-AI לייצר 8-10 שאלות מרובות + פתרונות עם התפלגות קושי מסוימת עם התבנית הראשונה. לאחר מכן, כזכור מיחידה 4, בקש מה-AI לכתוב קוד שפותר את כל השאלות עם SymPy ולהריץ את הקוד. השווה תוצאות SymPy עם מפתח התשובה של YZ. ודא שבכל שאלה יש בדיוק בחירה נכונה אחת ושהמסיחים למעשה לא נכונים. מצא ותקן לפחות שגיאה אחת או מסיח מסיח חלש.
רשימת בדיקה
- [ ] ציינתי בבירור את הנושא, רמת וחלוקת הקושי.
- [ ] פתרתי כל שאלה באופן עצמאי (רצוי אצווה עם SymPy).
- [ ] השוויתי את מפתח התשובה עם תוצאות SymPy.
- [ ] וידאתי שיש בדיוק אפשרות אחת נכונה בכל שאלה.
- [ ] בדקתי שהמסיחים התבססו על שגיאות אופייניות ובעצם היו שגויים.
- [ ] וידאתי שאין הצהרות מעורפלות ואין שאלות שחוזרות על עצמן.