Câștiguri:
- Capacitatea de a avea inteligența artificială să producă întrebări cu alegere multiplă, elemente de distracție bazate pe erori tipice și chei de soluție prin specificarea subiectului, nivelului și distribuției dificultăților.
- Abilitatea de a detecta cheia greșită și erori multiple/zero opțiuni corecte prin validarea independentă a fiecărei întrebări și cheie de răspuns, de preferință în bloc, cu SymPy
- Abilitatea de a evalua calitatea factorilor de distracție, neechivocitatea și echilibrul de dificultate a întrebărilor și de a aproba fiecare întrebare înainte de a susține examenul.
Pregătirea întrebărilor pentru examen și practică este una dintre sarcinile cele mai consumatoare de timp în educația matematică: stabilirea întrebărilor cu dificultate adecvată, proiectarea distractoarelor plauzibile (opțiuni greșite, dar plauzibile), pregătirea cheii de răspuns și echilibrarea dificultății durează ore întregi. Inteligența artificială poate accelera acest proces - generând zeci de variații de întrebări, opțiuni cu alegeri multiple și chei de soluție dintr-un singur subiect. Dar acuratețea fiecărei întrebări produse și lipsa erorilor fiecărei chei de răspuns trebuie verificate independent; O cheie incorectă înseamnă că elevii pierd puncte în mod nedrept. În această unitate veți învăța cum să utilizați AI ca partener de generare a întrebărilor și cum să moderați fiecare întrebare.
Câteva definiții. Un distractor este o opțiune într-o întrebare cu răspunsuri multiple care nu este corectă, dar corespunde unei greșeli comune pe care o poate face elevul. Un bun distractor nu este întâmplător; Reflectă o eroare tipică (eroarea semnului, confuzia regulilor). Cheia de răspuns este o listă de răspunsuri corecte la întrebări. Echilibrul de dificultate este distribuția adecvată a întrebărilor ușor-medii-dificile într-un examen.
Contribuția AI la generarea întrebărilor
- Variația întrebării: mai multe întrebări similare dintr-un model (schimbarea numerelor).
- Design distractor: alegeri plauzibil incorecte bazate pe erori comune.
- Schema cheie a soluției: soluție pas cu pas pentru fiecare problemă.
- Evaluare de dificultate: Clasificarea întrebărilor ca ușoare/medie/dificile.
- Acoperire subiect: seturi de întrebări care acoperă diferite subteme ale unei programe.
- Potrivire taxonomie Bloom: Întrebare în funcție de nivelurile cognitive, cum ar fi amintirea, aplicarea, analiza.
Pas cu pas: generarea unui set de întrebări de încredere
1. Specificați subiectul, nivelul și numărul de întrebări. De exemplu, „Liceu clasa a 10-a, ecuații patratice, 10 întrebări cu răspunsuri multiple”.
2. Solicitați tipul de întrebare și distribuția dificultăților. Cereți o distribuție de genul „4 ușoare, 4 medii, 2 greu”.
3. Rezolvați fiecare întrebare independent. Rezolvați fiecare întrebare singur sau cu SymPy; Comparați-l cu cheia de răspuns oferită de YZ. Acest pas nu este negociabil.
4. Verificați dacă există elemente de distracție. Sunt opțiunile greșite cu adevărat greșite? Uneori, AI-ul produce mai multe opțiuni corecte sau un distractor este de fapt corect. Verificați fiecare opțiune.
5. Garantați că există exact un răspuns corect. La alegere multiplă, exact o opțiune trebuie să fie corectă; Nu trebuie să existe zero sau mai multe corecte.
6. Verificați incertitudinea și duplicarea. Este întrebarea unică? Măsoară cele două întrebări același lucru? Sunt numerele rezonabile (de exemplu, dacă rădăcina ar trebui să fie negativă)?
Atenție: AI face două greșeli cele mai frecvente atunci când generează întrebări cu răspunsuri multiple: (1) opțiunea pe care a marcat-o drept „adevărat” este de fapt greșită, (2) mai multe opțiuni sunt corecte sau nici una dintre ele nu este corectă. Nu utilizați nicio întrebare fără a rezolva fiecare întrebare independent și a evalua fiecare dintre cele patru opțiuni separat ca adevărat/fals.
Întrebare diagramă de control al calității
control
Întrebare
ce să caute
precizie
Este corectă cheia de răspuns?
Confirmare prin soluție independentă
numai adevărat
Este corectă doar 1 opțiune?
Celelalte 3 trebuie să fie greșite
Calitatea distractorului
Sunt greșelile plauzibile?
Ar trebui să se bazeze pe o eroare tipică
Claritate
Este întrebarea unică?
Nu ar trebui să existe incertitudine
Nivel de conformitate
Este dificultatea adecvată scopului?
Nici prea ușor, nici prea dificil
Domeniul de aplicare
Subiectul este bine reprezentat?
Subiectele sunt echilibrate
trei mini cutii
Cazul 1 — Cheie greșită. Un profesor a produs un set cu răspunsuri multiple de 12 întrebări. Când a rezolvat fiecare întrebare cu SymPy, a constatat că în 3 dintre cele 12 întrebări, opțiunea pe care AI a marcat-o „corectă” era incorectă - răspunsul corect real era o altă opțiune. Profesorul a îndreptat cheile. Dacă acest set ar fi fost folosit fără verificare, întreaga clasă ar fi fost evaluată incorect în 3 întrebări.
Cazul 2 — Două opțiuni corecte. Într-o întrebare, AI a introdus atât „x = 2”, cât și „x = 2 sau x = -2”; Ambele erau adevărate într-un fel, iar întrebarea era neclară. Profesorul a rearanjat opțiunile și a lăsat un singur răspuns corect. Distractoarele trebuie să fie în mod clar incorecte.
Cazul 3 – Distractant slab. Într-o clasă de inginerie, AI a plasat elemente de distracție irelevante precum „42”, „aksaray”, „albastru”, „17” etc. într-o întrebare; Răspunsul corect a fost evident „17”. Profesorul a cerut distractoare numerice bazate pe erori tipice de calcul (de exemplu, valoarea rezultată din eroarea semnului), iar întrebările au devenit adevărați discriminatori. Bunul distractor reprezintă o adevărată cale falsă.
Patru șabloane copiabile
1) Set de întrebări cu alegere multiplă:
Generați [n] întrebări cu ALEGERE MULTIPLE pe [temă]. Nivel:[nivel]. Dificultate: [x ușor, y mediu, z greu]. Fiecare întrebare să aibă 4 opțiuni; Fie EXACT 1 să fie corect și celelalte 3 sunt distractori plauzibili bazați pe erori tipice. De asemenea, scrieți pas cu pas soluția și răspunsul corect pentru fiecare întrebare. Le voi verifica pe toate cu SymPy.
2) Variația întrebării (de la model):
Luați această întrebare ca PATTERN: [întrebare exemplu]. Generați [n] versiuni diferite care măsoară același concept, dar cu numere/context diferite. Rezolvați răspunsurile pentru fiecare versiune pas cu pas. Lasă răspunsurile să fie diferite unele de altele.
3) Generarea cheii de soluție:
Produceți o soluție PAS CU PAS și un răspuns final pentru fiecare dintre întrebările de mai jos. Specificați regula pe care o utilizați. Marcați soluția de care nu sunteți sigur; Voi verifica independent fiecare răspuns. Întrebări: [aici]
4) Îmbunătățirea distractorului:
Examinați elementele de distracție pentru această întrebare cu răspunsuri multiple. Explicați CARE greșeală tipică a elevului îi corespunde fiecare distractor incorect. Înlocuiți elementele de distracție irelevante sau evidente incorecte cu altele bazate pe erori reale. Întrebare: [aici]
Prompt slab / Prompt puternic
Slab: „Fă-mi 10 întrebări derivate”.
Rezultat: nivel incert, distribuție aleatorie a dificultăților, cheie de răspuns neverificată, set aleatoriu de distractoare (dacă există).
Puternic: „Produceți 10 întrebări derivate cu alegere multiplă pentru clasa a XII-a de liceu: 4 ușoare (reguli de bază), 4 medii (regula lanț/produs), 2 dificile (funcții compuse). Să fie 4 variante la fiecare întrebare, exact 1 corectă, celelalte sunt distractoare bazate pe erori tipice (uitând derivata interioară, semnează fiecare întrebare pas cu pas corect).
Rezultat: un set nivelat, echilibrat, care distrag atenția are sens și fiecare răspuns este auditabil.
Greșeli comune
- Nu se verifică cheia de răspuns. Ceea ce AI spune că este „corect” este adesea greșit; Rezolvați fiecare întrebare independent.
- Mai mult de unu/zero este opțiunea corectă. În alegerea multiplă trebuie să existe exact un adevăr; Verificați fiecare opțiune separat.
- Distractori slabi. Opțiunile irelevante sau evident incorecte fac ca întrebarea să nu fie distinctă.
- Nu se specifică distribuția dificultăților. Toate par a fi aceeași dificultate; Evaluarea nivelului nu se poate face.
- Repetiție și suprapunere. Diferite întrebări pot măsura același concept; Verificați soldul acoperirii.
- Expresie vagă. Întrebările cu înțeles dublu îi induc în eroare pe elevi pe nedrept.
Sfat: Cel mai eficient mod de a valida un set de întrebări este să scrieți cod care rezolvă toate întrebările simultan cu SymPy. Spuneți AI „scrieți codul care rezolvă fiecare dintre aceste 10 probleme cu SymPy”, rulați codul și comparați în bloc rezultatele SymPy cu cheia de răspuns a AI. În acest fel, verificați cele 10 întrebări nu una câte una, ci colectiv și determinist.
În concluzie
AI accelerează dramatic generarea de întrebări și examene de matematică: variația întrebărilor, designul distractorului, cheia soluției, evaluarea dificultății. Dar fiecare întrebare și fiecare cheie de răspuns trebuie validate independent - de preferință verificate în bloc cu SymPy. Cele mai frecvente erori sunt cheia de răspuns greșită, opțiunile multiple/zero corecte și factorii slabi de distracție. Specificarea subiectului, nivelului și distribuției dificultăților de la început crește calitatea. Orice întrebări neverificate nu ar trebui să intre în examen.
Sarcina de aplicare
Alegeți un subiect. Puneți AI să producă 8-10 întrebări cu răspunsuri multiple + soluții cu o anumită distribuție a dificultăților cu primul șablon. Apoi, amintindu-ne de la unitatea 4, cereți AI-ului să scrie un cod care rezolvă toate întrebările cu SymPy și să ruleze codul. Comparați rezultatele SymPy cu cheia de răspuns a lui YZ. Verificați dacă există exact o alegere corectă în fiecare întrebare și că elementele de distracție sunt de fapt incorecte. Găsiți și corectați cel puțin o eroare sau un distractor slab.
lista de verificare
- [ ] Am precizat clar subiectul, nivelul și distribuția dificultăților.
- [ ] Am rezolvat fiecare întrebare independent (de preferință în lot cu SymPy).
- [ ] Am comparat cheia de răspuns cu rezultatele SymPy.
- [ ] Am verificat că există exact o opțiune corectă în fiecare întrebare.
- [ ] Am verificat că elementele de distracție se bazează pe erori tipice și că de fapt au greșit.
- [ ] M-am asigurat că nu există afirmații vagi și întrebări repetitive.