Lợi nhuận:
- Khả năng trí tuệ nhân tạo tạo ra các câu hỏi trắc nghiệm, câu hỏi đánh lạc hướng dựa trên các lỗi điển hình và chìa khóa giải pháp bằng cách chỉ định chủ đề, cấp độ và phân bổ độ khó.
- Khả năng bắt sai khóa và nhiều/không có lỗi tùy chọn đúng bằng cách xác thực độc lập từng câu hỏi và khóa trả lời, tốt nhất là hàng loạt, với SymPy
- Có khả năng đánh giá chất lượng câu hỏi phân tâm, tính rõ ràng, cân bằng độ khó của các câu hỏi và phê duyệt từng câu hỏi trước khi thi.
Chuẩn bị đề thi và đề luyện tập là một trong những công việc tốn nhiều thời gian nhất trong giáo dục toán: đặt câu hỏi có độ khó phù hợp, thiết kế các câu đánh lạc hướng hợp lý (các phương án sai nhưng hợp lý), chuẩn bị đáp án và cân bằng độ khó mất hàng giờ. Trí tuệ nhân tạo có thể tăng tốc quá trình này - tạo ra hàng tá biến thể câu hỏi, phương án trắc nghiệm và chìa khóa giải pháp từ một chủ đề. Nhưng độ chính xác của từng câu hỏi được đưa ra và tính không có lỗi của từng đáp án phải được xác minh độc lập; Chìa khóa sai có nghĩa là học sinh bị mất điểm một cách không công bằng. Trong phần này, bạn sẽ tìm hiểu cách sử dụng AI làm đối tác tạo câu hỏi và cách kiểm duyệt từng câu hỏi.
Một vài định nghĩa. Câu đánh lạc hướng là một lựa chọn trong câu hỏi trắc nghiệm không đúng nhưng tương ứng với một lỗi phổ biến mà học sinh có thể mắc phải. Một tác nhân gây phân tâm tốt không phải là ngẫu nhiên; Phản ánh một lỗi điển hình (lỗi ký hiệu, nhầm lẫn quy tắc). Đáp án là danh sách các câu trả lời đúng cho các câu hỏi. Cân bằng độ khó là sự phân bổ hợp lý các câu hỏi dễ-trung bình-khó trong một bài thi.
Đóng góp của AI vào việc tạo câu hỏi
- Biến thể câu hỏi: Nhiều câu hỏi tương tự từ một mẫu (thay đổi số).
- Thiết kế gây xao nhãng: Những lựa chọn có thể không chính xác dựa trên những lỗi phổ biến.
- Đề cương chính của giải pháp: Giải pháp từng bước cho từng vấn đề.
- Đánh giá độ khó: Phân loại câu hỏi dễ/trung bình/khó.
- Nội dung chủ đề: Bộ câu hỏi bao gồm các chủ đề phụ khác nhau của một giáo trình.
- Bloom taxonomy fit: Đặt câu hỏi theo các cấp độ nhận thức như ghi nhớ, vận dụng, phân tích.
Từng bước: tạo ra một bộ câu hỏi đáng tin cậy
1. Xác định chủ đề, mức độ và số lượng câu hỏi. Như “lớp 10 THPT, phương trình bậc hai, 10 câu hỏi trắc nghiệm”.
2. Hỏi loại câu hỏi và phân bổ độ khó. Yêu cầu phân phối như "4 dễ, 4 trung bình, 2 khó".
3. Giải quyết từng câu hỏi một cách độc lập. Tự giải quyết từng câu hỏi hoặc bằng SymPy; So sánh nó với đáp án do YZ cung cấp. Bước này là không thể thương lượng.
4. Kiểm tra những yếu tố gây xao lãng. Những lựa chọn sai có thực sự sai? Đôi khi AI đưa ra nhiều lựa chọn đúng hoặc một phương án gây mất tập trung thực sự đúng. Kiểm tra từng tùy chọn.
5. Đảm bảo có đúng một câu trả lời đúng. Trong câu hỏi trắc nghiệm, chỉ có một phương án đúng; Không được có số 0 hoặc nhiều hơn một số đúng.
6. Kiểm tra tính không chắc chắn và trùng lặp. Câu hỏi có đơn nghĩa không? Hai câu hỏi có đo lường cùng một điều không? Các con số có hợp lý không (ví dụ: nếu nghiệm phải âm)?
Lưu ý: AI mắc hai lỗi phổ biến nhất khi tạo câu hỏi trắc nghiệm: (1) tùy chọn mà nó đánh dấu là "đúng" thực ra sai, (2) có nhiều hơn một tùy chọn đúng hoặc không có tùy chọn nào đúng. Không sử dụng bất kỳ câu hỏi nào mà không giải quyết từng câu hỏi một cách độc lập và đánh giá riêng từng lựa chọn trong số bốn lựa chọn là đúng/sai.
Biểu đồ kiểm soát chất lượng câu hỏi
kiểm soát
Câu hỏi
những gì cần tìm kiếm
độ chính xác
Đáp án có đúng không?
Xác nhận bằng giải pháp độc lập
chỉ đúng
Chỉ có 1 phương án đúng?
3 cái còn lại chắc sai
Chất lượng phân tâm
Những sai lầm có hợp lý không?
Nên dựa trên lỗi điển hình
Rõ ràng
Câu hỏi có đơn nghĩa không?
Không nên có sự không chắc chắn
Mức độ tuân thủ
Độ khó có phù hợp với mục tiêu không?
Không quá dễ cũng không quá khó
Phạm vi
Chủ đề có được trình bày tốt không?
Các chủ đề phụ được cân bằng
ba trường hợp nhỏ
Trường hợp 1 - Chìa khóa sai. Giáo viên đưa ra một bộ câu hỏi trắc nghiệm gồm 12 câu hỏi. Khi giải từng câu hỏi bằng SymPy, anh nhận thấy rằng ở 3 trong số 12 câu hỏi, tùy chọn mà AI đánh dấu là "đúng" là không chính xác - câu trả lời đúng thực tế là một lựa chọn khác. Giáo viên sắp xếp lại các phím. Nếu sử dụng bộ này mà không kiểm tra thì cả lớp sẽ bị đánh giá không công bằng ở 3 câu hỏi.
Trường hợp 2 - Hai phương án đúng. Trong một câu hỏi, AI đưa vào cả “x = 2” và “x = 2 hoặc x = −2”; Cả hai đều đúng theo một nghĩa nào đó và câu hỏi không rõ ràng. Giáo viên sắp xếp lại các phương án và chỉ để lại một đáp án đúng. Những yếu tố gây xao lãng phải rõ ràng là không chính xác.
Trường hợp 3 - Chất phân tâm yếu. Trong một lớp học kỹ thuật, AI đặt các ký tự phân tâm không liên quan như “42”, “aksaray”, “blue”, “17”, v.v. vào một câu hỏi; Câu trả lời đúng rõ ràng là "17". Giáo viên yêu cầu các yếu tố phân tâm bằng số dựa trên các lỗi tính toán điển hình (ví dụ: giá trị do lỗi ký hiệu) và các câu hỏi đã trở thành yếu tố phân biệt đối xử thực sự. Kẻ phân tâm tốt đại diện cho một con đường sai lầm thực sự.
Bốn mẫu có thể sao chép
1) Bộ câu hỏi trắc nghiệm:
Tạo [n] câu hỏi NHIỀU LỰA CHỌN về [chủ đề]. Cấp độ: [cấp độ]. Độ khó: [x dễ, y trung bình, z khó]. Cho mỗi câu hỏi có 4 phương án lựa chọn; Đặt CHÍNH XÁC 1 là chính xác và 3 cái còn lại là những yếu tố gây phân tâm hợp lý dựa trên các lỗi điển hình. Đồng thời viết giải pháp từng bước và câu trả lời đúng cho mỗi câu hỏi. Tôi sẽ xác minh tất cả chúng bằng SymPy.
2) Biến thể câu hỏi (từ mẫu):
Hãy coi câu hỏi này là MẪU: [câu hỏi mẫu]. Tạo [n] phiên bản khác nhau đo lường cùng một khái niệm nhưng với số lượng/bối cảnh khác nhau. Giải quyết các câu trả lời cho từng phiên bản từng bước. Hãy để các câu trả lời khác nhau.
3) Tạo khóa giải pháp:
Đưa ra giải pháp TỪNG BƯỚC và câu trả lời cuối cùng cho từng câu hỏi dưới đây. Chỉ định quy tắc bạn sử dụng. Đánh dấu giải pháp mà bạn không chắc chắn; Tôi sẽ xác minh độc lập từng câu trả lời. Câu hỏi: [tại đây]
4) Cải thiện bộ phân tâm:
Xem lại các yếu tố gây phân tâm cho câu hỏi trắc nghiệm này. Giải thích MỌI lỗi điển hình của học sinh mà mỗi lỗi phân tâm không chính xác tương ứng. Thay thế những yếu tố gây phân tâm không chính xác hoặc không liên quan bằng những yếu tố gây phân tâm dựa trên lỗi thực tế. Câu hỏi: [tại đây]
Dấu nhắc yếu / Dấu nhắc mạnh
Yếu: “Hãy cho tôi 10 câu hỏi phái sinh.”
Kết quả: Mức độ không chắc chắn, phân bổ độ khó ngẫu nhiên, đáp án chưa được xác minh, bộ phân tâm ngẫu nhiên (nếu có).
Mạnh: “Làm 10 câu hỏi đạo hàm trắc nghiệm lớp 12 THPT: 4 câu dễ (quy tắc cơ bản), 4 câu trung bình (quy tắc chuỗi/sản phẩm), 2 câu khó (hàm ghép). Mỗi câu có 4 phương án lựa chọn, trong đó có đúng 1 phương án đúng, còn lại đánh lạc hướng dựa trên các lỗi điển hình (quên đạo hàm nội, lỗi dấu). Giải từng câu hỏi và chỉ ra đáp án đúng.”
Kết quả: Một tập hợp ở mức độ, cân bằng, có yếu tố gây phân tâm đều có ý nghĩa và mọi câu trả lời đều có thể nghe được.
Những lỗi thường gặp
- Không xác minh đáp án. Những gì AI nói là “đúng” thường sai; Giải quyết từng câu hỏi một cách độc lập.
- Nhiều hơn một/không là lựa chọn đúng. Trong trắc nghiệm phải có đúng một sự thật; Kiểm tra từng tùy chọn riêng biệt.
- Yếu tố gây phân tâm yếu. Các lựa chọn không liên quan hoặc rõ ràng là không chính xác làm cho câu hỏi trở nên không có gì nổi bật.
- Không chỉ định sự phân bổ độ khó. Tất cả đều có vẻ khó khăn như nhau; Đánh giá mức độ không thể được thực hiện.
- Sự lặp lại và chồng chéo. Các câu hỏi khác nhau có thể đo lường cùng một khái niệm; Kiểm tra số dư bảo hiểm.
- Biểu hiện mơ hồ. Những câu hỏi có ý nghĩa kép sẽ đánh lừa học sinh một cách không công bằng.
Mẹo: Cách hiệu quả nhất để xác thực một nhóm câu hỏi là viết mã giải quyết tất cả các câu hỏi cùng lúc bằng SymPy. Nói với AI "viết mã giải quyết từng vấn đề trong số 10 vấn đề này với SymPy", chạy mã và so sánh hàng loạt kết quả của SymPy với đáp án của AI. Bằng cách này, bạn kiểm tra 10 câu hỏi không phải từng câu một mà một cách tập thể và dứt khoát.
Tóm lại
AI tăng tốc đáng kể câu hỏi toán học và tạo bài kiểm tra: biến thể câu hỏi, thiết kế phân tâm, khóa giải pháp, xếp hạng độ khó. Tuy nhiên, mỗi câu hỏi và mỗi đáp án phải được xác thực độc lập — tốt nhất là xác minh hàng loạt bằng SymPy. Các lỗi phổ biến nhất là sai đáp án, nhiều/không có phương án đúng và yếu tố gây phân tâm. Việc xác định chủ đề, mức độ và phân bổ độ khó ngay từ đầu sẽ làm tăng chất lượng. Những câu hỏi chưa được xác minh sẽ không được đưa vào bài thi.
Nhiệm vụ ứng dụng
Chọn một chủ đề. Yêu cầu AI tạo ra 8-10 câu hỏi trắc nghiệm + giải pháp với mức độ phân bổ độ khó nhất định với mẫu thứ nhất. Sau đó, nhớ lại bài 4, yêu cầu AI viết mã giải quyết tất cả các câu hỏi bằng SymPy và chạy mã. So sánh kết quả của SymPy với đáp án của YZ. Xác minh rằng có chính xác một lựa chọn đúng trong mỗi câu hỏi và các yếu tố gây phân tâm thực sự không chính xác. Tìm và sửa ít nhất một lỗi hoặc yếu tố gây phân tâm yếu.
danh sách kiểm tra
- [ ] Tôi đã nói rõ về chủ đề, mức độ và phân bổ độ khó.
- [ ] Tôi đã giải quyết từng câu hỏi một cách độc lập (tốt nhất là sử dụng hàng loạt câu hỏi bằng SymPy).
- [ ] Tôi đã so sánh đáp án với kết quả của SymPy.
- [ ] Tôi đã xác minh rằng có chính xác một phương án đúng trong mỗi câu hỏi.
- [ ] Tôi đã kiểm tra rằng những yếu tố gây phân tâm là dựa trên những lỗi điển hình và thực sự sai.
- [ ] Tôi đảm bảo rằng không có những tuyên bố mơ hồ và không có câu hỏi lặp đi lặp lại.