Dùng AI gợi ý lỗi bài làm: giáo viên kiểm tra gì trước khi viết nhận xét?
Một cách dùng AI để rà mẫu lỗi trong bài làm mà vẫn buộc mọi gợi ý quay về bằng chứng và giữ quyết định phản hồi ở giáo viên.
AI có thể giúp giáo viên nhìn nhanh một chồng câu trả lời và gợi ý những lỗi xuất hiện nhiều lần. Nhưng phát hiện mẫu lỗi không đồng nghĩa với quyết định học sinh đã hiểu đến đâu, nên được bao nhiêu điểm hay cần nhận xét gì.
Một cách an toàn hơn là giao cho AI một nhiệm vụ hẹp: chỉ ra điểm đáng kiểm tra và trích đúng câu trong bài làm làm bằng chứng. Sau đó giáo viên đối chiếu, loại gợi ý yếu và tự viết phản hồi cuối cùng.
Bài dưới đây dùng dữ liệu hoàn toàn giả lập. Đây không phải kết quả thử nghiệm trên một mô hình AI cụ thể.
Ba bài làm để thử quy trình
Giả sử câu hỏi là: “Vì sao nước đọng bên ngoài một cốc nước đá?”
Ba câu trả lời giả lập:
- Bài A: “Nước từ trong cốc thấm xuyên qua thành cốc vì bên trong có nhiều nước hơn.”
- Bài B: “Hơi nước trong không khí gặp bề mặt cốc lạnh, nguội đi và ngưng tụ thành giọt nước.”
- Bài C: “Nước xuất hiện vì không khí lạnh giữ được nhiều hơi nước hơn nên hơi nước biến thành giọt.”
Bài C là tình huống biên hữu ích: kết luận có nhắc tới hơi nước và giọt nước, nhưng phần giải thích về khả năng giữ hơi nước của không khí lạnh cần được kiểm tra.
Chỉ yêu cầu AI làm phần có thể kiểm chứng
Thay vì hỏi “hãy chấm ba bài này”, hãy giới hạn nhiệm vụ:
Đọc ba câu trả lời. Với mỗi bài, chỉ nêu tối đa hai điểm giáo viên nên kiểm tra. Mỗi điểm phải kèm nguyên văn câu hoặc cụm từ trong bài làm làm bằng chứng. Nếu không đủ căn cứ để kết luận học sinh hiểu hay không hiểu, hãy ghi “chưa đủ căn cứ”. Không cho điểm và không viết nhận xét gửi học sinh.
Kết quả mong đợi không phải là một bảng điểm. Nó chỉ nên giống một danh sách nghi vấn có bằng chứng. Ví dụ, với Bài A, một gợi ý hợp lý có thể chỉ vào cụm “thấm xuyên qua thành cốc” để giáo viên kiểm tra quan niệm sai về nguồn gốc của nước bên ngoài cốc.
Kiểm tra từng gợi ý bằng bài gốc
Đừng đọc bảng AI rồi viết nhận xét ngay. Với từng gợi ý, làm ba việc:
- Tìm đúng câu được AI trích trong bài làm. Nếu không tìm thấy, bỏ gợi ý.
- Hỏi: gợi ý này mô tả điều học sinh thực sự viết, hay AI đang suy ra ý định của học sinh? Nếu là suy đoán, không dùng nó như kết luận.
- Đối chiếu với mục tiêu bài học và tiêu chí chấm của chính giáo viên. AI không biết đầy đủ những gì lớp đã học nếu bạn không cung cấp, và ngay cả khi được cung cấp thì quyết định sư phạm vẫn cần người dạy chịu trách nhiệm.
Sau bước này, giáo viên mới tự viết phản hồi. Chẳng hạn, thay vì chép một nhãn như “sai về ngưng tụ”, giáo viên có thể hỏi Bài A: “Theo em, nếu thành cốc không bị thủng thì nước bên ngoài đến từ đâu?” Câu hỏi đó xuất phát từ mục tiêu dạy học và phán đoán của giáo viên, không phải từ quyền quyết định của AI.
Tình huống biên: kết luận nghe đúng nhưng lý do sai
Bài C giúp kiểm tra một lỗi dễ bỏ qua khi chỉ tìm từ khóa. Câu trả lời có các từ “không khí”, “hơi nước” và “giọt”, nên nhìn lướt có vẻ gần đáp án. Nhưng giáo viên vẫn phải đọc quan hệ nguyên nhân trong câu.
Bạn có thể thêm một yêu cầu kiểm tra:
Với mỗi bài, tách riêng “kết luận” và “lý do”. Nếu kết luận có vẻ phù hợp nhưng lý do mâu thuẫn với kiến thức trong tài liệu tôi cung cấp, hãy đánh dấu để giáo viên kiểm tra; không tự sửa bài cho học sinh.
Nếu AI không phát hiện vấn đề ở Bài C, đó là dấu hiệu để giáo viên biết quy trình không được phép dựa vào AI như bộ lọc cuối cùng. Nếu AI phát hiện đúng, điều đó cũng không chứng minh nó sẽ luôn làm đúng ở bài khác. Tình huống này được dựng để kiểm tra ranh giới, không phải để tuyên bố một tỷ lệ lỗi.
Khi nào nên dừng dùng AI cho bước này
Không nên đưa bài thật vào một công cụ chưa được trường phê duyệt nếu bài có tên, mã học sinh, điểm số, thông tin sức khỏe, hoàn cảnh gia đình hoặc dữ liệu nhạy cảm khác. Có thể bắt đầu bằng bài giả lập hoặc dữ liệu đã loại thông tin nhận dạng để xem quy trình có giúp ích hay chỉ tạo thêm việc kiểm tra.
Nếu AI thường xuyên trích sai câu, suy diễn ý định học sinh hoặc khiến thời gian đối chiếu dài hơn việc giáo viên tự đọc, hãy dừng bước AI thay vì cố giữ nó trong quy trình. Mục đích của bước thử là xem công cụ có giúp giáo viên tập trung sự chú ý hay không; nếu nó chỉ thêm một lớp phải rà lại, bỏ lớp đó.
UNESCO nhấn mạnh cách tiếp cận lấy con người làm trung tâm đối với AI trong giáo dục và vai trò của giáo viên trong việc định hướng sử dụng công nghệ. Điều đó phù hợp với ranh giới của quy trình này: AI có thể gợi ý chỗ cần nhìn, còn giáo viên giữ quyền đánh giá và phản hồi.
Tài liệu gốc để đối chiếu
- AI and the future of learning — UNESCO — Tổng quan của UNESCO về cách tiếp cận lấy con người làm trung tâm khi đưa AI vào giáo dục, dùng để đặt ranh giới vai trò giữa công cụ và giáo viên.
- Guidance for generative AI in education and research — UNESCO — Hướng dẫn gốc về AI tạo sinh trong giáo dục, hỗ trợ các lưu ý về quyền chủ động của con người, bảo vệ dữ liệu và sử dụng phù hợp bối cảnh.
Một nguyên tắc đủ ngắn để nhớ khi thử quy trình này: AI chỉ đánh dấu chỗ cần nhìn; giáo viên mới quyết định điều gì cần nói với học sinh.