跳到正文
arXiv AI Education· Clayton Cohn, Joyce Fonteles, Kirk Vanacore, Gianni Mazza, Candida Crawford, Tom Hooper, Gautam Biswas, Rene Kizilcec·· 10 小时前评分61

Agreement Is Not Validity: Cross-Model LLM Consensus in Diagnosing Student Failure Modes in K-12 Math Tutoring Dialogue

摘要

在K-12数学辅导中,学生与导师的对话提供了学习者解决问题过程和困难来源的丰富证据。学习分析研究越来越多地依赖大型语言模型(LLMs)从对话中提取此类信息,用于各种下游任务,如知识追踪、行为建模和学生推理错误诊断。然而,这些模型生成的解释的有效性仍不够明确。

推荐理由

请对照arXiv AI Education原文,核对完整说明及适用条件。

本站只提供摘要与原文入口。完整内容请阅读原文。

来源:arXiv AI Education · arxiv.org