- 论文公开站arXiv
适应AI:小学教师如何调整教学实践以融入AI课程
Adapting for AI: How elementary teachers adjust their practices for an AI-integrated curriculum
摘要显示,该研究追踪三名小学教师在为期13天、三周夏令营中实施围绕ToyTalk会话AI玩具开发平台构建的AI素养与英语语言艺术课程。基于每日个人反思、小组反思及营后访谈,研究发现教师的修复、差异化、翻译与平衡等适应性实践处于技术、学习者与教学三重张力交汇处,且教师对AI及自身角色的理解随营期经历演变。研究据此提出在小学课堂部署会话AI的设计启示与考量。
意义:为教育AI产品设计者与课程开发者提供一线教师适应性实践的实证依据,有助于让会话AI工具更贴合小学课堂真实教学情境。
- 论文公开站arXiv
StudentBench:AI与人类辅导产生等效GRE学习增益
StudentBench: AI and human tutoring yield equivalent GRE learning gains
摘要显示,研究者发布StudentBench评测套件与公开平台,收集超17.5万条学生-AI对话,并在2383名参与者中比较AI辅导、人类辅导与无辅导对GRE语文与数学成绩的影响。结果显示AI辅导与专家人类辅导的学习增益在统计上等效(p=.015),七个GRE领域中五个领域最佳AI导师平均超过人类导师;另有一项AI导师以低918倍成本达到等效增益。
意义:该研究为AI辅导效果提供大规模实证,表明低成本AI导师可能在某些场景替代人类辅导,对教育AI产品与模型评测有参考价值。
- 论文公开站arXiv
双维度LLM框架用于大规模测评中题目非内容相似性自动分析
A Dual-Dimensional LLM Framework for Automated Item Incidental Content Similarity Analysis in Large-Scale Assessments
该研究提出一种基于大语言模型的双维度自动题目相似性分析框架,通过结构化分解和语义相关性来检测题目中非内容冗余。心理测量验证显示,LLM指标比传统文本指标更接近构念无关局部依赖,并产生更一致的题目参数分组。在计算机自适应测试中,基于LLM的相似性约束提高了估计稳定性并减少了偏差。
意义:为大规模题库管理提供新方法,提升自适应测试的准确性和效率,对教育测评AI应用有重要价值。