AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
教育AI
3 篇相关内容
相关话题
大语言模型
自动评分
可靠性评估
自然语言处理
测量理论
意图推理
教学评估
AI辅助学习
数据集
评估框架
写作反馈
评估自动作文评分可靠性:新框架揭示不同文本条件下的评分差异
研究者提出条件概化理论框架,用于评估自动作文评分系统在不同文本复杂度条件下的可靠性差异,发现高熵文本需要更多评分条件才能保证准确性。
a
arXiv
·
6 天前
自动评分
教育AI
可靠性评估
自然语言处理
a
新框架APV:评估大模型如何理解教学意图,提升AI辅助学习可靠性
研究者提出自适应教学警觉性框架(APV),用于评估大模型对教学意图的推理能力。实验表明,APV能显著提升GPT-4o、Claude 3.5等模型对教学内容的辨别力,并与人类判断高度相关。
a
arXiv
·
18 天前
大语言模型
教育AI
意图推理
教学评估
a
SEFORA论文发布:首个真实课堂写作反馈数据集与LLM评估框架
研究者发布SEFORA数据集,包含564份学生论文草稿和8240条教师批注,并推出UniMatch评估框架,揭示当前大模型在生成写作反馈时与教师实际批注存在显著差距。
a
arXiv
·
19 天前
教育AI
大语言模型
数据集
评估框架
a