AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
测试时训练
2 篇相关内容
相关话题
大语言模型
长文本处理
模型优化
推理能力
评估框架
记忆机制
行为验证
自引导测试时训练:提升大模型长文本理解能力的新方法
研究人员提出自引导测试时训练方法,通过智能筛选关键证据片段进行参数微调,显著提升大模型在长文本任务中的推理准确率。
a
arXiv
·
8 天前
大语言模型
长文本处理
测试时训练
模型优化
a
超越困惑度:大语言模型测试时训练中部署记忆声明的行为评估框架
研究团队提出针对大语言模型测试时训练(TTT)中部署记忆声明的新评估框架,强调传统代理指标不足以验证实际部署能力,需通过行为证据进行校准。
a
arXiv
·
19 天前
大语言模型
测试时训练
评估框架
记忆机制
a