AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
长文本处理
2 篇相关内容
相关话题
大语言模型
测试时训练
模型优化
推理能力
语言模型
信息检索
注意力机制
上下文学习
自引导测试时训练:提升大模型长文本理解能力的新方法
研究人员提出自引导测试时训练方法,通过智能筛选关键证据片段进行参数微调,显著提升大模型在长文本任务中的推理准确率。
a
arXiv
·
8 天前
大语言模型
长文本处理
测试时训练
模型优化
a
语言模型能否胜任百万级文档检索?注意力稀释成关键挑战
研究首次系统探索语言模型在百万令牌规模下的上下文检索能力,提出BlockSearch模型并通过注意力机制改进,在多项基准测试中媲美甚至超越传统检索方法。
a
arXiv
·
18 天前
语言模型
信息检索
注意力机制
上下文学习
a