AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
测试时扩展
2 篇相关内容
相关话题
推理优化
语言模型
强化学习
arXiv研究
大语言模型
计算效率
验证机制
新框架LBR:通过局部分支路由实现高效可训练的语言模型测试时扩展
研究者提出局部分支路由(LBR)框架,通过轻量级路由机制在推理时扩展局部前瞻树,在数学推理任务中超越了传统思维链方法。
a
arXiv
·
25 天前
语言模型
推理优化
测试时扩展
强化学习
a
验证粒度自适应:GRACE框架为测试时扩展找到最优计算效率
研究者提出GRACE理论框架,揭示了验证粒度与计算预算的动态关系,证明在困难问题或充足算力下细粒度验证更优,反之粗粒度更佳。自适应策略在数学推理基准上提升准确率3.1%。
a
arXiv
·
31 天前
大语言模型
推理优化
计算效率
测试时扩展
a