AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
决策模型
2 篇相关内容
相关话题
强化学习
上下文学习
非平稳环境
元学习
评级系统
国际象棋
人工智能
技能评估
环境动态变化下的上下文强化学习研究综述
本文系统梳理了非平稳环境中上下文强化学习的最新进展,探讨智能体如何在参数固定的情况下,通过上下文推断动态变化的决策规则。
a
arXiv
·
6 天前
强化学习
上下文学习
非平稳环境
元学习
a
国际象棋技能评估新突破:漂移扩散模型增强Elo评级系统
研究者提出DD-Elo评级系统,通过整合每步棋局数据捕捉技能波动,相比传统Elo系统能更快适应棋手水平变化。
a
arXiv
·
25 天前
评级系统
国际象棋
人工智能
决策模型
a