AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
多任务学习
2 篇相关内容
相关话题
强化学习
大语言模型
熵控制
GEPO算法
量化金融
AI智能体
评测平台
金融科技
新算法GEPO:按组控制熵值,提升大语言模型强化学习效果
研究人员提出GEPO算法,通过分组熵值控制解决多任务强化学习中探索与利用的平衡难题,在多个基准测试中表现优于现有方法。
a
arXiv
·
10 小时前
强化学习
大语言模型
熵控制
GEPO算法
a
OpenFinGym:首个可验证的多任务量化金融AI智能体评测平台
研究者推出OpenFinGym统一评测环境,解决量化金融AI智能体评估碎片化问题,覆盖预测、交易、风控等全流程任务,支持论文自动转化为可执行任务包。
a
arXiv
·
25 天前
量化金融
AI智能体
评测平台
多任务学习
a