AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
置信度校准
3 篇相关内容
相关话题
大语言模型
arXiv
智能体
自我进化
多模态问答
GPT-4
任务专用架构
ICML
强化学习
推理优化
智能体自我进化:Critic Experience Bank 提升大模型行动置信度评估
研究者提出 Critic Experience Bank 框架,让大语言模型智能体能够基于历史执行反馈自我进化,显著提升单步行动置信度评估的准确性和校准度。
a
arXiv
·
6 天前
大语言模型
智能体
置信度校准
自我进化
a
双智能体架构亮相QANTA 2026挑战赛:任务专用推理策略刷新多模态问答纪录
研究团队针对QANTA 2026多模态问答挑战赛开发了任务专用双智能体架构,通过置信度校准与增量推理策略,在资源受限环境下实现了0.402的领先成绩。
a
arXiv
·
8 天前
多模态问答
GPT-4
置信度校准
任务专用架构
a
新算法C3RL:让大语言模型学会“诚实”表达自信度
研究者提出C3RL强化学习算法,解决大模型在强化学习训练后自信度与准确性脱钩的问题,并基于校准后的自信度开发动态推理策略CAS,最高可减少12倍计算开销。
a
arXiv
·
18 天前
大语言模型
强化学习
置信度校准
推理优化
a