AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
SSC-GRPO
1 篇相关内容
相关话题
大语言模型
推理幻觉
模型优化
AI可靠性
推理过程为何会出错?新方法让大模型自我纠偏
研究团队发现大模型在长链条推理中容易出现“上下文敏感的事实幻觉”,并提出基于步骤一致性的优化方法SSC-GRPO,显著提升推理准确率。
a
arXiv
·
19 小时前
大语言模型
推理幻觉
模型优化
SSC-GRPO
a