AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
AI可靠性
5 篇相关内容
相关话题
大语言模型
语言模型
科学推理
共形预测
学术研究
RAG系统
不确定性量化
贝叶斯网络
多跳推理
规划能力
符号推理
自我优化
科学生成自纠错新框架:语言模型也能“知错就改”
研究者提出科学可行性控制框架SFC,通过图结构共形预测为语言模型的科学推理提供统计有效性保障,显著减少科学原理违反现象。
a
arXiv
·
5 小时前
语言模型
科学推理
共形预测
AI可靠性
a
贝叶斯网络为智能RAG系统注入“不确定性感知”能力
研究人员提出一种基于贝叶斯网络的不确定性传播框架,可实时评估多阶段智能RAG系统各环节的可靠性,为工业级AI系统部署提供关键监控机制。
a
arXiv
·
19 天前
RAG系统
不确定性量化
贝叶斯网络
多跳推理
a
提升大语言模型规划能力:符号反馈驱动的迭代自优化框架
研究者提出一种符号反馈驱动的迭代自优化框架,通过自然语言提示映射逻辑符号,结合符号验证器识别错误并生成修正指令,显著提升大语言模型在长期规划任务中的可行性与正确性。
a
arXiv
·
22 天前
大语言模型
规划能力
符号推理
自我优化
a
指令泄露:提示组合式智能体系统中的跨模块干扰现象
研究发现提示组合式智能体系统存在一种隐蔽故障模式——修改某个提示模块会无声影响其他模块行为,即使它们没有共享变量或执行依赖。
a
arXiv
·
25 天前
智能体系统
提示工程
Transformer架构
系统评估
a
通义千问团队探索数学推理过程监督新方法,提升大模型可靠性
针对大语言模型在数学推理中可能产生计算错误或逻辑漏洞的问题,通义千问团队提出过程监督新思路,旨在提升推理过程的可信度。
通
通义千问 Qwen
·
28 天前
大语言模型
数学推理
过程监督
通义千问
通