AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
错误传播
2 篇相关内容
相关话题
AI代理
工具调用
可靠性评估
开源模型
大模型幻觉
多智能体系统
模型验证
AI可靠性
工具调用型AI代理的可靠性研究:早期错误如何“雪崩式”影响后续表现
最新研究发现,工具调用型AI代理在复杂任务中,早期一个微小的调用错误可能导致后续表现断崖式下跌——到第6步时,模型自身清洁上下文能力的近70%已被其早期错误侵蚀。
a
arXiv
·
6 天前
AI代理
工具调用
可靠性评估
错误传播
a
大模型幻觉雪球效应:多智能体流水线中错误如何层层放大
研究发现多智能体LLM流水线存在结构性缺陷:早期注入的幻觉会像滚雪球一样层层放大,从原始事实演变为计算、叙述乃至最终结论,检测难度逐级剧增。
a
arXiv
·
16 天前
大模型幻觉
多智能体系统
错误传播
模型验证
a