PASE框架:用神经符号世界模型验证LLM生成的云故障恢复计划

arXiv·18 天前

随着基于云的AI系统规模和复杂性持续增长,通过快速故障检测和自适应恢复确保服务可靠性已成为关键挑战。现有方法虽然整合了大型语言模型(LLM)进行语义理解和深度强化学习(DRL)进行策略优化,但通常采用顺序、松散耦合的架构,未能充分利用LLM的生成和推理能力。

研究团队提出PASE框架,这是一种规划感知的语义自愈引擎,将故障恢复重新概念化为神经符号程序合成任务。该框架采用LLM作为核心计划合成引擎,从语义原语库中生成结构化恢复计划。神经符号世界模型通过模拟验证计划可行性,而通过DRL训练的元提示优化器则学习生成最优提示来指导LLM的规划过程。

这种紧密的“推理-规划-验证-适应”循环支持动态、上下文感知的恢复策略生成,超越了预定义的动作空间。在真实世界云故障注入数据集上的实验表明,PASE显著优于现有方法,将平均系统恢复时间减少40%以上,并在未知故障场景中提高了故障检测准确率。该框架通过将基于LLM的推理与模型辅助验证和元学习指导相统一,推动了自主系统管理的发展。

LLM云故障恢复神经符号AI自主系统强化学习

原文来源:https://arxiv.org/abs/2607.01595

相关阅读

AI_LectureNote:英语医学术语还原与语义保真度研究
大模型生成文本的“文学无风格”现象
大语言模型中的问题顺序效应:QQ等式审计揭示机制特性与饱和陷阱
首个吉尔吉斯语大模型基准发布:揭示低资源语言评估挑战
Scope3Trace:基于证据的Scope 3温室气体排放识别与提取框架

← 返回