AI智能体进化新工具:Harness Handbook让复杂系统修改不再头疼

arXiv·5 天前

现代AI智能体的能力不仅取决于其基础模型,更依赖于其执行框架(harness)——负责构建提示、管理状态、调用工具和协调执行的核心组件。随着模型、API、环境和需求的不断演进,执行框架需要持续修改。然而,在实际开发中,开发者或编码智能体往往面临一个关键难题:如何在庞大、耦合度高且行为分散的代码库中,准确定位需要修改的代码位置?

传统代码搜索和仓库索引技术虽然能提供帮助,但仍需人工完成行为到代码的映射工作,这成为系统演进的主要瓶颈。为此,研究团队提出了Harness Handbook解决方案。该工具通过静态分析和大型语言模型辅助的结构化处理,自动从代码库合成以行为为中心的表示形式,将每个具体行为与其对应的源代码精确关联。

同时引入的“行为引导渐进披露”(BGPD)技术,能够引导智能体从高层次行为逐步深入到相关实现细节,并根据当前源代码验证候选修改位置。在针对两个开源执行框架的多样化修改请求测试中,Handbook辅助的规划显著提升了行为定位和编辑计划的质量,同时减少了规划所需的计算资源消耗。特别是在处理分散代码位置、不常执行路径和跨模块交互等复杂场景时,改进效果最为明显。

这项研究揭示了一个重要洞见:进化复杂的智能体系统不仅需要生成正确的代码修改,更需要准确判断这些修改应该应用在何处。Harness Handbook为解决这一核心挑战提供了创新思路,有望推动AI智能体开发维护进入更高效的新阶段。

AI智能体代码维护系统演进软件开发LLM应用

原文来源:https://arxiv.org/abs/2607.13285

相关阅读

AI_LectureNote:英语医学术语还原与语义保真度研究
大模型生成文本的“文学无风格”现象
大语言模型中的问题顺序效应:QQ等式审计揭示机制特性与饱和陷阱
首个吉尔吉斯语大模型基准发布:揭示低资源语言评估挑战
Scope3Trace:基于证据的Scope 3温室气体排放识别与提取框架

← 返回