AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
多智能体系统
36 篇相关内容
相关话题
大语言模型
强化学习
AI推理
群体智能
数学推理
人机交互
arXiv研究
arXiv
图神经网络
法律AI
可解释AI
提示注入攻击
多智能体LLM系统面临新威胁:PlanFlip攻击通过规划阶段提示注入实现级联破坏
研究人员发现多智能体LLM系统的规划阶段存在严重安全漏洞,提出PlanFlip攻击框架,通过四种伪装攻击方式可同时破坏所有下游子任务。实验显示能力越强的模型反而越脆弱,GPT-5攻击成功率最高达68%。
a
arXiv
·
5 小时前
多智能体系统
提示注入攻击
AI安全
大语言模型
a
AgentFAIR:多智能体协作框架,评估地理空间数据的FAIR合规性
研究者提出AgentFAIR框架,利用13个LLM评估器对地理空间数据的可发现、可访问、可互操作和可重用性进行自动化评估,显著提升了评估一致性。
a
arXiv
·
1 天前
多智能体系统
FAIR原则
地理空间数据
LLM评估
a
AI数学推理新发现:精准的评审未必能提升解题成功率
最新研究表明,在多智能体数学推理系统中,评审环节的精准度与最终解题成功率并不直接相关。即使评审能准确发现问题,若系统无法有效采纳建议,整体性能仍会受限。
a
arXiv
·
1 天前
多智能体系统
数学推理
AI评审机制
GPT-OSS
a
AnovaX:本地化多智能体语音助手,实现LLM规划与自适应恢复
研究人员提出AnovaX,一款完全在用户计算机上运行的本地优先语音助手,通过LLM规划、类型化执行器和自适应恢复机制,将桌面作为操作界面,支持多任务并发与远程手机控制。
a
arXiv
·
1 天前
语音助手
本地AI
多智能体系统
LLM规划
a
多智能体大模型协作中的语义信息压缩现象
研究发现多智能体大模型系统在处理复杂任务时,中间环节会显著压缩语义信息,影响下游决策准确性。
a
arXiv
·
4 天前
大语言模型
多智能体系统
语义压缩
AI协作
a
大模型隐式通信:文本传输的局限与潜在通道探索
研究揭示大语言模型在文本通信中存在信息损失,通过稀疏自编码器分析发现文本序列化会破坏88%的特征表达,而潜在通道在跨语言概念任务中表现相当但未超越文本通道。
a
arXiv
·
4 天前
大语言模型
多智能体系统
潜在通信
特征分析
a
ReasFlow:多智能体系统赋能数学推理与科学发现
研究团队提出ReasFlow系统,通过基于知识的智能体协作,辅助完成以推理为核心的科学发现任务,尤其在需要严谨证明的数学领域实现自动化研究。
a
arXiv
·
4 天前
AI智能体
科学发现
数学推理
自动化研究
a
RegNetAgents:AI多智能体框架助力癌症基因组调控因子发现
研究人员提出RegNetAgents多智能体框架,通过整合TCGA癌症网络与单细胞调控网络,实现跨网络调控候选因子的结构化识别,为癌症基因组学研究提供可解释的AI分析工具。
a
arXiv
·
4 天前
多智能体系统
癌症基因组学
基因调控网络
生物信息学
a
UrbanAgent:多智能体协同推理框架革新城市区域画像
研究者提出UrbanAgent框架,将城市区域画像任务转化为推理驱动的多智能体协作问题,通过工具增强的证据检索机制显著提升预测精度与泛化能力。
a
arXiv
·
5 天前
多智能体系统
城市计算
推理框架
强化学习
a
OpenRCA数据集挑战:AI如何突破微服务故障根因分析的瓶颈?
针对生产环境微服务故障根因分析难题,研究者提出结构化多智能体RCA流程,在OpenRCA数据集上显著超越传统因果发现与现有大模型方法,并揭示推理能力是当前主要瓶颈。
a
arXiv
·
5 天前
根因分析
微服务
多智能体系统
OpenRCA
a
SPINE框架:用智能体AI弥合机器人物理部署鸿沟
研究人员提出SPINE智能体框架,通过结构化工作流帮助非专家用户快速调试和部署双臂机器人,将操作成功率从75%提升至100%,显著降低对专业校准的依赖。
a
arXiv
·
5 天前
具身智能
机器人部署
多智能体系统
人机交互
a
大模型协调内容挤占任务预算?新测试方法RCWT揭示上下文分配难题
研究者提出RCWT测试协议,量化大模型多智能体系统中协调内容对任务执行预算的挤占效应。实验发现当参考证据降至数百token时,模型性能会急剧下降。
a
arXiv
·
6 天前
大语言模型
多智能体系统
上下文管理
提示工程
a
多智能体框架实现文本人格精准评估,突破传统单模型局限
研究人员提出一种基于微调的多智能体框架,通过心理测量监督和视角差异化设计,显著提升从生活叙事文本中检测OCEAN人格特质的准确性与一致性。
a
arXiv
·
6 天前
人格计算
多智能体系统
大型语言模型
心理测量学
a
CityBehavEx:可扩展且经验验证的大语言模型辅助城市模拟平台
研究人员推出CityBehavEx平台,结合传统人类移动模型与微调交叉编码器,实现大规模城市行为模拟,在单张消费级GPU上1小时内完成10万智能体75天行为仿真。
a
arXiv
·
6 天前
大语言模型
城市模拟
多智能体系统
计算社会科学
a
图反馈控制如何影响开源大语言模型群体的共识形成与派系分化
研究揭示开源大语言模型群体在交互过程中,图结构反馈机制对共识形成的关键作用:相似度阈值路由会加剧群体碎片化,而桥接式路由能在保留记忆时促进共识达成。
a
arXiv
·
6 天前
多智能体系统
语言模型
群体智能
共识形成
a
廉价AI群体如何高效纠错?预算约束下的“预言家”部署策略
研究团队提出在由廉价不可靠智能体组成的群体中,如何以最低成本部署少量“预言家”式强纠错器来引导正确共识,并推导出预算-正确性边界曲线。
a
arXiv
·
7 天前
多智能体系统
群体智能
预算优化
共识算法
a
小型语言模型也能闭环控制?多智能体自校正架构实现工业自主操作
研究人员提出结合规则对齐小型语言模型与多智能体自校正的闭环控制框架,在热控制仿真中实现91.5%的动作对齐准确率,为边缘设备自主控制提供新方案。
a
arXiv
·
7 天前
小型语言模型
闭环控制
工业自动化
多智能体系统
a
多智能体协同创作:AutoWorldBuilder 用分层压缩与迭代审核攻克虚构世界构建难题
研究人员提出 AutoWorldBuilder 系统,通过多智能体协作、分层上下文压缩和迭代审核机制,解决了大模型在虚构世界构建中面临的信息爆炸、创意与一致性矛盾等挑战,在实验中实现了95%的成功率。
a
arXiv
·
8 天前
大语言模型
多智能体系统
内容生成
AutoWorldBuilder
a
KV-PRM:通过KV缓存迁移实现高效过程奖励建模,加速多智能体测试时扩展
研究人员提出KV-PRM方法,通过直接读取LLM生成阶段产生的KV缓存,将过程奖励模型的评分计算复杂度从O(L²)降至O(L),在多智能体长序列任务中实现高达5000倍的计算效率提升。
a
arXiv
·
8 天前
过程奖励模型
KV缓存
多智能体系统
计算优化
a
法律推理新突破:多智能体辩论框架L-MAD系统评估
研究团队提出L-MAD框架,系统评估多智能体辩论在法律推理中的表现,发现合理配置智能体数量可提升准确性,但过度讨论会导致错误强化。
a
arXiv
·
8 天前
多智能体系统
法律AI
辩论框架
arXiv
a
多智能体协作框架ARCANA:用反思机制攻克抽象推理难题
研究人员提出ARCANA多智能体框架,通过感知、假设、执行与反思的迭代协作,在严格约束下解决ARC-AGI-2抽象推理任务。该框架结合结构化程序搜索与自适应修正机制,显著提升推理效率。
a
arXiv
·
8 天前
多智能体系统
程序合成
抽象推理
ARC-AGI
a
信息不对称设计:多智能体协同预测的新范式
研究团队提出通过设计信息不对称提升多智能体预测系统性能,在真实预测市场数据集上准确率提升4-8个百分点。
a
arXiv
·
18 天前
多智能体系统
预测模型
信息不对称
大语言模型
a
多智能体协同作战:Agent4cs框架让大型代码库理解更精准
研究者提出Agent4cs多智能体框架,通过分工协作的智能体团队,显著提升大型复杂代码库的自动摘要质量,在语义一致性和关键词覆盖上取得突破性进展。
a
arXiv
·
18 天前
代码摘要
多智能体系统
大型代码库
AI编程助手
a
Agri-SAGE:融合模拟与多智能体推理的农业AI顾问系统
Agri-SAGE 通过结合多智能体大语言模型推理与生物物理模拟,为农业提供动态、可验证的种植建议,显著优于传统静态农学指南。
a
arXiv
·
19 天前
农业AI
多智能体系统
大语言模型
模拟验证
a
幻灯片个性化新突破:SPIRE框架通过结构降噪学习设计意图
研究者提出将页面级幻灯片个性化建模为逆向规划问题,并开发SPIRE框架,通过结构降噪和多智能体强化学习实现无需预设模板的个性化设计。
a
arXiv
·
19 天前
AI设计
幻灯片生成
强化学习
个性化算法
a
运行时自主管理新框架:为单/多智能体系统引入齿轮化安全控制机制
研究人员提出一种名为“齿轮化执行”的运行时自主管理系统,通过五档执行模式与事件驱动回退机制,为缺乏持续人工监督的自主智能体提供安全保证。该系统在UR5机器人装配单元实验中实现99.6%异常检测率,并提供形式化物理空间安全证书。
a
arXiv
·
19 天前
自主系统
运行时安全
多智能体系统
机器人控制
a
新框架让AI心理支持更靠谱:TheraJudge评估器+TheraAgent多角色系统
研究人员提出两阶段框架,先训练能评估心理支持质量的AI法官,再构建多角色系统将评估信号转化为针对性改进,显著提升AI心理支持的安全性与共情能力。
a
arXiv
·
20 天前
心理健康AI
大语言模型对齐
多智能体系统
评估框架
a
DDIAgents:药物相互作用预测新框架,动态编排知识提升准确性
研究人员提出DDIAgents多智能体框架,通过机制条件化知识编排实现药物相互作用预测,在多个基准测试中超越现有方法。
a
arXiv
·
20 天前
药物相互作用
多智能体系统
AI4Science
生物医学AI
a
AgRefactor:自进化多智能体工作流,高效转换软件为硬件代码
研究人员提出AgRefactor多智能体工作流,通过自进化记忆系统与自动化工具结合,显著提升软件向高层次综合(HLS)代码的转换效率与性能。
a
arXiv
·
20 天前
高层次综合
代码重构
多智能体系统
硬件加速
a
多智能体法律推理:AI模拟法庭辩论,提升司法可及性
研究团队探索基于大语言模型的多智能体法律推理框架,模拟法庭辩论与法律论证,在复杂法律任务中展现出独特优势。
a
arXiv
·
20 天前
多智能体系统
法律AI
大语言模型
司法技术
a
HyphaeDB:为多智能体系统设计的活性知识拓扑记忆库
研究人员提出HyphaeDB,一种将HNSW图拓扑重新定义为多智能体通信架构的新型记忆基础设施,通过基于能量的传播机制实现知识在智能体间的主动流动。
a
arXiv
·
21 天前
多智能体系统
向量数据库
知识传播
HNSW
a
图世界模型中的长程推演误差如何产生与抑制?
研究团队提出图世界模型(GWM)的统一分析框架,揭示图结构演化与局部预测误差传播的关联机制,并设计误差感知训练策略以提升长程规划稳定性。
a
arXiv
·
22 天前
图神经网络
世界模型
强化学习
多智能体系统
a
开发者基于GLM-5.1打造全流程AI开发平台Builddy
开发者Neelkamalshah利用GLM-5.1构建了Builddy平台,能够通过单一文本提示直接生成并部署完整Web应用。该系统通过协调6个智能代理,覆盖从系统设计到最终部署的全流程开发任务。
智
智谱 GLM
·
24 天前
快讯
GLM-5.1
AI编程
多智能体系统
自动化开发
智
AI整合医疗数据:知识图谱与多智能体框架提升精神药物安全信息可追溯性
研究人员开发了一套基于知识图谱的多智能体框架,整合了FDA不良事件报告、患者论坛和医疗评论平台的抗抑郁药安全信息,实现了权威数据与患者经验的来源可追溯整合。
a
arXiv
·
25 天前
医疗AI
知识图谱
多智能体系统
药物安全
a
多智能体系统可信度突破:Argent信号协议有效遏制语义漂移
研究人员提出Argent信号协议,通过结构化质量信号帮助多智能体系统区分可修复错误与需遏制错误,在文档问答任务中显著提升准确率并完全阻断无依据信息传播。
a
arXiv
·
31 天前
多智能体系统
语义漂移
质量评估
可信AI
a
多智能体大语言模型如何达成共识?研究揭示隐藏的“信念锚点”
最新研究通过建立闭环动态系统模型,揭示了多智能体大语言模型在讨论过程中存在的“隐藏锚点”机制,解释了为何智能体能够突破初始观点形成的共识边界。
a
arXiv
·
31 天前
多智能体系统
大语言模型
共识机制
动态系统建模
a