AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
arXiv研究
32 篇相关内容
相关话题
大语言模型
强化学习
推理优化
AI对齐
语言模型
对抗攻击
多智能体系统
AI评估
模型泛化
KV缓存压缩
注意力机制
LLM智能体
SelKV:选择性KV缓存合并新框架,兼顾效率与精度
研究人员提出一种无需训练的双组件KV缓存压缩框架,通过软余弦门控选择性合并相似token,并引入注意力比例补偿机制,在保留25%缓存的情况下实现近无损生成质量。
a
arXiv
·
5 小时前
大语言模型
KV缓存压缩
注意力机制
推理优化
a
MOSAIC:为LLM智能体打造的高效结构化记忆系统
研究人员提出MOSAIC框架,通过图结构存储、哈希加速检索和冲突检测三大创新,显著提升LLM智能体长期记忆的准确性与效率。
a
arXiv
·
5 小时前
LLM智能体
记忆系统
图神经网络
检索增强
a
研究揭示:多数大语言模型具有稳定风险态度
最新研究发现,多数大语言模型在不确定性决策中表现出稳定的风险态度,其风险决策模式在不同任务间保持相对一致性,且分布范围比人类更集中。
a
arXiv
·
5 小时前
大语言模型
风险态度
决策评估
AI对齐
a
前沿大模型竟不会“抄作业”?研究者提出2D文本表示新思路
研究发现即使是最先进的大语言模型也难以精确复制输入文本,原因在于Transformer的位置编码机制存在缺陷。研究者提出2D-RoPE方法,将文本视为二维网格,显著提升了模型的复制能力。
a
arXiv
·
1 天前
大语言模型
Transformer
位置编码
模型能力评估
a
多头部潜在控制:为LLM智能体决策提供统一接口
研究人员提出多头部潜在控制方法,通过读取冻结大模型的隐藏状态轨迹来生成部署时的控制信号,显著提升多模型系统的质量-成本平衡,在路由执行中可将大模型使用率降低最高90.7%。
a
arXiv
·
4 天前
大语言模型
智能体决策
模型路由
潜在控制
a
研究发现:一句简单前缀即可绕过AI安全防护机制
最新研究揭示,对齐语言模型的安全拒绝机制存在脆弱性,仅需在提示前添加简单前缀即可使其绕过安全限制生成有害内容。研究通过多模型实验定位了拒绝机制失效的具体位置和原理。
a
arXiv
·
4 天前
语言模型
AI安全
对抗攻击
机制可解释性
a
多智能体大模型协作中的语义信息压缩现象
研究发现多智能体大模型系统在处理复杂任务时,中间环节会显著压缩语义信息,影响下游决策准确性。
a
arXiv
·
4 天前
大语言模型
多智能体系统
语义压缩
AI协作
a
大模型研究创意生成新策略:预算化子集精炼提升执行可行性
研究提出预算化子集精炼方法,通过选择性优化部分候选创意而非均匀分配计算资源,显著提升大模型生成研究创意的多样性和执行可行性,在10种研究创意生成环境中验证了其有效性。
a
arXiv
·
4 天前
大语言模型
研究创意生成
计算资源分配
多样性优化
a
LLM如何理解群体偏好?新研究让大模型动态选择推荐策略
研究者利用大语言模型模拟人类对公平性、满意度和共识的主观判断,开发出能根据群体内部偏好分布动态调整推荐策略的系统,在用户研究中获得更高满意度评分。
a
arXiv
·
7 天前
大语言模型
推荐系统
群体决策
人机对齐
a
大语言模型进军金融预测:并购套利新突破
研究人员开发出基于语言模型的并购套利预测系统,通过专家引导的上下文工程与历史交易回溯监督微调,在长文档金融场景中超越传统方法。
a
arXiv
·
7 天前
大语言模型
金融预测
并购套利
长上下文推理
a
AI创新瓶颈:突破固定表征框架的“词汇”与“验证”鸿沟
最新研究指出,当前AI系统在开放式创新中存在两大关键限制:难以创造新的表征基元(词汇鸿沟),以及难以评估新表征的长期价值(验证鸿沟)。
a
arXiv
·
8 天前
AI理论
表征学习
开放式创新
认知架构
a
AI系统本质是语义抽象:新框架解析模型输出与事实的差距
研究者提出语义框架,区分AI系统输出的知识来源,为模型幻觉、引用不当等常见问题提供精确定义与检查方法。
a
arXiv
·
8 天前
AI可解释性
语义框架
模型幻觉
知识验证
a
合成数据如何更有效?揭秘固定源合成与源扩展的差异
研究区分了合成数据扩展的两种路径:固定源合成与源扩展,发现大预算下增加种子问题优于重复生成回答,为合成协议比较提供了可控框架。
a
arXiv
·
18 天前
合成数据
数据扩展
机器学习
模型训练
a
SemHash-LLM:多粒度语义哈希框架,高效实现文档去重
研究人员提出SemHash-LLM框架,通过多粒度语义哈希与LLM裁决机制,在保持语义等价性的同时,大幅降低大规模文档去重的计算成本。
a
arXiv
·
18 天前
文档去重
语义哈希
大语言模型
多粒度学习
a
渐进式代码切换:低成本实现多语言推理能力迁移
研究者提出PCS框架,仅需轻量翻译即可将大模型的英语推理能力迁移至其他语言,无需依赖昂贵的外部模型蒸馏或监督。
a
arXiv
·
19 天前
多语言推理
能力迁移
代码切换
大语言模型
a
大语言模型身份之谜:不同训练模式下的人格向量会“分裂”吗?
最新研究通过实验发现,大语言模型在不同操作模式下提取的人格向量存在显著差异,挑战了现有理论中关于模型身份识别的核心假设。
a
arXiv
·
19 天前
大语言模型
认知科学
人格向量
模型身份
a
AI能力评估现分歧:指标选择将决定技术普惠方向
最新研究揭示,AI模型能力的评估方式将直接影响技术资源分配格局——采用有界或无界性能指标,会得出截然相反的结论,进而决定尖端能力是集中于少数巨头还是普惠于广大开发者。
a
arXiv
·
19 天前
AI评估
计算规模
技术普惠
性能指标
a
AI智能体也能被“教练”指导?新框架让游戏角色实时响应风格指令
研究人员提出一种可教练智能体框架,结合强化学习与风格控制技术,让AI在完成核心任务的同时,能实时响应用户对执行风格的调整指令。该技术已在《地平线:西之绝境》《GT赛车》及人形机器人测试中验证效果。
a
arXiv
·
19 天前
强化学习
交互式AI
游戏AI
智能体控制
a
HARC新方法:耦合有害性与拒绝方向,提升大模型安全对齐鲁棒性
研究者提出HARC微调方法,通过耦合提示端与响应端的有害性与拒绝方向,在保持模型通用能力的同时显著提升对抗攻击的防御能力。该方法在五大模型家族上验证有效,无需架构特定调整。
a
arXiv
·
19 天前
大语言模型
安全对齐
对抗攻击
微调方法
a
RareDxR1:无需人工标注,AI自主推理实现罕见病诊断突破
研究人员提出RareDxR1模型,通过端到端推理框架直接分析临床记录进行罕见病诊断,无需依赖结构化表型或人工标注,在多个基准测试中达到最先进准确率。
a
arXiv
·
19 天前
医疗AI
罕见病诊断
大语言模型
自主推理
a
LabGuard:让实验室自然语言规则成为AI实验助手的“安全卫士”
研究人员提出LabGuard系统,可将实验室自然语言规则转化为可执行的运行时监控程序,显著降低AI实验助手在动态实验环境中的安全风险。
a
arXiv
·
20 天前
实验室AI
安全监控
自然语言处理
机器人控制
a
AgentBound:为自主AI代理提供可验证的行为治理框架
研究人员提出AgentBound框架,通过三重权威评估机制和加密可验证的治理凭证,为自主AI代理提供运行时行为监督,将治理从依赖信任转变为可独立验证的过程。
a
arXiv
·
20 天前
AI代理
行为治理
可验证性
安全框架
a
RoPoLL:用鲁棒统计提升大模型评委团的抗干扰能力
研究团队提出RoPoLL方法,通过引入几何中位数等鲁棒统计量改进大模型评委团的共识机制,显著提升评估系统在数据污染攻击下的稳定性。
a
arXiv
·
20 天前
大模型评估
鲁棒统计
评委团机制
几何中位数
a
手语模型能听懂“语音”吗?研究发现AI具备初步音系感知能力
最新研究揭示,手语识别模型展现出对抽象音系特征的敏感性,其中姿态模型擅长区分手形,像素模型更易捕捉位置变化,但现有训练范式仍受限于架构本身的归纳偏好。
a
arXiv
·
21 天前
手语识别
音系感知
多模态AI
模型可解释性
a
多模态大模型评测存在哪些盲区?研究者系统梳理关键缺失维度
最新研究指出,当前多模态大语言模型的评测体系存在明显滞后,多数基准测试局限于孤立任务,难以评估模型跨模态信息整合能力。
a
arXiv
·
25 天前
多模态大模型
模型评测
人工智能评估
arXiv研究
a
AI辅助折纸艺术:COrigami实现几何约束与视觉美学的协同设计
研究人员提出COrigami人工智能流程,通过自然语言生成折痕图案,在满足严格几何折叠条件的同时实现视觉美感,为折纸艺术提供AI协同创作工具。
a
arXiv
·
25 天前
生成式AI
计算折纸
协同设计
几何约束
a
新框架LBR:通过局部分支路由实现高效可训练的语言模型测试时扩展
研究者提出局部分支路由(LBR)框架,通过轻量级路由机制在推理时扩展局部前瞻树,在数学推理任务中超越了传统思维链方法。
a
arXiv
·
26 天前
语言模型
推理优化
测试时扩展
强化学习
a
强化学习能否训练出广泛且持久有益的人工智能模型?
研究表明,在现实领域中对有益行为进行强化学习,能显著提升AI模型在训练分布之外的泛化对齐能力,并增强其抵抗恶意引导的持久性。
a
arXiv
·
27 天前
强化学习
AI对齐
模型泛化
有益AI
a
RIFT-Bench:面向智能体AI系统的动态红队测试新框架
研究者提出RIFT-Bench,一种基于图表示的动态红队测试方法,可对异构智能体AI系统进行统一安全评估,支持攻击探测与防御策略测试。
a
arXiv
·
27 天前
智能体安全
红队测试
AI评估
大语言模型
a
算法如何让世界杯门将一夜成名:从5万到820万粉丝的多语言叙事分析
一项研究通过多语言语料分析,揭示了世界杯门将沃齐尼亚在赛后粉丝激增背后的算法叙事机制,展示了不同语言如何塑造独特的传播框架。
a
arXiv
·
31 天前
计算话语分析
多语言NLP
社交媒体算法
世界杯
a
多智能体系统可信度突破:Argent信号协议有效遏制语义漂移
研究人员提出Argent信号协议,通过结构化质量信号帮助多智能体系统区分可修复错误与需遏制错误,在文档问答任务中显著提升准确率并完全阻断无依据信息传播。
a
arXiv
·
31 天前
多智能体系统
语义漂移
质量评估
可信AI
a
大语言模型在硬件设计中的局限:RTL编码的失败与泛化瓶颈
研究发现,大语言模型在硬件设计领域面临严峻挑战,尤其在将顺序编程思维转化为并行硬件逻辑时,存在不可逾越的泛化天花板,模型表现受限于预训练知识而非对齐技术。
a
arXiv
·
31 天前
大语言模型
硬件设计
RTL编码
模型泛化
a