AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
人机交互
40 篇相关内容
相关话题
大语言模型
arXiv
强化学习
语言模型
智能体
对话系统
WAIC
多智能体系统
AI伦理
具身智能
大模型
游戏设计
AI助手新挑战:如何与用户“对齐”模糊任务意图?
研究发现当前语言模型在用户任务不明确时表现不佳,仅能识别22-32%的真实意图,远低于人类的48%。论文提出将任务对齐问题建模为POMDP框架,揭示AI在交互式任务理解上的关键短板。
a
arXiv
·
5 小时前
任务对齐
人机交互
语言模型
POMDP
a
开源通信平台Hail.so v0.15发布:为AI智能体与人类提供一体化电话、短信和邮件服务
开源通信平台Hail.so发布0.15版本,为AI智能体和人类用户提供统一的电话、短信和电子邮件通信解决方案。
H
Hail.so
·
23 小时前
开源平台
AI通信
智能体
人机交互
H
多轮对话研究新视角:将“对话对象识别”从离散标签转向连续层级
一项研究挑战了传统多轮对话中“对话对象识别”的离散分类范式,提出将其视为连续现象,并通过实验证明连续层级模型能更准确地预测发言权转移及听众行为。
a
arXiv
·
1 天前
对话系统
多轮对话
自然语言处理
人机交互
a
AnovaX:本地化多智能体语音助手,实现LLM规划与自适应恢复
研究人员提出AnovaX,一款完全在用户计算机上运行的本地优先语音助手,通过LLM规划、类型化执行器和自适应恢复机制,将桌面作为操作界面,支持多任务并发与远程手机控制。
a
arXiv
·
1 天前
语音助手
本地AI
多智能体系统
LLM规划
a
WAIC现场直击:主观世界模型引热议,AI如何理解人类内心?
在2024世界人工智能大会上,主观世界模型成为焦点,展示了AI对个体认知与内心状态的理解能力,引发行业广泛讨论。
量
量子位
·
1 天前
主观世界模型
WAIC
人机交互
认知AI
量
WAIC 2026前瞻:AI Agent将具备性格特质,智能伙伴更拟人化
北电数智在WAIC 2026前瞻讨论中提出,未来AI Agent将拥有个性化性格,并展示其在民生领域的实际应用案例。
北
北电数智
·
3 天前
AI Agent
人机交互
WAIC
北电数智
北
AI助手面临“割裂问题”:大模型无法感知用户全貌
研究发现当前AI助手存在阿谀奉承、过度自信等行为,根源在于语言模型缺乏对用户完整认知的显式表征,研究者提出通过“割裂框架”在模型中植入结构化未知信息来改善这一问题。
a
arXiv
·
4 天前
语言模型
AI安全
人机交互
认知建模
a
对话式视觉地点识别:让AI像人类一样通过对话定位场景
研究者提出对话式视觉地点识别新范式,将静态检索转变为交互式对话推理过程,并发布首个大规模对话基准数据集DlgQuest-Cities。
a
arXiv
·
4 天前
视觉地点识别
对话式AI
跨模态检索
人机交互
a
UESF-Bench:首个统一化具身智能寻人跟随基准发布
研究者提出首个统一化具身智能寻人跟随基准UESF-Bench,解决现有基准将搜索与跟随任务割裂的问题,并推出SeekFollow-VLA框架实现任务自适应切换。
a
arXiv
·
5 天前
具身智能
人机交互
基准测试
多模态学习
a
AI建议抑制人类说“我不知道”的意愿,即使建议错误且鼓励准确
研究表明,AI助手的建议会显著降低人们在面对困难问题时选择“我不知道”的意愿,即使AI建议是错误的,且参与者被鼓励追求准确性。
a
arXiv
·
5 天前
人工智能
人机交互
行为科学
决策
a
DROPJ:通过人类偏好与解释训练安全智能体行为
研究者提出DROPJ方法,通过人类在模拟环境中的偏好选择和理由说明,训练出更安全可靠的智能体策略,无需预设奖励函数即可在未知动态环境中实现安全部署。
a
arXiv
·
5 天前
安全AI
强化学习
人机交互
世界模型
a
SPINE框架:用智能体AI弥合机器人物理部署鸿沟
研究人员提出SPINE智能体框架,通过结构化工作流帮助非专家用户快速调试和部署双臂机器人,将操作成功率从75%提升至100%,显著降低对专业校准的依赖。
a
arXiv
·
5 天前
具身智能
机器人部署
多智能体系统
人机交互
a
Real World VoiceEQ:衡量语音AI人性化表现的新指标
研究者提出Real World VoiceEQ评估框架,用于量化语音AI在真实场景中的人性化表现,为优化人机交互体验提供新工具。
H
Hugging Face
·
5 天前
语音AI
评估框架
人机交互
arXiv
H
STEPX Neo手机获2026 WAIC“镇馆之宝”称号,大模型原生智能体开启AI交互新范式
STEPX Neo手机在2026世界人工智能大会上被评为“镇馆之宝”,其大模型原生智能体设计重新定义了人机交互方式。
量
量子位
·
6 天前
大模型
智能体
人机交互
WAIC
量
阿里Qwen-Audio-3.0-Realtime发布:实时语音大模型迎四项核心升级
阿里推出新一代实时语音大模型Qwen-Audio-3.0-Realtime,在响应速度与功能覆盖上实现显著提升。该模型支持语音对话、多任务处理等四项核心功能升级,旨在优化人机交互体验。
阿
阿里
·
6 天前
语音大模型
阿里巴巴
实时交互
AI产品
阿
实时句子级手语翻译系统新突破:Raspberry Pi实现低延迟交互
研究人员提出首个面向实时部署的句子级手语翻译系统,通过优化计算架构将响应延迟降低27%,在Raspberry Pi上实现摄像头捕捉、本地显示与语音输出的完整交互链。
a
arXiv
·
8 天前
手语翻译
实时系统
边缘计算
多模态AI
a
OpenProver发布:基于LLM的交互式定理证明系统,集成Lean 4验证
研究人员推出开源系统OpenProver,采用LLM驱动与Lean 4形式化验证结合的自动定理证明架构,支持人机交互式证明搜索。
a
arXiv
·
8 天前
定理证明
大语言模型
开源工具
形式化验证
a
CogniConsole:将推理控制外部化为结构化接口,提升大模型交互可靠性
研究提出CogniConsole框架,将大语言模型推理过程的控制层外部化为结构化接口,通过程序化协调与受限提示推理相结合,显著降低输出方差与失败率。
a
arXiv
·
8 天前
大语言模型
推理控制
系统可靠性
人机交互
a
对话策略选择框架DiPS:让AI在紧急劝说场景中更懂人心
研究者提出DiPS框架,通过强化学习动态选择劝说策略,在火灾疏散等高风险场景中显著提升AI的劝说成功率。
a
arXiv
·
18 天前
对话系统
强化学习
紧急救援
个性化劝说
a
对话轮转自然度自动评估新框架:TurnNat 亮相
研究者提出 TurnNat,一种基于似然度的自动评估框架,用于衡量双通道口语对话中的轮转自然度,无需依赖人工标注即可识别多种时序异常。
a
arXiv
·
18 天前
对话系统
自动评估
语音处理
人机交互
a
AI眼镜迈向独立:告别手机依赖,专属操作系统问世
AI眼镜迎来重大突破,新操作系统使其摆脱对手机的依赖,实现独立运行。
量
量子位
·
19 天前
AI眼镜
操作系统
大模型
人机交互
量
任务状态表征:让移动端GUI智能体告别“健忘症”
研究人员提出了一种无需训练的任务状态表征框架,通过显式分离任务状态与屏幕观察,显著提升了移动端GUI智能体在长程任务中的执行成功率。
a
arXiv
·
19 天前
GUI智能体
任务规划
人机交互
移动自动化
a
语音游乐场:交互式语音分析与对比工具问世
研究人员推出Speech Playground交互式语音可视化工具,支持多种特征类型的探索与对比,为语音研究和发音训练提供新工具。
a
arXiv
·
19 天前
语音分析
可视化工具
人机交互
语音研究
a
AI原生游戏:定义、分类与未来设计路线图
本文首次提出AI原生游戏的明确定义,即运行时生成式AI构成核心玩法循环,并基于此筛选分析53款游戏,构建G/N双轴分类法,指出语义开放性与稳定游戏机制结合是核心设计挑战。
a
arXiv
·
19 天前
生成式AI
游戏设计
AI原生应用
人机交互
a
空中交通管制新算法:为管制员提供直观决策支持
研究团队提出一种面向航路空中交通管制的无冲突路径规划算法,通过解决方案空间框架提升算法可解释性和计算效率,更贴合管制员实际决策需求。
a
arXiv
·
19 天前
空中交通管制
路径规划算法
决策支持系统
人机交互
a
构建式对齐:AI如何影响人类偏好演变
研究提出'构建式对齐'新范式,将AI对齐视为对人类偏好动态轨迹的调控问题,而非静态偏好满足。
a
arXiv
·
19 天前
AI对齐
人机交互
偏好建模
控制理论
a
突破对话AI瓶颈:感知不对称理论为协作对话注入新思路
研究者将摩擦策略优化理论扩展至感知不对称场景,揭示了信息不对称对话中的理解机制,为AI对话系统的共同基础构建提供新视角。
a
arXiv
·
20 天前
对话AI
信息不对称
摩擦策略优化
人机交互
a
智能体应助用户构建偏好,而非仅被动询问
研究指出,传统智能体常预设用户是专家,已有明确偏好,但现实中用户常因缺乏领域知识而无法准确表达需求。研究提出新框架CoPref,强调智能体应通过对话帮助用户构建偏好,而非仅通过提问来获取偏好。
a
arXiv
·
20 天前
人机交互
智能体
推荐系统
用户偏好
a
AI如何从反馈中真正进步?研究发现关键瓶颈
最新研究揭示,多轮语言模型的性能提升往往并非来自反馈本身,而是源于重采样或额外计算。真正的进步需要模型具备利用反馈的能力,而非仅仅获得反馈。
a
arXiv
·
20 天前
语言模型
反馈机制
模型评估
人机交互
a
当搜索智能体该提问时:DiscoBench评测澄清感知的深度搜索
研究团队推出DiscoBench基准,用于评估搜索智能体在深度搜索中识别模糊查询、主动提出澄清问题并通过交互修正推理路径的能力。
a
arXiv
·
22 天前
大语言模型
搜索智能体
评测基准
人机交互
a
情感识别新突破:快慢思维协同推理框架MER-R1,让AI更懂情绪
研究发现,显式推理未必提升多模态情感识别准确率,快思维直接作答常优于慢思维深思熟虑。MER-R1框架通过强化学习融合二者优势,实现精准率与召回率的协同优化。
a
arXiv
·
22 天前
多模态情感识别
推理优化
强化学习
大语言模型
a
小语言模型助力人机交互系统综述:速度提升千倍,准确率达九成
研究者探索用小语言模型辅助社会物理人机交互领域的文献筛选,模型虽未超越人工精度,但处理速度提升数个量级,并额外发现10%相关论文。
a
arXiv
·
25 天前
小语言模型
人机交互
文献综述
学术工具
a
用非暴力沟通约束降低大语言模型对话中的冲突升级
研究团队通过引入非暴力沟通原则作为提示词约束,成功引导大语言模型在情感冲突场景中采取更具缓和性的对话策略,显著降低了对话冲突升级风险。
a
arXiv
·
25 天前
大语言模型
对话安全
非暴力沟通
提示工程
a
Nature研究警示:过度依赖AI对话或影响人类认知能力
《自然》期刊最新研究表明,长期与AI模型(如Claude)进行拟人化深度对话,可能对用户的现实社交认知产生潜在影响。
N
Nature
·
26 天前
AI伦理
人机交互
心理健康
Claude
N
Vibe Coding XR:结合XR Blocks与Gemini加速AI+XR原型开发
Google DeepMind推出Vibe Coding XR项目,通过XR Blocks和Gemini技术,显著提升AI与扩展现实(XR)领域的原型开发效率。
G
Google DeepMind
·
26 天前
AI
XR
Google DeepMind
原型开发
G
Metis:融合文本与代码记忆,让智能体自主进化
研究者提出新型自进化智能体系统Metis,通过分层双表征记忆架构,将文本记忆的广泛适用性与代码记忆的执行效率相结合,显著提升任务准确率并降低执行成本。
a
arXiv
·
27 天前
自进化智能体
记忆架构
人机交互
经验复用
a
Vapi AI 推出自然语音合成与高性价比语音识别 API
Vapi AI 发布新一代语音合成与语音识别 API,号称提供最自然的 TTS 体验和最具成本效益的 STT 服务。
x
xAI
·
27 天前
快讯
语音合成
语音识别
Vapi AI
API
x
非传统背景如何催生前沿XR技术?Meta AI分享跨界创新故事
Meta AI官方分享了一位非传统技术背景的开发者如何通过跨界思维,推动扩展现实(XR)技术取得突破性进展。
M
Meta AI
·
27 天前
XR技术
Meta AI
跨界创新
人机交互
M
ABot-Earth0.5登顶Hugging Face三榜第一,获图形学权威陈宝权好评
ABot-Earth0.5模型在Hugging Face论文榜单实现三榜登顶,并获国际图形学权威学者陈宝权教授公开好评。该模型支持直接导入Unity、Unreal Engine等主流游戏引擎进行交互开发。
A
ABot
·
31 天前
ABot
AI模型
游戏引擎
人机交互
A
AI化身游戏大师?探索智能体在游戏中的新角色
研究探讨AI智能体能否像游戏主持人一样动态引导游戏进程,为玩家创造个性化体验。
T
Two Minute Papers
·
31 天前
AI智能体
游戏设计
自适应系统
人机交互
T