AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
认知科学
12 篇相关内容
相关话题
大语言模型
语言模型
arXiv
Transformer
模型审计
量子模型
脑电信号
神经语言学
模型评估
可解释AI
意识模拟
对齐研究
大语言模型中的问题顺序效应:QQ等式审计揭示机制特性与饱和陷阱
研究者将人类调查中的QQ等式转化为大语言模型顺序判断的审计标准,发现当前基于下一个词概率的审计方法在模型响应趋于确定性时存在局限性。
a
arXiv
·
5 小时前
大语言模型
模型审计
认知科学
量子模型
a
脑电信号揭示语言模型与人类阅读认知的差异
研究通过脑电信号分析发现,语言模型的高预测准确率并不完全对应人类阅读时的认知处理模式,仅特定信息指标与大脑语言处理相关。
a
arXiv
·
5 小时前
语言模型
脑电信号
认知科学
神经语言学
a
语言模型中的“可表达层”:揭示AI的隐性思考空间
研究人员发现大型语言模型内部存在类似人类意识的“全局工作空间”,通过新型解释技术可解码模型未说出口的思考过程,为AI对齐研究提供新视角。
a
arXiv
·
1 天前
语言模型
可解释AI
意识模拟
对齐研究
a
语义导航大比拼:人类与三大主流大模型谁更灵活?
最新研究通过语言流畅性任务对比人类与GPT-4o等大模型的语义搜索模式,发现人类在概念空间中的探索更具多样性和广度,现有模型架构难以完全复现人类语义检索的动态平衡。
a
arXiv
·
6 天前
大语言模型
语义导航
认知科学
GPT-4o
a
视觉经验如何塑造语义记忆?盲人与视力正常者的认知差异研究
最新研究发现,先天失明者与视力正常者在语义记忆导航模式上存在显著差异,视觉经验对概念的组织方式具有决定性影响。
a
arXiv
·
6 天前
认知科学
语义记忆
具身认知
盲人研究
a
AI代理前瞻记忆大挑战:PM-Bench基准揭示LLM执行延迟意图的困境
研究者推出PM-Bench基准测试,专门评估大语言模型代理的前瞻记忆能力。测试显示当前最先进的GPT-5.4代理仅获得65.1%的F1分数,凸显AI代理在延迟意图执行方面的重大挑战。
a
arXiv
·
6 天前
大语言模型
AI代理
基准测试
认知科学
a
语言模型如何统一处理多种心理空间?研究发现共享路由机制
最新研究发现,Transformer语言模型采用统一机制处理现实、假设、信念等不同心理空间,通过可复用的值槽和可操纵的路由器实现跨空间信息管理。
a
arXiv
·
7 天前
语言模型
心理空间
Transformer
语义理解
a
大语言模型身份之谜:不同训练模式下的人格向量会“分裂”吗?
最新研究通过实验发现,大语言模型在不同操作模式下提取的人格向量存在显著差异,挑战了现有理论中关于模型身份识别的核心假设。
a
arXiv
·
19 天前
大语言模型
认知科学
人格向量
模型身份
a
Transformer语言模型如何学习统计规律?研究发现:从抽象到具体
一项新研究采用发展心理学视角,追踪Transformer语言模型在训练过程中的内部表征变化,发现模型先学习最抽象的全局统计模式,再逐步掌握局部依赖关系。
a
arXiv
·
22 天前
Transformer
语言模型
统计学习
认知科学
a
人类放弃思考时,推理模型仍在坚持:揭示AI与人类决策的根本差异
最新研究发现,大型推理模型与人类在面对难题时表现出相反的决策模式:模型在答错时会消耗更多计算资源,而人类则倾向于在答错时提前放弃。
a
arXiv
·
25 天前
推理模型
决策机制
人机对比
认知科学
a
Nature研究警示:过度依赖AI对话或影响人类认知能力
《自然》期刊最新研究表明,长期与AI模型(如Claude)进行拟人化深度对话,可能对用户的现实社交认知产生潜在影响。
N
Nature
·
26 天前
AI伦理
人机交互
心理健康
Claude
N
AI 对决:爱因斯坦与费曼,谁的物理直觉更胜一筹?
研究人员利用 AI 模型对比爱因斯坦与费曼的物理直觉能力,探索 AI 在模拟科学思维方面的潜力。
T
Two Minute Papers
·
31 天前
AI 模拟
物理直觉
科学思维
比较研究
T