AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
GPT-4o
2 篇相关内容
相关话题
大语言模型
推理评估
思维链
AI安全
语义导航
认知科学
AI研究
新方法检测大模型推理漏洞:GPT-4o的思维链竟有66%问题存在“答对但推理错”
研究人员提出“干预式基础审计”方法,通过谓词替换检测大模型思维链推理对前提的真实依赖程度,发现GPT-4o在解决推理问题时,66%的正确回答中存在与证明树依赖不一致的推理步骤。
a
arXiv
·
5 天前
大语言模型
推理评估
思维链
GPT-4o
a
语义导航大比拼:人类与三大主流大模型谁更灵活?
最新研究通过语言流畅性任务对比人类与GPT-4o等大模型的语义搜索模式,发现人类在概念空间中的探索更具多样性和广度,现有模型架构难以完全复现人类语义检索的动态平衡。
a
arXiv
·
6 天前
大语言模型
语义导航
认知科学
GPT-4o
a