AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
模型行为分析
2 篇相关内容
相关话题
大语言模型
推理机制
Qwen
可解释AI
注意力机制
arXiv
自然语言处理
大模型提前“锁定”答案?Qwen3-8B 在推理前已倾向错误选择
研究发现,即使任务前提被违反,开源大模型 Qwen3-8B 在生成答案前就可能提前“锁定”错误选项,后续推理仅为合理化该选择。
a
arXiv
·
9 小时前
大语言模型
模型行为分析
推理机制
Qwen
a
大语言模型新发现:句子级上下文同化现象
研究发现大语言模型存在句子级上下文同化现象,即提示中的句子会显著提升自身在推理时的生成概率,且该现象可通过调控少数注意力头进行抑制。
a
arXiv
·
27 天前
大语言模型
注意力机制
arXiv
模型行为分析
a