AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
GPT-2
2 篇相关内容
相关话题
语言模型
信息局部性
归纳偏好
自然语言处理
预训练
权重初始化
模型分析
语言模型能否从“不可能语言”中重建自然语言?信息局部性效应揭秘
研究通过微调在“不可能语言”上预训练的GPT-2模型,探究语言模型从信息局部性被破坏的输入中恢复自然英语的能力,揭示了模型对局部性结构的归纳偏好。
a
arXiv
·
7 天前
语言模型
GPT-2
信息局部性
归纳偏好
a
研究发现:GPT-2预训练权重谱可复用,但单纯模仿光谱特征不足以提升模型性能
研究人员分析多个GPT-2变体模型发现,预训练模型存在可复用的结构化权重谱特征,但将其作为初始化信号时,仅模仿组件级光谱特征并未带来显著性能提升。
a
arXiv
·
8 天前
语言模型
预训练
权重初始化
GPT-2
a