维基百科小编辑如何影响大模型价值观?动物权益倡导者案例揭秘
维基百科作为大语言模型训练数据的重要来源,其内容权重通常高于普通网络爬取文本。一项最新研究揭示,一个名为‘亲动物维基编辑组’的志愿者团体,通过在115个相关页面进行125次编辑,系统性地增加了动物福利相关内容。研究团队采用梯度数据归因和检索归因技术,追踪这些编辑对Llama等开源模型行为的影响。结果显示:在动物福利相关查询中,被编辑章节占据最高归因文档的68%,而在相同企业的无关查询中仅占52%。这意味着模型能够将编辑内容与特定议题而非泛实体进行关联。进一步的对抗性影响评估发现,在所有训练顺序随机种子中,动物福利查询的前10个最具影响力文档均为该团体编辑内容。当分别用编辑内容和对照内容微调模型后,各模型仅在对应文本类型上表现更优——动物福利文本的困惑度从12.4降至8.4。这表明即使小规模的协同编辑活动,也能可测量地塑造语言模型对特定议题的处理方式。