手语数据集规模化:全面盘点资源、基准与标注标准

arXiv·31 天前

手语作为聋人及听障群体使用的视觉语言,其技术发展长期受限于数据碎片化、标注不一致及语言覆盖不足等问题。近日,一项发表于arXiv的研究对全球手语数据集进行了系统性盘点,覆盖35种手语的120个资源,并深入剖析了当前数据集的三大核心挑战:模态失衡(如视频与文本数据比例失调)、标注粒度差异(从词汇级到句子级标注混杂),以及手语者多样性偏差。研究团队同时提出24字段的“手语数据表”规范,并开源GitHub仓库(https://github.com/Ginqwerty/Open-Sign-Language),旨在推动数据文档标准化与可复现评估。该工作为开发适用于真实场景的规模化手语识别、翻译与生成技术提供了实践框架,强调未来数据集设计需兼顾语言学完整性与社区实际沟通需求。

手语技术数据集人工智能伦理多模态学习可访问性

原文来源:https://arxiv.org/abs/2606.19352

相关阅读

AI_LectureNote:英语医学术语还原与语义保真度研究
大模型生成文本的“文学无风格”现象
大语言模型中的问题顺序效应:QQ等式审计揭示机制特性与饱和陷阱
首个吉尔吉斯语大模型基准发布:揭示低资源语言评估挑战
Scope3Trace:基于证据的Scope 3温室气体排放识别与提取框架

← 返回